AI時短ラボ
検索

プロンプトの記事

「プロンプト」に関連するAIニュースと解説、20本。新しい順に並べています。

解除

プロンプト の記事:20件

Anthropic「Claude Platformで費用を下げつつ性能を上げる3つの直し方」──①プロンプトキャッシュの命中率(時刻を先頭に置かない、長い処理はTTL1時間)②古いモデル向けの「2回検証しろ」を消す(Opus 5移行で費用14.6%減・精度5.3%増)③effortの較正(低effortのFable 5.1は高effortのFable 5と同等で費用3分の1)の記事画像

Anthropic「Claude Platformで費用を下げつつ性能を上げる3つの直し方」 ①プロンプトキャッシュの命中率(時刻を先頭に置かない、長い処理はTTL1時間)②古いモデル向けの「2回検証しろ」を消す(Opus 5移行で費用14.6%減・精度5.3%増)③effortの較正(低effortのFable 5.1は高effortのFable 5と同等で費用3分の1)

検証(発表 9月8日)
Google「AI Agents Challenge」上位に共通した4つの設計──①自分のツール層をMCPサーバーとして他のエージェントにも開く②呼び出し連鎖でなくイベントバスで並列に反応③フォールバック先のFlashも同じ検証関数を通す④正規表現→10トークンの分類→本モデルの3層で4割超をモデル呼び出し前に処理。「名前つきプロンプトの連鎖」は多エージェントではないの記事画像

Google「AI Agents Challenge」上位に共通した4つの設計 ①自分のツール層をMCPサーバーとして他のエージェントにも開く②呼び出し連鎖でなくイベントバスで並列に反応③フォールバック先のFlashも同じ検証関数を通す④正規表現→10トークンの分類→本モデルの3層で4割超をモデル呼び出し前に処理。「名前つきプロンプトの連鎖」は多エージェントではない

検証(発表 9月2日)
Google「ハーネス・エンジニアリングの解剖」──Terminal-BenchやDeepSWEの総合点が数ポイント動いても「なぜ」は分からない。「曖昧な指示で聞き返すか」「ビルドファイルを変えたら検証を回すか」を単体テストのように断言する「行動評価」を、Antigravity SDK+pytestで5秒以内に回す。評価は「ドッグフーディングで自分のコードベースを扱えるようになった後」からの記事画像

Google「ハーネス・エンジニアリングの解剖」 Terminal-BenchやDeepSWEの総合点が数ポイント動いても「なぜ」は分からない。「曖昧な指示で聞き返すか」「ビルドファイルを変えたら検証を回すか」を単体テストのように断言する「行動評価」を、Antigravity SDK+pytestで5秒以内に回す。評価は「ドッグフーディングで自分のコードベースを扱えるようになった後」から

検証(発表 9月9日)
GPT-6 Astra公式ガイドの続き──OpenAI開発者ブログ「Rethinking skills and prompts」全文解説、skillとAGENTS.mdは足すより減らせの記事画像動画

GPT-6 Astra公式ガイドの続き OpenAI開発者ブログ「Rethinking skills and prompts」全文解説、skillとAGENTS.mdは足すより減らせ

活用
DSPy 3.3.0の実験機能「Flex」「ReActV2」──プロンプトでなくプログラムの構造そのものをGEPAに最適化させるの記事画像

DSPy 3.3.0の実験機能「Flex」「ReActV2」 プロンプトでなくプログラムの構造そのものをGEPAに最適化させる

研究
GEPAを飲み込んだ最適化基盤「synth-optimizers」──ホスト専用の探索アルゴリズム「GELO」を覗くの記事画像

GEPAを飲み込んだ最適化基盤「synth-optimizers」 ホスト専用の探索アルゴリズム「GELO」を覗く

研究
GPT-6 Astra公式ガイド「Using GPT-6 Astra」全体解説──癖5つと対処法11本、公式が「強く推奨」したのはプロンプトを足すことではないの記事画像動画

GPT-6 Astra公式ガイド「Using GPT-6 Astra」全体解説 癖5つと対処法11本、公式が「強く推奨」したのはプロンプトを足すことではない

活用
DSPyの裏側で動く最適化エンジン「GEPA」──強化学習より少ない試行でプロンプトを進化させる仕組みを読むの記事画像

DSPyの裏側で動く最適化エンジン「GEPA」 強化学習より少ない試行でプロンプトを進化させる仕組みを読む

研究
プロンプトを「使い捨てる」のをやめる──個人開発者Huzzahが提案する疑似コードエディタの記事画像

プロンプトを「使い捨てる」のをやめる 個人開発者Huzzahが提案する疑似コードエディタ

検証
日本発「PEP検定」とは──開始1年でシラバスに「AIエージェント」「コンテキストエンジニアリング」を追加した資格の中身の記事画像

日本発「PEP検定」とは 開始1年でシラバスに「AIエージェント」「コンテキストエンジニアリング」を追加した資格の中身

業界
「年収3000万円」のプロンプトエンジニアは今どこにいるのか──Anthropicの採用ページを2026年8月27日に確認したの記事画像

「年収3000万円」のプロンプトエンジニアは今どこにいるのか Anthropicの採用ページを2026年8月27日に確認した

業界
AI法務支援サービスは弁護士法違反か──法務省が新ガイドラインで線引きを補完の記事画像

AI法務支援サービスは弁護士法違反か 法務省が新ガイドラインで線引きを補完

業界
CodexにGPUカーネル最適化を『自動でリサーチさせながら』回したら232倍速くなった話の記事画像

CodexにGPUカーネル最適化を『自動でリサーチさせながら』回したら232倍速くなった話

活用
「エージェントハーネス」がプロダクトマネージャーの肩書きになった──Cohereの求人票を読むの記事画像

「エージェントハーネス」がプロダクトマネージャーの肩書きになった Cohereの求人票を読む

プロダクト
MiniMax H3が「非公開」にした変換層を、有志が3つ独立に作っていた──H3-Context-IRを覗くの記事画像

MiniMax H3が「非公開」にした変換層を、有志が3つ独立に作っていた H3-Context-IRを覗く

検証
OpenAIの「Programmatic Tool Calling」──モデルがコードを書いてツールを並列実行し、中間結果を圧縮するの記事画像

OpenAIの「Programmatic Tool Calling」 モデルがコードを書いてツールを並列実行し、中間結果を圧縮する

プロダクト
旧Workbenchのデータが消えるのは9月1日──Claude Playground移行で引き継がれないものと引き継ぐ手順の記事画像

旧Workbenchのデータが消えるのは9月1日 Claude Playground移行で引き継がれないものと引き継ぐ手順

活用
ChatGPTがPowerPointの中で直接スライドを作る「ChatGPT for PowerPoint」ベータ公開の記事画像

ChatGPTがPowerPointの中で直接スライドを作る「ChatGPT for PowerPoint」ベータ公開

プロダクト
Microsoft 365 Copilotに「1クリックでデータ窃取」の脆弱性チェーン ― CVE-2026-42824、パッチ適用済みの記事画像

Microsoft 365 Copilotに「1クリックでデータ窃取」の脆弱性チェーン ― CVE-2026-42824、パッチ適用済み

プロダクト
Claude Designを仕事で使い倒してみた ― 雑に頼むと外れ、構造で頼むと化けるの記事画像

Claude Designを仕事で使い倒してみた ― 雑に頼むと外れ、構造で頼むと化ける

検証実機で検証

古い記事は月別アーカイブから ›