2026年9月11日 金曜日
AI時短ラボ

ニュース一覧

最新のAIニュースを出典付きでお届けします。

AIエージェントへの攻撃成功率85%──OpenARTは『環境そのものを変え続ける』ことで安全性テストの死角を突くの記事画像
研究09.06読了20

AIエージェントへの攻撃成功率85%──OpenARTは『環境そのものを変え続ける』ことで安全性テストの死角を突く

出典 ─ OpenART: Scaling Agent
日本発「PEP検定」とは──開始1年でシラバスに「AIエージェント」「コンテキストエンジニアリング」を追加した資格の中身の記事画像
業界09.06読了11

日本発「PEP検定」とは──開始1年でシラバスに「AIエージェント」「コンテキストエンジニアリング」を追加した資格の中身

出典 ─ PR TIMES
Claude Code・Codex・Cursorを並列で走らせる自己ホスト型AI IDE「Proliferate」の記事画像
検証09.06読了11

Claude Code・Codex・Cursorを並列で走らせる自己ホスト型AI IDE「Proliferate」

出典 ─ proliferate-ai/prolife
RunwayがGWM-1で目指す次──「動画生成」から「世界そのものをシミュレートする」への転換の記事画像
プロダクト09.06読了10

RunwayがGWM-1で目指す次──「動画生成」から「世界そのものをシミュレートする」への転換

出典 ─ Runway Research
モデルの起動待ち時間を2.38倍短縮──SGLangが「CUDAグラフのキャプチャ中にチェックポイントを読み込む」設計に変えたの記事画像
研究09.06読了15

モデルの起動待ち時間を2.38倍短縮──SGLangが「CUDAグラフのキャプチャ中にチェックポイントを読み込む」設計に変えた

出典 ─ sgl-project/sglang v0.
論文執筆を「13個のスキル」に分解する──Spark-to-Paperは1本8.1ドル・3.2時間で書き上げ、捏造検出率を14%から92%に上げたの記事画像
研究09.06読了14

論文執筆を「13個のスキル」に分解する──Spark-to-Paperは1本8.1ドル・3.2時間で書き上げ、捏造検出率を14%から92%に上げた

出典 ─ Spark-to-Paper: End-to
アイデア1行をPDFの論文に変えるspark-to-paper-skills──Claude Codeの13個のスキルだけで、数値を捏造せず図まで組む仕組みの記事画像
検証09.06読了14

アイデア1行をPDFの論文に変えるspark-to-paper-skills──Claude Codeの13個のスキルだけで、数値を捏造せず図まで組む仕組み

出典 ─ Spark-To-Paper-Skills/
モデルを変えずにTerminal-Bench 2.1で95.3%──「ハーネス側だけ」を作り込んだStateMの実験費用は15ドルの記事画像
研究09.06読了16

モデルを変えずにTerminal-Bench 2.1で95.3%──「ハーネス側だけ」を作り込んだStateMの実験費用は15ドル

出典 ─ StateM: Reaching 95.3%
Sunoが9月3日からダウンロード数に上限──旧モデル全廃も予告、公式ブログ4本で確認する変更点の記事画像
プロダクト09.06読了11

Sunoが9月3日からダウンロード数に上限──旧モデル全廃も予告、公式ブログ4本で確認する変更点

出典 ─ Suno Blog
SWE-bench Verifiedの未解決問題、6割はテスト自体に欠陥があった──7言語・170件のリファクタリングで最高スコアは41.2%の記事画像
研究09.06読了17

SWE-bench Verifiedの未解決問題、6割はテスト自体に欠陥があった──7言語・170件のリファクタリングで最高スコアは41.2%

出典 ─ SWE-Bench ProMax: Benc
Tencentが「画面を見て操作する」オープンウェイトAIエージェントを公開──OSWorld-Verifiedで77.0点、手元で動かせるcomputer useの選択肢の記事画像
モデル09.06読了10

Tencentが「画面を見て操作する」オープンウェイトAIエージェントを公開──OSWorld-Verifiedで77.0点、手元で動かせるcomputer useの選択肢

出典 ─ Hugging Face
正解ラベルなしで自分を鍛え直す──U-OPSDはモデルの多数決だけを教師にして数学ベンチマークを8.5〜10.7%押し上げたの記事画像
研究09.06読了16

正解ラベルなしで自分を鍛え直す──U-OPSDはモデルの多数決だけを教師にして数学ベンチマークを8.5〜10.7%押し上げた

出典 ─ On-Policy Self-Distill
AIが2000年前の炭化した巻物を読む──Vesuvius Challengeは何をどこまで解読したかの記事画像
研究09.06読了17

AIが2000年前の炭化した巻物を読む──Vesuvius Challengeは何をどこまで解読したか

出典 ─ Vesuvius Challenge 公式サ
vLLMのDecode Context Parallelで、Kimi-K3のKVキャッシュ容量がGPU1台あたり10倍にの記事画像
研究09.06読了10

vLLMのDecode Context Parallelで、Kimi-K3のKVキャッシュ容量がGPU1台あたり10倍に

出典 ─ vllm-project/vllm v0.2
vLLMに投機的デコードの新手法「DFlash2」──1H200・GSM8Kで自己回帰の3.51倍のスループットの記事画像
研究09.06読了10

vLLMに投機的デコードの新手法「DFlash2」──1H200・GSM8Kで自己回帰の3.51倍のスループット

出典 ─ vllm-project/vllm v0.2
コピーを持たない「最初の公開AI」──wildstaticの実験Staticに接続すると、お金が尽きていて誰とも話せなかったの記事画像
プロダクト09.06読了11

コピーを持たない「最初の公開AI」──wildstaticの実験Staticに接続すると、お金が尽きていて誰とも話せなかった

出典 ─ The First Public AI
AIエージェント同士の『言い分の食い違い』をJSON+PDFの裁定書で解決する──Agentic Dispute Protocol(ADP)を読むの記事画像
研究09.05読了11

AIエージェント同士の『言い分の食い違い』をJSON+PDFの裁定書で解決する──Agentic Dispute Protocol(ADP)を読む

出典 ─ IETF Datatracker「draft
『AI学習していいか』を2つの単語だけで表す──IETF AI Preferences Vocabularyドラフトを読むの記事画像
研究09.05読了11

『AI学習していいか』を2つの単語だけで表す──IETF AI Preferences Vocabularyドラフトを読む

出典 ─ IETF「A Vocabulary For
MCPでもA2Aでも──『エージェントを見つける』だけに徹する軽量プロトコルARDPを読むの記事画像
研究09.05読了11

MCPでもA2Aでも──『エージェントを見つける』だけに徹する軽量プロトコルARDPを読む

出典 ─ IETF Datatracker「draft
有償AIコードレビューをやめてローカル自作に切り替えた話──diffだけを見るPythonツール avouchの記事画像
検証09.05読了12

有償AIコードレビューをやめてローカル自作に切り替えた話──diffだけを見るPythonツール avouch

出典 ─ Show HN: I canceled my
ChatGPT無料版のテキストチャットが無制限に──既定モデルはGPT-5.6 Lunaの記事画像
プロダクト09.05読了11

ChatGPT無料版のテキストチャットが無制限に──既定モデルはGPT-5.6 Luna

出典 ─ August Updates」システムカード(2026年8月6日)
Ollamaユーザー向けのデスクトップアプリ「ChatOSS」──ローカルモデルでコード・カンバン・独自アプリを1画面にまとめるの記事画像
検証09.05読了11

Ollamaユーザー向けのデスクトップアプリ「ChatOSS」──ローカルモデルでコード・カンバン・独自アプリを1画面にまとめる

出典 ─ ChatOSS 公式サイト(トップページ)
Claude Codeに組み込みの「Concise」出力スタイルが追加──前置きと実況を省いて結果から話すの記事画像
プロダクト09.05読了12

Claude Codeに組み込みの「Concise」出力スタイルが追加──前置きと実況を省いて結果から話す

出典 ─ Claude Code CHANGELOG.
Claude Managed AgentsのDreamsに「元のメモリストアを上書き」する選択肢が追加された(ドキュメントは未反映)の記事画像
プロダクト09.05読了11

Claude Managed AgentsのDreamsに「元のメモリストアを上書き」する選択肢が追加された(ドキュメントは未反映)

出典 ─ anthropic-sdk-python v

新しい記事をメールで受け取る

AIの新しい発表を、公式資料にあたって数字を確認したうえで届けます。盛らない・出典を明記する・確認できていないことは書かない、を守ります。