AI時短ラボ

AI研究・論文の記事

「AI研究・論文」に関連するAIニュースと解説を、出典付きで107本まとめています。

解除

AI研究・論文 の記事:107

『記憶』だけを6.9Bパラメータまで太らせたら、モデル本体を大きくするより効率が良かったの記事画像
研究09.04読了12

『記憶』だけを6.9Bパラメータまで太らせたら、モデル本体を大きくするより効率が良かった

出典 ─ Memory Decoder at Scal
150Mパラメータでタスク1件0.07銭──Pathwayの再帰アーキテクチャBDH-CQが「未学習のARC-AGI-1」を自作して測った理由の記事画像
研究09.03読了14

150Mパラメータでタスク1件0.07銭──Pathwayの再帰アーキテクチャBDH-CQが「未学習のARC-AGI-1」を自作して測った理由

出典 ─ pathwaycom/arc-task-ge
DSPyのReActV2──「1本の巨大な文字列」だったツール履歴を、構造化されたメッセージに分解するの記事画像
検証09.03読了13

DSPyのReActV2──「1本の巨大な文字列」だったツール履歴を、構造化されたメッセージに分解する

出典 ─ stanfordnlp/dspy 3.3.0
GPUのメモリを殴る研究が、なぜ賞を総なめにしているのか──GPUHammer→GPUBreach→GPUThorの受賞歴を追うの記事画像
研究09.03読了13

GPUのメモリを殴る研究が、なぜ賞を総なめにしているのか──GPUHammer→GPUBreach→GPUThorの受賞歴を追う

出典 ─ Gururaj Saileshwar(トロン
ロボットの『振り返り』は、動作が終わってからでは遅い──Zettaが基礎方策を凍結したまま推論速度11.1倍を出した閉ループ設計の記事画像
研究09.03読了13

ロボットの『振り返り』は、動作が終わってからでは遅い──Zettaが基礎方策を凍結したまま推論速度11.1倍を出した閉ループ設計

出典 ─ Zetta ζ: An Efficient
エージェントが失敗するのは「考えられないから」ではなく「何を覚えておくか管理できていないから」──ACMという論文の主張の記事画像
研究09.02読了15

エージェントが失敗するのは「考えられないから」ではなく「何を覚えておくか管理できていないから」──ACMという論文の主張

出典 ─ Agentic Context Management: Solving Agent Memory and Cost by Treating Them as Lifecycle and Architecture Problems(PDF全文)
プロンプトではなく「プログラムの構造」自体を最適化する──DSPyの実験的機能`dspy.Flex`の記事画像
検証09.02読了14

プロンプトではなく「プログラムの構造」自体を最適化する──DSPyの実験的機能`dspy.Flex`

出典 ─ stanfordnlp/dspy 3.3.0
ベースモデルを凍結し、LoRAをターンごとに切り替える──Macaron-V1が選んだ「継続学習」への回り道の記事画像
モデル09.02読了15

ベースモデルを凍結し、LoRAをターンごとに切り替える──Macaron-V1が選んだ「継続学習」への回り道

出典 ─ Macaron-V1: Towards Op
LLMは『次の実験で何が起きるか』を予測できるか──Scale AIの新ベンチマークSciPredictを読むの記事画像
研究09.02読了15

LLMは『次の実験で何が起きるか』を予測できるか──Scale AIの新ベンチマークSciPredictを読む

出典 ─ SciPredict: Can LLMs P
Claude Fable 5.1公開──科学研究ベンチが24.7%から52.6%へ、価格据え置きで実質25%安の記事画像
モデル09.01読了26

Claude Fable 5.1公開──科学研究ベンチが24.7%から52.6%へ、価格据え置きで実質25%安

出典 ─ Anthropic公式ブログ
AIエージェントの『目次』『身分証』『語彙』を別々に作る──Cisco主導AGNTCYの3プロジェクトを読むの記事画像
研究09.01読了15

AIエージェントの『目次』『身分証』『語彙』を別々に作る──Cisco主導AGNTCYの3プロジェクトを読む

出典 ─ GitHub: agntcy/dir REA
動画生成AIの『記憶』をKVキャッシュの外に出す──Alaya-EVOKEはH200で1.5秒分の映像を2.11秒で作り続けるの記事画像
研究09.01読了22

動画生成AIの『記憶』をKVキャッシュの外に出す──Alaya-EVOKEはH200で1.5秒分の映像を2.11秒で作り続ける

出典 ─ Alaya-EVOKE: From Line
1体のエージェントの自己改善には天井がある──『共進化』というもう1つの自己進化の軸を整理したサーベイ論文の記事画像
研究09.01読了19

1体のエージェントの自己改善には天井がある──『共進化』というもう1つの自己進化の軸を整理したサーベイ論文

出典 ─ Co-Evolution in Agenti
「Gemini Plays Pokemon」が一度も負け戦なくポケモンクリスタルを攻略した後、人間を完全に外した自己改善ハーネス「Continual Harness」の論文を読むの記事画像
研究09.01読了15

「Gemini Plays Pokemon」が一度も負け戦なくポケモンクリスタルを攻略した後、人間を完全に外した自己改善ハーネス「Continual Harness」の論文を読む

出典 ─ Continual Harness: Onl
狭い範囲の追加学習が、AIを広く危険にする──『創発的アライメント崩壊』という現象の記事画像
研究09.01読了15

狭い範囲の追加学習が、AIを広く危険にする──『創発的アライメント崩壊』という現象

出典 ─ Emergent Misalignment:
動画生成AIの採点に「なぜそのスコアか」を残す──HarnessEval-Wはサブエージェントを分業させて評価の根拠を証拠の木にするの記事画像
研究09.01読了16

動画生成AIの採点に「なぜそのスコアか」を残す──HarnessEval-Wはサブエージェントを分業させて評価の根拠を証拠の木にする

出典 ─ HarnessEval-W: Agentif
OpenAIが『再帰的自己改善』専任の安全研究者を募集している──Preparednessチームの求人票を読むの記事画像
業界09.01読了16

OpenAIが『再帰的自己改善』専任の安全研究者を募集している──Preparednessチームの求人票を読む

出典 ─ Researcher, Recursive
『できること』ではなく『やりたがること』を測る──PropensityBenchが導入した安全性評価の軸の記事画像
研究09.01読了21

『できること』ではなく『やりたがること』を測る──PropensityBenchが導入した安全性評価の軸

出典 ─ PropensityBench Projec
Anthropicが「AIとウェルビーイング」の評価手法に500万ドルの助成──応募締切は9月21日の記事画像
研究08.31読了10

Anthropicが「AIとウェルビーイング」の評価手法に500万ドルの助成──応募締切は9月21日

出典 ─ Anthropic公式ブログ「Funding
NVIDIA GPUのECCを破る「GPUThor」──研究は8月25日に公開済み、攻撃コードは11月15日の記事画像
研究08.30読了15

NVIDIA GPUのECCを破る「GPUThor」──研究は8月25日に公開済み、攻撃コードは11月15日

出典 ─ GPUThor公式サイト(トロント大学 Li
Fable 5の生物学セーフガードが更新──フォールバック85%減、Anthropicが分類器の中身を公開したの記事画像
モデル08.29読了6

Fable 5の生物学セーフガードが更新──フォールバック85%減、Anthropicが分類器の中身を公開した

出典 ─ Anthropic「Improving Fa
『成果を出せ』と言われたAIエージェントはどれだけルールを破るか──実測ベンチマーク論文を読むの記事画像
研究08.28読了6

『成果を出せ』と言われたAIエージェントはどれだけルールを破るか──実測ベンチマーク論文を読む

出典 ─ A Benchmark for Evalua
AIの「嘘発見器」は訓練しても未知のケースに汎化しなかった──Anthropic Alignment Science Blogの8月分3本を読むの記事画像
研究08.28読了8

AIの「嘘発見器」は訓練しても未知のケースに汎化しなかった──Anthropic Alignment Science Blogの8月分3本を読む

出典 ─ Anthropic Alignment Sc
AIが自分自身を作り始めた──Anthropicの「When AI Builds Itself」を、誇張なしで読むの記事画像
研究08.27読了13

AIが自分自身を作り始めた──Anthropicの「When AI Builds Itself」を、誇張なしで読む

出典 ─ Anthropic Institute「Wh

新しい記事をメールで受け取る

AIの新しい発表を、公式資料にあたって数字を確認したうえで届けます。盛らない・出典を明記する・確認できていないことは書かない、を守ります。