AI時短ラボ
検索

AI研究・論文の記事

「AI研究・論文」に関連するAIニュースと解説、128本。新しい順に並べています。

解除

AI研究・論文 の記事:128件

Anthropicが科学者向けに1万席を開放──「Claude team plan for scientists」は標準席が1年無料、5倍枠のプレミアム席が月$15。AI for Scienceの助成は1プロジェクト最大5万ドル、生物・化学以外にも拡大。生物・化学はOpus級まで、Mythos級は米政府と協議中(→9月17日にLSVPで実現)の記事画像

Anthropicが科学者向けに1万席を開放 「Claude team plan for scientists」は標準席が1年無料、5倍枠のプレミアム席が月$15。AI for Scienceの助成は1プロジェクト最大5万ドル、生物・化学以外にも拡大。生物・化学はOpus級まで、Mythos級は米政府と協議中(→9月17日にLSVPで実現)

業界(発表 8月27日)
研究室の装置にCodexをつないだら何が起きたか──MITの量子ビット校正はGPT-5.6 Solが「信号が明瞭なら」自律で完走、弱い信号では研究者の助言が必要。抗菌分子探索の研究室はChatGPT・Codexを「分野の壁を越える道具」に。OpenAIの研究者事例2本(日本語版あり)の記事画像

研究室の装置にCodexをつないだら何が起きたか MITの量子ビット校正はGPT-5.6 Solが「信号が明瞭なら」自律で完走、弱い信号では研究者の助言が必要。抗菌分子探索の研究室はChatGPT・Codexを「分野の壁を越える道具」に。OpenAIの研究者事例2本(日本語版あり)

研究(発表 9月8日)
Qwen Intelligenceとは──Alibabaが「AIスマホを作るメーカー向け」に出したエージェント3点セット。スマホ操作は1,000回38元、画像は1枚0.08元から。重みは非公開、リンク先で見えた数字のズレの記事画像

Qwen Intelligenceとは Alibabaが「AIスマホを作るメーカー向け」に出したエージェント3点セット。スマホ操作は1,000回38元、画像は1枚0.08元から。重みは非公開、リンク先で見えた数字のズレ

プロダクト
OpenAI「Advisory Group on Mathematics and Artificial Intelligence」の告知画像動画

数学者はもう要らない? OpenAI「100以上の未解決問題を解決」を起点に、数学者自身が「まだ早い」と言っていた記録、4か月の快進撃、他の仕事との違い、3つの反論を一次ソースで並べる

研究
Anthropicが7月30日の「Claudeが実在システムに侵入」3件と英AISIのMythos 5の件を受けて何を変えたか──脱出を検知して止める分類器、外部評価者への必須手順、RL環境の1か月凍結で10%超を差し戻し、「報酬ハックで訓練したモデル」が模擬環境でサンドボックスを破る実験。METRに独立レビューを依頼の記事画像

Anthropicが7月30日の「Claudeが実在システムに侵入」3件と英AISIのMythos 5の件を受けて何を変えたか 脱出を検知して止める分類器、外部評価者への必須手順、RL環境の1か月凍結で10%超を差し戻し、「報酬ハックで訓練したモデル」が模擬環境でサンドボックスを破る実験。METRに独立レビューを依頼

研究(発表 8月31日)
Qwen4とは──9月22日の雲栖大会で「Qwen4 Series Coming Soon」として Qwen4-Max/Flash & Plus/27B の3枠が出た。公式プレスリリースは「訓練中」「4.5・5は5〜10兆パラメータ」まで。「人間ゼロ介入で33回の自己改善」の主張と、Artificial Analysisで実測した現行Maxの位置(45・首位53)の記事画像

Qwen4とは──9月22日の雲栖大会で「Qwen4 Series Coming Soon」として Qwen4-Max/Flash & Plus/27B の3枠が出た。公式プレスリリースは「訓練中」「4.5・5は5〜10兆パラメータ」まで。「人間ゼロ介入で33回の自己改善」の主張と、Artificial Analysisで実測した現行Maxの位置(45・首位53)

モデル
XiaomiがMiMo-V2.6を公開──1.02兆パラメータのオープンウェイト、公式掲載のArtificial Analysis指数46、価格はV2.5据え置きの記事画像動画

XiaomiがMiMo-V2.6を公開 1.02兆パラメータのオープンウェイト、公式掲載のArtificial Analysis指数46、価格はV2.5据え置き

モデル
Anthropicが「Life Sciences Verification Program」を開始──審査を通った生命科学の組織に、Mythos 5.1・Opus 5・Sonnet 5を生物学向けに緩めた安全装置で提供。Standard Use(年次更新・チーム単位)とHigh-risk Use(半年更新・プロジェクト単位・生命科学の遮断を全解除)、リアルタイム遮断から30日保持の事後監視への記事画像

Anthropicが「Life Sciences Verification Program」を開始 審査を通った生命科学の組織に、Mythos 5.1・Opus 5・Sonnet 5を生物学向けに緩めた安全装置で提供。Standard Use(年次更新・チーム単位)とHigh-risk Use(半年更新・プロジェクト単位・生命科学の遮断を全解除)、リアルタイム遮断から30日保持の事後監視へ

業界
Googleが「300言語超・70億人・世界人口の86%」と数字を出した言語AIの現在地──Gemini 3.5 Live Translateは70言語・2,000超の言語ペア、目標は「話者数上位1,000言語」、端末内翻訳TranslateGemmaは55言語、フィーチャーフォンでもGeminiの記事画像

Googleが「300言語超・70億人・世界人口の86%」と数字を出した言語AIの現在地 Gemini 3.5 Live Translateは70言語・2,000超の言語ペア、目標は「話者数上位1,000言語」、端末内翻訳TranslateGemmaは55言語、フィーチャーフォンでもGemini

研究
Your Agent Aced the Task. Will It Do It Again?(IBM Research・Hugging Faceブログの画像)

AIエージェントは同じ課題を5回やって全部成功するか IBM Researchが「Pass^k」で測ると、平均77.4%のエージェントの全回成功は53.0%。温度0でも起きる24.4ポイントの「一貫性ギャップ」を、自分の記録から作ったガイドラインで半減

研究
Google AI & Economy ATLAS(Google公式ブログの画像)

Googleの「AI & Economy ATLAS」9月版 米国は仕事のAI利用の30%がコンピュータ・数学職、インドは19%がクリエイティブ職、日本は手作業向けの利用が4%。科学者の半数近くが毎日AIを使い、週7時間弱を節約しても「仮説の積み残し」が増える

研究
AlphaGenome Atlas(Google DeepMind公式ブログの画像)

Google DeepMind「AlphaGenome Atlas」 ヒトゲノムで起こりうる一文字変異90億通りの分子効果を予測して公開、1ペタバイトでAlphaFoldデータベースの30倍超、変異1つを1つの数字にするAVIスコア

研究
How workers are unlocking new ways of working(OpenAI公式の画像)

OpenAIの経済調査「Work at the Frontier」第2弾 自分の職種外の仕事にAIを使う人は、翌月も同じ仕事に戻る(23.6%対8.4%)。150万メッセージで見えた「肩書きが変わる前に仕事が広がる」

研究
Our framework for reporting model misalignment(OpenAI公式の画像)

OpenAI、モデルの「不整合」を公開報告する枠組みを発表 「業界は最高速度で拡大を続けられるほどアライメントを解いていない」、初回6件は漏れたAPIキーの無断使用・数字の捏造・要約に埋めた「隠せ」の指示

研究
OpenAIは「自社AIの問題行動6件」を、Anthropicは「AIが研究の26%を主導」の数字を公開──ライバル2社が同じ方向に出した文書を一次ソースで読むの記事画像動画

OpenAIは「自社AIの問題行動6件」を、Anthropicは「AIが研究の26%を主導」の数字を公開 ライバル2社が同じ方向に出した文書を一次ソースで読む

業界
Google DeepMindがAGIに向けた研究所「DeepMind Institute」を設立──公式ページに「残るギャップは間もなく閉じる」、公開された5本の文章を原文で読むの記事画像動画

Google DeepMindがAGIに向けた研究所「DeepMind Institute」を設立 公式ページに「残るギャップは間もなく閉じる」、公開された5本の文章を原文で読む

業界
フィールズ賞受賞者25人が連名で宣言「AI企業と数学界の目標は深刻にずれている」──全文に書いてあること、書いていないことの記事画像動画

フィールズ賞受賞者25人が連名で宣言「AI企業と数学界の目標は深刻にずれている」 全文に書いてあること、書いていないこと

研究
Fugu Ultra v2・Fugu Maxとは──Sakana AIが同時公開、Fable 5.1もGPT-6 Astraもプールに入れず8本中5本で首位、Maxは出力$6の記事画像動画

Fugu Ultra v2・Fugu Maxとは Sakana AIが同時公開、Fable 5.1もGPT-6 Astraもプールに入れず8本中5本で首位、Maxは出力$6

モデル
OpenAIが「AIがナビエ・ストークスを解いた」と発表──同じ日に数学者が公にした「パクられた疑惑」、何が証明され、どこまで検証されたかの記事画像動画

OpenAIが「AIがナビエ・ストークスを解いた」と発表 同じ日に数学者が公にした「パクられた疑惑」、何が証明され、どこまで検証されたか

研究
エージェントの評価軸に「主体性の保全」を置く──ComBodied Agentsとベンチマーク CombodiedBench を読むの記事画像

エージェントの評価軸に「主体性の保全」を置く ComBodied Agentsとベンチマーク CombodiedBench を読む

研究
1タスク0.07円でARC-AGI-1を解く150Mモデル──BDH-CQは「言葉にしない推論」で費用対精度の記録を更新したの記事画像

1タスク0.07円でARC-AGI-1を解く150Mモデル BDH-CQは「言葉にしない推論」で費用対精度の記録を更新した

研究
倉庫番の「最短手順」をブラウザだけで証明する──ネイティブC++探索をJSに移植したSokoban Solverの記事画像

倉庫番の「最短手順」をブラウザだけで証明する ネイティブC++探索をJSに移植したSokoban Solver

研究
薬の飲み忘れに「また届ける」だけでは足りない──ComBodied Agentsが提案する「Personal World Models」という考え方の記事画像

薬の飲み忘れに「また届ける」だけでは足りない ComBodied Agentsが提案する「Personal World Models」という考え方

研究
Skillsが効くのは「知識を足すから」ではなく「手順の道しるべになるから」──8,135件のトライアルが示した実態の記事画像

Skillsが効くのは「知識を足すから」ではなく「手順の道しるべになるから」 8,135件のトライアルが示した実態

研究

古い記事は月別アーカイブから ›