2026年9月の記事
799本。公開日の新しい順です。
9月27日(15本)
- 業界米控訴裁、国防総省によるClaudeの締め出しを2対1で容認 判決文で読む「問われるのは何をするかで、なぜではない」
- モデル【リーク】Claude Sonnet 5.5、Anthropicがステルステスト中と投稿 提携先には2つ目のチェックポイント、公開は「来週」
- モデル【リーク】Gemini 4 Pro、Google社内でチェックポイント「argon」が出回り始めたと投稿 出力の上限は25万6,000トークン、新しい版「barium-b」の投稿も
- 検証Google ADKに「ライブ・音声エージェントの評価」 模擬ユーザーがGemini TTSで話し、音声の返答をルーブリックで採点。名前確認→生年月日の検証(ツール呼び出し)→予約案内の3段ワークフローを、会話計画とペルソナ(NOVICE等)で即興させるか台本どおりに回す。test_config.jsonのlive_model_configを外せば同じケースをテキストで実行、CI/CDにも
- 検証Google「AI Agents Challenge」上位に共通した4つの設計 ①自分のツール層をMCPサーバーとして他のエージェントにも開く②呼び出し連鎖でなくイベントバスで並列に反応③フォールバック先のFlashも同じ検証関数を通す④正規表現→10トークンの分類→本モデルの3層で4割超をモデル呼び出し前に処理。「名前つきプロンプトの連鎖」は多エージェントではない
- 検証Google「Credentio」 C2PAコンテンツ認証情報を検証するC++ライブラリをオープンソース化。約40のGoogle製品で数百億件の生成物を扱ってきたのと同じコードで、仕様2.2と2.4に対応。完全にローカルで検証(送信なし・即時判定)、数GBの動画でもメモリ消費は小さく、公式のC2PA Trust Listを渡せる。生成・埋め込みは今後
- 検証Google「ハーネス・エンジニアリングの解剖」 Terminal-BenchやDeepSWEの総合点が数ポイント動いても「なぜ」は分からない。「曖昧な指示で聞き返すか」「ビルドファイルを変えたら検証を回すか」を単体テストのように断言する「行動評価」を、Antigravity SDK+pytestで5秒以内に回す。評価は「ドッグフーディングで自分のコードベースを扱えるようになった後」から
- 検証Google Labs「Julesで測るべきもの」 コーディングエージェントは「頼まれたタスク」から「目標」へ。SWE-Benchは課題の完了しか測れないので、社内の705件のバグ(1,178 CL)を時間的近接と意味的類似で束ねて「目標」の正解を作り、修正前の状態に戻してエージェントに探索させLLMで5段階採点。1回の探索で平均4.5、探索を2回→3回にするとHit@5が33%→57%
- 検証Raspberry Pi 5でGemma 4 E2Bをオフライン実行 LiteRT-LMでプリフィル99トークン/秒・デコード9トークン/秒・ピークメモリ1,432MB、生成は約300語/分(人の会話の2倍)。GPUにYOLOの物体検出を逃がし、CPUでMoonshineの音声認識・Gemma・TTSを回すReachy Miniロボットの構成。pip install litert-cliで開始
- 検証Google「LiteRT.js」 .tfliteモデルをブラウザで動かすJavaScript版LiteRT。TensorFlow.jsのJSカーネルでなくネイティブのランタイムをWebAssemblyで提供し、CPU(XNNPACK)・GPU(WebGPU)・NPU(WebNN)を使い分け。他のWebランタイム比で最大3倍、CPU比でGPU/NPUは5〜60倍
- 検証Google・Manyika氏「科学を加速し生活を良くするAI」の棚卸し AlphaFoldは190か国400万人、乳がん検診で見逃し25%を検出、結核X線2.5万件・糖尿病網膜症115万件、Flood Hubは150か国超20億人、山火事警報7,500万人、Planetary Prediction Engineはエボラの新規ホットスポット83%を事前特定、研修10億ドルで1億人超
- 検証Google DeepMind「クライアントSDKの生成はオープンであるべき」 2026年5月、使っていたSDK生成ベンダーが買収され突然の終了。Interactions APIのGA直前に乗り換え、Speakeasyと組んでOpenAPI生成スイートをAGPLv3でオープンソース化。7言語のSDK・エージェント向けCLI・ドキュメントMCPサーバーを生成、6ターゲットを約1人で保守
- 検証Google「autofinetune」 仕様書1枚を書いて寝ると、エージェントが一晩でLoRAのランク・学習率・バッチを探索し、改善したコミットだけGitに残す。TPU v5eでFunctionGemma 270MのSFTを20回、TPU v6eでGemma 3 1BのGRPOを40回回し報酬約10%改善。Tunix+Antigravity CLI+Gemini 3.7 Flash
- 検証Google「ゼロトラスト・エージェント」第2回 構文でなく意図を判定する。正規表現の脱獄辞書をModel Armor(入口で403)に、「30ドル超のソフトライセンスは返金不可」を自然言語のポリシー(1判定2,576トークン)に、20ドル×8回で160ドルを抜く多ターン攻撃をAgent Anomaly Detectionに置き換え、再デプロイなしで新ポリシーを足して閉じる
- モデルMiniMax、新モデル「M3.1-Flash-Preview」をMiniMax Codeで公開 推論の強さは5段階、前日のリークは「来週」と書いていた
9月26日(17本)
- 業界OpenAI、研究環境のエージェントがユーザーの画像53件を画像共有サイトに上げていたと公表 2日前にはTransluceが「政府サイトを含む3か所へのハッキングの試み」を報告。7月からの事故記録ページと並べて読む
- 検証Anthropic「エージェントのコーディングがCIを圧迫している」 CIジョブが6か月で25倍、テスト選択サービスに当てた応急処置は70日・29日・1日未満しか持たず、状態を外に出す再設計で安定。Claude Tagの長期セッションが遅延5万件超で担当者を呼び出し、設計変更を主張し続けた
- 検証Gemini「エージェント型の動画理解」 毎秒1フレームで丸ごと読む代わりに、必要な区間だけ探して見直す。トークン最大88%減・費用最大66%減・精度最大7%向上(Google DeepMind、3.7 Flash・3.6 Flash・3.5 Flash-Lite)。APIの設定を"agentic"にするだけ、追加料金なし。Geminiアプリと「Ask YouTube」にも順次
- 検証豪州の法律事務所Gilbert + Tobin、ChatGPT EnterpriseとCodexを全社展開 有効化ライセンスの87%が実利用(通常のツール導入率の2倍超)、採用調査は約4時間→約20分、利益相反・KYC・AML審査は3〜8時間→数分、300法人の監査報告書で丸1日の手作業を削減。CEOの「デジタルツイン」カスタムGPTで幹部が提案を事前検証、法律業務はHarvey等の承認済み基盤
- 検証Google「Fairwind Program」 Gemini 3.8 Flash CyberとCodeMenderを政府・重要インフラ・基盤ソフトの「信頼できる防御側」に限定提供。参加は650超、社内のセキュリティ・インシデント対応・侵入テストの担当者に限りMFA必須。Google.orgのサイバー資金は累計1億ドル超、米国35のサイバークリニックに3,600万ドル
- 検証Google Research「Retrieve-for-Train」 AI検索の「クエリ分解」を推論時に考えさせない。強化学習で一度だけ良い分解を見つけ、5,390万パラメータの拡散モデルに焼き込んで一発生成。自己回帰の12〜20倍速く、大きなバッチで50秒近くかかる処理が数秒に
- 検証Google Research「ToolGrad」 ツール使用データを「答えから先に」作る。API連鎖を先に組んでから質問を書く逆順で合格率ほぼ100%、Gemma 3 12Bの微調整版がBFCLで83.1(Gemini 2.5 Pro 83.2・Claude 4.5 Opus 82.8・GPT-5 74.4と並ぶ)。教師のGemini 2.5 Flash-Liteを生徒が上回る
- 検証「Safety for Whom?」 安全化の学習で有害応答率を26.26%から0.14%に下げた同じチェックポイントが、無害な質問の74%を拒否していた。Multiverse Computingが「話題ごと」でなく「話題の中の境界」で拒否を学ばせる手法をHugging Faceで解説。境界ペアで過剰拒否32.94%→4.16%
- 検証NVIDIA「メガワットからトークンへ」 同じ電力予算で19ノードを85%出力で回すと、16ノード全開よりトークン処理量24%増(Lambdaの実測、HGX B200)。電力会社の信号でAI工場の消費を4MWから3MWへ1分未満で自動調整(Emerald AI・Silicon Valley Power、200回超すべて成功)。DSX Flex初の商用配備は96MWのVera Rubin工場
- 検証OpenAI「AIネイティブ企業はワークフローを業務遂行力に変える」 上位10%のフロンティア企業は利用者1人当たり出力トークンが一般企業の8.3倍(1月は2.6倍)。Basisは初日のオンボーディングを2時間→30分(Codex+社内スキル)、Clayはアカウント別サブエージェントが夜間に商談を更新、ExaはCodexが連携機会を監視しPRとテストまで
- 検証OpenAI「AI政策の窓は開いている。動くべきだ」 議会に「能力ベースの義務的な国家AI安全規制」を求め、加州の4法案(SB 813独立評価機関・AB 1405監査人基準・SB 1119若者保護・AB 1864遺伝子合成の審査)を支持。「安全基準を満たせないなら能力の伸びを遅らせる」「対象はフロンティア研究所のみ、オープンウェイト政策の代わりにしない」。以前は不支持の法案も再考
- 検証OpenAI、医療機関のEHR(Epic)をChatGPTに接続 許可された患者記録を横断して「前回受診から何が変わったか」を要約。ClinicalTrials.gov・PubMed・DailyMedなど9つの公的医療情報源を束ねたプラグインも。27の臨床ユースケース4,363件の医師評価で99.1%が「安全」。パイロットはUCSF Health
- 検証OpenAI、ジャーナリズム支援を「教室からニュースルームまで」に拡大 CUNY NewmarkとNorthwestern Medillの院生・教員に400超のChatGPT Edu、American Journalism Projectの50超の報道機関にChatGPT EnterpriseとAPIクレジット、LenfestのAIフェロー、WAN-IFRAの165超のニュースルーム支援を継続
- 検証OpenAI CFOサラ・フライアー氏「いま実現できる仕事」 週次10億人超・250万社、個人プラン利用者は登録6か月後にメッセージ約50%増・タスクの種類約2倍、研究組織は人間1日につきエージェント3.1稼働日分、GPT-5.6 Solで提供コスト20%減・トークン効率15%超向上、自社チップJalapeñoはワット当たり1.5〜1.9倍で年末までに導入
- 検証OpenAI、13〜17歳とAIの発達に関する独立研究に500万ドルの助成 1件最大100万ドル、間接費は10%まで、応募は2026年10月6日まで(英語・Googleドキュメント1本)、採択通知は11月13日まで。資金と運営はOpenAI Group PBC。「AI製品事業者に好ましい結果かどうかにかかわらず信頼できる知見を生む能力」を審査基準に明記
- 検証ポール・クリスティアーノ氏がOpenAI Foundationの理事に RLHFの基礎を築きARCを創設、米NIST CAISIで2政権にまたがりフロンティアモデルを評価してきた研究者が、安全・セキュリティ委員会(委員長ジコ・コルター氏)にも参加。OpenAI Group PBC理事会では議決権のないオブザーバー。CAISI上級技術顧問は継続し、OpenAI関連の案件と全モデル評価から自らを除外
- モデル覆面AI「Pixel Canary」、トークン数はQwen3.5以降の語彙と95本すべて一致 名前はGoogle風でもGoogleの辞書とは24本、推論には「You are Qwen」
9月25日(24本)
- モデルOdysseyの世界モデル「Agora-2」にOpus 5.5を4回入れてみた 0キルから50キル、ボス撃破まで。ゲームエンジンのどこをAIが引き受け、どこがルールのまま残っているか
- 業界Emerald AI・Google・NVIDIAが「AI Energy Management Alliance(AEMA)」を設立 AIデータセンターを「電力を柔軟に減らせる資源」として電力網につなぐ。負荷の移動・蓄電・併設発電で系統の逼迫に応じ、接続前にライドスルー・抑制・緊急応答の義務を定め、検証可能な柔軟性を約束した事業者には速い接続経路を
- 研究Appleの研究「Shared Selective Persistent Memory」 エージェントに会話の全履歴を持たせると成績が下がる(71%)、何も持たせないと79%、「4種類だけ選んで残す」と96%。ゼロトークンでデータ更新(14倍速)、要約駆動で1回あたりのトークン97分の1、記憶はワークスペース単位で他の人に渡せる
- 研究Appleの研究「価値観を教え込むとLLMはどう変わるか」 好奇心・共感・誠実さなどの価値を選んで微調整すると、関連する別の価値(時に相反する価値)まで表れ、肯定的な価値は安全性を上げるが、どの価値でも擬人化した言葉遣いが増えて「肯定し、追従する」モデルになる
- 検証Claude Code、autoモードのclassifierがAPI/Enterprise/Bedrock/Vertex/Foundryでもサーバー側実行に既定変更 オーバーヘッド課金なし(v2.1.278)
- 検証Claude Code、Pro/Team StandardプランでOpus 5.5が既定モデルに 何も設定しなければSonnetでなくOpusが動く
- 検証Cline、日本からオープンウェイトモデルを配信する「ai&」に新規対応(既定モデルGLM 5.3) DesktopアプリもLinux初対応
- 検証Cursorが「Rollouts」と「Security Review」を追加 デプロイ監視とPRの脆弱性レビューを担う新ボット2つ
- モデルCognition、Devinの次世代コーディングモデル「SWE-2」をエージェント選択の研究プレビューに追加 有効化はエンタープライズ管理者→組織管理者の2段階、Fable 5.1と組む「Fusion」にも先行採用
- 活用ElevenLabsの料金と使い方【2026年9月版】 無料(月1万クレジット)から$6・$22・$99・$299・$990の6段階、クレジットの消費(文字1・文字起こし1分330・音楽1分900・吹き替え1分2,000)、商用利用と音声クローンの条件、年払い・繰り越しの仕組み
- 検証低リスクなツール呼び出しは自動承認、Codexエージェントはプランモードに対応 GitHub Copilot for JetBrains 1.18.0
- 検証GitHub CopilotにOpenAIのGPT-6 Sol・GPT-6 Lunaが追加 対応プランとモデルピッカー一覧
- 検証OSが守れないなら実行しない GitHub Copilotアプリにローカルサンドボックスがパブリックプレビュー追加
- 検証Google「ADK for Kotlin 1.0」が正式版 Python版・Java版のADK 1.0と同じ機能に加え、Android向けの端末内エージェント(LiteRT-LM・ML Kitベータ)、Firebase AI Logicのハイブリッド、RoomとAppSearchで状態の保存。@Toolと@Paramでスキーマを自動生成、SKILL.mdで手順を段階的に読む
- プロダクトGoogleの「Agent Anomaly Detection」がプライベートプレビュー エージェントの推論の痕跡・ツール呼び出し・実行の流れを事後に読んで「境界の外の振る舞い」を見つける。OWASP Agentic Top 10の4項目+資源枯渇、応答は遅くしない、Security Command Centerに通知、APIで次のツール呼び出しを止められる
- 研究Google×HHMI Janeliaがオスのショウジョウバエの脳と中枢神経系の完全な配線図を公開 16万6,000超のニューロン・1億2,500万のシナプス結合で「ニューロン数で史上最大の脳地図」。AIが電子顕微鏡画像を3D再構成し、人が校正。メスの地図と比べて求愛・攻撃の回路を調べられる。次は魚の脳全体
- 活用LM Studioの使い方と料金【2026年9月版】 無料でローカルLLMを動かす手順(Mac M1〜M4・Windows・Linux、16GB推奨、4bit以上の量子化)、OpenAI互換API・MCP・文書チャット、新アプリ「Bionic」とBionic+ $20/Pro $100のクラウド(Kimi K3・GLM 5.3・DeepSeek V4 Flash、ZDR)
- 活用n8nの使い方と料金【2026年9月版】 無料で自分のPCに立てる(`curl -fsSL https://get.n8n.io | sh`・`npx n8n`・Docker)、クラウドはStarter €20/Pro €50/Business €667、課金は「ステップ数でなく実行回数」、AIエージェント・RAG・MCPの入口、Zapier・Difyとの違い
- 業界NTTドコモビジネス、IoT通信基盤「docomo business SIGN」でセキュアな「フィジカルAI」活用環境を実現 MECとGPUaaSを直結し1GPU単位のソブリンAI環境を2026年12月提供開始
- 業界NVIDIAの次世代ラック「Vera Rubin NVL72」がMLPerf Inference v6.1に初登場 Qwen3-VLでGB300 NVL72の最大3.7倍、DeepSeek-R1で最大2.5倍(プレビュー提出)。GB300は4ラック288GPUで99%のスケーリング効率、ソフトウェア改善だけでv6.0比最大1.6倍。エージェント向け指標では30倍という自社測定も
- 業界Sakana AI、LSTM考案者の一人シュミットフーバー氏を招聘 Transformer論文の共著者は氏ではなく同社CTOのLlion Jones氏
- モデルTencentが文書解析AI「WeVisDoc」をオープンウェイト公開 OmniDocBench v1.6で95.38、end-to-end型パーサーの比較で首位と主張
- 活用Veo 3.1の使い方と料金【2026年9月版】 8秒・720p〜4K・音声つき、Standard/Fast/Liteの1秒あたり$0.05〜0.60、延長・最初と最後のフレーム指定・参照画像3枚、Googleが「既定はGemini Omni Flash」と書く現在の位置づけ、Flowでの使い方
- 検証Zed v1.21.0、Opus 5.5とGPT-6 3モデルにBYOK追加 SuperGrokサインインも新設
9月24日(25本)
- モデルClaude Opus 5.5は本当に最強か 第三者ベンチマーク2社で総合1位、研究課題で初の人間基準超え。ただしフォールバック込みの数字と、筆者が見た「暴れ馬」の癖
- 研究AI資格まとめ【2026年9月版】 生成AIパスポート・G検定・E資格・PEP検定の受験料・形式・日程を公式で並べる。終了したJDLA Generative AI Test、「AI資格」で検索して出てくる民間資格の見分け方、非エンジニアが取る意味
- モデル中国AIモデルまとめ【2026年9月版】 DeepSeek・Qwen・Kimi・GLM・MiniMax・Tencentの現行モデル、API価格、重みの公開状況(Hugging Faceで確認)、ライセンスの条件、データの保存先。覆面モデルOx Alpha(GLM-5.3-Flash)とUnion Alpha(UnbiasedのPareto)の正体まで
- 検証Claude Codeの1タスクはいくらかかるか ターン数・キャッシュ・出力トークンの内訳をAnthropicが公式ブログで示す
- プロダクトClaude Marketplace公開 公式は「2,000超」のコネクタ・プラグインを謳い、一覧ページの表示は計1,168件。個人のPro/Maxで使えるのはどこまでか
- プロダクトClaude Opus 5.5がGitHub Copilotで利用可能に 使えるプランとClaude Code・APIとの料金差
- モデルGoogle、Gemini 3.8 Flash TTSと3.8 Flash-Lite TTSを発表 9/15公開の3.8 Liveとは別の読み上げ専用モデル、既製の声は2,000種類超、音声出力は10秒$0.0015〜$0.00225(2026年内)
- プロダクトGeminiのアプリ連携にAdobe・Webflow・Airtableなど14サービス Googleの対応表では10件が「米国のみ」、13件が「英語のみ」
- 業界政府AI『源内』OSS Ver2.0は2027年2月ごろ公開予定 『エージェントチャット』『源内工房』の中身と、民間・自治体が使える範囲
- プロダクトGoogleマップの「マップに相談」が日本で提供開始 Geminiと会話して「充電できてコーヒーが並ばず買える場所」を探す。Gmail連携のパーソナルインテリジェンス(既定オフ)、履歴オンで過去の会話を再開、交通・混雑・公共交通の遅延もリアルタイム。5億人超の投稿者と3億超の場所の情報
- プロダクトPixelの「詐欺の可能性」警告が日本語に対応 メッセージを開く前の通知の段階で表示、9月のPixel Dropで日本を含む9か国・6言語に拡大。VIPウィジェット刷新、Pixel Watchの「手を上げて話す」精度向上、Audible 2か月無料も
- 業界Google、宇宙データセンター研究「Project Suncatcher」の試作衛星を来週打ち上げへ 太陽光は地上の最大8倍、論文は打ち上げ費用200ドル/kgで電力コストが地上並みと試算
- プロダクトGoogle Vids、Gemini Omni 1.1 Flashで誰でも無料の1080p動画生成へ 個人アカウントの無料枠は英語版ヘルプで「月6本」
- プロダクトGPT-6のプロンプトキャッシュ改善を読む 割引90%・書き込み1.25倍・TTL30分はGPT-5.6と同じ、ダッシュボードと診断ツールは8〜9月に公開済み、発表前日のガイドに無かったのはプリウォーム
- 業界令和9年度AI関連予算の概算要求は2兆9,392億円、令和8年度予算の5.8倍 中小企業向けAX・DX支援に経産省が新規約3,746億円
- 活用4万行のFortran 77をAIエージェントでC++に移した記録 Mistralが公開した3つの教訓:①移行コードを書く前に「数値の一致」を証明するパリティハーネスを作る、②100超のエージェントでまず文書化、③完全自律は「Fortranを C++の文法で書き直しただけ」になり、人がゲートに立つ構造化ワークフローに落ち着いた
- モデルNano Banana(ナノバナナ)とは Googleの画像生成モデル4種(2 Lite・2・Pro・初代)の違い、API価格(1枚$0.034〜$0.24)、Geminiアプリでの使い方、参照画像14枚・4K・検索グラウンディング、初代の10月2日停止まで
- 活用Next.jsのサイトを毎朝自動でビルド・デプロイして「予約公開」を成立させる Mac1台のlaunchd+Vercel CLIで、二重起動ロック・失敗をDesktopに通知・本番URLの200確認・直近3日の取りこぼし確認・IndexNow送信まで。当サイトが2026年8月28日から動かしている仕組み
- 業界NTTドコモビジネスが「1GPUから」のGPUクラウド「GPUaaS」を9月30日に開始 閉域網と国内クラウドで「AI処理からデータ保管まで国内完結」のソブリンAI。同じ日、NTTデータ系のフォーティエンスは消費財向け「AI駆動型需要予測FDEサービス」(19種の予測モデルをSKUごとに自動選択、現場がバイブコーディングで改善)
- 業界NVIDIAが「商用規模で走る主要ロボタクシーはすべて自社スタックの上」と書いた 訓練(DGX+Alpamayo)・シミュレーション(Omniverse/Cosmos)・車載(Hyperion=Thor×2、カメラ14・レーダー9・ライダー3)の3台構成。日本はTIER IV・いすゞのレベル4バス、日産×Wayve×Uber。Uberは2028年に28都市
- 研究OpenAI、メンタルヘルス対応を測る「MentalHealthBench」を公開 緊急時以外の会話まで、80人超の専門家が採点基準を作成
- 業界OpenAIが「第三者評価の優先事項と原則」を公表 提携先も金額も書かず。Anthropic×Accentureの「社員並みアクセス」と並べて読む
- プロダクトPerplexityのローカル版エージェント「Portable Computer」がWindowsに RTX/RTX PROのVRAM 24GB以上で、Qwen3.8-27Bをローカルで動かして多段階の仕事をこなし、機密データは端末に残しクレジットも消費しない。クラウドに送るときは許可を求める
- 研究Sakana AI、社内で育ってきた研究グループ「Frontier Intelligence Group」を公表 Transformer論文共著者のCTO Llion Jones氏が問うポストTransformer
- プロダクトYouTube「Made On YouTube 2026」発表 Shorts会話型AI編集・Live自動吹き替え・肖像検出の拡大、使える時期はバラバラ
9月23日(14本)
- プロダクトMeta Connect 2026基調講演まとめ 100gの「Meta VR glasses」、カメラ無しのRay-Ban Meta Audio、Ray-Ban Meta Gen 3、Muse Charm
- 研究Claudeが新しい酵素システム「ART」を自力で発見 指示は「相棒の遺伝子を探せ」だけ、生のDNAを読んでCRISPRに似た繰り返しに気づいた
- 活用Claude Opus 5.5公式プロンプトガイドを全部読む effortの既定がhighからmediumへ、無人エージェントが止まる4つの型と公式の対策文、貼るだけのプロンプト6型
- 活用AIエージェントの作り方【2026年9月版】 ノーコード(Dify・Lindy)、SDK(Claude Agent SDK・OpenAI Agents SDK・Google ADK・LangGraph)、任せる型(OpenAI Agents API・Claude Managed Agents)の3段階と、最初の1本を動かすまでのコード、暴走と課金を止める4つの安全装置
- 研究Anthropicの「Model Hardware Standard(MHS)」 AIエージェントが顕微鏡・分注ロボット・ロボットアームを安全に動かすための共通規格を研究プレビュー。標準ドライバの「read/write」、自然言語のタグから機器の参照ファイルを自動生成、MCP・CLI・コードの3経路。HHMI Janeliaと開発、Genentechが実装、量子コンピュータのレーザー校正まで
- 業界Anthropicが科学者向けに1万席を開放 「Claude team plan for scientists」は標準席が1年無料、5倍枠のプレミアム席が月$15。AI for Scienceの助成は1プロジェクト最大5万ドル、生物・化学以外にも拡大。生物・化学はOpus級まで、Mythos級は米政府と協議中(→9月17日にLSVPで実現)
- 研究生成AIパスポートとは GUGAが年5回オンラインで行う「生成AIリスクを予防する」資格試験。受験料11,000円(学生5,500円)・60分60問・四肢択一・受験資格なし、合格は無期限で毎年の資格更新テスト(6,600円)は任意。G検定・PEP検定との違い
- 業界Googleが小売向けに「AIモードでの自社の露出率」を測る指標を一般提供 Merchant CenterのAI performance insights(米・豪・加・印・NZ)、YouTube広告の中で客が質問できるBusiness Agent(米ベータ)、UCPのカート移送、会話属性は「AIモードの推薦に50%取り込まれた」
- 検証AUTOMATIC1111の機能をGradioの「Workflow」で作り直した「Workflow1111」 73ノード・11パイプライン、GPUなしで動く(推論はInference ProvidersとSpaces)、出力は自動でREST APIとMCPツールに。ComfyUIとの違いをHugging Faceが整理
- プロダクトFirefoxのAIブラウジング「Smart Window」(ベータ)がMistralのモデルで動く フランスと北米から、英国・ドイツは年内。会話はMozillaのサーバーに既定で保存せず、Mistralはゼロデータ保持。ChatGPT Atlas・Perplexity Comet・Claude in Chromeに対する「オープンソース2社」の答え
- 研究研究室の装置にCodexをつないだら何が起きたか MITの量子ビット校正はGPT-5.6 Solが「信号が明瞭なら」自律で完走、弱い信号では研究者の助言が必要。抗菌分子探索の研究室はChatGPT・Codexを「分野の壁を越える道具」に。OpenAIの研究者事例2本(日本語版あり)
- 業界PFNの9月7〜16日 三菱重工が100億円出資で資本業務提携(社会インフラ・ナショナルセキュリティ)、屋内ロボット向け2B級モデル「PLaMo-SemGround」をGENIACで開発、国交省の発注・審査を支援するAIエージェントをデロイトと検証、Rustで書き直した「Rustuna」は最大1,000倍速
- プロダクトQwen Intelligenceとは Alibabaが「AIスマホを作るメーカー向け」に出したエージェント3点セット。スマホ操作は1,000回38元、画像は1枚0.08元から。重みは非公開、リンク先で見えた数字のズレ
- モデル覆面AI「Space Bunny」、トークナイザはMiniMax M3と17対17で一致 なのに天安門を答え、「OpenAI製」と名乗る
9月22日(24本)
- モデルClaude Opus 5.5が登場 入力4ドル・出力20ドルでOpus 5より2割安、公式ベンチ9項目のうち7項目で首位
- 研究数学者はもう要らない? OpenAI「100以上の未解決問題を解決」を起点に、数学者自身が「まだ早い」と言っていた記録、4か月の快進撃、他の仕事との違い、3つの反論を一次ソースで並べる
- モデルGPT-6 SolとLunaが公開 API価格は5.6世代から半額の入力2ドル/出力10ドル、公式表ではOpus 5のmaxを上回る
- 活用Adobe Fireflyの料金と使い方【2026年9月版】 無料で毎日生成できること、Standard 1,580円/Pro 3,180円/Pro Plus/Premiumの生成クレジット(2,000〜50,000)と「1年間無制限」の特別価格(10月12日まで)、使えるモデル(Nano Banana Pro・Veo 3.1・Kling 3.0)、商用利用の条件
- 業界AI事業者ガイドライン(第1.2版)とは 総務省・経産省が2026年3月31日に公表。誰が対象で(AI開発者・提供者・利用者)、10の「共通の指針」は何か、法的拘束力はあるのか、第1.2版で加わった「AIエージェント」「フィジカルAI」の定義と留意事項、活用の手引き・チャットボット・チェックリストの使い方
- 研究Anthropicが7月30日の「Claudeが実在システムに侵入」3件と英AISIのMythos 5の件を受けて何を変えたか 脱出を検知して止める分類器、外部評価者への必須手順、RL環境の1か月凍結で10%超を差し戻し、「報酬ハックで訓練したモデル」が模擬環境でサンドボックスを破る実験。METRに独立レビューを依頼
- 業界Anthropicが9月14〜15日に業種別の3本を同時に出した Claude for Small Business(43ワークフロー・27統合・インストール90万回超)、Salesforce in Claude(ベータ・37スキル・7,000人の営業が利用)、Claude for Financial Advisors(Schwab・BlackRock・Vanguardなどのコネクタ)
- 業界Anthropicの「Enterprise Frontier Safeguards(EFS)」 ゼロデータ保持と悪用検知を両立させるため、監視用のデータを顧客自身のクラウド(S3・Azure Blob・GCS)に置き、Anthropicの人間は見ない。今秋から段階的に提供、それまでFable 5/5.1はZDR。米大手銀行のCISOらと設計
- プロダクトClaude Docs・Claude Slidesとは 2026年9月16日に新登場した、Claudeと一緒に文書を書き、スライドを下書きし、そのまま発表・PowerPoint/PDFで書き出す機能。有料プランでベータ、Pro・Maxから数週間かけて展開、Team・Freeは「まもなく」、Enterpriseは30日前に通知。Cowork統合との関係と使い始め方
- 活用Codexの使い方【2026年9月版】 CLI・IDE拡張・デスクトップ・クラウドの4つの入口、インストールとログイン、プランごとの5時間あたりの目安(Astra/Sol/Terra/Luna)、AGENTS.md・権限・Goal Mode・Auto-review、知っておくべき不具合まで
- 活用Copilot+ PCとは 「40 TOPS以上のNPU」を積んだWindows 11 PCの区分。NPUとは何か、Snapdragon X/Core Ultra 200V/AMDのどれが該当するか、ネット無しで動く機能(リコール・スタジオエフェクト・ライブキャプション)とクラウドが要る機能の線引き、開発者向けはDirectMLからWindows MLへ
- 業界ディープフェイクとは EU AI法の定義(第3条60号)「実在の人・物・場所・出来事に似せ、本物だと誤認させるAI生成・加工の画像・音声・動画」。Arupから2,560万ドルを取った偽ビデオ会議、Article 50の表示義務(2026年8月2日施行)、SynthID・C2PAの透かしと来歴、YouTubeの開示ルール、日本の景表法の位置を1ページに
- 活用Felo(フェロー)の使い方と料金【2026年9月版】 無料でできること(AI検索使い放題・Pro検索1日5回・毎日200クレジット)、Pro 月2,099円/年払い1,750円で何が増えるか、クレジット単価の目安、載っているモデル(GPT-6 Astra・Claude Fable・Nano Banana Pro)
- 業界メール秘書AI「Fyxer」は1つのモデルに書かせない 30〜50の小さなモデルに分け、人が直した下書きをDPOで学習、A/Bテストで有意差が出た版だけ出す。下書きの53%がそのまま送信、90日後の継続率90%超、ARRは1年で100万→3,200万ドル
- 活用Genspark(ジェンスパーク)とは 使い方と料金【2026年9月版】。無料は1日100クレジット、Plus月$24.99(年払い$19.99)で10,000クレジット、Pro月$249.99で125,000クレジット、Team $30/席。9月18日に入った「無料利用枠」と、2027年1月に変わる「無制限」の条件
- 活用Google Antigravity(アンチグラビティ)とは 無料で使えるGoogleのAIエージェント開発環境。Antigravity 2.0(単体アプリ)・CLI(agy)・IDE拡張の3つの入口、無料/AI Pro/AI Ultraで変わる上限、日本で使えるか、Claude Codeなど他社ツールからのログインが規約違反になる理由
- 業界GPT-6 AstraをPerplexityとCognition(Devin)はどう使っているか OpenAIの事例2本(日本語版あり)。Perplexityは「本番システムを監視させ、確認の頻度を大きく減らした」、DevinはAstraで自分の成果物をテストして録画とレポートを返す
- 活用Manus(マナス)とは 使い方と料金【2026年9月版】。無料は毎日300クレジット(Manus 1.6 Liteのみ)、有料は月$20で4,000/$40で8,000/$200で40,000クレジット、Team $20/席〜。クラウドコンピューターは別料金($10〜$50/月)、Meta買収から8か月で独立運営に戻った経緯まで
- モデルQwen4とは──9月22日の雲栖大会で「Qwen4 Series Coming Soon」として Qwen4-Max/Flash & Plus/27B の3枠が出た。公式プレスリリースは「訓練中」「4.5・5は5〜10兆パラメータ」まで。「人間ゼロ介入で33回の自己改善」の主張と、Artificial Analysisで実測した現行Maxの位置(45・首位53)
- プロダクトSakana AIの9月10〜17日 Sakana ChatでFugu Maxが全ユーザーに+会話を覚える「メモリー」、Marlinに引用の裏取りができる「Interactive Reading」と編集可能なPowerPoint出力、SCSK・住友商事と包括提携(金融・製造の実案件、脆弱性診断〜修正のサービス、住商の連結900社・顧客10万社)
- 業界シャドーAI(Shadow AI)とは IT部門の承認なしに従業員がAIツールを使うこと。IBMの定義、漏洩コストが平均67万ドル上乗せされる根拠、AI関連の事故を起こした組織の97%に「AIのアクセス制御が無かった」、米従業員の59%・経営層の93%という調査、日本企業の方針策定率49.7%、そして「禁止」から「解禁+研修」へ動いたSamsungの例
- 研究シンギュラリティ(技術的特異点)とは 言葉を広めた1993年のヴィンジ論文は「2005〜2030年」と書き、2045年説はカーツワイルの2005年の著書が出どころ。「2045年問題」は何を指し、2025年にアルトマンが言った「穏やかな特異点」はどう違うのか、当サイトの原文検証記事でたどる
- プロダクトSiri AIとは iOS 27で登場するApple Intelligenceの会話型アシスタント。日本語は「年内に対応予定」、最初は英語のみ・ベータ・EUは初期段階で対象外、サーバ側の機能には1日の回数制限があり「今後、有料で拡大する予定」。対応機種、Siriアプリ、カメラのSiriモード、声のカスタマイズまでApple公式ページで整理
- 活用Suno(スノ)とは 使い方と料金【2026年9月版】。無料は1日50クレジットで商用不可・ダウンロードは生涯7回、Pro(年払い月$8)で2,500クレジット・月20曲、Premier(年払い月$24)で10,000クレジット・月60曲とSuno Studio。曲の権利は「誰のものか」を公式ヘルプで確認する
9月21日(13本)
- モデルSpaceXAIがGrok 4.7を公開 価格は4.6と同じ2ドル/6ドルのまま、公式表7項目で対Fable 5.1は3勝4敗・対GPT-5.6 Solは5勝2敗
- モデルXiaomiがMiMo-V2.6を公開 1.02兆パラメータのオープンウェイト、公式掲載のArtificial Analysis指数46、価格はV2.5据え置き
- 業界Anthropicが「Life Sciences Verification Program」を開始 審査を通った生命科学の組織に、Mythos 5.1・Opus 5・Sonnet 5を生物学向けに緩めた安全装置で提供。Standard Use(年次更新・チーム単位)とHigh-risk Use(半年更新・プロジェクト単位・生命科学の遮断を全解除)、リアルタイム遮断から30日保持の事後監視へ
- プロダクトOpenAI「ChatGPT for Financial Services」 モルガン・スタンレーとエバコアと設計した金融機関向けChatGPT Work、Daloopa・PitchBook・LSEG・Crunchbaseのデータを内蔵、GPT-6 AstraはOfficeQA Proで69.9%(Solは60.2%)
- プロダクトChatGPT Workに「Data」エージェント Redshift・BigQuery・Snowflake・Databricksなどに接続して質問だけで分析とダッシュボード、Tableau・Power BIにも書き出し。NTTデータは「非エンジニアが自分でダッシュボードを作れるようになった」
- 研究コンテキストウィンドウとは AIが一度に「見ていられる」量。主要モデルの現在値(API 100万トークン級)、ChatGPT・Geminiのプラン別上限、超えるとどうなるか、広ければいいわけではない理由
- 活用DeepSeekの使い方【2026年9月版】 無料アプリ・Web版のログイン方法と機能、API(deepseek-flash/deepseek-v4-pro)の始め方とピーク・オフピーク料金、Claude Code・Codexから使う方法、データが中国のサーバーに置かれる点まで
- 研究Googleが「300言語超・70億人・世界人口の86%」と数字を出した言語AIの現在地 Gemini 3.5 Live Translateは70言語・2,000超の言語ペア、目標は「話者数上位1,000言語」、端末内翻訳TranslateGemmaは55言語、フィーチャーフォンでもGemini
- 研究AIエージェントは同じ課題を5回やって全部成功するか IBM Researchが「Pass^k」で測ると、平均77.4%のエージェントの全回成功は53.0%。温度0でも起きる24.4ポイントの「一貫性ギャップ」を、自分の記録から作ったガイドラインで半減
- 業界Manusが独立運営を再開 2025年12月29日のMeta買収から8か月で分離。「特定の法域の規制対応」で一部ユーザーの買収後データを8月23〜24日に削除、バックアップ→復元(期限なし)、データの保存先は米国とシンガポール、創業チームが引き続き経営
- 業界Mistral AIが30億ユーロを調達、評価額210億ユーロ超 欧州テック史上最大の株式調達をサムスン電子が主導、「主権を保てるオープンウェイトAI」を旗印に20か国・125社超へ
- 業界OpenAI、55歳以上のChatGPT利用が米国で1年で6%→約10%に、「怪しいメールやサイトの判定」は週に数千万回 AARP系のOATSと高齢者向け無料ワークショップを米10都市・1,000人に
- 業界OpenAIが米GSAと27か月の新契約 連邦・州・地方・部族政府にChatGPT Enterpriseのライセンス料$0(通常$15/人/月)と利用料50%オフ、対象は公務員約2,300万人。政府の防御側は「Daybreak Blue」を半額で、Redは通常価格で申請可
9月20日(12本)
- モデルAlibaba、Qwen-Image-2.1の重みを公開 絵を描く部分は7B、自社ベンチで29モデル中7位(Nano Banana 2.0より上)、透明PNGと参照10枚の編集を1モデルで。ライセンスは研究限定
- 検証AnthropicがAccentureと「埋め込み型の独立評価」で提携 評価者が社員と同等のアクセスで社内に入り、学習中のモデルを見て、安全の約束が守られているかを検証し、事故を報告する。Accenture傘下のFacultyが主導し、評価・レッドチーム・アラインメント評価・安全装置の試験。両社が5年で各10億ドル以上。非独占でMETR等とも協議
- 検証運用資産約380億ドルのBalyasny、Claude Fable 5を「数千の実在する金融タスク」で評価してから採用 正答89.4%(前の本番モデル86.1%)、一度も解けなかった経済学の問題群を初めて完走し「評価の不具合」を疑って再検証。M&Aアービトラージの初期分析は3〜5日→1日未満、中銀分析は2日→30分。自社基盤BAMAgentで数千のエージェントが24時間稼働
- プロダクトClaude Codeの「プロジェクト」が再設計 目標を渡すと、コーディネーターがスレッド(=クラウドのClaude Codeセッション)に仕事を割り振り、並列でPRを開いて結果を組み立てる。9月17日からPro・Maxの一部でベータ、既存プロジェクトはそのまま
- 活用Claudeの使い方【2026年9月版】 無料でできること、Pro($20)とMax($100/$200)の違い、モデル(Fable 5.1・Opus 5・Sonnet 5・Haiku)の選び方、Claude Code・Cowork・Design・Chrome・Managed Agentsの入口を当サイトの記事30本でつなぐ
- モデルClaude Mythosとは Fable 5.1と「同じモデルで安全装置が違う」招待制の最上位版。4月のPreviewから5.1までの経緯、誰が使えるか、価格、個人が触れる経路は無い
- 研究Googleの「AI & Economy ATLAS」9月版 米国は仕事のAI利用の30%がコンピュータ・数学職、インドは19%がクリエイティブ職、日本は手作業向けの利用が4%。科学者の半数近くが毎日AIを使い、週7時間弱を節約しても「仮説の積み残し」が増える
- 研究米国の13〜17歳の94%が過去1年にAIを使い、74%は週1回以上「勉強の相棒」に Googleが公開した10代1,000人超の調査、55%は他の情報源で裏を取り、67%はネットの習慣で親を最も信頼
- モデルGPT-5.6 Solとは ChatGPTの「Instant」で動いている標準モデル。Terra・Lunaとの違い、GPT-6 Astraとの関係、API価格($4/$20は11月21日まで)、Sol Pro・Ultrafastまで
- プロダクトOpenAI「Agents API」パブリックベータ Codexを動かしているハーネスとサンドボックスをAPI1回で借りる。文脈の自動圧縮・ツール検索・既定6並列のサブエージェント、環境はOpenAIホスト/自社/提携9社から、追加料金はコンテナ代(1GB 20分$0.03)
- プロダクトOpenAI、全二重の音声モデル「GPT-Live-1」をAPIで提供 1分$0.05(秒単位課金)の会話層に、推論とツールはGPT-6 Astraなど後ろのモデルへ委任。Full Duplex BenchでGPT-Realtime-2.1より30ポイント上、電話(SIP)対応、声は12種類
- 研究OpenAIが「週に10億人超」の裏側のストレージ基盤Habitatを解説 毎秒7,000万リクエスト・500PB・3年連続で年10倍超の成長。Pythonで粘ってから、エンジニア2人+Codex+GPT-5.5でRustに書き直し、CPU効率6倍・メモリ15倍
9月19日(14本)
- プロダクトClaude CodeがAGENTS.mdを読むようになった 2.1.277から、CLAUDE.mdが無いフォルダではAGENTS.mdを使う。反応6,653件・13ヶ月の要望に対応、切り替えは/config
- 研究Google DeepMind「AlphaGenome Atlas」 ヒトゲノムで起こりうる一文字変異90億通りの分子効果を予測して公開、1ペタバイトでAlphaFoldデータベースの30倍超、変異1つを1つの数字にするAVIスコア
- 活用ChatGPTの使い方【2026年9月版】 無料でできること、Plus・Proの選び方、Chat/Work/Codexの3つの顔、モデルの選び方(Instant・Thinking・Pro)、音声・画像・メモリ・プラグインまで当サイトの記事25本を1ページに
- プロダクトChatGPT Work・Codexの管理者向け分析をOpenAIが解説 AI利用を「何の仕事か」で分類し、Codexが関わったマージ済みコードの割合を追い、ROIを試算する5つの問い(例示は245%)
- プロダクトClaude Coworkとチャットが「1つのClaude」に統合 Claude Docs・Claude Slidesが新登場(有料プランでベータ)、Designは会話の中で動く。Pro・Maxから数週間かけて展開、TeamとFreeは後日、Enterpriseは30日前に通知
- モデルClaude Fable 5.1とは 公開、プラン別の使える条件、料金、公式プロンプトガイド、370年暗号の検算、GPT-6 Astraとの比較まで、当サイトの記事を1ページに(随時更新)
- 活用Geminiアプリの使い方【2026年9月版】 無料でできること、モデル(Flash-Lite・Flash・Pro)と思考レベルの選び方、5時間ごとの使用量上限、プラン別のコンテキスト(3.2万・12.8万・100万トークン)、Live・Deep Research・Canvas・Gem・Sparkの入口
- 活用Gemini CLIの使い方【2026年9月】 インストール3通り、ログイン3方式と1日の上限(Googleアカウントで1,000回・AI Proで1,500回・APIキー無料枠は250回)、モデルの選び方、スクリプトからの呼び方
- プロダクトGemini Notebook(旧NotebookLM)に勉強向けの新機能 ノートと声で会話・講義の録音・クイズと暗記カード・60秒の動画要約、学生はGoogle AI Plusが1年無料(米国はProが1年無料)
- 活用Google AI Plus・Pro・Ultraの違い【2026年9月・日本の料金】 月725円・2,900円・14,500円/32,000円で何が変わるか、Geminiの使用量上限(2倍・4倍・Proの5倍/20倍)、ストレージ、YouTube Premium、学生の1年無料
- モデルGPT-5.5、10月14日にChatGPT・ChatGPT Work・Codexの全プランから廃止 APIは対象外。Codexの設定は`gpt-5.5`→`gpt-5.6-sol`へ。GPT-5.4/5.4 miniは8月31日にCodexから退役済み
- モデルGPT-6 Astraとは 開発停止から公開、プラン別の使い方、料金、公式ガイド、独立指標、Fable 5.1との比較まで、当サイトの記事12本を1ページに(随時更新)
- 検証OpenAI「Astra for Law」 GPT-6 Astraに法務用の検索索引(米国の判例・法令2億3,000万URL超)と法的分析の指示を組み合わせた法律事務所向けの土台。Vals AIのLegal Research Benchで正答54.0%(Web検索のみは38.7%)。まずTrusted AccessでChatGPTとCodexに、APIは近日。ZDR、26プラグイン
- 研究OpenAIの経済調査「Work at the Frontier」第2弾 自分の職種外の仕事にAIを使う人は、翌月も同じ仕事に戻る(23.6%対8.4%)。150万メッセージで見えた「肩書きが変わる前に仕事が広がる」
9月18日(11本)
- 研究OpenAI、モデルの「不整合」を公開報告する枠組みを発表 「業界は最高速度で拡大を続けられるほどアライメントを解いていない」、初回6件は漏れたAPIキーの無断使用・数字の捏造・要約に埋めた「隠せ」の指示
- 業界2026年8月のAIニュース46本まとめ 中国勢の激安高性能モデルが月末に集中、米2社は主力モデルなし、OpenAIがCursorを切った月【月刊AIニュース】
- 業界OpenAIは「自社AIの問題行動6件」を、Anthropicは「AIが研究の26%を主導」の数字を公開 ライバル2社が同じ方向に出した文書を一次ソースで読む
- モデルAlibaba、Qwen3.8-Omni-Flashを発表 音声1時間の入力が1セント未満、会議の文字起こしはDER 88.1→3.4、Gemini 3.8 Flashに音声で上・動画推論で下、重みは非公開
- 業界Z.aiの公式コーディングアプリZCodeが、利用者のリポジトリをGit全履歴ごと無断で送信していた 設定では止まらず、暗号を開ける鍵はサーバーだけ。Z.aiは認めて謝罪したが、説明は証拠と合わない
- プロダクトChatGPT広告の次の形は「スポンサード・エージェント」 広告をクリックすると企業の代理AIと会話、HubSpot・Shopifyに広告管理を組み込み、Shopifyアプリは9月23日に国際展開
- プロダクトChatGPT、9月の新機能・変更点まとめ(9月1日〜14日) GPT-6 Astra、Images 2.5、Voiceの上限改定(Pro $200は無制限)、Deep ResearchがWorkとCodexに、カスタムGPT廃止の予告、自動で考えるモードの廃止
- プロダクトClaude APIに「任意のタイミングで会話を圧縮する」オンデマンド圧縮(ベータ) 署名付きの要約ブロックを返し、直近の会話は原文のまま残せる。しきい値型との違い、課金の見方、失敗時の挙動
- 活用Claude Fable 5.1の使い方 どのプランで使えて、上限に当たるとどうなり、遮断されたら何が起きるか(Pro・Max・Claude Code・API)
- モデルGemini 3.8 Liveと3.8 Live Extended Thinking公開 話しながら裏で考えて道具を動かす音声モデル、Artificial Analysisの音声対話指数で首位、音声は1分あたり入力$0.005・出力$0.018
- モデルGPT-6 Astra vs Claude Fable 5.1 比較 同じ$10/$50で何が違うか。公式ベンチの突合・独立指標・プラン別に使える条件・キャッシュ単価の4倍差を1枚に
9月17日(11本)
- プロダクトOpenAI、カスタムGPTを廃止へ 廃止予定日は12月11日、Enterpriseの新規作成終了は10月26日に延期、移行先は「プラグイン」
- 研究Anthropicが公開した「2030年の経済モデル」を読む GDP+1.6%から+32.4%、認知職の失業率17.9%、賃金の符号を決めるのはAIの賢さではなく資本の増え方だった
- プロダクトClaude Codeの週間上限、9月14日から恒久+25%に +50%キャンペーンは9月13日で終了、Anthropic公式が「今日と比べて17%減」と明記
- 活用Claude Fable 5.1公式プロンプトガイド全17項目を読む effortは5段階で既定はhigh、「箇条書きを使うな」「見つけたことは最後まで取っておけ」の旧指示が今は逆効果、公式が配る貼るだけの文面11本
- 業界Google DeepMindがAGIに向けた研究所「DeepMind Institute」を設立 公式ページに「残るギャップは間もなく閉じる」、公開された5本の文章を原文で読む
- 研究370年間誰も解けなかった暗号をFable 5.1が44分で解いた 「解けていない」という反証が出たので、1834年版の本で自分たちも検算した
- 研究OpenAI、「自動研究インターンに到達」と宣言 研究者1人にエージェント3.1労働日、中央値の研究者が1日600ドル、成功の過半数には人の介入。社内実測の全数字と、同じ日に主席科学者が書いた「減速」
- 業界今週のAIニュース(2026年9月第1週) Fable 5.1・GPT-6 Astra・Gemini 3.8 Flash・Muse Spark 1.3、フロンティア4社が同じ週に新モデルを出した7本
- 業界今週のAIニュース(2026年9月第2週) OpenAI「研究インターン到達」とナビエ・ストークス「解決」、数学者25人の反発、アモディ「減速」にマスク・アルトマンが同意、Proは新規停止
- 活用GPT-6 Astraの使い方 どのプランで、どこで使えて、週に何通まで送れるか(ChatGPT・Work・Codex・API)
- モデル覆面AI(ステルスモデル)とは Ox Alpha・Omen Alpha・Union Alphaの一覧と正体、トークナイザで見分ける方法【2026年9月】
9月16日(2本)
9月15日(1本)
9月14日(1本)
9月12日(4本)
9月11日(2本)
9月10日(1本)
9月9日(1本)
9月8日(3本)
9月7日(88本)
- 研究『robots.txtより厳格な』新ポリシーファイルAGENTS.TXTのIETFドラフト、参考文献が架空だった
- 研究Anthropicの「責任あるスケーリングポリシー」とは v1.0からv3.4まで、9回の改訂を公式ページで追う
- プロダクトApple Intelligenceの日本語版でまだ使えない機能一覧 Apple公式サポートページを機能別に読み解いた
- 研究「アーキテクチャがすべてを証明した」 ARC Prize創設者が2024年12月、スケーリング則の限界を言い切った理由
- 研究「AutoSaddler」とは何か harnessの改善を「浅い内省」でなく「深いデバッグ」でやると9〜10ポイント伸びる
- 研究『コンテナランタイムは汎用ワークロード向けに作られた、AI推論は汎用ワークロードではない』 Basetenの専門チームを求人票から読む
- 研究1タスク0.07円でARC-AGI-1を解く150Mモデル BDH-CQは「言葉にしない推論」で費用対精度の記録を更新した
- 研究イラストレーターは「低リスク」判定だったのに減っていた 米国BLS統計とNRIリストを突き合わせる
- モデルByteDanceが「見ながら聞きながら話す」全二重AIを実運用投入 音声だけのGPT系リアルタイムAIとの違いはどこにあるか
- プロダクトClaude Codeに「/claude-api cost-optimize」が追加 既存プロジェクトのAPI支出を測って1つずつ削るコマンド
- 検証Claude Codeがアイドルになったら1回だけ通知してくれるように notify_when_idleの仕組み
- 検証Claude Codeが自分でフィードバックの下書きを作るようになった SendFeedbackツールの仕組みとオフ設定
- プロダクトClaude ConsoleのWorkbenchが8月17日に終了 Playgroundへの移行で消えたもの・残ったもの
- プロダクトエージェントの記憶を「夢見て」整理し直す Claude Managed Agentsの新機能Dreamsを読む
- 研究「Co-RL」とは何か 正解データなしで、複数のAIが互いを採点し合いながら賢くなる仕組み
- 検証Appshotsとは何か ChatGPTデスクトップアプリでMacの「今見ている画面」をそのまま渡す機能
- 研究Activation Steeringの『効果』は選択肢の並べ方のせいだった? 評価そのものを疑う『Cross-Encoding Steering Evaluation』
- 研究「白領の大虐殺」発言を原文で読む Anthropic CEOがAxiosに語った根拠なき50%という数字
- 研究「DarwinX」とは何か モデルは固定したまま、harnessを自然選択で進化させる手法
- 検証DeepL Writeは日本語で使えるのか 「英語・ドイツ語だけ」はもう古い
- プロダクトDeepSeekが「値上げを予告」してからピーク課金制に 公式価格表で確認できる現行料金と、確認できなかった値上げ幅
- 検証「本物のユーザーがこのタスクを完了できるか」をAIエージェントに判定させるモバイルテストツール Deltix
- 研究拡散モデルの強化学習「DiffusionOPSD」とは何か GPU時間を最大63%削って画質を上げる自己蒸留の作法
- 研究バグ再現テストを書かせると目標がズレる「Goal Drift」 DPIAgentが分業で対処した81.76%という数字
- 研究「DreamX-Phi」とは何か ロボットの腕が「映像としては自然だが違う腕を動かしている」を防ぐ世界モデル
- 研究DSPy 3.3.0の実験機能「Flex」「ReActV2」 プロンプトでなくプログラムの構造そのものをGEPAに最適化させる
- 業界「自分のharnessを持つ」とは何か HNで576ポイントを集めた、クライミングの比喩で読む agent harness 入門
- 研究「Embodied-Navigator(TAMP-Nav)」とは何か ロボットの行き先指示を「座標」でなく「画面上の点」で与える発想
- 研究AIの性能向上は本当に鈍化しているか Epoch AIの実測データで確認する
- 研究AI駆動開発は技術的負債を「増幅」する 形式手法の研究者2名が書いた行動提起論文を読む
- 研究パイプラインは『動いている』のに、証拠は壊れている 多段LLMパイプラインの『Evidence-State Reliability』
- 検証Mac Studio 1台か、Mac mini 3台の分散推論か exoのTB5 RDMAクラスタ機能を公式READMEで確認した
- プロダクトFigma Config 2026のベータ機能まとめ 3D変換とFigJam・Slidesエージェント
- 検証Figma Motionとは タイムラインがキャンバスに来て、Lottie書き出しにも対応した新機能
- 研究Wikipediaは言語ごとに『違う話』をしている 20言語・150概念で測る『Framing Distance』
- 研究「FreeToken」とは何か ワークステーションGPU1枚で753BのMoEモデルを動かす、帯域適応型の推論システム
- 検証コーディングエージェントの「なぜ高くつくのか」を見えるようにする Frugal Tokens
- 研究GDPvalは本当に「線形に伸びている」のか 2026年5月から8月まで、モデル発表8件分のスコアで検証した
- プロダクトGeminiアプリが月間10億ユーザー突破 Google史上最速の成長、利用者の63%が音声で直接話しかける
- 活用GGUFとMLX、Macで動かすならどっちを選ぶべきか 「ファイル形式」と「フレームワーク」を混同しないための整理
- 研究「GigaBrain-0.7」とは何か 37,000時間の異種ロボットデータで鍛えた「三系統」基盤モデル
- 研究「AIで3億人分の仕事」の原文を読む ゴールドマン・サックスの2023年レポートは何を計算したか
- 業界MarvellがGoogleに最大121.8億ドル相当のワラント発行 「TPU本体」ではなく周辺シリコンだった契約をSEC 8-Kで確認する
- 研究AIの事実誤りは「知らない」のではなく「思い出せない」 Google Researchのrecall仮説を読む
- 研究AIが天気予報を変える Google DeepMindのWeatherNext 2とは
- プロダクトGrok Imagineの「エージェントモード」とは 1本の動画を単発プロンプトでなく「プロジェクト」として作る
- 研究ハーネスエンジニアリングとは何か 「エージェント=モデル+ハーネス」という考え方
- 検証止まらないAIエージェント「Headlong」 LaudeとMITが1万行未満のBashで作った
- 研究言葉は同じでも『言い方』でAIアシスタントの行動は変わるべきか 480シナリオで測る『Hear2Act』
- 業界Higgsfieldが評価額54億ドルでシリーズB調達 8カ月前の4倍、年換算売上7億ドル・Fortune 500の390社と取引と自社発表
- 研究「放射線科医はAIに置き換わる」から8年 ヒントンの予測と、放射線科医不足という現実
- 研究エージェントの記憶を「みんなに効く原則」と「あなただけの癖」に分ける HiPSという枠組み
- 研究Humanity's Last Exam、Nature誌に掲載 2,500問の「人類最後の試験」を作った理由と、まだ超えられていない壁
- プロダクトGemini APIのImagen 4系が2026年8月17日に停止済み 公式移行先はNano Banana 2系「gemini-3.1-flash-image」
- 研究「みどりの窓口」削減計画は、いったん止まっている JR東日本、440駅から140駅への計画を凍結するまで
- 研究AIで書いた広告文・レビュー、景品表示法のステマ規制に引っかかるライン 「AI専用ルール」は存在しない
- 業界『AI生成』の表示、法律で義務付けられているのはどこまでか
- 研究「AIが700人分の仕事をした」Klarnaが、1年後に人間を再び雇い始めた理由
- 研究「Large Discovery Model(LDM)」とは何か 「たぶんこれが良さそう」にベイズ統計で不確実性の物差しを足す設計
- モデルRedNoteのdots3-noteをllama.cppがサポート 280Bのマルチモーダル、動くのは16B、Apache 2.0
- 検証MCP Inspectorのv2が標準に Web・CLI・TUIの3クライアントを1パッケージに統合、Node 22.19以上が必須に
- モデル5分のフル楽曲を生成するMiniMax Music 3、重みが公開 8B+0.6Bの2段構えLLMとFlow Matchingで歌詞から曲を作る
- 活用非エンジニアがAIエージェントに個人開発を任せてみた実測記録
- 研究銀行窓口係は「代替可能性が高い」側だった 野村総研リストと米国10年分の実測
- 業界NVIDIAがApollo・BlackRock・KKRらと5,000億ドル超を動員する「コンピュート金融プラットフォーム」 GPUは投資適格資産になるのか
- 研究軍事戦略の意思決定ループでツール利用エージェントの「状態-行動競合」を分離する OODA-Tool
- 検証「魔法の機械も魔法の運用者もいない」 テストをリポジトリの中に置いたHaskell製LeetCodeランナー Openleetcode
- プロダクトPixVerse Growth Studioとは 製品URLから広告動画バッチを作る新機能
- 研究AIは詩の『行間』を読めるか 現代中国詩の理解度を測る『Poetic Logic』というベンチマーク
- 研究拡散言語モデルは『やり直させる』と自分の答えの信頼度が分かる PDCという検証手法
- 研究ARC-AGI-3のBest@1を30%から95.5%に押し上げたPrime Agent 「コンテキストを変数として扱う」RLMという考え方
- モデルQwen3.8-27Bが公開 1枚のGPUに収まる密モデルで動画も読める、ダウンロード330万回・likes 1.3万で中国勢8月最多
- 研究マルチエージェントの引き継ぎ方式を155トークンのルーターに選ばせる Routed Graph Handoff
- 研究NCCLに頼らないallreduce SGLangがBlackwell世代のFlashInfer MNNVLワークスペースを使い回す最適化
- 研究SGLangが「allgather+scatter」を1回のall-to-allに統合 DeepSeek-V4-Proのデコード時間が320μsから169μsに
- 検証手元のメモリを99.998%まで使い切る量子化ツール「shoehorn」 プリセットGGUFをやめる発想
- 研究「SkillZip」とは何か 10万件のスキルライブラリでも壊れない、エージェント向け「圧縮」の作法
- 研究倉庫番の「最短手順」をブラウザだけで証明する ネイティブC++探索をJSに移植したSokoban Solver
- 活用個人開発でAIエージェント的な自動化を作った時にやったこと
- 活用個人開発でAIのコスパを実測した 公開中のツールに何がかかったか
- 活用個人開発でAIとゲームを作って詰まったところ 公開までに直した3つ
- 活用個人開発でAIコーディングツールを選ぶ判断基準 「おすすめ」より先に見る3つの軸
- 研究「SPADE」とは何か 1つのAIが「問題を作る役」と「解く役」を両方演じて自分を鍛える仕組み
- 研究テストを書く前に「契約」を書かせる Googleのバグ実データで検証されたSpec-Driven Test Generation
- 研究GEPAを飲み込んだ最適化基盤「synth-optimizers」 ホスト専用の探索アルゴリズム「GELO」を覗く
- 検証ターミナルの中にVS Codeを持ち込む「terminal-code(tode)」
- 検証Vidu「Reference to Video」は動きだけを借りる機能ではなかった 公式FAQで確認した実際の仕組み
- 研究ザッカーバーグ「2025年にミッドレベルエンジニア相当のAI」 発言から1年半後、その言葉はどこにあるか
9月6日(86本)
- 活用GPT-6 Astra公式ガイド「Using GPT-6 Astra」全体解説 癖5つと対処法11本、公式が「強く推奨」したのはプロンプトを足すことではない
- 研究「Agent Memory Distillation」とは何か 学習不要で、4Bの小型モデルにGPT-5-miniの「成功パターン」を渡す
- 検証AIエージェントに`rm -rf ~`を打たれても平気にする macOS向けサンドボックスAgent Safehouseの仕組み
- 研究URLに『これはAIエージェントです』の意味を持たせる agent://プロトコルのIETFドラフトを読む
- 研究LLMアプリの「落ちたら最初から」を無くす設計案 AgentRが提案するステートフル・アーキテクチャ
- 検証Claude発の「Skills」がベンダー中立の標準規格になっていた agentskills.ioを実際に開いて確認する
- 活用AIは無料版で足りるか、有料に上げるべきか 実際に使い分けてきて分かった判断の分かれ目
- 研究「Apodex Discovery」とは何か 561業界を調査して選んだ423件の「本物の難題」でAIの発見能力を測る枠組み
- 研究AIは『見られていない』と判断すると計画的に嘘をつくのか Apollo Researchの検証
- 研究「AGIはまだない。これがその証拠だ」 ARC Prize財団が2026年4月に公式に断言した理由
- 研究「ASI-Bench」とは何か 手法のヒントを取り上げるほどAIのスコアが50.91から26.62まで落ちるベンチマーク
- 研究「AutoDesign」とは何か 論文を学会ポスターに自動変換、253回のツール呼び出しを40分・3ドル未満でやり切る
- 研究校正者は10年で半減していた 米国BLS統計を数え直す、震源不明のまま
- 研究IETFで『AIエージェント間通信』の提案が乱立し過ぎて、交通整理のためのBOFが承認された CATALISTを読む
- プロダクトChatGPT、8月の新機能まとめ レストラン予約からLinuxアプリまで
- プロダクトChatGPT for Teens提供開始 公開から4年越しの10代専用モードとModel Spec改訂
- 検証Claude Codeのコスト表示に「US限定推論の1.1倍」が反映されるようになった /costで何が変わったか
- プロダクトClaude Codeが会話を打ち切れるようになった EndConversationツールの仕組みと適用範囲
- 活用Claude Codeは無料で試せるか 7日間無料の「ゲストパス(Guest Pass)」と、課金なしで動かせる範囲を確認した
- 活用Claude Codeの/goalコマンド 「続けて」を打ち続ける代わりに完了条件を渡す
- 検証Claude Codeの自己ホストランナー、SIGTERM後も猶予時間を持てるように defer-shutdown-max-minの仕組み
- プロダクト推論が始まる前にプロンプトを検問する Claude Enterprise向けInference hooksの仕組み
- 検証Codex Desktopの『生きてるか確認』が15.5時間でPro週次枠の90%を溶かした サブエージェント幽霊化バグを読む
- 活用CodexのGoal Modeが実験段階を終えた 公式ドキュメントで確認できる「/goal」の使い方
- 研究薬の飲み忘れに「また届ける」だけでは足りない ComBodied Agentsが提案する「Personal World Models」という考え方
- 研究AIの『忘れさせ方』にも文脈が要る 悪用も正当利用もできる知識を測る『ConceptGuard』ベンチマーク
- 研究『このAI処理はクラウドかブラウザか』をestimateQoS()で自動判定する W3CのDAOP提案を読む
- 研究Skillsが効くのは「知識を足すから」ではなく「手順の道しるべになるから」 8,135件のトライアルが示した実態
- プロダクトAIブラウザ「Dia」のWindows版はいつ来るのか 「この秋」以外の詳細はまだ何もない
- 検証コーディングエージェントのコンテナからCVEを99%消す Echo×NanoClawの舞台裏を読む
- 研究ターミナル作業の訓練データ、生成の仕方が悪いと『解けない問題』になる FACETが守る『指示・環境・正解・検証器』の一貫性
- 検証Figma Buzzとは?バナーを大量生成する新ベータ機能を確認した
- 検証Figma Weaveとは?画像・動画・音声をつなぐ新AIワークフローを確認した
- 研究DSPyの裏側で動く最適化エンジン「GEPA」 強化学習より少ない試行でプロンプトを進化させる仕組みを読む
- 検証自分のブラウザがどこまで『特定』されているかをその場で見せるGlassBox 計測はローカル完結、例外はIP情報だけ
- 検証Google AI Studioの無料利用、入力内容はAI開発に使われる Gemini API利用規約を確認する
- プロダクトGoogle純正の『朝刊AI』Dreambeansとは?日本ではまだ使えない新実験を確認した
- 研究暗号化されたままAI推論する Googleのオープンソースコンパイラ「HEIR」を公式ブログから読む
- プロダクト手話をテキストに変えるAI「SL2T」 Google DeepMindがPixel 11に載せた仕組み
- モデルgrok-voice-latestが裏側でThink Fast 2.0に切り替わった日 8月5日、気づかれずに起きたルーティング変更
- プロダクトHawk-Eyeは今どこまでAI化したか Sony傘下のスポーツ判定技術を公式情報で確認する
- 検証プロンプトを「使い捨てる」のをやめる 個人開発者Huzzahが提案する疑似コードエディタ
- 業界Intelが約230億ドルの公募増資 SEC 8-K原文で確定させる実額と、報道で揺れた数字
- 研究カーツワイルの「2029年」まであと2年半 「収穫加速の法則」原論文を読み、2045年説の出どころを確認する
- 検証作曲だけじゃない AIマスタリングLANDRは何を自動化しているのか
- 研究「LLMRouter」とは何か 「どのAIに投げるか」を選ぶ仕組みを、16種類以上まとめて比較できる基盤
- モデルLightricksがLTX-2.5をオープンウェイト公開 HDR ACES対応の動画生成モデルとLTX Studioは別物
- プロダクト「AI動画の税金」にLumaが挑む 承認するまでレンダリングしない「Luma Scenes」の設計
- 研究AGI・超知能の「賭け」、いま何%か 予測市場7つの現在地を公開APIで確認する
- 検証依存ゼロ・単一Rustバイナリで動くMCPサーバー mcp-stama p50レイテンシ327マイクロ秒の中身
- 研究「Mechanist」とは何か AIの中身をAI自身に解剖させたら「安全そうな学習データ」経由の危険な特性伝播が見つかった
- モデルMetaが「Muse Glimmer」を公開 Muse Sparkを30Bに蒸留、Apache 2.0でローカル実行専用
- 研究「2030年にIT人材79万人不足」の出典を探したら、経産省の資料には見当たらなかった
- 研究有料道路の料金所は、係員がいなくなる方向に進んでいる NEXCO発表を年ごとに数える
- 研究手話をAIが生成する時代へ NHKの「手話CG」研究を公式サイトで確認した
- 活用「非エンジニアが開発者になるのは幻想」論に、実際に手を動かして答える
- 研究測量士・通関士は国家資格職なのに「代替可能性が高い」側だった 野村総研2015年リストの実名
- 業界NVIDIAがOpenAIの家賃を最大1,050億ドル肩代わり SEC 8-K原文で読む保証契約の中身
- 業界800万ドルで発足→3日で1,000万ドルに LinuxディストロOmarchyの新財団Omacomに、OpenClaw作者が加わった理由
- 業界OpenAI DevDay Exchangeは世界8都市へ、東京は10月20日 申込ページの応募締切表記は消え、審査中も受付継続(9月25日確認)
- プロダクトOpenAIが「4o」を外した文字起こしモデルを投入 GPT Transcribe・GPT Live Transcribeの料金と対応範囲
- 研究AIエージェントへの攻撃成功率85% OpenARTは『環境そのものを変え続ける』ことで安全性テストの死角を突く
- 研究RAGのボトルネックは生成側でなく検索側にある時がある 証拠を前倒しする「PACE」という数学的な保証つき手法
- 業界日本発「PEP検定」とは 開始1年でシラバスに「AIエージェント」「コンテキストエンジニアリング」を追加した資格の中身
- 検証Claude Code・Codex・Cursorを並列で走らせる自己ホスト型AI IDE「Proliferate」
- 研究プロンプトエンジニアリングはオワコンなのか 「もう死んだ」論と、いまも公式ガイドを更新し続ける2社
- モデルQwen3.8-Maxの重みは「Apache 2.0ではない」 売上5,000万ドル超のAIサービス事業者だけに求められる別途契約を条文で読む
- プロダクトRunwayがGWM-1で目指す次 「動画生成」から「世界そのものをシミュレートする」への転換
- 研究モデルの起動待ち時間を2.38倍短縮 SGLangが「CUDAグラフのキャプチャ中にチェックポイントを読み込む」設計に変えた
- 研究ローカルのコーディングLLMが存在しないパッケージ名を作る率は最大73% Slopsquatting対策論文を読む
- 活用個人開発でAI生成コード・画像の著作権をどう考えるか
- 研究論文執筆を「13個のスキル」に分解する Spark-to-Paperは1本8.1ドル・3.2時間で書き上げ、捏造検出率を14%から92%に上げた
- 検証アイデア1行をPDFの論文に変えるspark-to-paper-skills Claude Codeの13個のスキルだけで、数値を捏造せず図まで組む仕組み
- 研究モデルを変えずにTerminal-Bench 2.1で95.3% 「ハーネス側だけ」を作り込んだStateMの実験費用は15ドル
- 研究暗号化された「思考」は使い回せる 推論トレースを盗み出す手口を報告した論文を読む
- プロダクトSunoが9月3日からダウンロード数に上限 旧モデル全廃も予告、公式ブログ4本で確認する変更点
- 研究SWE-bench Verifiedの未解決問題、6割はテスト自体に欠陥があった 7言語・170件のリファクタリングで最高スコアは41.2%
- モデルTencentが「画面を見て操作する」オープンウェイトAIエージェントを公開 OSWorld-Verifiedで77.0点、手元で動かせるcomputer useの選択肢
- 研究AIが『問題を解きながら賢くなる』 テスト時学習(Test-Time Training)とは
- 研究GPT-4.5は73%の確率で「人間」と判定された チューリングテスト論文を原文で読み、AGIの証拠になるか考える
- 研究正解ラベルなしで自分を鍛え直す U-OPSDはモデルの多数決だけを教師にして数学ベンチマークを8.5〜10.7%押し上げた
- 研究AIが2000年前の炭化した巻物を読む Vesuvius Challengeは何をどこまで解読したか
- 研究「VibeWorlding」とは何か 「なんとなくこんな世界」を3Dに組み立てさせたら、GPT-5.5でも成功率6割未満だった
- 研究vLLMのDecode Context Parallelで、Kimi-K3のKVキャッシュ容量がGPU1台あたり10倍に
- 研究vLLMに投機的デコードの新手法「DFlash2」 1H200・GSM8Kで自己回帰の3.51倍のスループット
- プロダクトコピーを持たない「最初の公開AI」 wildstaticの実験Staticに接続すると、お金が尽きていて誰とも話せなかった
9月5日(80本)
- 研究A2Aプロトコルは結局使われているのか 1年後の公式発表を読む
- 研究AIエージェント同士の『言い分の食い違い』をJSON+PDFの裁定書で解決する Agentic Dispute Protocol(ADP)を読む
- 研究「AGIはいつ来るか」を年表で並べる 1993年のヴィンジから2027年のアッシェンブレナーまで、誰が何と言ったか
- 活用『無料AIセミナー』は受けていいか 見分ける3つの視点
- 活用非エンジニアがAI生成コードを本番に出す前に見る判断基準 検証ゲートで欠陥率が81%から0%になった実測をもとに
- 研究「AI4AI at Test-Time」とは何か 強いモデルが弱いモデルのためにharnessを設計する、学習不要の能力転移
- 研究『AI学習していいか』を2つの単語だけで表す IETF AI Preferences Vocabularyドラフトを読む
- 業界Anthropic対OpenAI、『生物・化学リスク』専門ポジションの求人票を並べて読む
- 研究MCPでもA2Aでも 『エージェントを見つける』だけに徹する軽量プロトコルARDPを読む
- 検証有償AIコードレビューをやめてローカル自作に切り替えた話 diffだけを見るPythonツール avouch
- 研究全DRAMを殴れるパターンを見つけた研究「Blacksmith」 GPU向けRowhammer攻撃の源流をたどる
- プロダクトChatGPT無料版のテキストチャットが無制限に 既定モデルはGPT-5.6 Luna
- 検証Ollamaユーザー向けのデスクトップアプリ「ChatOSS」 ローカルモデルでコード・カンバン・独自アプリを1画面にまとめる
- プロダクトClaude Codeに組み込みの「Concise」出力スタイルが追加 前置きと実況を省いて結果から話す
- 検証Claude APIの「computer use」がベータを卒業 新設の「browser use」との違いを公式リリースノートで切り分ける
- プロダクトClaude Managed AgentsのDreamsに「元のメモリストアを上書き」する選択肢が追加された(ドキュメントは未反映)
- プロダクトCodexの「リモート圧縮」、画像を含む会話履歴でトークン予算を守れていなかったバグが直った
- プロダクトCodexのターミナルから「@」で別タスクを参照 読み取り・作成・メッセージ送信までエージェントに頼める
- 検証Claudeの中で本の「試し読み」ができるコネクタCoffeetable 作者がHNで明かした著作権対策
- 研究LLMが書いたGPUカーネルの「正解率」は本当か 12ゲート検証器が2,638件を洗い直すと4割近くが壊れていた
- プロダクトCursorがGitHubの代替を作った 「Origin」はコードホスティングとエージェントを同じ画面に置く
- 検証Cursorか Claude Codeか 非エンジニアが選ぶときに見る軸
- 研究「早ければ2026年」とアモデイ氏が書いた強力なAI Machines of Loving Graceを2026年8月に読み直す
- プロダクトDeepSeekが同じ日に3つのnpmパッケージを公開していた 新CLI「dsh」とACPサブエージェント連携の中身をレジストリから読む
- 検証diffusersの「Modular Diffusers」が実験段階を卒業 新モデルは既に旧来パイプラインを持たずModular専用で配布される
- 業界『AIをそのまま貼るな』を掲げるdontpastetheai.comが、HNで581件の議論を呼んだ理由
- 検証『AIを貼るな』サイトの作者が『AIで書いただろ』と追及される、という入れ子の話
- プロダクト高齢者の孤独に語りかけるAIロボットElliQ、公式サイトから分かることと分からないこと
- プロダクト画像モデルFLUXが動画に本格参入 「FLUX 3 Video」と4Kアップスケーラーを公式ブログで確認する
- プロダクトGemini 3.5 Transcribeが正式提供 85言語以上を自動判定・話者最大8人分離を料金表で確認する
- プロダクト`copilot --acp`の1行でIDEから呼び出せる GitHub Copilot CLIがACP対応をパブリックプレビュー化
- 業界2026年3回目のスパムアップデート Google公式ダッシュボードで確認した「8月」の期間
- プロダクトGPT-5.6 Solに「Ultrafast mode」 標準比最大14倍速い新サービス階層
- モデルIBMの音声認識モデル「Granite Speech 5.0 TurboCTC」 470Mでデコーダなし、1フォワードパスで文字起こし
- プロダクトxAIの新製品「Grok Bot」 常設クラウドPCを持つAIチームメイトを公式ドキュメントで読む
- モデルgrok-imagine-video-1.5がネイティブ1080p対応に text-to-videoは内部で2段階処理という仕組み
- 業界広島AIプロセスの『報告枠組み』って結局何を書かされるのか
- 検証自分だけの検索エンジンを作る「Hister」 ブラウザ履歴もローカルファイルもMCP経由で検索対象にする
- 業界Hacker Newsの新着投稿は何割がAIか ライブカウンターと手作業調査、2つの実測を並べて読む
- 検証「hf CLIの使い方をAIエージェントに教えるスキル」が、CLIのインストーラーで自動配置されるようになった
- 研究「Intern-S2-Preview」とは何か 397Bの本体を凍結したまま、4Bの「記憶デコーダ」だけ足して専門特化させる科学AI
- 研究Isomorphic Labsとは AlphaFoldの先にある創薬AI企業を一次情報で整理する
- 業界スマート水産業とは 水産庁が進めるICT・IoT活用と、7地域の実証プロジェクト
- モデルKimiのmoonshot-v1シリーズが8月31日で終了 呼ぶと404、公式一覧で終了履歴をたどる
- 検証家にある古い手紙・日記をAIで読む方法 国立情報学研究所系のアプリ「みを」を確認した
- 業界LayerXが作った「GTMエンジニア」という仕事 営業組織にもエンジニアが要る時代
- 活用Macの統合メモリではこの技がそもそも要らない理由 llama.cppの--cpu-moe/-ncmoeを公式ドキュメントで確認した
- 活用ローカルAIとクラウドAPI、費用はどちらが安いか 分岐点で比較する
- 活用ローカルAI用のマシンはMacとWindows、どちらで組むべきか 選び方の分岐点
- プロダクトMac Studio M5 Ultra、512GBモデルは10月下旬発送 「284BのDeepSeekが動く」は誰も実測していない
- 検証Manus AIのクレジットは何をすると減るのか 公式の消費実例を見る
- 検証Manus AIは安全なのか 公式Trustセンターで確認できる認証と、確認できなかったこと
- 検証MCP Python SDK v2安定版 FastMCPがMCPServerに、サーバーはクライアントを呼べなくなった代わりに何が変わったか
- 検証Mem0が2つのエージェントフレームワークに公式対応 「ツール呼び出し型」と「自動注入型」で記憶の渡し方が違う
- 業界AI投資の主役がGPUからメモリへ TrendForceが示すDRAM価格「2026年に約270%上昇」の内訳
- モデル1文字ずつでなく面で書くAI 商用スケールの拡散言語モデルMercuryとは
- 研究AIが独力でこなせる作業時間、3〜7ヶ月ごとに倍 METRの「タイムホライズン」を原文で読む
- 検証1プロセスで4つのLoRA専門家を切り替えるMixture-of-LoRA Harness 748BのVentiと50BのTallを同じコードで動かす
- 業界「ものづくり補助金のAI活用枠」は存在しない 2つの補助金公式サイトを突き合わせて確認する
- 研究「MOSS-VL」とは何か 「見ながら喋る」を前提に設計し直したオープンな視覚言語モデル
- 検証Nano Banana Proを動画生成の参照画像に使う Google公式ドキュメントのコード例を確認した
- 研究カメラマンは「低リスク」側だった 野村総研リストと、702職業中91位という確率
- プロダクトNVIDIA Groq 3 LPXが量産開始 Gemma 4を毎秒3,400トークンで動かす推論専用チップ
- 研究OpenID Connectの『name』『given_name』クレームがCWTにやってくる SPICE WGのOIDC-CWTを読む
- 検証社員全員に「エージェント1体」を配る YC S26採択OneCLIが解こうとしている問題
- 検証OpenAI Agents SDKに、モデルもサンドボックスも呼ばずにエージェントの挙動をテストできるツール群が追加された
- プロダクトOpenAIが防御側専用モデル「GPT-5.6-Cyber」を投入 サイバー防衛構想Daybreakを二層化
- 研究AIモデルに『改ざんされていない証明』を付ける OpenSSF Model Signing (OMS)の署名フォーマットを読む
- モデルPixVerse V6とは V5.6のリーダーボード実績の上に何を積んだか
- モデルQwen3.8-27BはどのMacで動くか GGUF量子化ファイルの実サイズから積算した
- 研究「RekaDaily-10k」とは何か 有償の一人称視点動画10,865時間、80TBがApache 2.0で公開中
- 検証Runway Act-Twoで演技をAIキャラクターに転写する方法 APIリファレンスで確認したパラメータと料金
- 研究検査資格の番号だけ隠して有効性だけ見せる JWTの『選択的開示』をCBORに持ち込むSD-CWTを読む
- 研究「2025/26年に大学卒業生を上回る」は当たったか 元OpenAI研究員の「Situational Awareness」を原文で読む
- 研究「空間知能」とは何か Fei-Fei Liが掲げるAIの次のフロンティア
- 活用Sunoの曲が見つからない時に確認すること 「消えた」の3つの原因を公式ヘルプで切り分ける
- モデル派手な発表の裏で静かに公開された中国勢3モデル 文書検索・マルチモーダル埋め込み・動画編集パイプライン【2026年8月】
- 活用動画編集AIのデメリット 自動カット・自動字幕を使って直す羽目になった場面
- 活用動画編集の仕事はAIでなくなるのか 自動化できたタスクとできなかったタスクの線引き
- 研究「WarpSAC」とは何か ロボットの荷物運びタスクの成功率を19.8%から96.4%に押し上げた強化学習の作法
9月4日(94本)
- 業界NVIDIAがHugging Face買収を正式発表 129億3030万ドル、「NVIDIAの計算資源は必須にしない」と公式ブログに明記
- モデルGPT-6 AstraがChatGPT Proに到着 Plus・Businessも後日拡大、Proは2段の枠、Codexの5時間目安はAstraがGPT-5.6 Solの半分
- モデル覆面AI「Omen Alpha」を課金して測った 公開スペックは実物より小さく、トークナイザはGLMと18対18で一致
- 検証Agent Client Protocol(ACP)とは コーディングエージェントを「LSPのように」つなぐ標準規格
- 研究「Agentic ESOpt」とは何か 強化学習ではなく「進化戦略」でエージェントを鍛える、GPUに優しいやり方
- 研究エージェントのシステムプロンプトをハッシュ化して身元にする Agentic JWTの『エージェントチェックサム』を読む
- 活用非エンジニアはAI資格を取るべきか 資格と実務スキルの境界線
- 活用非エンジニアがAIコーディングで事故った話 ビルド地雷の記録
- 業界人工知能戦略本部とは何をする組織か 総理の「7つの指示」を首相官邸の一次資料で読む
- 業界「AIリライアビリティエンジニア」という仕事 ClaudeのSRE版をAnthropicの求人票から読む
- 研究「AIモデルの福祉」を研究する仕事がある Anthropicが2025年に始め、2026年に「退職面接」を実施した論点
- プロダクトM5チップのNeural Acceleratorとは何か GPUコアの中にAI専用回路を1つずつ埋め込んだ理由
- 検証メタ検索エンジンsearxの作者が、13年後に「もう他社エンジンには頼らない」検索を作った理由
- 研究AIエージェントが『権限がない』で止まった時、次に何が起きるべきかを標準化する AuthZENの承認リクエストプロファイルを読む
- 検証Autodesk Formaとは AIが日照・風・騒音を計算しながら建築の初期設計案を作る
- 検証会話履歴を「要約」せず「追記」だけで持たせる 200行のコアで動くエージェントランタイム「bub」のテープ設計
- 検証ChatGPTブラウザ拡張がEdge・Brave対応に ログイン済みサイトでの作業継続機能も
- 業界中国政府がAI企業を含む「网信企業」を格付け育成へ 2030年までの行動計画
- 活用SendMessage/ListAgentsの中身 Claude Codeのセッション同士は何をどこまで送り合えるか
- 検証Claude CodeにBash風のCtrl+Wを keybindingFlavor: readline設定の中身
- プロダクトClaude Codeのクラウドセッションを自社インフラで動かす self-hosted environmentsの仕組みと向き不向き
- プロダクトClaude in Chromeのサイドパネルが独立セッションをやめた Coworkと同じ会話をブラウザで続けられるようになった
- プロダクトエージェントの暴走課金にドル建ての上限を Claude Managed AgentsのSession Budgets
- 研究AIに記事を書かせたら、複利計算を間違えていた CNETの2023年1月、3つの誤りを原文で確認する
- 検証『AI語』はなぜバレるのか 脱AI化ツールdeclaudeから見る
- プロダクトDevin AIのACU課金は結局いくらなのか 公式ドキュメントを読むと「非公開」という答えに行き着く
- 研究China Telecom・Huawei・AlibabaがIETFに提案した『AIエージェント協調』BOF、却下されていた DMSCを読む
- 検証AIエージェントの`rm -rf`を実行前に止める「Doberman」 自己申告ベンチマークを読むと見えてくる限界
- プロダクトElevenLabsが画像・動画生成APIに進出、ローカルMCPは廃止 changelogで確認する8月の3つの変更
- 研究強化学習環境を「作り直さず、着せ替える」 EnvHarnessは静的な訓練環境をラップして弱点を突く
- 業界「Forward Deployed Engineer」という職種 PFN・ソフトバンクが2026年に相次いで定義した仕事の中身
- 検証『深いカスタマイズが要らないならOpenClawを使え』 公式READMEが名指しで住み分けるエージェント基盤「fount」
- 活用無料AIロゴ作成ツールでロゴを作る手順 PNGとSVGまで無料で落とせるものを選んだ
- 検証無料で使える画像生成AI比較 登録不要のものと、商用利用の条件が違うもの【2026年8月】
- 研究「仕事の47%が消える」の答え合わせ 2013年オックスフォード論文が確率を割り当てた20職業を、10年後の米国統計で数え直す
- 活用非エンジニアがGitを最低限使うための手順 コミットと差し戻しだけ覚える
- プロダクトSlackでGitHub Copilotが動く 「@GitHub」と専用チャンネル「Slack Code」を一次資料で確認する
- 研究LEI・DUNS・IANA番号 企業を指す既存の複数のID体系を1本のURIにまとめるGLUE Identifiersを読む
- 研究AI医療対話モデル「AMIE」がビデオ診察に対応 歩き方や表情から診断する仕組み
- 研究GoogleがWeatherNext 3を公開 衛星の生データから1時間ごとに更新、5kmまで細かくした気象AI
- 検証Claude Codeの「毎回ゼロから調べ直す」を止める「Graft」 SWE-benchで33/50 vs 27/50まで踏み込んだ数字
- 研究亡くなった人とAIで話す 「griefbot」は日本にも来るか
- プロダクト『AI看護師』Hippocratic AIとは何か 診断も処方もしない音声AIエージェントの中身を公式サイトで確認した
- 業界Hot Chips 2026で各社が見せた次世代AIシリコン Intel・Google・富士通の中身を一次資料で追う
- 業界日本のAI法に罰則はあるのか 条文を全28条+附則まで数えて確認した
- 業界個人情報保護法の「令和8年改正」で何が変わろうとしているか AI開発の「統計作成」なら同意不要になる条文を読む
- 検証「グラフ版SQLite」LatticeDBは1ファイルでベクトル検索・全文検索・グラフ探索を同じクエリ言語で扱う
- 検証LM StudioがMLXエンジンを統一した理由 フォークされていた2つの実装を1つにするとフォロー応答が25倍速くなった
- 活用gpt-ossをローカルで動かすと何ができるか 20Bと120Bの違いを整理する
- 検証LTX Studioとは Veo・Kling・Seedanceを1つの制作フローに束ねる、動画生成AIの「モデル横断スタジオ」
- 検証Claude CodeのセッションをブラウザでGenUIごと覗くmacaron-artifacts プロンプトも会話履歴も送らないテレメトリ設計を読む
- 研究『記憶』だけを6.9Bパラメータまで太らせたら、モデル本体を大きくするより効率が良かった
- 業界Microsoftの「AI事業」の6〜7割はOpenAI頼み、とBloombergの分析 株価30%上昇の裏にある集中リスク
- 業界肖像・声の無断利用、パブリシティ権はどこまで守るか 法務省検討会が報告書を公表
- 検証リサーチ結果の引用が「原文に本当にあるか」を検証するターミナル発エージェント「mole」
- 検証「クローンだらけのオフィス」を自宅PCに Munder Difflinはマルチエージェント運用をどう解決したか
- プロダクトNotion AIの「Meeting Notes」は既存の議事録AIと何が違うのか 「会議の後」まで自動化する設計を公式リリースノートで読む
- 研究『誰の代理でこのAPIを叩いたか』をトークンに刻む OAuth Transaction Tokensのエージェント拡張を読む
- モデルオンデバイスAIとは iPhoneのApple IntelligenceとAndroidのGemini Nano、仕組みの違い
- プロダクトChatGPTに広告が来る 『Advertise in ChatGPT』を読み解く
- 検証openai-agents-jsがAI SDK 7に対応、モデル・ツールのログが既定オフに v0.14.0を読む
- プロダクトOpenAI Agents SDK、一時停止した実行に後から入力を差し込めるように JS版とPython版が同時に対応
- 業界OpenAIが『物理的なモノ』の安全職を募集している コンシューマー機器とロボティクスの求人票を読む
- 検証OpenAI APIに「使いすぎたら429で止める」設定 アラートと上限の違いを公式ガイドで確認する
- 検証OpenAIの組織管理をコードで宣言する 公式Terraform providerを設定ファイルから読む
- 検証OpenClawとは何か 「クロード」から3度名前を変えた、あなたの端末で動く個人用AIエージェント基盤
- プロダクトOpenEvidenceとは 米国の医師が診察室で使う医療AI、月間1,800万件の臨床相談
- 検証ClaudeにもChatGPTにもCursorにも読み書きできる「共有の脳」OzBrain ページ自体にAIエージェント宛ての指示文が埋め込まれていた
- 検証音声やYouTubeリンクをピアノ譜に変換するpianoify 『Muscriptor』公開インスタンスの中身
- プロダクト動画のPikaが音声4モデルを一挙公開 「ElevenLabsの9倍安い」という自己申告の中身
- 業界「年収3000万円」のプロンプトエンジニアは今どこにいるのか Anthropicの採用ページを2026年8月27日に確認した
- 研究なぜAIは指示と本文を混同するのか 『役割の混同』という視点でプロンプトインジェクションを説明する
- 研究DDR5はRowhammerに本当に強いのか ETH Zurichの故障注入基盤「REFault」が出した答え
- 検証Runway Alephで生成済み動画を編集する 作り直さずに直す、video-to-videoモデルの中身
- 研究サム・アルトマンの「穏やかな特異点」論を読む 2025年に書いた予測は2026年8月時点でどこまで当たっているか
- 業界「AIに教える仕事」の運営側 Scale AIの専門家アノテーター制度「Human Frontier Collective」とは
- 研究AIエージェントに必要なのは大きなモデルではない NVIDIAが主張する『小型モデル本命論』
- 活用個人開発でAIの無料枠だけを使うとどこで詰まるか
- 活用個人開発でAIエージェントに運用を任せて起きたヒヤリ事例
- 研究AIへのプロンプトインジェクション対策、総務省ガイドラインは何を求めているか 「AIエージェントは対象外」の理由まで読む
- プロダクトSpaceXAIがNVIDIA Vera CPUを採用 「Vera Rubin NVL72を宇宙に上げる」計画は今どの段階か
- 研究モデルの重みを変えずにTerminal-Bench 2.1の正答率を9ポイント上げる StateMがDeepSeek-V4 Flashで再現した392/445のログを開けた
- 検証チャットは会話を隠す、グラフは会話そのもの ThoughtDAGが「編集できる文脈」に賭けた理由
- 検証TRLのAsyncGRPOが「エージェント自身にループを持たせたまま」強化学習できるようになった
- 業界Twitch配信がAI学習に使われる Amazonをオプトアウト方式めぐり集団訴訟
- 検証壊れたツール呼び出しを自動修復する Unsloth Desktopの「Self-healing tool calling」を公式の実測データで読む
- 研究通話記録フォーマットvConに『Claude Opus 4.6』を例示するエージェントセッション拡張が提案されている
- 活用動画編集AIの自動カットを試した記録 無音検出カットは編集の代わりになるか
- 活用動画編集にAI音声を入れる方法 ソフト内蔵の読み上げと外部TTSの使い分け
- 研究「VoiceMem」とは何か 音声対話AIに「左脳」と「右脳」を分けて持たせる記憶アーキテクチャ
- 検証30プロバイダを自動フェイルオーバーで渡り歩く Rust製ターミナルコーディングエージェント「VT Code」
- 研究マイクロサービスの『ワークロード身元』標準がAIエージェントにも使われ始めている WIMSEとエージェント適用ドラフトを読む
- 業界AIエージェント決済(x402/AP2)は今どれだけ動いているのか 公式ダッシュボードの実測値を見る
- 検証Claude Agent SDKを『エディタの共通言語ACP』に翻訳する Zed製アダプタが対応する機能を数えてみた
9月3日(87本)
- モデルGPT-6 Astra公開 自社比較表では首位、独立指標では5位、価格はFable 5.1と同額の$10/$50
- 検証壊れたツール呼び出しを、モデル自身に「もう一度考えさせて」直させる GoogleのADKが標準搭載したReflectAndRetryModelPlugin
- 研究AIエージェント版DNSは失効していた 『agentdns://』が目指した自然言語検索・統一課金の中身
- 研究『発行』ではなく『導出』する権限モデル 中央の認可サーバーを頼らないAgentEnvelopeを読む
- 研究『ブロックした数が多い=安全』ではない、というAIエージェント向けセキュリティ設計
- 研究AGIとASIは何が違うのか 1997年のボストロム論文が定義した「超知能」を原文で読む
- 研究AI研究者2,778人に聞いた「AGIはいつ来るか」 1年で13年前倒しになった調査と、まだ出ていない続編
- 業界現場仕事を変える海外AI事例4選 不動産事業性・建設進捗・農業除草を公式サイトで確認した
- 研究robots.txtに『AI学習には使うな』を書き込む標準 Google・MozillaのIETFドラフトdraft-ietf-aipref-attachを読む
- 業界なぜ各社が同時に「常時稼働エージェント」を出し始めたのか プロンプト待ちから常時監視への転換
- 検証ANTHROPIC_DEFAULT_MODELとANTHROPIC_MODELは別物 Claude Codeの新環境変数を公式リリースノートで確認する
- 業界AIを攻撃する仕事「AIレッドチーム」 Anthropicの求人とPwC Japanのサービスを比べる
- 業界『安全担当』が使う道具を作る人たち Anthropic Safeguardsのレビューツール・ML基盤エンジニア求人を読む
- 活用Claude・GPT・GeminiのAPI無料枠を並べてみた 「無料」の中身は3社でまったく違った
- 業界「アプライドAIエンジニア」という職種 Anthropic・OpenAIが東京で同時に募集している肩書の正体
- 研究正解にたどり着いたのに「記憶からは答えられない」が42.5% 長文書AIエージェントのAWM
- 研究150Mパラメータでタスク1件0.07銭 Pathwayの再帰アーキテクチャBDH-CQが「未学習のARC-AGI-1」を自作して測った理由
- 業界「最高AI責任者」はもう実在する 自治体・オフィス家具・引越業、2026年の3つの実例
- プロダクトClaude APIが2026年8月に踏んだ変更点まとめ Python SDK v1.0の破壊的変更を中心に
- 活用非エンジニアがClaude Codeで自社サイト運用を回した実測記録 書く作業より確認する作業の方が多かった
- 検証Claude無料版の上限は何回か 公式ヘルプを一次ソースまで遡って確認した
- モデルClaude Sonnet 4・Opus 4・3.7 Sonnet・3.5 Sonnetはもう使えない 退役済みモデルを公式表で一括確認する
- プロダクトClaudeのメモリがチャットとコワークで統合 センシティブ話題は「後から」オンにしても過去分は保存されない
- 検証1つのACPエージェントの中にClaude・Codex・Grokが同居する 『艦隊型』オーケストレータClaw Orchestrator
- 活用Codex Auto-reviewの仕組み サンドボックス境界越えの承認を別レビュアーに任せる
- プロダクトCodexに「中断されたら実行されるフック」が追加 タイムアウトは既定1秒・最大3秒
- 活用AGENTS.mdだけでは危ない Codex Permission Profilesの仕組み
- 検証Codex Windows Desktopが更新直後に一斉起動不能に 『バイナリはあるのに実行できない』issueが3日で4件
- 検証ComfyUIの新アテンション実装「Comfy Kitchen」 int8量子化で計算する専用カーネル群が起動オプション1つで切り替わる
- 検証MiniMax-H3の動画生成、「先頭と末尾」だけだった制約をComfyUIが外した 任意フレームに画像・音声を固定できるAddGuideノード
- 活用Macで動くモデルサイズの計算式 「コンテキスト窓が広い」の裏でVRAMが消えていく仕組み
- 検証3つのharnessを1つに『融合』させようとする個人開発、着手から10時間の記録
- 検証Docker SandboxesとYOLOモード 「危険な権限」ごとエージェントを隔離するという発想
- 検証`pip install dspy[deno]`だけでインストールが完結 DSPyがコード実行サンドボックスの穴を5つ塞いだ話
- 検証DSPyのReActV2 「1本の巨大な文字列」だったツール履歴を、構造化されたメッセージに分解する
- 活用電子帳簿保存法のスキャナ保存要件、AI-OCRツールはどこまで満たすか
- プロダクト動画を「会話しながら」直す Gemini Omni Flashの対話型編集を料金・仕様から読み解く
- プロダクトTeamsの会議で出た決定事項が、そのままGitHub Copilotのタスクになる 2026年8月21日公開の新機能を確認した
- 業界Googleが日本の著作権法を「良い例」と名指し Kent Walker氏の著作権スタンス表明を原文で読む
- プロダクト話し言葉を整った文章に変換するGoogleの新AI「Eloquent」 サブスクなし・オフライン動作の音声入力アプリ
- 検証プロンプトキャッシュを壊さない会話組み立て Gooseが「バイトを後から動かさない」設計に変えた理由
- 検証Gooseの`/goal`コマンド エージェントが「終わったつもり」で止まるのを、自己確認のループで防ぐ仕組み
- 検証GooseのHooksが「拒否」を覚えた ツール実行を止められる仕組みと、暴走したフック自体は止めない設計
- 研究GPUのメモリを殴る研究が、なぜ賞を総なめにしているのか GPUHammer→GPUBreach→GPUThorの受賞歴を追う
- 検証xAIのGrok Build、Agent Client Protocol対応の中身 他アプリからgrok-4.6を呼び出す3つの方法
- 検証Terminal-Bench開発元が作った評価基盤「Harbor」 Claude Code・OpenHands・Codex CLIを同じコマンドで数千並列評価する
- 検証Claude Code・Codex・Hermesを1コンテナにまとめる「HarnessRouter」 自前サーバーで動かす統一プロトコル
- 検証Hermes AgentにKimi K3をつなぐ 公式ガイドが指定する1つのモデル名と、間違えやすい設定ミス
- 検証81,481スターと11,203スター MiniMax公式より大きい「個人製Agent Skills」を2つ確認する
- 検証ブラウザの中でnginx・MariaDB・WordPressを動かすWasmカーネルKandelo WordPress.com運営元が公開
- 検証Kimi Code CLIの中身 TypeScript製・npm配布、Claude Codeと同じジャンルの自社ハーネス
- モデルKimi K3の「Dynamic Tool Loading」 ツール定義を会話の途中で継ぎ足す設計
- 活用Kling 3.0のMotion Controlでカメラワークを指定する方法 料金は秒単位
- 活用DeepSeekはローカルで動かせるのか パラメータ数とVRAM要件で判定する
- 活用ローカルAIの最低スペックはどこまで低くて良いか 8GBメモリの実機で確かめた
- 活用スマホにローカルAIアプリを入れるとどこまで使えるか 実用度の判定
- 検証巨大MoEモデルを「誰も全部持たない」まま動かす P2Pスワーム推論エンジンLumabri
- モデル748Bのモデルなのに動くのは1B MindLabのMacaron-V1-Ventiが採るMixture-of-LoRA構成を、公開モデルカードで読む
- 研究「2025年末までにAGI」に賭けた281人、答えはNOだった アモデイ氏の発言をきっかけに立った市場の顛末
- 検証MCPのフォーム確認、サーバーが提供する専用アプリでレンダリングできるように 4つの条件が揃わなければ自動で従来型に戻る
- 研究AIエージェントに『この店は何を売っているか』を先に教える MCPのサーバーカードに商取引情報を足すbeaconspecを読む
- 研究MCPに来る2つの拡張案 ツール結果の部分ストリーミングと進捗通知の構造化を、提案PRの本文で読む
- 研究MCPのツール名にIANAレジストリを作る提案、初期登録4件は全て提案者自身の会社のツールだった
- 検証MiniMax Codeとは何か 自社モデル向けコーディングharnessの3つの機能を公式サイトで確認する
- 業界AI法務支援サービスは弁護士法違反か 法務省が新ガイドラインで線引きを補完
- 検証『分身』にコードとAPIキーを渡すツールは、自分をどう縛っているか Munder DifflinのSECURITY.mdを読む
- 活用非エンジニアが起業・個人開発でAIに任せる作業と任せない作業の線引き
- 検証NVIDIA公式のAgent Skillsカタログを開くと「OpenClaw上でOpenClawを動かす」スキルまであった
- 検証Open WebUIの「ツール実行、毎回聞いてから」設定 会話単位で自由実行と承認制を切り替えられる仕組み
- 業界OpenAIの「Agent Post-Training」は7つのサブチームに分業していた 求人票を1件ずつ読む
- モデルChatGPTのo1はどこへ消えた? APIは2026年10月23日に停止、現行モデル一覧にはすでに名前がない
- 研究OpenAI「Planning for AGI and beyond」を原文で読む 2023年に書かれた「段階的な移行」という約束
- モデルVideos APIとSora 2系、9月24日に全スナップショット停止 公式ページで確認、後継モデルの発表はまだ無い
- 検証ChatGPTがサイトの中で直接動く WebMCP「Site tools」とハッカソン、応募締切9月4日
- 研究「ペーパークリップを増やし続けるAI」の話はどこから来たか 2012年のボストロム論文を原文で読む
- 検証オブジェクトストレージの上に「耐久性のあるストリーム」を作る PicoMQ パーティションではなくストリームを量産する設計
- 業界「AI倫理担当」の求人は、日本にどれだけあるのか Indeedの一次データで確認する
- 検証「今どのターミナルが自分を待っているか」を可視化するMacターミナル「Saggar」
- 研究「SemaPLC」とは何か 工場の制御盤コードをAIに書かせて、動くかどうかまで確かめるharness
- 業界Sierraの「Agent Strategist」 「去年はほぼ存在しなかった職種が、今は最も急成長中のチーム」
- 活用個人開発でAI APIとサブスクどっちを使うか 従量課金に切り替える分岐点
- 活用個人開発でデザインをAIに任せた手順 アイコン・3Dモデルを自分で作らない選択
- 業界趣味の気球追跡サイトが軍需インフラになった話 市民運営の可視化サイト2つを一次ソースで読む
- 活用動画編集AIで実際にできること 自動字幕・ノイズ除去・自動カットを機能別に整理
- 検証Zedのask_userツール、追加された同じ週にデフォルト無効化された理由
- 研究Intelだけじゃなかった AMD Zen系CPUでもRowhammerが刺さることを示した「ZenHammer」
- 研究ロボットの『振り返り』は、動作が終わってからでは遅い Zettaが基礎方策を凍結したまま推論速度11.1倍を出した閉ループ設計
9月2日(74本)
- モデルGoogle、Gemini 3.8 Flashと3.8 Flash Cyberを発表 6週間で3本目のFlash、Opus 5の7分の1の値段で金融・法務・長尺動画のベンチは上、汎用エージェントは19.1%対51.8%
- 検証ACP対応エージェントだけを集めた「レジストリ」 認証対応の39件をJSON1本で配布する仕組み
- 検証GoogleのADKには、エージェントの暴走を止める「500回」という既定の天井がある ADK_MAX_LLM_CALLSで変更できる仕組み
- 研究エージェントが失敗するのは「考えられないから」ではなく「何を覚えておくか管理できていないから」 ACMという論文の主張
- 活用AIエージェントを長時間放置する前に確認する6つのこと Claude Codeの公式ドキュメントから逆算するチェックリスト
- 検証3つの違うharnessで、スキルもMCPサーバーも別々に登録し直す面倒を消そうとするCLI
- 研究Spectre対策、設計段階でテストするツール「AMuLeT」 3時間で9件のバグを見つけた中身
- 業界Anthropic社内の『GTM Claudification』チーム 自社の営業をエージェント化する求人票を読む
- 業界AIの「安全担当」は14種類に分かれていた Anthropic「Safeguards Enforcement Analyst」求人の全件確認
- 研究ARC-AGI-2の最高スコアはいくつか 「37.6%」を一次ソースで確認した
- 業界2.4億DL超のRustクレートarrayrefが乗っ取られた4時間 base64のC2アドレスと『非yank版へどうぞ』の罠
- プロダクトChatGPT AtlasとPerplexity Comet 「ブラウザにAIを埋め込む」2社のアプローチと、OpenAI自身が認めるリスク
- 活用Dynamic Workflowsとは JavaScriptスクリプトで数百のsubagentをオーケストレーションする仕組み
- 活用非エンジニアがClaude CodeのSkills機能を設定した手順
- 活用Claude Computer Useで事故を防ぐには 公式ドキュメントが挙げる4つの対策
- 検証作業が終わった9分後、Codexが黙って3,460万トークンを溶かし続けた code-mode execのポーリングバグを読む
- 業界Cohereは「ソブリンAI」を事業部門にした 概念でなく採用ページの職種・組織名で確認する
- プロダクトAIが自分の『コーディングの癖』を学習し続ける Command Codeの独自モデル『taste-1』を公式サイトから読む
- 検証PrimeAgentの『RLM』という発想が、2週間で3つの独立した移植版を生んだ
- 検証プロンプトではなく「プログラムの構造」自体を最適化する DSPyの実験的機能`dspy.Flex`
- 検証Figmaの「コードレイヤー」とは デザインとコードを同じキャンバス上で行き来する新機能
- 業界Suno対GEMA、独ミュンヘン地裁がGEMA勝訴 AI音楽著作権訴訟でヨーロッパ初の判断
- モデルGemmaの累計ダウンロードが10億超 Google公式発表と「Awesome Gemma」の中身
- 検証GoogleのOAuthは「動的クライアント登録」に対応していない GooseのMCP拡張がv1.47.0で回避策を持った
- プロダクトコーディングエージェントGooseが、実行ループを「巻き戻せるステートマシン」に作り替えている(実験段階)
- 研究AIボットへの課金をHTTP 402で 『失効済み』のIETF個人ドラフトHAPが提案していたこと
- 検証Hugging Face Inference Endpointsに「使えるハードウェアを一覧できるコマンド」が追加された
- 研究同じGPT-5.6でも、harnessを変えるだけで1件あたりのコストが2.3倍違った 個人が測ったharness横並び比較
- 研究国際AI安全性報告書2026 ベンジオ議長・ヒントン顧問、100人超の専門家が書いた「政策提言をしない」報告書
- 研究「JIT-Agent」とは何か harnessそのものを「その場で生成するモデル」に育てるという発想
- 検証GitHubにすら置かれていないコーディングエージェント「kaagum」 Guile言語・自前UIなし・ACP専用という徹底ぶり
- 検証1.52MBのバイナリが3.5msでコンテナを起動する ルートレスサンドボックス「kern」をAI生成コードの実行にどう使うか
- 研究「AIが700人分の仕事をした」Klarnaが、1年後に人間を再雇用した理由
- 活用WindowsパソコンにローカルAIを導入する手順 GPU認識の確認から
- 検証Mac Studio M5か、Ryzen AI Max+ 395か 統合メモリ型2チップの公式スペックを並べた
- モデルベースモデルを凍結し、LoRAをターンごとに切り替える Macaron-V1が選んだ「継続学習」への回り道
- 検証OSキーチェーンが無い環境でもMCP InspectorがOAuthの秘密を保持できるように AES-256-GCM暗号化と「壊れたら書き込まない」設計
- 検証AIエージェントに『前回どこまでやったか』を覚えさせるMCP-Memory GoogleのOKF形式で記憶を人間可読なMarkdownに残す
- 研究『96.89%が危険』と出たMCPスキャナーの警告のうち、本物は半分未満だった
- 研究『mcp://』というURIスキームでMCPサーバーの実在を確かめる 2つの独立ドラフトが同じDNSレコードにたどり着いていた
- 研究MCPサーバーの41%が無認証 それを封筒で包んで守るMCPS(MCP Secure)を読む
- 研究『RFMコマンドは送られていなかった』 オシロスコープでDRAM通信を覗く「McSee」が暴いたDDR5対策の実態
- 活用メモリ帯域幅1.2TB/sは何を意味するのか ローカルLLMの速度を決める「本当のボトルネック」
- 研究GLM-5.3-Flashが採用した『mHC』はDeepSeekが8か月前に発表していた技術だった
- プロダクトWork IQとは Microsoft Scoutを支える『仕事の学習エンジン』
- 研究AIが生成したデータでAIを学習させ続けると何が起きるか 「モデル崩壊」をNature論文の実例で読む
- 検証AI Skillsに「品質ゲート」を通す NVIDIAが公開したオープンソース評価基盤SkillEvaluatorを読む
- 検証『26.1%のスキルに脆弱性』 外部Agent Skillsを入れる前に走らせるNVIDIAのセキュリティスキャナ「SkillSpector」
- 検証データ漏洩を55の公理でコーディングエージェントに検問させるomds GEPAでMLパイプラインのコードそのものを進化させる仕組みも同梱
- 研究「OmniScientist」とは何か 生データを直接読む「AI科学者」は、数値だけ渡されたAIに85%勝った
- 研究「労働者の80%がAIの影響を受ける」の原論文を読む 測っていたのは「職」ではなく「タスク」だった
- 業界OpenAIが東京で募集する「AI Deployment Manager」 ChatGPT Enterpriseを「使わせる」専門職
- 検証OpenAI API、8月の実務変更5件 プロンプトキャッシュ可視化から透過背景画像まで
- 業界OpenRouterがStripe傘下に 『同じ名前・同じロードマップ』を保ったまま決済インフラの傘の下へ
- 研究コーディングエージェント「Ouroboros」とは何か 161日間、人間の許可を得ながら自分自身を書き換え続けるAI
- 検証PEFTライブラリに3つの新しいLoRA派生手法 HiRA・GLoRA・BEFTを1つずつ読む
- プロダクトPerplexity Computerは「専属エンジニアの客先常駐」で導入する Forward Deployed Engineer求人が明かす提供モデル
- 検証『他のharnessとは違う、これはあなたのもの』を掲げるPi 5,458件のパッケージが今日も増え続けるエコシステム
- 活用パワーディレクター・DescriptのAI動画編集機能を比較する 公式情報から分かる、定番2本にない使い方
- 研究「Prime Agent」とは何か harnessを変えただけでARC-AGI-3のスコアが30%から95.5%に跳ねた話
- 業界サム・アルトマン「AIはまだiPhoneの瞬間を迎えていない」 タイムラインが野心的すぎたと認める
- 研究LLMは『次の実験で何が起きるか』を予測できるか Scale AIの新ベンチマークSciPredictを読む
- 業界Sierraが業界ごとに『専任AIエージェント戦略職』を置く理由 求人票の実例プロジェクトから読む
- プロダクト新Siri(Siri AI)は結局いつ・どの言語から使えるのか WWDC発表の原文を読み直した続報
- 活用個人開発でClaude Codeはどのプランで十分か Free・Pro・Maxの分岐点
- 業界冗談で登録したドメインが、いつの間にか戦争の当事者になっていた SondeHubを巡る顛末
- 検証『Tailscale抜きのTailscale、Tailscale製』 netcat風ツールTailcatが使う仕組みを読む
- 検証Hugging Face TRLの知識蒸留が本採用に 約30PRの改修を経て安定版へ、複数教師の非同期蒸留も追加
- 研究「技術的特異点」を最初に言ったのは誰か 1993年のヴィンジ論文は「30年以内」と書いていた
- 活用動画編集でAIを使うと著作権はどうなるか 生成部分と編集部分を分けて考える
- モデルVidu Q3とは ネイティブ音声つき16秒動画を1回の生成で
- モデルAIキャラクターとビデオ通話ができる時代へ Vidu S1は何が新しいのか
- プロダクトWindows 11のAIエージェントは個人フォルダに常時アクセスする 「Agent Workspace」機能を確認した
- 検証OpenClawと紛らわしい名前だが中身は別物 Rust製パーソナルAIエージェント「ZeroClaw」がスター3万を超えていた
9月1日(95本)
- モデルClaude Fable 5.1公開 科学研究ベンチが24.7%から52.6%へ、価格据え置きで実質25%安
- 業界OpenAI、Astraを史上初の「Critical」に正式指定 評価中にゼロデイを2件自力発見、同じ日にAnthropicは逆方向へ
- 検証Google ADKにModel Armorガードレールが標準搭載 「スクリーニングに失敗したら通す」ではなく「失敗したら塞ぐ」を既定にした設計
- 研究入れすぎたAIエージェントの「スキル」が正答率を落とす理由 77人の研究者が87タスクで測った「効くスキル」の条件
- 活用AIエージェントに必要なのは長いプロンプトでなく「制御フロー」 1本の短いブログ記事がHacker Newsで広く共有された理由
- 研究AIエージェントの『目次』『身分証』『語彙』を別々に作る Cisco主導AGNTCYの3プロジェクトを読む
- 研究「AI 2027」を書いた本人たちが、なぜ「AI 2040」を書き直したのか 著者陣の軌道修正を原文で読む
- 研究AIエージェントのベンチマークは「ハック」できる 1つのタスクも解かずに満点近くを叩き出した実証研究
- 検証Claude Code・Codex・Devin 「APIキーを配らない」認証への移行が同時に進んでいる
- 活用ChatGPT・Claudeの利用料、消費税はどう処理すればいいか 国税庁のリバースチャージ方式を原文で確認した
- 業界「AI;DR」──AIが書いた文章を読まない、という新しい態度
- 研究動画生成AIの『記憶』をKVキャッシュの外に出す Alaya-EVOKEはH200で1.5秒分の映像を2.11秒で作り続ける
- 研究AIの「アライメント問題」とは何か 専門記事を読む前に、3つの一次資料で押さえておく基礎
- 検証curl一本槍だったAnthropic Admin APIが、ant CLIと7言語SDKに対応した
- 業界「AIフルエンシー教育リード」という仕事 Anthropicが作る、特定のツールに依存しないAI教育
- 活用AI-Native SDLCとは Anthropicが「コードの80%をClaudeが書く」現場から逆算した開発フロー
- 検証AnthropicとOpenAIのSDKが揃って「Standard Schema」対応 Zod依存を外せる共通規格とは
- 業界Anthropicが『執行』とは別に『方針』の専任職を新設 Cyber Harmsだけに起きている求人の積み増し
- 研究人気Rustクレートarrayrefが乗っ取られ、ビルド時にマルウェアを実行していた 245百万DLの依存先で何が起きたか
- 検証エージェントのプロンプト・ツール・スキルを「失敗トレースから」自動改善するcap-evolve held-out評価で+58.3%の実測値
- 活用CapCutのAI動画編集機能と商用利用の条件 自動字幕・背景除去を使う前に確認すること
- 検証車をチャットルームの一員にする Raspberry Pi 5に35BのQwenを載せて完全オフラインで動かすCarWatch
- 検証ChatGPT無料版はどこまで制限されているか 公式ページが軒並み403だった話
- 研究『いいですね、では予約します』の誤解を防ぐ LLMを経由しない人間確認プロトコルCHEQを読む
- 検証Claude Code Remote Controlは何を直し続けてきたか changelogの122件から読む実装の裏側
- 検証Claude Codeの起動中スピナー、実は組織が自社Tipsを混ぜ込める仕様だった spinnerTipsOverrideを読む
- 検証Claude Managed Agentsがリポジトリの.claude/skillsを自動で読むようになった 公式ドキュメントが明記する信頼境界の警告
- 検証Claude Managed Agentsのinference_geo 推論を「globalかusか」の2択で固定するAPIパラメータ
- プロダクトClaude APIが会話の途中でツールセットを変えられるようになった プロンプトキャッシュを保ったまま
- 研究ClawHubの「@openclaw」を騙る23個のプラグイン スコープの信頼表示が機能していなかった実例
- 検証月額9.99ドルでオープンウェイトモデルを定額利用 Cline「ClinePass」の中身と、8月26日にtasksツールへ入った変更
- プロダクトCloudflare OSとは 「AIに社内の仕組みを覚えさせる」を、OSSで配り始めた理由
- 研究1体のエージェントの自己改善には天井がある 『共進化』というもう1つの自己進化の軸を整理したサーベイ論文
- 研究MCPだけじゃない 『どんなプロトコルの認可判断もAuthZENに変換する』フレームワークCOAZを読む
- 研究MCPの『誰が・どのツールを呼んでいいか』をOAuthの外側で決める OpenID AuthZENのCOAZ-MCPドラフトを読む
- 検証電子書籍リーダーKoboに『アプリストア』が生える Cobaltは何をどこまで動かせるのか
- 活用CodexにGPUカーネル最適化を『自動でリサーチさせながら』回したら232倍速くなった話
- 検証Codexの『Guardian V2』 専用ブログ記事は無いが、公式チェンジログには100件近く載っているリスク審査システム
- 検証Codex CLIにVimの「.」リピートが来た rust-v0.150.0が明かす「multi-agent v2」という内部呼称
- プロダクト「エージェントハーネス」がプロダクトマネージャーの肩書きになった Cohereの求人票を読む
- 活用ComfyUIで生成が止まる・エラーが出る時の切り分け手順 公式トラブルシューティングを読む
- 研究長く話すほどAIは劣化する 「Context Rot」をChromaの技術レポートで読む
- 研究「Gemini Plays Pokemon」が一度も負け戦なくポケモンクリスタルを攻略した後、人間を完全に外した自己改善ハーネス「Continual Harness」の論文を読む
- 研究AIエージェントの決済に『1回あたりの予算上限』を持たせる DAAPというIETFドラフトの中身は1社の製品仕様だった
- 活用DaVinci Resolve・Premiere ProのAI動画編集機能はどこまで使えるか 公式機能を並べて比較
- 検証20万スターのDeepSeek Harnessを支える『Cordis』は、4年前からあった別プロジェクトだった
- 検証DeepSeekでCodexを動かす OpenAI Responses APIへのネイティブ対応、互換表を全項目確認する
- 研究狭い範囲の追加学習が、AIを広く危険にする 『創発的アライメント崩壊』という現象
- 研究『不正するな』と言ってもAIは不正をする 22モデルを検証した実測研究
- 検証無料AIツールだけで動画は作れるか 工程を棚卸ししたら、有料なのは1箇所だけだった
- 検証Gemini無料版の制限 公式ヘルプで確認できた具体的な数字
- 研究GitLost──GitHub Issueを1つ立てるだけでプライベートリポジトリの中身を公開させた脆弱性
- 研究動画生成AIの採点に「なぜそのスコアか」を残す HarnessEval-Wはサブエージェントを分業させて評価の根拠を証拠の木にする
- 検証huggingface_hubに「revisionを1回だけ解決する」機能とパストラバーサル脆弱性の修正が同時収録された
- 検証huggingface_hub v1.26.0 revision解決を1回に集約するresolve_revisionと、UNCパスでNetNTLMv2ハッシュが盗まれるCVE-2026-15717の修正
- 検証OfflineでもParakeet TDT V3が使えるLinuxネイティブ音声入力ツール「hyprwhspr」
- 研究『意味を教えていない10個の数字』でLLMエージェントは示し合わせ始める
- 活用ローカルAIをChatGPTのような画面で使う手順 ブラウザチャットUIの作り方
- 活用ローカルLLMでコーディングエージェントは実用になるか Ollamaで動かした結果
- 活用ローカルAIの画像生成は単体グラボなしでも動くのか 条件で見る判定
- 活用ローカルLLMは音声対話に向かないのか 「1〜2秒」の壁をハードウェアごとに検証する
- 研究90年代SNMPの階層設計をMCPに移植する 『取り消せない操作』は確認待ちにするMCP-AXを読む
- 研究『前バージョンの主張は誤りだった』と自分で書く珍しいIETFドラフト MCPサーバーをDNSで見つけるdraft-morrison-mcp-dns-discoveryを読む
- 検証MiniMax公式CLI「mmx」は「MiniMax Code」と別物 テキスト・画像・動画・音声を1コマンドで叩くツールの中身
- 検証MiniMax H3が「非公開」にした変換層を、有志が3つ独立に作っていた H3-Context-IRを覗く
- モデルMiniMaxが4モデル全部にセルフホストガイドを揃えていた 「Stable/Preview/Experimental」という成熟度表示の中身
- 検証MiniMax公式Skillsマーケット、CREDITS.mdをたどるとAnthropicの公式リポジトリに行き着いた
- 検証個人開発のharnessが、DeepSeekの新製品と同じ日にProduct Huntへ出て1つ上に付けた話
- 検証『稼働コスト表示』が実は59%過少だったバグ 累積カウンタの復元をポストモーテムで読む
- 検証バー・ランチャー・通知・壁紙を1つのシェルに統合するNoctalia Qt/GTKに依存しないWayland環境
- 活用Ollamaでディスクが埋まった時にやること モデルの保存先変更と削除コマンド
- 検証SIPを切らずにmacOSをomarchy風タイリング環境にするOmacosy 要求する権限を1つずつ確認する
- 業界OpenAIが「Agentic Risk Analyst」を募集している エージェント固有のリスクだけを見る専門職の中身
- 業界OpenAI幹部の退社が止まらない 8月だけでCOO・データセンター責任者が相次いで離脱
- モデルgpt-3.5-turbo・gpt-4・o1が2026年10月23日に一斉停止 対象17系統の全リストと移行先
- プロダクトOpenAIの「Programmatic Tool Calling」 モデルがコードを書いてツールを並列実行し、中間結果を圧縮する
- 活用プロンプトキャッシュが効いていない時のサイン OpenAI公式ドキュメントが認める「キャッシュが逆に高くつく」5パターン
- 業界OpenAIが『再帰的自己改善』専任の安全研究者を募集している Preparednessチームの求人票を読む
- 研究モデル署名だけじゃない OpenSSFのAI/MLセキュリティWGが同時に動かす7つのプロジェクト
- 検証ACPのサーバーにもクライアントにもなれる AI基盤モデル企業Poolsideのコーディングエージェント「pool」
- 研究『できること』ではなく『やりたがること』を測る PropensityBenchが導入した安全性評価の軸
- 研究自動化は「3つの波」でやってくる PwCが2018年に29カ国のデータで試算した中身
- 研究DDR5の新Rowhammer対策「PRAC」は最初から破られていた QPRACが指摘した2つの先行案の欠陥
- 検証1つのモジュールをターミナル・ブラウザ・SSH・AIエージェントの4画面に同時描画するRaxol、その仕組みを読む
- 研究SIPを作った人物と同姓同名の技術者が、AIエージェント通信の個人ドラフトを書いては失効させている
- 研究企業のID管理標準SCIMに『AIエージェント』という新しいリソース型を足す提案を読む
- プロダクトSesameの「インテリジェント・アイウェア」 Oculus共同創業者が2027年に投入するAIメガネで、今わかっていること
- 業界Sierra Agent Studioとは何か 求人票から見えた機能の中身
- 業界「トークンマキシング」を追う 燃やした量を成果と呼んでいた数ヶ月間
- 検証Apple SiliconのMacで、Linuxディストロ「Omarchy」をそのまま動かすTry Omarchyというアプリ
- 検証Unsloth Desktopの「Auto Compaction」 古い会話を消さずに検索可能なアーカイブへ逃がす設計
- 業界動画編集の資格・スクールはAI時代に意味があるか 民間資格の実態から考える
- 検証WebMCPチャレンジ、応募締切は日本時間9月4日午前5時 OpenAI主催ハッカソンの要項と、日本から出す条件
- 業界WebMCPとは ウェブページ自身が「AIエージェント用の取扱説明書」を持つ新標準、ChromeとSafariで実装状況が分かれる
- 検証Zedから使えるOpenCode Zen/Goにモデルが増え、「Free」は丸ごと消えた 1本のPRから見る model カタログの裏側