新モデルのニュース
モデル07.28読了16分
Kimi K3の重みが公開された──1.56TBの中身を開けて、公称スペックを全部数え直した
出典 ─ Kimi K3 Technical Repo
モデル07.25読了9分
Claude Opus 5が登場──価格据え置きでFable 5級の知能、アライメントは歴代最高
出典 ─ Anthropic公式「Claude Opu
モデル07.22読了13分
Google、Gemini 3.6 Flashなど3モデルを同時発表──出力トークン17%減・長文1Mで54.0%、一方でコーディング4種目は1位ゼロ
出典 ─ Google公式ブログ: Introduci
モデル07.22読了10分
Sakana AI、サイバー特化『Fugu-Cyber』発表──CyberGymで86.9・GPT-5.5-CyberとMythos Previewを上回る
出典 ─ Sakana AI公式ブログ: Introd
モデル07.17読了8分
Kimi K3正式発表──2.8兆パラメータ・世界初のオープン3Tクラス、公式ベンチでOpus 4.8とGPT-5.5をほぼ全種目で上回る
出典 ─ Kimi公式ブログ: Kimi K3
モデル07.09読了5分
Meta、Muse Spark 1.1を発表──エージェント系ベンチ4つで1位、初のAPI提供も同時開始
出典 ─ Meta AI公式
モデル07.09読了7分
OpenAI、GPT-5.6を一般提供開始──Sol・Terra・Lunaの3モデル同時投入、Fableを複数ベンチで上回る
出典 ─ OpenAI公式
モデル07.08読了5分
Fable 5のプロモーション期間が7月12日まで延長──GPT-5.6一般公開直前の5日間
出典 ─ Claude Fable 5 Promoti
モデル07.08読了5分
xAI、Grok 4.5を発表──ベンチ1位はゼロだがトークン効率4.2倍・入力$2出力$6で別の土俵へ
出典 ─ xAI公式
モデル07.01読了5分
Claude Sonnet 5リリース──Opus級の性能を半額以下で全プラン開放
出典 ─ Anthropic公式ブログ
モデル07.01読了4分
Fable 5が条件つきで復活──7月7日まで50%枠、以降は従量課金
出典 ─ Anthropic公式声明
モデル06.26読了10分
Google、Gemini 2.5 ProにDeep Think推論モードを追加――MMLU-Pro 89.8%で公開モデル首位を主張
出典 ─ Google Blog
モデル06.25読了12分
JTLスコア v3──24モデルを「性能・体感・コスパ」3軸で本気比較した(2026年6月版)
出典 ─ llm-stats.com(ベンチマークデー
モデル06.22読了4分
PFNが「PLaMo 3.0 Prime」公開──日本語性能でGPT-5.4 Miniに並び、コスト半額以下
出典 ─ PFN公式ブログ「PLaMo 3.0 Pri
モデル06.22読了7分
日本のSakana AIが「Fugu」発表──複数AIを束ねてClaude Opus 4.8を超えるベンチマーク
出典 ─ Sakana AI 公式「Fugu」発表ペー
モデル06.21読了6分
MiniMax M3──428Bパラメータ・100万トークン文脈のオープンウェイト中国モデル
出典 ─ MiniMax Blog
モデル06.21読了7分
NVIDIA Cosmos 3発表──物理AIのためのオープンなオムニモデル
出典 ─ NVIDIA Newsroom
モデル06.20読了4分
Google、ローカル動作の拡散型テキスト生成モデル「Diffusion Gemma」を公開
出典 ─ Diffusion Gemma - Goog
モデル06.19読了9分
Claude 3.5/4 料金・性能比較・ChatGPTとの違い【2026年版】
出典 ─ Claude Pricing | Anthr
モデル06.19読了6分
GPT-5はいつ出た?GPT-5.5までの性能・料金まとめ【2026年版】
出典 ─ OpenAI公式
モデル06.19読了9分
Llama 4 ローカルで動かす方法・性能・ライセンス【Meta 2026年】
出典 ─ CoderSera
モデル06.13読了5分
中国Zhipu AIがGLM-5.2を公開──100万トークン対応・MIT重み公開予定のコーディング特化モデル
出典 ─ 1M Context, Coding-First (June 2026)
モデル06.12読了5分
Moonshot AIがKimi K2.7-Codeを公開──1Tパラメータ・推論トークン30%削減のコーディングモデル
出典 ─ MarkTechPost

モデル06.11読了9分
Claude Fable 5 完全ガイド ― 何が強く、何がブロックされ、いくらかかるのか
出典 ─ Anthropic実機検証
モデル06.02読了4分
Microsoft、Build 2026で自社初の推論モデル「MAI-Thinking-1」を発表
出典 ─ Thurrott

モデル05.28読了4分
Anthropic、Claude Opus 4.8を公開 ― エージェント性能とコスト効率を強化
出典 ─ Anthropic

モデル05.28読了3分
Claude Opus 4.8登場、回答の「がんばり度」を選べるEffort Controlを追加
出典 ─ Introducing Claude Opu

モデル05.20読了3分
Google I/O 2026、「Gemini 3.5 Flash」を発表 ― エージェント・コーディング特化
出典 ─ Google Cloud Blog
モデル05.05読了3分
OpenAI、ChatGPTの新デフォルト「GPT-5.5 Instant」を投入 ― 幻覚を大幅削減
出典 ─ OpenAI
モデル05.04読了3分
xAI、コスト効率型『Grok 4.3』と専用コーディングモデル『Grok Build 0.1』を投入
出典 ─ Basenor