2026年7月28日 火曜日
AI時短ラボ

新モデルのニュース

Kimi K3の重みが公開された──1.56TBの中身を開けて、公称スペックを全部数え直したの記事画像
モデル07.28読了16

Kimi K3の重みが公開された──1.56TBの中身を開けて、公称スペックを全部数え直した

出典 ─ Kimi K3 Technical Repo
Claude Opus 5が登場──価格据え置きでFable 5級の知能、アライメントは歴代最高の記事画像
モデル07.25読了9

Claude Opus 5が登場──価格据え置きでFable 5級の知能、アライメントは歴代最高

出典 ─ Anthropic公式「Claude Opu
Google、Gemini 3.6 Flashなど3モデルを同時発表──出力トークン17%減・長文1Mで54.0%、一方でコーディング4種目は1位ゼロの記事画像
モデル07.22読了13

Google、Gemini 3.6 Flashなど3モデルを同時発表──出力トークン17%減・長文1Mで54.0%、一方でコーディング4種目は1位ゼロ

出典 ─ Google公式ブログ: Introduci
Sakana AI、サイバー特化『Fugu-Cyber』発表──CyberGymで86.9・GPT-5.5-CyberとMythos Previewを上回るの記事画像
モデル07.22読了10

Sakana AI、サイバー特化『Fugu-Cyber』発表──CyberGymで86.9・GPT-5.5-CyberとMythos Previewを上回る

出典 ─ Sakana AI公式ブログ: Introd
Kimi K3正式発表──2.8兆パラメータ・世界初のオープン3Tクラス、公式ベンチでOpus 4.8とGPT-5.5をほぼ全種目で上回るの記事画像
モデル07.17読了8

Kimi K3正式発表──2.8兆パラメータ・世界初のオープン3Tクラス、公式ベンチでOpus 4.8とGPT-5.5をほぼ全種目で上回る

出典 ─ Kimi公式ブログ: Kimi K3
Meta、Muse Spark 1.1を発表──エージェント系ベンチ4つで1位、初のAPI提供も同時開始の記事画像
モデル07.09読了5

Meta、Muse Spark 1.1を発表──エージェント系ベンチ4つで1位、初のAPI提供も同時開始

出典 ─ Meta AI公式
OpenAI、GPT-5.6を一般提供開始──Sol・Terra・Lunaの3モデル同時投入、Fableを複数ベンチで上回るの記事画像
モデル07.09読了7

OpenAI、GPT-5.6を一般提供開始──Sol・Terra・Lunaの3モデル同時投入、Fableを複数ベンチで上回る

出典 ─ OpenAI公式
Fable 5のプロモーション期間が7月12日まで延長──GPT-5.6一般公開直前の5日間の記事画像
モデル07.08読了5

Fable 5のプロモーション期間が7月12日まで延長──GPT-5.6一般公開直前の5日間

出典 ─ Claude Fable 5 Promoti
xAI、Grok 4.5を発表──ベンチ1位はゼロだがトークン効率4.2倍・入力$2出力$6で別の土俵への記事画像
モデル07.08読了5

xAI、Grok 4.5を発表──ベンチ1位はゼロだがトークン効率4.2倍・入力$2出力$6で別の土俵へ

出典 ─ xAI公式
Claude Sonnet 5リリース──Opus級の性能を半額以下で全プラン開放の記事画像
モデル07.01読了5

Claude Sonnet 5リリース──Opus級の性能を半額以下で全プラン開放

出典 ─ Anthropic公式ブログ
Fable 5が条件つきで復活──7月7日まで50%枠、以降は従量課金の記事画像
モデル07.01読了4

Fable 5が条件つきで復活──7月7日まで50%枠、以降は従量課金

出典 ─ Anthropic公式声明
Google、Gemini 2.5 ProにDeep Think推論モードを追加――MMLU-Pro 89.8%で公開モデル首位を主張の記事画像
モデル06.26読了10

Google、Gemini 2.5 ProにDeep Think推論モードを追加――MMLU-Pro 89.8%で公開モデル首位を主張

出典 ─ Google Blog
JTLスコア v3──24モデルを「性能・体感・コスパ」3軸で本気比較した(2026年6月版)の記事画像
モデル06.25読了12

JTLスコア v3──24モデルを「性能・体感・コスパ」3軸で本気比較した(2026年6月版)

出典 ─ llm-stats.com(ベンチマークデー
PFNが「PLaMo 3.0 Prime」公開──日本語性能でGPT-5.4 Miniに並び、コスト半額以下の記事画像
モデル06.22読了4

PFNが「PLaMo 3.0 Prime」公開──日本語性能でGPT-5.4 Miniに並び、コスト半額以下

出典 ─ PFN公式ブログ「PLaMo 3.0 Pri
日本のSakana AIが「Fugu」発表──複数AIを束ねてClaude Opus 4.8を超えるベンチマークの記事画像
モデル06.22読了7

日本のSakana AIが「Fugu」発表──複数AIを束ねてClaude Opus 4.8を超えるベンチマーク

出典 ─ Sakana AI 公式「Fugu」発表ペー
MiniMax M3──428Bパラメータ・100万トークン文脈のオープンウェイト中国モデルの記事画像
モデル06.21読了6

MiniMax M3──428Bパラメータ・100万トークン文脈のオープンウェイト中国モデル

出典 ─ MiniMax Blog
NVIDIA Cosmos 3発表──物理AIのためのオープンなオムニモデルの記事画像
モデル06.21読了7

NVIDIA Cosmos 3発表──物理AIのためのオープンなオムニモデル

出典 ─ NVIDIA Newsroom
Google、ローカル動作の拡散型テキスト生成モデル「Diffusion Gemma」を公開の記事画像
モデル06.20読了4

Google、ローカル動作の拡散型テキスト生成モデル「Diffusion Gemma」を公開

出典 ─ Diffusion Gemma - Goog
Claude 3.5/4 料金・性能比較・ChatGPTとの違い【2026年版】の記事画像
モデル06.19読了9

Claude 3.5/4 料金・性能比較・ChatGPTとの違い【2026年版】

出典 ─ Claude Pricing | Anthr
GPT-5はいつ出た?GPT-5.5までの性能・料金まとめ【2026年版】の記事画像
モデル06.19読了6

GPT-5はいつ出た?GPT-5.5までの性能・料金まとめ【2026年版】

出典 ─ OpenAI公式
Llama 4 ローカルで動かす方法・性能・ライセンス【Meta 2026年】の記事画像
モデル06.19読了9

Llama 4 ローカルで動かす方法・性能・ライセンス【Meta 2026年】

出典 ─ CoderSera
中国Zhipu AIがGLM-5.2を公開──100万トークン対応・MIT重み公開予定のコーディング特化モデルの記事画像
モデル06.13読了5

中国Zhipu AIがGLM-5.2を公開──100万トークン対応・MIT重み公開予定のコーディング特化モデル

出典 ─ 1M Context, Coding-First (June 2026)
Moonshot AIがKimi K2.7-Codeを公開──1Tパラメータ・推論トークン30%削減のコーディングモデルの記事画像
モデル06.12読了5

Moonshot AIがKimi K2.7-Codeを公開──1Tパラメータ・推論トークン30%削減のコーディングモデル

出典 ─ MarkTechPost
Claude Fable 5 完全ガイド ― 何が強く、何がブロックされ、いくらかかるのかの記事画像
モデル06.11読了9

Claude Fable 5 完全ガイド ― 何が強く、何がブロックされ、いくらかかるのか

出典 ─ Anthropic実機検証
Microsoft、Build 2026で自社初の推論モデル「MAI-Thinking-1」を発表の記事画像
モデル06.02読了4

Microsoft、Build 2026で自社初の推論モデル「MAI-Thinking-1」を発表

出典 ─ Thurrott
Anthropic、Claude Opus 4.8を公開 ― エージェント性能とコスト効率を強化の記事画像
モデル05.28読了4

Anthropic、Claude Opus 4.8を公開 ― エージェント性能とコスト効率を強化

出典 ─ Anthropic
Claude Opus 4.8登場、回答の「がんばり度」を選べるEffort Controlを追加の記事画像
モデル05.28読了3

Claude Opus 4.8登場、回答の「がんばり度」を選べるEffort Controlを追加

出典 ─ Introducing Claude Opu
Google I/O 2026、「Gemini 3.5 Flash」を発表 ― エージェント・コーディング特化の記事画像
モデル05.20読了3

Google I/O 2026、「Gemini 3.5 Flash」を発表 ― エージェント・コーディング特化

出典 ─ Google Cloud Blog
OpenAI、ChatGPTの新デフォルト「GPT-5.5 Instant」を投入 ― 幻覚を大幅削減の記事画像
モデル05.05読了3

OpenAI、ChatGPTの新デフォルト「GPT-5.5 Instant」を投入 ― 幻覚を大幅削減

出典 ─ OpenAI
xAI、コスト効率型『Grok 4.3』と専用コーディングモデル『Grok Build 0.1』を投入の記事画像
モデル05.04読了3

xAI、コスト効率型『Grok 4.3』と専用コーディングモデル『Grok Build 0.1』を投入

出典 ─ Basenor