オープンソース・オープンウェイトの記事
「オープンソース・オープンウェイト」に関連するAIニュースと解説、159本。新しい順に並べています。
オープンソース・オープンウェイト の記事:159件
Anthropic、Claudeがオープンソースの生体分子モデル30超を4週間弱で平均約4倍高速化 三角注意のカーネル「FlashPairformer」は既存標準比2.7〜2.9倍、「Big」モードで1万トークン超のリボソーム等を1ノードで予測。結合タンパク質の設計はH200 1枚・約150ドルで前回(GPU時間100分の1)と同等。Adaptyv Bioと設計コンペ、クレジット最大100万ドル
Anthropic、Claudeがオープンソースの生体分子モデル30超を4週間弱で平均約4倍高速化三角注意のカーネル「FlashPairformer」は既存標準比2.7〜2.9倍、「Big」モードで1万トークン超のリボソーム等を1ノードで予測。結合タンパク質の設計はH200 1枚・約150ドルで前回(GPU時間100分の1)と同等。Adaptyv Bioと設計コンペ、クレジット最大100万ドル
検証
Google「Credentio」 C2PAコンテンツ認証情報を検証するC++ライブラリをオープンソース化。約40のGoogle製品で数百億件の生成物を扱ってきたのと同じコードで、仕様2.2と2.4に対応。完全にローカルで検証(送信なし・即時判定)、数GBの動画でもメモリ消費は小さく、公式のC2PA Trust Listを渡せる。生成・埋め込みは今後
Google「Credentio」C2PAコンテンツ認証情報を検証するC++ライブラリをオープンソース化。約40のGoogle製品で数百億件の生成物を扱ってきたのと同じコードで、仕様2.2と2.4に対応。完全にローカルで検証(送信なし・即時判定)、数GBの動画でもメモリ消費は小さく、公式のC2PA Trust Listを渡せる。生成・埋め込みは今後
検証
Raspberry Pi 5でGemma 4 E2Bをオフライン実行 LiteRT-LMでプリフィル99トークン/秒・デコード9トークン/秒・ピークメモリ1,432MB、生成は約300語/分(人の会話の2倍)。GPUにYOLOの物体検出を逃がし、CPUでMoonshineの音声認識・Gemma・TTSを回すReachy Miniロボットの構成。pip install litert-cliで開始
Raspberry Pi 5でGemma 4 E2Bをオフライン実行LiteRT-LMでプリフィル99トークン/秒・デコード9トークン/秒・ピークメモリ1,432MB、生成は約300語/分(人の会話の2倍)。GPUにYOLOの物体検出を逃がし、CPUでMoonshineの音声認識・Gemma・TTSを回すReachy Miniロボットの構成。pip install litert-cliで開始
検証
Google「LiteRT.js」 .tfliteモデルをブラウザで動かすJavaScript版LiteRT。TensorFlow.jsのJSカーネルでなくネイティブのランタイムをWebAssemblyで提供し、CPU(XNNPACK)・GPU(WebGPU)・NPU(WebNN)を使い分け。他のWebランタイム比で最大3倍、CPU比でGPU/NPUは5〜60倍
Google「LiteRT.js」.tfliteモデルをブラウザで動かすJavaScript版LiteRT。TensorFlow.jsのJSカーネルでなくネイティブのランタイムをWebAssemblyで提供し、CPU(XNNPACK)・GPU(WebGPU)・NPU(WebNN)を使い分け。他のWebランタイム比で最大3倍、CPU比でGPU/NPUは5〜60倍
検証
Google DeepMind「クライアントSDKの生成はオープンであるべき」 2026年5月、使っていたSDK生成ベンダーが買収され突然の終了。Interactions APIのGA直前に乗り換え、Speakeasyと組んでOpenAPI生成スイートをAGPLv3でオープンソース化。7言語のSDK・エージェント向けCLI・ドキュメントMCPサーバーを生成、6ターゲットを約1人で保守
Google DeepMind「クライアントSDKの生成はオープンであるべき」2026年5月、使っていたSDK生成ベンダーが買収され突然の終了。Interactions APIのGA直前に乗り換え、Speakeasyと組んでOpenAPI生成スイートをAGPLv3でオープンソース化。7言語のSDK・エージェント向けCLI・ドキュメントMCPサーバーを生成、6ターゲットを約1人で保守
検証
Google「autofinetune」 仕様書1枚を書いて寝ると、エージェントが一晩でLoRAのランク・学習率・バッチを探索し、改善したコミットだけGitに残す。TPU v5eでFunctionGemma 270MのSFTを20回、TPU v6eでGemma 3 1BのGRPOを40回回し報酬約10%改善。Tunix+Antigravity CLI+Gemini 3.7 Flash
Google「autofinetune」仕様書1枚を書いて寝ると、エージェントが一晩でLoRAのランク・学習率・バッチを探索し、改善したコミットだけGitに残す。TPU v5eでFunctionGemma 270MのSFTを20回、TPU v6eでGemma 3 1BのGRPOを40回回し報酬約10%改善。Tunix+Antigravity CLI+Gemini 3.7 Flash
検証
Cline、日本からオープンウェイトモデルを配信する「ai&」に新規対応(既定モデルGLM 5.3) DesktopアプリもLinux初対応
Cline、日本からオープンウェイトモデルを配信する「ai&」に新規対応(既定モデルGLM 5.3)DesktopアプリもLinux初対応
検証
Google「ADK for Kotlin 1.0」が正式版 Python版・Java版のADK 1.0と同じ機能に加え、Android向けの端末内エージェント(LiteRT-LM・ML Kitベータ)、Firebase AI Logicのハイブリッド、RoomとAppSearchで状態の保存。@Toolと@Paramでスキーマを自動生成、SKILL.mdで手順を段階的に読む
Google「ADK for Kotlin 1.0」が正式版Python版・Java版のADK 1.0と同じ機能に加え、Android向けの端末内エージェント(LiteRT-LM・ML Kitベータ)、Firebase AI Logicのハイブリッド、RoomとAppSearchで状態の保存。@Toolと@Paramでスキーマを自動生成、SKILL.mdで手順を段階的に読む
検証
Google×HHMI Janeliaがオスのショウジョウバエの脳と中枢神経系の完全な配線図を公開 16万6,000超のニューロン・1億2,500万のシナプス結合で「ニューロン数で史上最大の脳地図」。AIが電子顕微鏡画像を3D再構成し、人が校正。メスの地図と比べて求愛・攻撃の回路を調べられる。次は魚の脳全体
Google×HHMI Janeliaがオスのショウジョウバエの脳と中枢神経系の完全な配線図を公開16万6,000超のニューロン・1億2,500万のシナプス結合で「ニューロン数で史上最大の脳地図」。AIが電子顕微鏡画像を3D再構成し、人が校正。メスの地図と比べて求愛・攻撃の回路を調べられる。次は魚の脳全体
研究
Tencentが文書解析AI「WeVisDoc」をオープンウェイト公開 OmniDocBench v1.6で95.38、end-to-end型パーサーの比較で首位と主張
Tencentが文書解析AI「WeVisDoc」をオープンウェイト公開OmniDocBench v1.6で95.38、end-to-end型パーサーの比較で首位と主張
モデル
政府AI『源内』OSS Ver2.0は2027年2月ごろ公開予定 『エージェントチャット』『源内工房』の中身と、民間・自治体が使える範囲
政府AI『源内』OSS Ver2.0は2027年2月ごろ公開予定『エージェントチャット』『源内工房』の中身と、民間・自治体が使える範囲
業界
4万行のFortran 77をAIエージェントでC++に移した記録 Mistralが公開した3つの教訓:①移行コードを書く前に「数値の一致」を証明するパリティハーネスを作る、②100超のエージェントでまず文書化、③完全自律は「Fortranを C++の文法で書き直しただけ」になり、人がゲートに立つ構造化ワークフローに落ち着いた
4万行のFortran 77をAIエージェントでC++に移した記録Mistralが公開した3つの教訓:①移行コードを書く前に「数値の一致」を証明するパリティハーネスを作る、②100超のエージェントでまず文書化、③完全自律は「Fortranを C++の文法で書き直しただけ」になり、人がゲートに立つ構造化ワークフローに落ち着いた
活用
AUTOMATIC1111の機能をGradioの「Workflow」で作り直した「Workflow1111」 73ノード・11パイプライン、GPUなしで動く(推論はInference ProvidersとSpaces)、出力は自動でREST APIとMCPツールに。ComfyUIとの違いをHugging Faceが整理
AUTOMATIC1111の機能をGradioの「Workflow」で作り直した「Workflow1111」73ノード・11パイプライン、GPUなしで動く(推論はInference ProvidersとSpaces)、出力は自動でREST APIとMCPツールに。ComfyUIとの違いをHugging Faceが整理
検証
FirefoxのAIブラウジング「Smart Window」(ベータ)がMistralのモデルで動く フランスと北米から、英国・ドイツは年内。会話はMozillaのサーバーに既定で保存せず、Mistralはゼロデータ保持。ChatGPT Atlas・Perplexity Comet・Claude in Chromeに対する「オープンソース2社」の答え
FirefoxのAIブラウジング「Smart Window」(ベータ)がMistralのモデルで動くフランスと北米から、英国・ドイツは年内。会話はMozillaのサーバーに既定で保存せず、Mistralはゼロデータ保持。ChatGPT Atlas・Perplexity Comet・Claude in Chromeに対する「オープンソース2社」の答え
プロダクト
PFNの9月7〜16日 三菱重工が100億円出資で資本業務提携(社会インフラ・ナショナルセキュリティ)、屋内ロボット向け2B級モデル「PLaMo-SemGround」をGENIACで開発、国交省の発注・審査を支援するAIエージェントをデロイトと検証、Rustで書き直した「Rustuna」は最大1,000倍速
PFNの9月7〜16日三菱重工が100億円出資で資本業務提携(社会インフラ・ナショナルセキュリティ)、屋内ロボット向け2B級モデル「PLaMo-SemGround」をGENIACで開発、国交省の発注・審査を支援するAIエージェントをデロイトと検証、Rustで書き直した「Rustuna」は最大1,000倍速
業界
Qwen4とは──9月22日の雲栖大会で「Qwen4 Series Coming Soon」として Qwen4-Max/Flash & Plus/27B の3枠が出た。公式プレスリリースは「訓練中」「4.5・5は5〜10兆パラメータ」まで。「人間ゼロ介入で33回の自己改善」の主張と、Artificial Analysisで実測した現行Maxの位置(45・首位53)
Qwen4とは──9月22日の雲栖大会で「Qwen4 Series Coming Soon」として Qwen4-Max/Flash & Plus/27B の3枠が出た。公式プレスリリースは「訓練中」「4.5・5は5〜10兆パラメータ」まで。「人間ゼロ介入で33回の自己改善」の主張と、Artificial Analysisで実測した現行Maxの位置(45・首位53)
モデル
XiaomiがMiMo-V2.6を公開 1.02兆パラメータのオープンウェイト、公式掲載のArtificial Analysis指数46、価格はV2.5据え置き
XiaomiがMiMo-V2.6を公開1.02兆パラメータのオープンウェイト、公式掲載のArtificial Analysis指数46、価格はV2.5据え置き
モデル
Mistral AIが30億ユーロを調達、評価額210億ユーロ超 欧州テック史上最大の株式調達をサムスン電子が主導、「主権を保てるオープンウェイトAI」を旗印に20か国・125社超へ
Mistral AIが30億ユーロを調達、評価額210億ユーロ超欧州テック史上最大の株式調達をサムスン電子が主導、「主権を保てるオープンウェイトAI」を旗印に20か国・125社超へ
業界
Alibaba、Qwen-Image-2.1の重みを公開 絵を描く部分は7B、自社ベンチで29モデル中7位(Nano Banana 2.0より上)、透明PNGと参照10枚の編集を1モデルで。ライセンスは研究限定
Alibaba、Qwen-Image-2.1の重みを公開絵を描く部分は7B、自社ベンチで29モデル中7位(Nano Banana 2.0より上)、透明PNGと参照10枚の編集を1モデルで。ライセンスは研究限定
モデル
2026年8月のAIニュース46本まとめ 中国勢の激安高性能モデルが月末に集中、米2社は主力モデルなし、OpenAIがCursorを切った月【月刊AIニュース】
2026年8月のAIニュース46本まとめ中国勢の激安高性能モデルが月末に集中、米2社は主力モデルなし、OpenAIがCursorを切った月【月刊AIニュース】
業界
DeepSeek-V4.1-Flash公開 出力100万トークン0.6ドル、KVキャッシュは1トークン890バイト
DeepSeek-V4.1-Flash公開出力100万トークン0.6ドル、KVキャッシュは1トークン890バイト
モデル
『コンテナランタイムは汎用ワークロード向けに作られた、AI推論は汎用ワークロードではない』 Basetenの専門チームを求人票から読む
『コンテナランタイムは汎用ワークロード向けに作られた、AI推論は汎用ワークロードではない』Basetenの専門チームを求人票から読む
研究
DSPy 3.3.0の実験機能「Flex」「ReActV2」 プロンプトでなくプログラムの構造そのものをGEPAに最適化させる
DSPy 3.3.0の実験機能「Flex」「ReActV2」プロンプトでなくプログラムの構造そのものをGEPAに最適化させる
研究
コーディングエージェントの「なぜ高くつくのか」を見えるようにする Frugal Tokens
コーディングエージェントの「なぜ高くつくのか」を見えるようにする Frugal Tokens
検証