Hugging Face が Mellum2: A 12B Mixture-of-Experts Model by JetBrains をリリース ── 12BパラメータのMoE、推論は2.5Bで2倍速
JetBrainsのMoEモデル「Mellum2」が12Bパラメータで登場。推論時は2.5Bのみ活性化し、2倍の高速性を実現。Apache 2.0ライセンス。
JetBrainsのMoEモデル「Mellum2」が12Bパラメータで登場。推論時は2.5Bのみ活性化し、2倍の高速性を実現。Apache 2.0ライセンス。
IBM Researchが提唱する企業AI導入の鍵「Agent Logic」とは。LLMのハルシネーションを抑え、業務フローを制御する手法。
NVIDIA Cosmos 3は物理AI向けオムニモデル。MoT採用で生成・推論・アクションを1モデルに統合。Hugging Faceで公開中。
OpenAIが最先端AIモデルの安全性を確認するための第三者評価ガイドラインを公開。モデルの能力やセーフガードの評価方法を解説。
BraintrustがCodexとGPT-5.5を活用し顧客リクエストを高速でコード化する事例をOpenAIが公開。
OpenAIがバイオ防御・パンデミック対策に特化したRosalind Biodefenseを立ち上げ、審査済み開発者と米政府パートナーにGPT-Rosalindのアクセスを拡大した。
Hugging FaceがPyTorchプロファイリング入門連載を開始。行列積からトレースの読み方やtorch.compileの変化を解説。
EndavaがCodexで要件分析を数週間から数時間に短縮。agentic organization構築のリアルな事例が公開された。
ターミナルアプリWarpがOpenAIの「GPT-5.5」を導入。ローカルやクラウドなど複数環境を横断するコーディングエージェントの統合を発表。
IBMとArtificial Analysisがエージェント型ITベンチマーク「ITBench-AA」を公開。最先端モデルでも正答率50%未満という結果に。