DeepSeek が DeepSeek-V4.1 を投入 ── 1MトークンでもKVキャッシュが1/4に
DeepSeekがDeepSeek-V4.1-Flashを公開。552Bパラメータで1Mトークン対応、KVキャッシュを1/4に圧縮する新技術CSA2などを搭載。
DeepSeekがDeepSeek-V4.1-Flashを公開。552Bパラメータで1Mトークン対応、KVキャッシュを1/4に圧縮する新技術CSA2などを搭載。
Tencentが公開したEVIE-4.5Bは、学習不要の圧縮技術で100万ページの文書インデックスを3.81GiBにまで縮小。ViDoRe V3で高精度を検証済み。
TencentのEVIE-8Bがオープンソース化。画像ドキュメント検索でViDoRe V3のnDCG@10 66.75を記録し、表やグラフの構造理解で競合を圧倒。
Alibaba (Qwen) が Qwen-Drive-1.0-4B を投入。Qwen3.5-4Bをベースに、3D認識と経路計画を統合した自動運転向けVLM。NAVSIMでPDMS 90.7を記録。
Zhipu AIがGLM-5.3を公開。ベースモデル不変のままポストトレーニングで性能を引き上げ、サイバーセキュリティ能力がGLM-5.2比2倍に急増した。
Tencentが公開したContextPilot-14B。Qwen3-14Bベースで、強化学習によりエージェント自身がコンテキストを整理・記憶する能力を強化。長文脈タスク向け。
Tencentが公開したContextPilot-E4Bは、強化学習でエージェントのコンテキスト管理能力を鍛えたモデル。長期推論におけるメモリ肥大化問題を自律的に解決するフレームワークを提供する。
DeepSeek-V4初のマルチモーダル実験モデル「Flash-Vision-Exp」が登場。視覚エージェント能力でOpus-4.8に肉薄し、テキスト性能も維持。オープンソースで公開。
Zhipu AIが公開したGLM-5.3-Flash。18BアクティブパラメータでClaude Opus 4.8級の実力を実現し、推論コストを1/10に削減したハイブリッドアテンションモデルです。
Zhipu AIがGLM-5.3を公開。ポストトレーニングのみでコーディング性能50%向上、サイバーエクスプロイト能力が前モデル比2倍以上に急成長したオープンソースモデル。