Alibaba (Qwen) が Qwen3.5-35B-A3B-Base-W128K-L0_100 をリリース ── Qwenの頭の中を覗き見るSAE解釈モジュール
アリババがQwen3.5用のSAE解釈モジュール「Qwen-Scope」をリリース。全40層対応、TopK=100のSparse Autoencoderでモデル内部を解析可能。
アリババがQwen3.5用のSAE解釈モジュール「Qwen-Scope」をリリース。全40層対応、TopK=100のSparse Autoencoderでモデル内部を解析可能。
Mistralの最新統合モデル「Mistral Medium 3.5」が登場。128Bパラメータ、256kコンテキスト、画像対応。
Tencentが超軽量翻訳モデル「Hy-MT1.5-1.8B-1.25bit」をリリース。440MBでスマホオフライン動作可能な驚異的な1.25ビット量子化を実現。
DeepSeek-V4が100万トークン対応で登場。推論FLOPs27%削減の超効率アーキテクチャ。HuggingFaceで公開中。
DeepSeek-V4がリリース。100万トークン対応でKVキャッシュをV3.2の10%に削減、オープンソース最高峰を宣言
Tencentが実世界ロボット向け基盤モデルHY-Embodied-0.5-XをOSS公開。4B/2Bのエッジサイズで10ベンチマークSOTA達成。
Tencentが総パラメータ295Bの巨大MoEモデル「Hy3-preview-Base」を公開。アクティブ21Bで競合を凌駕。
Tencentが295B MoEモデルHy3-previewを公開。アクティブ21BでDeepSeek-V3に肉薄、コード・エージェント性能が突出。
AlibabaのQwen3.6-27Bが登場。エージェント型コーディング能力が大幅向上し、Terminal-Benchで驚異のスコアを記録した27Bモデル。
Moonshot AIがKimi-K2.6をオープンソースで公開。1T/32B MoE、256Kコンテキスト、エージェントスウォーム対応。DeepSearchQAでGPT-5.4を大幅に上回るスコアを記録。