ByteDance が SimArt を公開 ── 可動する3D構造をマルチモーダル入力から生成
ByteDanceがSimArtの重みを公開。Qwen3-VL-8Bベースのモデルで、マルチモーダル入力から関節付き3D構造を生成。
ByteDanceがSimArtの重みを公開。Qwen3-VL-8Bベースのモデルで、マルチモーダル入力から関節付き3D構造を生成。
Alibabaが画像生成(T2I)の品質を自動評価するQwen-Image-Benchを公開。Qwen3.6-27BベースのQ-Judgerが思考推論を経て詳細に採点する。
Tencentが33言語対応の翻訳モデルHy-MT2を公開。1.8Bモデルは1.25ビット量子化で440MBに圧縮可能。
Tencentが多言語翻訳特化モデルHy-MT2シリーズを公開。33言語対応、1.8Bは440MBで動く。
ByteDanceのCola-DLMは拡散モデルを言語生成に応用した異端のLLM。Text VAE+DiT構成でHuggingFace公開。
AlibabaがLLMの内部挙動を解読するための解釈可能性モジュール「Qwen-Scope」を公開。TopK SAEを用いてモデルの思考を可視化。
AlibabaがQwen3-30B-A3B向けSAE「Qwen-Scope」を公開。131,072次元のスパース特徴でLLM内部を解読する試み。
アリババがQwen3.5用のSAE解釈モジュール「Qwen-Scope」をリリース。全40層対応、TopK=100のSparse Autoencoderでモデル内部を解析可能。
Mistralの最新統合モデル「Mistral Medium 3.5」が登場。128Bパラメータ、256kコンテキスト、画像対応。
Tencentが超軽量翻訳モデル「Hy-MT1.5-1.8B-1.25bit」をリリース。440MBでスマホオフライン動作可能な驚異的な1.25ビット量子化を実現。