Hugging Face が Which tokens does a hybrid model predict better? を提供開始 ── ハイブリッドモデルとTransformerの得意分野がトークンレベルで判明
Ai2がOlmo 3とOlmo Hybridを比較。ハイブリッドは文脈を追うトークン予測で有利だが、入力の繰り返しではTransformerが強いと判明。
Ai2がOlmo 3とOlmo Hybridを比較。ハイブリッドは文脈を追うトークン予測で有利だが、入力の繰り返しではTransformerが強いと判明。
Hugging FaceとTrebleが、現実の騒音や反響を再現したASRベンチマーク「FFASR Leaderboard」を公開。理想と現実のギャップを可視化。
NVIDIA NeMo AutoModelとTransformers v5を組み合わせることで、MoEモデルのファインチューニングが最大3.7倍高速化し、GPUメモリも約30%削減されます。
Transformers.jsで提案中のCross-Origin Storage APIを紹介。異なるWebサイト間でのAIモデルの重複ダウンロード問題を解消する新しいアプローチ。
IBM Research製エージェントハーネスCUGAが24個の動くサンプルとともに公開。配管作業を抹消して開発者はツールとプロンプトだけ書けばいい
Hugging FaceがAIとオープンソースツール、人間の確認を組み合わせ、huggingface_hubの毎週リリースを実現したワークフローを公開。
Hugging FaceがローカルLLMをエージェントとして活用し、OpenClawのissueをAPI制限なしで無料・リアルタイムに自動トリアージする手法を公開。
PaddlePaddleチームの最新多言語OCR「PP-OCRv6」が登場。1.5M〜34.5Mの3サイズ展開で50言語をサポートし、前モデルから大幅に精度向上。
Deep ResearchエージェントのWeb検索クエリから社外秘が漏れる「モザイク効果」と、漏洩を9.9%に抑える訓練手法PA-DRを提案する研究。
Hugging Faceが「LoRA一強で本当にいいのか?」を問う記事を公開。HubのPEFTモデル98.4%がLoRA使用という圧倒的シェアを示しつつ、他手法の検討を促している。