Hugging Face が Training and Finetuning Multi-Vector Embedding Models with Sentence Transformers を投入 ── 単一GPUで医療ドメイン特化モデルを実装
Sentence Transformers v6.0でColBERT風マルチベクトルモデルの学習が正式サポート。RTX 3090 1枚で汎用検索モデルを上回る医療特化モデルの実例を紹介。
Sentence Transformers v6.0でColBERT風マルチベクトルモデルの学習が正式サポート。RTX 3090 1枚で汎用検索モデルを上回る医療特化モデルの実例を紹介。
Tencentが公開したWeMM-Embedding-9Bは、Qwen3.5をベースにテキスト・画像・動画・混合入力を単一の4,096次元ベクトルに変換できるオープンソースモデルです。
OpenAIが初の自社推論チップ「Jalapeño」の実測データを公開。GPT-OSS 120Bで商用システムを上回るスループットと低レイテンシを実現し、フルスタック最適化によるコスト削減と性能向上の両立を示した。
OpenAIの独自推論チップ「Jalapeño」の初回実測値が公開。電力効率1.5〜1.9倍、レイテンシ最大3.6倍低減など、スループットと速度の両立に成功。
OpenAIがChatGPT WorkとCodex向けのAdmin pluginを発表。利用状況確認から権限管理、自動化まで、会話だけで完結する新しい管理手法。
IBM Granite 4.2は512KコンテキストとアジェンティックRLを備えた推論LLM。3B/8B/30Bの3サイズでApache 2.0ライセンス公開。
Hugging Faceが公開したQuantization-Aware Healing(QAH)により、4bitに圧縮されたLLMが元の16bitモデルを上回る性能を発揮。GPT-OSS 120Bの圧縮版が9ベンチマーク中7つで逆転成功。
Hugging FaceのGradioに組み込まれたgr.Workflow。パイプライン定義がそのままUI・API・デプロイ対象になる新機能の詳細と、FLUX等の実例を紹介する。
Hugging FaceがPapers with Codeの検索システム裏側を公開。PostgreSQLとpgvectorによるハイブリッド検索で11万超の論文を処理し、Jobs・Buckets・Inference Endpointsの連携で低レイテンシを実現。
OpenAIとAWSがKiroにGPT-5.6を導入。仕様駆動型開発によりTerminal-Bench 2.1で約82%のコスト削減を実現し、AIコーディングの経済性を根本から変えた。