Hugging Face が Up to 3.2x Faster Inference with LFM2.5-DSpark を発表 ── 推論速度を劇的に改善する新アーキテクチャ
LiquidAIのLFM2.5シリーズにDSparkドラフトモデルが追加。GPUで最大3.18倍高速化を実現した新技術の仕組みと影響を検証。
LiquidAIのLFM2.5シリーズにDSparkドラフトモデルが追加。GPUで最大3.18倍高速化を実現した新技術の仕組みと影響を検証。
OpenAIがZDR環境下で複数回の対話からリスクを検知する「Private Safety Processing」を発表。ユーザーデータへの社員アクセスなしに安全性を担保。
OpenAI GPT-5.6 Luna搭載のReplit Free Mode公開。トークンコストなしでアプリ開発が可能になる価格革命の動向。
OpenAI、ChatGPT Adsを欧州31か国へ拡大。コンバージョン最適化やジオターゲティングに対応し、無料ユーザー向け広告プラットフォームを本格始動させる。
Liquid AIのLFM2.5シリーズにQAD対応Q4_0 GGUFが登場。エッジデバイスでもBF16性能の97%を維持し、高速推論を実現。
OpenAI、次期モデル「Astra」がサイバー能力の閾値に到達?開発ペースを落とし安全性を優先する理由と3つの新しいガードレールを解説。
OpenAIが10代限定の「ChatGPT for Teens」を発表。Study Modeや保護者向けStudy Hoursを導入し、AIを活用した学習支援を強化。
AsanaがCodex導入でテストシステム撤去を2週間で完了、コスト600万ドル→1.2万ドルへ。5年分の仕事を圧縮した実測事例。
エージェントに必要なメモリ量はモデルによって異なる。IBMが8モデル検証した結果、gpt-oss-120bは+16.1pp向上かつコスト50%削減を実現。
Sentence Transformers v6.0 で追加された Multi-Vector (Late Interaction) エンコーダの仕組みと、RAG・視覚検索での活用メリットを解説。