内容をスキップ

LLM Watch

  • LLM Watch について
  • お問い合わせ
  • プライバシーポリシー
  • 利用規約
LLM Watch
  • Training and Finetuning Multi-Vector Embedding Models with Sentence Transformers カバー画像
    Hugging Face

    Hugging Face が Training and Finetuning Multi-Vector Embedding Models with Sentence Transformers を投入 ── 単一GPUで医療ドメイン特化モデルを実装

    ByLLM Watch編集部 2026年8月27日

    Sentence Transformers v6.0でColBERT風マルチベクトルモデルの学習が正式サポート。RTX 3090 1枚で汎用検索モデルを上回る医療特化モデルの実例を紹介。

    続きを読む Hugging Face が Training and Finetuning Multi-Vector Embedding Models with Sentence Transformers を投入 ── 単一GPUで医療ドメイン特化モデルを実装次へ

  • WeMM-Embedding-9B カバー画像
    Tencent

    Tencent が WeMM-Embedding-9B を投入 ── 画像・動画・テキストの混在入力に対応

    ByLLM Watch編集部 2026年8月26日

    Tencentが公開したWeMM-Embedding-9Bは、Qwen3.5をベースにテキスト・画像・動画・混合入力を単一の4,096次元ベクトルに変換できるオープンソースモデルです。

    続きを読む Tencent が WeMM-Embedding-9B を投入 ── 画像・動画・テキストの混在入力に対応次へ

  • OpenAI

    OpenAI が The full stack behind abundant intelligence を公開 ── 自社チップ「Jalapeño」の実測データで示す統合戦略

    ByLLM Watch編集部 2026年8月26日

    OpenAIが初の自社推論チップ「Jalapeño」の実測データを公開。GPT-OSS 120Bで商用システムを上回るスループットと低レイテンシを実現し、フルスタック最適化によるコスト削減と性能向上の両立を示した。

    続きを読む OpenAI が The full stack behind abundant intelligence を公開 ── 自社チップ「Jalapeño」の実測データで示す統合戦略次へ

  • OpenAI

    OpenAI が Jalapeño’s first results show industry-leading speed and efficiency in AI inference を発表 ── 電力効率と遅延の両立に成功

    ByLLM Watch編集部 2026年8月26日2026年8月28日

    OpenAIの独自推論チップ「Jalapeño」の初回実測値が公開。電力効率1.5〜1.9倍、レイテンシ最大3.6倍低減など、スループットと速度の両立に成功。

    続きを読む OpenAI が Jalapeño’s first results show industry-leading speed and efficiency in AI inference を発表 ── 電力効率と遅延の両立に成功次へ

  • OpenAI

    OpenAI が Introducing the Admin plugin for ChatGPT Work and Codex を投入 ── マネジメント作業の「会話」化

    ByLLM Watch編集部 2026年8月26日

    OpenAIがChatGPT WorkとCodex向けのAdmin pluginを発表。利用状況確認から権限管理、自動化まで、会話だけで完結する新しい管理手法。

    続きを読む OpenAI が Introducing the Admin plugin for ChatGPT Work and Codex を投入 ── マネジメント作業の「会話」化次へ

  • Granite 4.2 LLMs: How They're Built カバー画像
    Hugging Face

    Hugging Face が Granite 4.2 LLMs: How They’re Built を公開 ── 512KコンテキストとアジェンティックRLの実装

    ByLLM Watch編集部 2026年8月26日

    IBM Granite 4.2は512KコンテキストとアジェンティックRLを備えた推論LLM。3B/8B/30Bの3サイズでApache 2.0ライセンス公開。

    続きを読む Hugging Face が Granite 4.2 LLMs: How They’re Built を公開 ── 512KコンテキストとアジェンティックRLの実装次へ

  • Quantization-Aware Healing: a compressed, 4-bit model that outperforms its full-precision original カバー画像
    Hugging Face

    Hugging Face が Quantization-Aware Healing: a compressed, 4-bit model that outperforms its full-precision original を発表 ── 4bitが16bitを超える逆転現象

    ByLLM Watch編集部 2026年8月26日

    Hugging Faceが公開したQuantization-Aware Healing(QAH)により、4bitに圧縮されたLLMが元の16bitモデルを上回る性能を発揮。GPT-OSS 120Bの圧縮版が9ベンチマーク中7つで逆転成功。

    続きを読む Hugging Face が Quantization-Aware Healing: a compressed, 4-bit model that outperforms its full-precision original を発表 ── 4bitが16bitを超える逆転現象次へ

  • Wire It, Run It, Deploy It: AI Workflows in Gradio カバー画像
    Hugging Face

    Hugging Face が Wire It, Run It, Deploy It: AI Workflows in Gradio を投入 ── パイプラインがそのままUIになる

    ByLLM Watch編集部 2026年8月26日

    Hugging FaceのGradioに組み込まれたgr.Workflow。パイプライン定義がそのままUI・API・デプロイ対象になる新機能の詳細と、FLUX等の実例を紹介する。

    続きを読む Hugging Face が Wire It, Run It, Deploy It: AI Workflows in Gradio を投入 ── パイプラインがそのままUIになる次へ

  • How Hugging Face Inference Endpoints, Jobs, and Buckets Power Search on Papers with Code カバー画像
    Hugging Face

    Hugging Face が Papers with Code 検索の裏側を公開 ── 11万本超論文を扱うハイブリッド設計

    ByLLM Watch編集部 2026年8月26日

    Hugging FaceがPapers with Codeの検索システム裏側を公開。PostgreSQLとpgvectorによるハイブリッド検索で11万超の論文を処理し、Jobs・Buckets・Inference Endpointsの連携で低レイテンシを実現。

    続きを読む Hugging Face が Papers with Code 検索の裏側を公開 ── 11万本超論文を扱うハイブリッド設計次へ

  • OpenAI

    OpenAI が Advancing price-performance for developers with GPT‑5.6 in Kiro を発表 ── 82%コスト削減の実績

    ByLLM Watch編集部 2026年8月25日

    OpenAIとAWSがKiroにGPT-5.6を導入。仕様駆動型開発によりTerminal-Bench 2.1で約82%のコスト削減を実現し、AIコーディングの経済性を根本から変えた。

    続きを読む OpenAI が Advancing price-performance for developers with GPT‑5.6 in Kiro を発表 ── 82%コスト削減の実績次へ

ページナビゲーション

前のページ前へ 1 … 4 5 6 7 8 … 51 次のページ次へ

© 2026 LLM Watch

  • LLM Watch について
  • お問い合わせ
  • プライバシーポリシー
  • 利用規約