内容をスキップ

LLM Watch

  • LLM Watch について
  • お問い合わせ
  • プライバシーポリシー
  • 利用規約
  • 当サイト実測ランキング
LLM Watch
  • Gemini 3.8 カバー画像
    Google DeepMind

    Google DeepMind が Gemini 3.8 を投入 ── 会話中にバックグラウンド処理を行う新機能

    ByLLM Watch編集部 2026年9月16日

    Gemini 3.8 Live は会話中のバックグラウンド処理を実現。音声AIが単なるチャット相手から、複雑なタスクを並行してこなす作業パートナーへ進化。

    続きを読む Google DeepMind が Gemini 3.8 を投入 ── 会話中にバックグラウンド処理を行う新機能次へ

  • 実測

    【実測】Llama-Prompt-Guard-2-22M の実測を試みたが失敗した(生成モデルではない(text-classification)。当ベンチマークは生成モデル対象)

    ByLLM Watch編集部 2026年9月16日

    当環境で Llama-Prompt-Guard-2-22M の実測を試み、失敗した。理由: 生成モデルではない(text-classification)。当ベンチマークは生成モデル対象。

    続きを読む 【実測】Llama-Prompt-Guard-2-22M の実測を試みたが失敗した(生成モデルではない(text-classification)。当ベンチマークは生成モデル対象)次へ

  • 実測

    【実測】Qwen3-4B をローカルRTX 3090で走らせて測った(IQ4_XS)

    ByLLM Watch編集部 2026年9月15日

    当環境で Qwen3-4B(IQ4_XS)を実測。生成速度 123.8 tokens/s、指示遵守 60/100。

    続きを読む 【実測】Qwen3-4B をローカルRTX 3090で走らせて測った(IQ4_XS)次へ

  • 実測

    【実測】Gemini 3.8 の実測を試みたが失敗した(GGUF未提供)

    ByLLM Watch編集部 2026年9月15日

    当環境で Gemini 3.8 の実測を試み、失敗した。理由: GGUF未提供。

    続きを読む 【実測】Gemini 3.8 の実測を試みたが失敗した(GGUF未提供)次へ

  • 解説

    週間ダイジェスト 2026-09-15(当サイト実測)

    ByLLM Watch編集部 2026年9月15日

    当週の実測ランキングと公表値の比較。

    続きを読む 週間ダイジェスト 2026-09-15(当サイト実測)次へ

  • 実測

    【実測】Qwen3-4B をローカルRTX 3090で走らせて測った(IQ4_XS)

    ByLLM Watch編集部 2026年9月15日2026年9月15日

    当環境で Qwen3-4B(IQ4_XS)を実測。生成速度 116.89 tokens/s、指示遵守 60/100。

    続きを読む 【実測】Qwen3-4B をローカルRTX 3090で走らせて測った(IQ4_XS)次へ

  • 実測

    【実測】GPT-6 の実測を試みたが失敗した(no gguf)

    ByLLM Watch編集部 2026年9月15日2026年9月15日

    当環境で GPT-6 の実測を試み、失敗した。理由: no gguf。

    続きを読む 【実測】GPT-6 の実測を試みたが失敗した(no gguf)次へ

  • Simple-Attention-Sparsification カバー画像
    Tencent

    Tencent が Simple-Attention-Sparsification を投入 ── 推論時のコンテキスト選択を最適化

    ByLLM Watch編集部 2026年9月15日2026年9月15日

    Tencentが公開したSASは、連続ゲートを用いてKVブロックの選択を最適化。Qwen3対応で推論時のコンテキスト効率を向上させる新手法。

    続きを読む Tencent が Simple-Attention-Sparsification を投入 ── 推論時のコンテキスト選択を最適化次へ

  • OpenAI

    OpenAI が How Fyxer built an AI executive assistant people trust を公開 ── 50万時間のデータで「信頼」を獲得

    ByLLM Watch編集部 2026年9月15日

    OpenAIモデルと50万時間のEA業務データを活用したAIアシスタントFyxer。53%のドラフト採用率と90%のリテンション率を実現。

    続きを読む OpenAI が How Fyxer built an AI executive assistant people trust を公開 ── 50万時間のデータで「信頼」を獲得次へ

  • Async GRPO with LoRA across HF Jobs: a bucket, a proxy, and no NCCL カバー画像
    Hugging Face

    Hugging Face が Async GRPO with LoRA across HF Jobs: a bucket, a proxy, and no NCCL を公開 ── 500ステップの訓練時間を1/4以下へ

    ByLLM Watch編集部 2026年9月15日

    Hugging FaceのAsync GRPO TrainerにLoRA対応が追加。NCCL不要で分散環境を構築し、500ステップの訓練時間を3時間27分から53分へ短縮。

    続きを読む Hugging Face が Async GRPO with LoRA across HF Jobs: a bucket, a proxy, and no NCCL を公開 ── 500ステップの訓練時間を1/4以下へ次へ

ページナビゲーション

1 2 3 … 52 次のページ次へ

© 2026 LLM Watch

  • LLM Watch について
  • お問い合わせ
  • プライバシーポリシー
  • 利用規約
  • 当サイト実測ランキング