内容をスキップ

LLM Watch

  • LLM Watch について
  • お問い合わせ
  • プライバシーポリシー
  • 利用規約
LLM Watch
  • Qwen3-1.7B-Base-W32K-L0_100 カバー画像
    Alibaba (Qwen)

    Alibaba (Qwen) が Qwen3-1.7B-Base-W32K-L0_100 を発表 ── LLMのブラックボックスを解き明かすSAEモジュール

    ByLLM Watch編集部 2026年4月30日2026年8月10日

    AlibabaがLLMの内部挙動を解読するための解釈可能性モジュール「Qwen-Scope」を公開。TopK SAEを用いてモデルの思考を可視化。

    続きを読む Alibaba (Qwen) が Qwen3-1.7B-Base-W32K-L0_100 を発表 ── LLMのブラックボックスを解き明かすSAEモジュール次へ

  • Qwen3-30B-A3B-Base-W128K-L0_100 カバー画像
    Alibaba (Qwen)

    Alibaba (Qwen) が Qwen-Scope (SAE) を発表 ── Qwen3-30B-A3Bの内部を131,072次元で解読

    ByLLM Watch編集部 2026年4月30日2026年8月10日

    AlibabaがQwen3-30B-A3B向けSAE「Qwen-Scope」を公開。131,072次元のスパース特徴でLLM内部を解読する試み。

    続きを読む Alibaba (Qwen) が Qwen-Scope (SAE) を発表 ── Qwen3-30B-A3Bの内部を131,072次元で解読次へ

  • Qwen3.5-35B-A3B-Base-W128K-L0_100 カバー画像
    Alibaba (Qwen)

    Alibaba (Qwen) が Qwen3.5-35B-A3B-Base-W128K-L0_100 をリリース ── Qwenの頭の中を覗き見るSAE解釈モジュール

    ByLLM Watch編集部 2026年4月30日

    アリババがQwen3.5用のSAE解釈モジュール「Qwen-Scope」をリリース。全40層対応、TopK=100のSparse Autoencoderでモデル内部を解析可能。

    続きを読む Alibaba (Qwen) が Qwen3.5-35B-A3B-Base-W128K-L0_100 をリリース ── Qwenの頭の中を覗き見るSAE解釈モジュール次へ

  • OpenAI

    OpenAI が「Where the goblins came from」を公開 ── GPT-5の奇妙なクセの裏側

    ByLLM Watch編集部 2026年4月30日

    OpenAIがGPT-5の振る舞いに現れる「ゴブリン出力」の発生原因と修正プロセスについて解説。

    続きを読む OpenAI が「Where the goblins came from」を公開 ── GPT-5の奇妙なクセの裏側次へ

  • OpenAI

    OpenAI が Building the compute infrastructure for the Intelligence Age を公開 ── AGI実現に向け「Stargate」大規模展開へ

    ByLLM Watch編集部 2026年4月30日2026年8月10日

    OpenAIがAGI実現に向けコンピュートインフラ「Stargate」を大規模展開。データセンター容量を追加しAI需要に対応する体制構築へ。

    続きを読む OpenAI が Building the compute infrastructure for the Intelligence Age を公開 ── AGI実現に向け「Stargate」大規模展開へ次へ

  • DeepInfra on Hugging Face Inference Providers 🔥 カバー画像
    Hugging Face

    Hugging Face が DeepInfra on Hugging Face Inference Providers 🔥 を提供開始 ── 最安値クラスのサーバーレス推論がHub直結で使えるように

    ByLLM Watch編集部 2026年4月30日2026年8月10日

    Hugging FaceがDeepInfraをInference Providerとして追加。100超モデルが最安値クラスで使えるサーバーレス推論環境

    続きを読む Hugging Face が DeepInfra on Hugging Face Inference Providers 🔥 を提供開始 ── 最安値クラスのサーバーレス推論がHub直結で使えるように次へ

  • AI evals are becoming the new compute bottleneck カバー画像
    Hugging Face

    Hugging Face が AI evals are becoming the new compute bottleneck をリリース ── AIの評価コストがついに学習費を超える

    ByLLM Watch編集部 2026年4月30日

    Hugging Faceが警告、AI評価コストが許容範囲を超える。エージェント評価で数万ドル、モデル開発のコストを超す可能性も。

    続きを読む Hugging Face が AI evals are becoming the new compute bottleneck をリリース ── AIの評価コストがついに学習費を超える次へ

  • Mistral-Medium-3 カバー画像
    Mistral

    Mistral が Mistral-Medium-3.5 を発表 ── 推論・エージェント・マルチモーダルを統合した128Bの大躍進

    ByLLM Watch編集部 2026年4月30日2026年8月10日

    Mistralの最新統合モデル「Mistral Medium 3.5」が登場。128Bパラメータ、256kコンテキスト、画像対応。

    続きを読む Mistral が Mistral-Medium-3.5 を発表 ── 推論・エージェント・マルチモーダルを統合した128Bの大躍進次へ

  • Granite 4.1 LLMs: How They’re Built カバー画像
    Hugging Face

    Hugging Face が Granite 4.1 LLMs: How They’re Built を公開 ── 15Tトークン学習の8B小型モデルが前世代32Bを凌駕

    ByLLM Watch編集部 2026年4月30日2026年5月1日

    IBMのGranite 4.1は15Tトークンで学習した3B〜30BのLLM。8Bモデルが前世代の32Bモデルを凌駕。最大512Kトークンの長文コンテキストに対応。

    続きを読む Hugging Face が Granite 4.1 LLMs: How They’re Built を公開 ── 15Tトークン学習の8B小型モデルが前世代32Bを凌駕次へ

  • Hy-MT1.5-1.8B-1.25bit カバー画像
    Tencent

    Tencent が Hy-MT1.5-1.8B-1.25bit を公開 ── 440MBで33言語翻訳、スマホでサクサク動く極限の軽量モデル

    ByLLM Watch編集部 2026年4月29日2026年8月10日

    Tencentが超軽量翻訳モデル「Hy-MT1.5-1.8B-1.25bit」をリリース。440MBでスマホオフライン動作可能な驚異的な1.25ビット量子化を実現。

    続きを読む Tencent が Hy-MT1.5-1.8B-1.25bit を公開 ── 440MBで33言語翻訳、スマホでサクサク動く極限の軽量モデル次へ

ページナビゲーション

前のページ前へ 1 … 32 33 34 35 36 … 51 次のページ次へ

© 2026 LLM Watch

  • LLM Watch について
  • お問い合わせ
  • プライバシーポリシー
  • 利用規約