内容をスキップ

LLM Watch

  • LLM Watch について
  • お問い合わせ
  • プライバシーポリシー
  • 利用規約
LLM Watch
  • Qwen-Image-Bench カバー画像
    Alibaba (Qwen)

    Alibaba (Qwen) が Qwen-Image-Bench を提供開始 ── AIが画像生成を自動採点する新時代

    ByLLM Watch編集部 2026年5月28日2026年8月10日

    Alibabaが画像生成(T2I)の品質を自動評価するQwen-Image-Benchを公開。Qwen3.6-27BベースのQ-Judgerが思考推論を経て詳細に採点する。

    続きを読む Alibaba (Qwen) が Qwen-Image-Bench を提供開始 ── AIが画像生成を自動採点する新時代次へ

  • OpenAI

    OpenAI の GPT-5.5 が Warp に登場 ── ローカルからクラウドまでエージェントを統括

    ByLLM Watch編集部 2026年5月28日

    ターミナルアプリWarpがOpenAIの「GPT-5.5」を導入。ローカルやクラウドなど複数環境を横断するコーディングエージェントの統合を発表。

    続きを読む OpenAI の GPT-5.5 が Warp に登場 ── ローカルからクラウドまでエージェントを統括次へ

  • ITBench-AA: Frontier Models Score Below 50% on the First Benchmark for Agentic Enterprise IT Tasks — by Artificial Analysis and IBM カバー画像
    Hugging Face

    Hugging Face が ITBench-AA を公開 ── 最先端AIでも半分解けないエンタープライズIT実務ベンチマーク

    ByLLM Watch編集部 2026年5月28日

    IBMとArtificial Analysisがエージェント型ITベンチマーク「ITBench-AA」を公開。最先端モデルでも正答率50%未満という結果に。

    続きを読む Hugging Face が ITBench-AA を公開 ── 最先端AIでも半分解けないエンタープライズIT実務ベンチマーク次へ

  • Reachy Mini goes fully local カバー画像
    Hugging Face

    Hugging Face が Reachy Mini のフルローカル動作を実装 ── クラウド不要で動くプライベート会話ロボット

    ByLLM Watch編集部 2026年5月28日2026年5月30日

    Hugging FaceのReachy Miniが完全ローカル化。クラウドやAPIキー不要で、データを外部に送らずにロボットと会話できる仕組みが登場した。

    続きを読む Hugging Face が Reachy Mini のフルローカル動作を実装 ── クラウド不要で動くプライベート会話ロボット次へ

  • OpenAI

    OpenAI が Building self-improving tax agents with Codex を公開 ── 税務申告を自動化する自己改善型エージェント登場

    ByLLM Watch編集部 2026年5月28日2026年8月10日

    OpenAIがThrive、Creteと協業しCodexで自己改善型税務エージェントを構築。申告自動化と精度向上を実現する取り組み。

    続きを読む OpenAI が Building self-improving tax agents with Codex を公開 ── 税務申告を自動化する自己改善型エージェント登場次へ

  • OpenAI

    OpenAI が自己改善型タックスエージェントを構築 ── Codex活用で確定申告を自動化

    ByLLM Watch編集部 2026年5月28日

    OpenAIがThrive、Creteと共同でCodexを活用した自己改善型の税務エージェントを構築。申告の自動化と精度向上を実現しました。

    続きを読む OpenAI が自己改善型タックスエージェントを構築 ── Codex活用で確定申告を自動化次へ

  • Shipping a Trillion Parameters With a Hub Bucket: Delta Weight Sync in TRL カバー画像
    Hugging Face

    Hugging Face が Shipping a Trillion Parameters With a Hub Bucket: Delta Weight Sync in TRL を公開 ── 1TBの重み同期をわずか数MBに激減させる革新的アプローチ

    ByLLM Watch編集部 2026年5月27日2026年8月10日

    Hugging FaceがTRLでデルタウェイト同期を導入。1TBの重み同期ペイロードをわずか数MBに削減し、Async RLのコストを劇的に低下させる。

    続きを読む Hugging Face が Shipping a Trillion Parameters With a Hub Bucket: Delta Weight Sync in TRL を公開 ── 1TBの重み同期をわずか数MBに激減させる革新的アプローチ次へ

  • Harness, Scaffold, and the AI Agent Terms Worth Getting Right カバー画像
    Hugging Face

    Hugging Face が AI Agent 用語集を公開 ── Harness と Scaffold の違い、ちゃんと説明してみた

    ByLLM Watch編集部 2026年5月26日

    AIエージェント用語の混乱を解消。HarnessとScaffoldの違いをICLR 2026後の議論を基に整理したHugging Faceの用語集。

    続きを読む Hugging Face が AI Agent 用語集を公開 ── Harness と Scaffold の違い、ちゃんと説明してみた次へ

  • Towards Speed-of-Light Text Generation with Nemotron-Labs Diffusion Language Models カバー画像
    Hugging Face

    NVIDIAが拡散モデルでテキスト生成の常識を覆す「Nemotron-Labs Diffusion」公開 ── 光速テキスト生成へ一歩近づく

    ByLLM Watch編集部 2026年5月23日

    NVIDIAが拡散モデルベースの言語モデル「Nemotron-Labs Diffusion」を公開。並列生成と反復的洗練でARモデルの限界を突破する。

    続きを読む NVIDIAが拡散モデルでテキスト生成の常識を覆す「Nemotron-Labs Diffusion」公開 ── 光速テキスト生成へ一歩近づく次へ

  • OpenAI

    OpenAI が Virgin Atlantic の Codex 活用事例を公開 ── P1欠陥ゼロでホリデー期のアプリ刷新を達成

    ByLLM Watch編集部 2026年5月23日

    Virgin AtlanticがCodex活用でモバイルアプリを刷新。ユニットテストカバレッジほぼ100%、P1欠陥ゼロを達成した事例を公開。

    続きを読む OpenAI が Virgin Atlantic の Codex 活用事例を公開 ── P1欠陥ゼロでホリデー期のアプリ刷新を達成次へ

ページナビゲーション

前のページ前へ 1 … 26 27 28 29 30 … 51 次のページ次へ

© 2026 LLM Watch

  • LLM Watch について
  • お問い合わせ
  • プライバシーポリシー
  • 利用規約