内容をスキップ

LLM Watch

  • LLM Watch について
  • お問い合わせ
  • サイトについて
  • サンプルページ
  • プライバシーポリシー
LLM Watch
  • ScarfBench: Benchmarking AI Agents for Enterprise Java Framework Migration カバー画像
    Hugging Face

    Hugging Face が ScarfBench: Benchmarking AI Agents for Enterprise Java Framework Migration をリリース ── エンタープライズJava移行を試す超実践ベンチマーク

    ByLLM Watch編集部 2026年7月1日

    エンタープライズJavaのフレームワーク移行を評価するScarfBenchが登場。ビルドからデプロイまでAIエージェントがこなせるかを測る、超実践的な新ベンチマーク。

    続きを読む Hugging Face が ScarfBench: Benchmarking AI Agents for Enterprise Java Framework Migration をリリース ── エンタープライズJava移行を試す超実践ベンチマーク次へ

  • OpenAI

    OpenAI が GeneBench-Pro をリリース ── ゲノム・生物学の複雑な現実データでAIを試す新ベンチマーク

    ByLLM Watch編集部 2026年7月1日

    OpenAIがゲノム・生物学向けの新ベンチマーク「GeneBench-Pro」を発表。複雑な現実世界のデータでAIを試す。

    続きを読む OpenAI が GeneBench-Pro をリリース ── ゲノム・生物学の複雑な現実データでAIを試す新ベンチマーク次へ

  • Gemini Omni カバー画像
    Google DeepMind

    Google DeepMind が Nano Banana 2 Lite と Gemini Omni Flash をリリース ── 画像生成4秒&動画の編集も会話で完結

    ByLLM Watch編集部 2026年7月1日

    Google DeepMindが、4秒で画像生成&1K枚0.034ドルの「Nano Banana 2 Lite」と動画編集モデル「Gemini Omni Flash」をリリース。

    続きを読む Google DeepMind が Nano Banana 2 Lite と Gemini Omni Flash をリリース ── 画像生成4秒&動画の編集も会話で完結次へ

  • OpenAI

    OpenAI が Core dump epidemiology: fixing an 18-year-old bug を公開 ── 大規模解析で18年越しのバグを発見

    ByLLM Watch編集部 2026年7月1日

    OpenAIのエンジニアが大規模なコアダンプ解析を実施し、インフラクラッシュの原因となっていたハードウェア障害と18年間眠っていたバグを特定した。

    続きを読む OpenAI が Core dump epidemiology: fixing an 18-year-old bug を公開 ── 大規模解析で18年越しのバグを発見次へ

  • Why Specialization Is Inevitable カバー画像
    Hugging Face

    Hugging Face が『Why Specialization Is Inevitable』を公開 ── AIは万能より特化へ向かうのか

    ByLLM Watch編集部 2026年7月1日

    万能なAIより特化型が勝る理由を数学や生物学から紐解く、Dharma AIチームによるHugging Faceの注目考察記事。

    続きを読む Hugging Face が『Why Specialization Is Inevitable』を公開 ── AIは万能より特化へ向かうのか次へ

  • Why Specialization Is Inevitable カバー画像
    Hugging Face

    Hugging Face が Why Specialization Is Inevitable を公開 ── AIの真の進化は「特化」にあり

    ByLLM Watch編集部 2026年7月1日

    万能な汎用AIは幻想? 最適化理論と進化生物学が示唆する、特化型AIの圧倒的優位性と今後の展望をDharma-AIが鋭く解説。

    続きを読む Hugging Face が Why Specialization Is Inevitable を公開 ── AIの真の進化は「特化」にあり次へ

  • Featuring Every Eval Ever Results on Hugging Face Model Pages カバー画像
    Hugging Face

    Hugging Face が Every Eval Ever 統合をリリース ── 散在するAIベンチマークスコアを一つにまとめる

    ByLLM Watch編集部 2026年6月30日

    Hugging Faceがベンチマーク評価の標準化プロジェクトEEEとCommunity Evalsを連携。約22万件の評価結果を統一フォーマットでモデルページに統合。

    続きを読む Hugging Face が Every Eval Ever 統合をリリース ── 散在するAIベンチマークスコアを一つにまとめる次へ

  • DiScoFormer: One transformer for density and score, across distributions カバー画像
    Hugging Face

    Hugging Face が DiScoFormer: One transformer for density and score, across distributions を紹介 ── 再学習なしで分布の密度とスコアを同時に推定

    ByLLM Watch編集部 2026年6月30日

    1つのTransformerでデータの密度とスコアを同時推定し、再学習なしで未知データにも適応するDiScoFormerを解説。

    続きを読む Hugging Face が DiScoFormer: One transformer for density and score, across distributions を紹介 ── 再学習なしで分布の密度とスコアを同時に推定次へ

  • DeepSeek-V4 カバー画像
    DeepSeek

    DeepSeek が DeepSeek-V4 をリリース ── 1Mコンテキストで演算コスト大幅削減の超進化

    ByLLM Watch編集部 2026年6月27日

    DeepSeekがV4シリーズをプレビュー公開。100万トークン対応で計算量を27%、KVキャッシュを10%に削減し、圧倒的な長文処理効率を実現。

    続きを読む DeepSeek が DeepSeek-V4 をリリース ── 1Mコンテキストで演算コスト大幅削減の超進化次へ

  • DeepSeek-V4 カバー画像
    DeepSeek

    DeepSeek が DeepSeek-V4 をリリース ── 1兆6000億パラメータで100万トークンの処理コストを劇的に削減

    ByLLM Watch編集部 2026年6月27日

    DeepSeekが「DeepSeek-V4」をリリース。1兆6000億パラメータでありながら、100万トークン処理時の計算コストを劇的に削減することに成功した超効率MoEモデル。

    続きを読む DeepSeek が DeepSeek-V4 をリリース ── 1兆6000億パラメータで100万トークンの処理コストを劇的に削減次へ

ページナビゲーション

前のページ前へ 1 … 4 5 6 7 8 … 40 次のページ次へ

© 2026 LLM Watch

  • LLM Watch について
  • お問い合わせ
  • サイトについて
  • サンプルページ
  • プライバシーポリシー