【実測】Qwen3-4B をローカルRTX 3090で走らせて測った(IQ4_XS)

当環境での実測(IQ4_XS / RTX 3090 / suite v1)

指標
生成速度 123.8 tokens/s(3回平均)
初出しまで 69.8 ms
指示遵守テスト 60/100
メモリ RSS 4k: 2611496KB / 8k: 2615876KB / 16k: 2624368KB
長文保持(16k中3地点) 3/3

再現性(手続きの全開示)

  • 環境: i7-7700K / 64GB RAM / RTX 3090 24GB / LM Studio(執筆モデルと単一GPUを交互使用)
  • スループット: 固定プロンプト、temperature=0、max_tokens=256、3回平均
  • 指示遵守: 10問(JSON/完全一致/正規表現/順序/文字数)機械採点
  • 長文保持: 16kコンテキストに「隠し単語は「みかづき」です。」を3位置に埋め込み検索

測定日: 2026-09-15

関連速報 / ランキング

類似投稿

コメントを残す

メールアドレスが公開されることはありません。 が付いている欄は必須項目です