【実測】Qwen3-4B をローカルRTX 3090で走らせて測った(IQ4_XS)
当環境での実測(IQ4_XS / RTX 3090 / suite v1)
| 指標 | 値 |
|---|---|
| 生成速度 | 116.89 tokens/s(3回平均) |
| 初出しまで | 93.0 ms |
| 指示遵守テスト | 60/100 |
| メモリ RSS | 4k: 20079220KB / 8k: 20079220KB / 16k: 20079220KB |
| 長文保持(16k中3地点) | 3/3 |
再現性(手続きの全開示)
- 環境: i7-7700K / 64GB RAM / RTX 3090 24GB / LM Studio(執筆モデルと単一GPUを交互使用)/ LM Studio
- 量子化: IQ4_XS(suite v1)
- スループット: 固定プロンプト、temperature=0、max_tokens=256、3回平均
- 指示遵守: 10問(JSON/完全一致/正規表現/順序/文字数)機械採点
- 長文保持: 16kコンテキストに「隠し単語は「みかづき」です。」を3位置に埋め込み検索
測定日: 2026-09-15