Ask HN: Has anyone replaced Claude/GPT with a local model for daily coding?
副次的な
コメントの要約
副次的な
回答では、Apple M4 で Gemma 4 を試したがトークン毎秒がクラウドよりかなり低く、モデル選定を助ける企業向けツールもないのでまだだという報告が最上位にある。RTX Pro 6000 Blackwell 2 枚で DeepSeek V4 Flash を 160 トークン毎秒で動かし、自動でコードを書かせて別のシステムにレビューさせているという構成や、Qwen 3.6 27B dense は Haiku 4.5 から Sonnet 程度だという評価も出た。
OpenRouter を繋げば主要なオープンウェイトモデルを全て試せるという助言や、Strix Halo 向けに antirez の ds4 の安定を待っているという声もあった。