abctest
V2EX  ›  问与答

Nvidia 128G 的那个小盒子用哪个模型好?

  •  
  •   abctest · 2h 45m ago · 216 views

    试了最新出的 Qwen3.8-27B ,吐字很慢,4token/s 。 试了 Qwen3.6-35B-A3B ,质量感觉不行,幻觉有些严重。

    1 replies    2026-08-26 21:07:47 +08:00
    volvo007
        1
    volvo007  
       2h 37m ago
    因为这货的带宽太低了,所以非常不适合稠密模型的推理。所以比较合适的还是两台上满血 d4f
    About   ·   Help   ·   Advertise   ·   Blog   ·   API   ·   FAQ   ·   Solana   ·   2726 Online   Highest 6679   ·     Select Language
    创意工作者们的社区
    World is powered by solitude
    VERSION: 3.9.8.5 · 20ms · UTC 15:45 · PVG 23:45 · LAX 08:45 · JFK 11:45
    ♥ Do have faith in what you're doing.