GoForum🌐 V2EX

Nvidia 128G 的那个小盒子用哪个模型好?

abctest · 2026-08-26 21:03 · 0 次点赞 · 1 条回复

试了最新出的 Qwen3.8-27B ,吐字很慢,4token/s 。 试了 Qwen3.6-35B-A3B ,质量感觉不行,幻觉有些严重。

1 条回复
volvo007 · 2026-08-26 21:13
#1

因为这货的带宽太低了,所以非常不适合稠密模型的推理。所以比较合适的还是两台上满血 d4f

添加回复
你还需要 登录 后发表回复

登录后可发帖和回复

登录 注册
主题信息
作者: abctest
发布: 2026-08-26
点赞: 0
回复: 0