GoForum🌐 V2EX

qwen3.8 27B 被低估了

1258 · 2026-08-17 13:42 · 0 次点赞 · 7 条回复

qwen3.8 27B 完全被低估了,讨论度不高。 如果有人在年初跟我讲,可以用两张 3090 本地部署一个超越当时最强的 opus4.5 几代的模型,我会觉得是痴人说梦。 感觉 qwen3.8 完全可以加入穿越者套餐了,穿越之自带太阳能发电板+本地部署 qwen3.8 27B 的硬件设备,再造人类文明完全不是问题吧

7 条回复
yiranw09 · 2026-08-17 13:52
#1

你指 runinfra 免费的 qwen3.8 27B ?很奇怪的是我始终无法把他接入 hermes ,一直报错 Context length exceeded (16 tokens). Cannot compress further.

sentinelK · 2026-08-17 13:52
#2

没有网络检索能力的小模型就是渣。

小模型意味着信息量储备少,没有非常深厚的常识基础,或者说常识的抽象程度很高。 如果没有外部信息做支撑,很容易产生很多没有细节的“正确的废话”。

最简单的办法,你用 llama.cpp 的默认 web 应用调用一下试试看,直接就变成弱智。

能力强的小模型很像中年老板。能量大,但其实不太关注信息量和细节。他的能力都来自于和外界的串联。你把他手机收了直接降级成中年油腻老头。

相反,老版本的大模型像是老教授,不太会玩手机,所以显得很笨,很脱离现实。

1258 · 2026-08-17 14:02
#3

@sentinelK 好比喻,也可以比喻成能力很强的年轻程序员,没有 github 或者网络检索很难凭经验解决 bug ,只能力大砖飞

1258 · 2026-08-17 14:02
#4

@yiranw09 runinfra 的 3.8 居然免费了吗?这个模型部署成本确实很低

levn · 2026-08-17 14:07
#5

都吹成本地的 opus4.6 了,还叫低估吗

1258 · 2026-08-17 14:12
#6

@levn 是本地百无禁忌的 opus4.6 ,这很夸张了,你甚至可以要求他做坏事,或者在灰色地带赚钱,只需要付出电费。

nguoidiqua · 2026-08-17 14:17
#7

其实 R 站讨论热度很高的,国内玩自己部署的还是相对较少。

单看编程方面的跑分,略超 Opus 4.6 、MiniMax M3 、Gemini 3.5 ,略低于 Hy3 、Kimi K2.6 ,稍弱于 V4 Flash 0731 、Spark 1.1 、Gemini 3.7 、GLM-5.2 、Qwen3.7 Max 。(当然跑分这个东西仅供参考,各家跑分的排名都是出入较大的)

不过目前反馈有:一、过度推理,xHigh 下面推理消耗的时间和 TOKEN 比 Medium 多几倍。二、偏科严重,相比 Qwen3.6 27B ,某些方面提升很大,某些方面反而倒退了。

添加回复
你还需要 登录 后发表回复

登录后可发帖和回复

登录 注册
主题信息
作者: 1258
发布: 2026-08-17
点赞: 0
回复: 0