GoForum › 🌐 V2EX
在线体验 16K token/s 的新大模型部署架构
fortitudeZDY ·
2026-08-07 09:47 ·
0 次点赞 · 1 条回复
在 HN 上看到 AMD 收购那家把模型权重烧到芯片里的 taalas 的消息, 考虑到 gpt 5.6 相比 gpt 5.5 实际体验并没有多在的改进, 感觉或许把权重烧到芯片里, 没准是条路子
帖子里有他们的模型架构体验接口, 自己试了下, 16k token/s, 不敢想象要是有 gpt5.5 这样的模型这么快, 体验得多么好了
1 条回复
添加回复
你还需要 登录
后发表回复
我印象他们家好像都是做小模型的,之前都是 10B 以内的 最近好像放话要做 qwen3.6-27b 的,不知道进展如何