GoForum🌐 V2EX

在线体验 16K token/s 的新大模型部署架构

fortitudeZDY · 2026-08-07 09:47 · 0 次点赞 · 1 条回复

在 HN 上看到 AMD 收购那家把模型权重烧到芯片里的 taalas 的消息, 考虑到 gpt 5.6 相比 gpt 5.5 实际体验并没有多在的改进, 感觉或许把权重烧到芯片里, 没准是条路子

帖子里有他们的模型架构体验接口, 自己试了下, 16k token/s, 不敢想象要是有 gpt5.5 这样的模型这么快, 体验得多么好了

https://chatjimmy.ai/

1 条回复
cowcomic · 2026-08-07 10:07
#1

我印象他们家好像都是做小模型的,之前都是 10B 以内的 最近好像放话要做 qwen3.6-27b 的,不知道进展如何

添加回复
你还需要 登录 后发表回复

登录后可发帖和回复

登录 注册
主题信息
作者: fortitudeZDY
发布: 2026-08-07
点赞: 0
回复: 0