新模型每次推出都标记知识库截至时间,随着时间的增长,理论上讲,LLM 的体积只增不减吗(降智的方式不算)
或者,出现颠覆 Transformer 架构的新理论出现,可能大幅压缩模型体检
登录后可发帖和回复