GoForum🌐 V2EX

存储表结构 RAG 与 Skill 哪个更优?

TimG · 2026-09-01 09:28 · 0 次点赞 · 2 条回复

最近接到任务尝试使用 qwen3.8 搭建内部数据分析平台,目前还是第一次尝试,离线基础环境已经配置好,我使用 2 年前的过时经验把表结构存到 chromadb ,用 mcp 服务器暴露给 opencode 调用。因为在离线环境,模型无法查阅数据库支持的函数文档,想再去官网 curl 一个文档,分块再存进知识库,顺便问了一下 deepseek ,它建议我把文档与表结构都做成 reference 给模型,说是方便维护且保持文档连续完整。

在我 2 年前的保守想象中,给上下文载入一堆 skill+reference+表结构无疑会撑满,即使对表结构按照业务模块分文件,单个 500+字段的模块也遍地都是。并且我个人理解表结构并不特别需要连续性,只要知道是一个表的内容拼凑所需字段就可以。

我的原本的构思中,是想要将这些文档尽可能存入 RAG 数据库,然后通过 skill 声明主要业务表与业务流程概况。降低上下文长度,但如果模型能力强大,已经能保持长上下文依然注意力集中,那么毫无疑问就沦为了过度设计。但我对 llm 的了解大概就在两年前的水平,麻烦各位朋友给出个招,谢谢!

2 条回复
zh3256 · 2026-09-01 09:33
#1

先用 skill 做,遇到问题再解决,不要提前预设问题。

TimG · 2026-09-01 09:38
#2

@zh3256 了解了,这确实是非常务实的方式。谢谢!

添加回复
你还需要 登录 后发表回复

登录后可发帖和回复

登录 注册
主题信息
作者: TimG
发布: 2026-09-01
点赞: 0
回复: 0