先说结论
小简的文档链路不是把全文塞进一次提问。当前本地候选会把文件作为受控资产处理,提取可用文本,再让对话围绕明确的问题输出摘要、风险和行动项。生产对象存储、病毒扫描资源与真实模型仍需部署验证。已核对事实与边界
- 当前代码支持私有文档资产、文本提取与文档摘要任务。
- 过长或无法提取文本的文件会返回明确错误,不应被宣传为任意文件都能处理。
- 本地自动化不能替代生产对象存储、病毒扫描和真实模型回归。
先定义你要从文档得到什么
比“帮我总结”更可靠的方式,是先写清读者、决策和输出结构。例如:给管理层提取三项结论、两项风险、责任人和截止时间。明确的任务会让摘要更容易核对,也减少模型用漂亮措辞掩盖信息缺口。
- 目标读者是谁
- 需要做什么决定
- 哪些数字、条款或日期必须逐项保留
把文件当作证据,而不是背景装饰
上传后先确认文件类型和提取结果,再开始提问。若文档是扫描件、表格密集或超过当前处理长度,应拆分任务并明确说明遗漏范围。小简当前实现会拒绝没有可用文本或内容过长的资产;这是一条安全边界,不是故障。
用第二轮对话做事实核对
第一轮用于形成结构,第二轮只检查关键事实:要求列出对应章节、原文术语和无法确认的项目。最终交付应把“文档明确写了什么”与“模型据此推断什么”分开。
来源与证据
- 仓库自动化证据:apps/worker/src/assets.test.ts(文档隔离、UTF-8 与 DOCX 提取,2026-08-02)
- 公开商用放行仍受生产存储、扫描与真实模型门禁约束
能力状态基于 2026-08-02 的仓库证据,不构成生产可用性或商用放行保证。