跳到正文

任务指南 01 · 文档工作

用小简处理长文档:从文件到可执行摘要

一套面向长报告、合同与内部资料的可复用流程:先明确问题,再上传文档,最后核对摘要、风险与行动项。

本地实现已验证,生产存储与扫描待部署回归

先说结论

小简的文档链路不是把全文塞进一次提问。当前本地候选会把文件作为受控资产处理,提取可用文本,再让对话围绕明确的问题输出摘要、风险和行动项。生产对象存储、病毒扫描资源与真实模型仍需部署验证。

已核对事实与边界

  • 当前代码支持私有文档资产、文本提取与文档摘要任务。
  • 过长或无法提取文本的文件会返回明确错误,不应被宣传为任意文件都能处理。
  • 本地自动化不能替代生产对象存储、病毒扫描和真实模型回归。
01

先定义你要从文档得到什么

比“帮我总结”更可靠的方式,是先写清读者、决策和输出结构。例如:给管理层提取三项结论、两项风险、责任人和截止时间。明确的任务会让摘要更容易核对,也减少模型用漂亮措辞掩盖信息缺口。

  • 目标读者是谁
  • 需要做什么决定
  • 哪些数字、条款或日期必须逐项保留
02

把文件当作证据,而不是背景装饰

上传后先确认文件类型和提取结果,再开始提问。若文档是扫描件、表格密集或超过当前处理长度,应拆分任务并明确说明遗漏范围。小简当前实现会拒绝没有可用文本或内容过长的资产;这是一条安全边界,不是故障。

03

用第二轮对话做事实核对

第一轮用于形成结构,第二轮只检查关键事实:要求列出对应章节、原文术语和无法确认的项目。最终交付应把“文档明确写了什么”与“模型据此推断什么”分开。

来源与证据

  1. 仓库自动化证据:apps/worker/src/assets.test.ts(文档隔离、UTF-8 与 DOCX 提取,2026-08-02)
  2. 公开商用放行仍受生产存储、扫描与真实模型门禁约束

能力状态基于 2026-08-02 的仓库证据,不构成生产可用性或商用放行保证。

把指南变成一次真实任务

打开小简,让任务在一段对话里持续完成。

开始使用