产品需求
产品版本:V1.1
Lito 面向已有研究方向和参考文献的研究写作者,支持文献问答、多篇比较、中文综述初稿、连续修改与原文核验。用户在项目中组织材料,通过对话完成研究与写作,并将结果带回自己的写作工具。
一、需求分析
1.1 目标用户
优先服务正在撰写文献综述或研究评述的研究生,以及承担同类任务的研究写作者。他们通常已经确定研究方向、收集了一组中英文论文,需要理解材料、比较发现,并说明已有研究与自己课题的关系。
| 用户情况 | 当前做法 | 主要需要 |
|---|---|---|
| 已有材料,尚未形成清楚的论述结构 | 整理摘要,请 AI 分类或生成初稿 | 看清文献之间的关系,围绕研究问题组织正文 |
| 已有初稿,需要连续修改 | 补充范文、研究背景和细致指令,逐轮调整 | 保留已经确认的要求,减少反复解释 |
| 对结论、数字或引文有疑问 | 打开论文,手动寻找相应段落 | 从回答直接找到文献和原文位置 |
首批试用优先邀请已有一组论文、需要反复调整综述的用户。他们有明确材料与正在推进的任务,可以直接比较使用前后的正文和操作。
用户选择主要依据任务,而非专业或年级:是否需要综合多篇文献,是否会继续修改,是否需要核验关键观点。对于只问一个概念、已有工具修改一次便能采用的用户,先保留直接问答的轻量体验;对于尚未收集材料的用户,论文搜集由原有工具完成。
1.2 场景与问题
| 场景 | 触发情况 | 用户遇到的问题 | 期望结果 |
|---|---|---|---|
| S01 理解论文 | 读到不熟悉的方法、机制或结论 | 摘要不足以解释细节,关键条件需要翻阅正文 | 清楚解释,并给出相应原文 |
| S02 比较文献 | 多篇论文讨论相近问题 | 逐篇介绍容易重复,不同对象与条件容易混在一起 | 按共同维度比较,保留差异和来源 |
| S03 形成综述 | 已有主题与材料,需要组织初稿 | 内容容易罗列,缺少主题之间的联系 | 连贯正文,能据此继续调整 |
| S04 连续修改 | 初稿方向基本正确,结构或篇幅需要调整 | 新要求生效时,旧要求、事实或引用可能丢失 | 修改后的完整文本,保留仍有效的内容 |
| S05 核验观点 | 对某个结论、数字或引文存疑 | 回答与原文之间来回查找费时 | 找到真实来源,判断是否采用 |
这些场景会出现在同一项任务中。例如,用户先了解几篇论文,再按研究对象比较,生成综述后调整结构,最后检查其中的关键结论。
1.3 调研依据
已有材料包括四位同学的访谈和一次个人写作实践。三位受访者已经使用 AI 辅助写作,反馈集中在文献组织、研究联系与修改成本。
| 观察 | 需求判断 | 对应设计 |
|---|---|---|
| 有人认为反复解释不如自己改;有人用现有工具修改一次即可采用 | 操作成本影响使用意愿 | 允许直接提问、先看正文,再按需要深入修改 |
| 内容容易逐篇罗列,难以说明文献与本文的关系 | 初稿需要围绕研究问题组织 | 支持研究背景、比较维度和主题要求 |
| 用户看到初稿后,才逐渐明确满意的写法 | 修改也是形成想法的过程 | 后续修改保留用户已经提出的要求 |
| 个人实践先调整评述位置,再补回主题引导 | 后续指令需要延续此前决定 | 检查后续修改是否保留原有结构和事实 |
| 未核实摘要的提示在改写中丢失,补回后又混进正文 | 来源状态应随材料保留 | 计划在来源查看处保留核验状态 |
据此,本期优先解决文献组织与连续修改。引用核验作为写作过程中的必要操作,在用户需要时展开。初始探索中的逐步审核流程改为以对话和正文为主:用户先得到可判断的内容,再决定补材料、改结构还是核对原文。
这个选择也带来要求:减少前置填写后,系统需要从实际问题和后续修改中识别任务,并保留已经明确的要求。对于材料范围、篇幅等会直接影响结果的歧义,应进行简短确认;其余偏好允许边写边调整。
试用记录同时保存用户采用的段落、仍需手工处理的部分,以及重复说明同一要求的次数。
1.4 竞品分析
与 Lito 相关的产品主要有三类:支持长期任务的通用对话工具、围绕资料阅读的研究助手,以及按步骤完成文献整理的研究工具。以下根据官方产品说明比较其定位与操作方式。
| 产品 | 主要用途 | 典型使用方式 | 与研究写作的关系 |
|---|---|---|---|
| ChatGPT Projects | 将长期任务的文件、指令和对话集中在项目中 | 上传材料、设置项目要求,在对话中提问和修改,也可使用 Canvas 起草文档 | 项目保留研究背景,对话适合逐步补充要求,文档编辑支持正文调整。官方说明 |
| NotebookLM | 理解和整理用户提供的资料 | 添加来源,围绕材料提问、综合内容,通过引用查看相关原文 | 将资料阅读与来源回查放在同一过程中,方便理解文献和检查回答依据。官方说明 |
| Elicit | 按研究问题搜集、筛选论文,提取信息并生成研究报告 | 提出问题,经过论文搜集、筛选和信息提取,再综合为报告 | 把文献整理拆成明确步骤,提取的信息用于后续研究综合。官方说明 |
比较结论。 从上述使用方式看,ChatGPT Projects 以项目和对话组织持续工作,NotebookLM 把提问与资料阅读结合起来,Elicit 将文献搜集、筛选、提取和报告生成组织成流程。这些产品已经提供了材料管理、资料问答和研究综合的不同做法,Lito 的设计重点是如何将这些操作用于已有论文的中文综述写作。
| 设计问题 | 竞品提供的参考 | Lito 的选择 |
|---|---|---|
| 同一组材料如何反复使用 | ChatGPT Projects 将文件、指令和对话保存在项目中 | 按研究主题组织项目,论文与研究背景可用于多次问答和修改 |
| 用户怎样提出写作要求 | ChatGPT 的对话与 Canvas 支持起草和调整内容 | 用户明确问题和材料后即可开始,结构、篇幅和表达偏好可在看到正文后补充 |
| 怎样检查回答依据 | NotebookLM 通过引用连接回答与原文 | 在具体论述处保留引用,点击后查看论文、原文和可用定位信息 |
| 多篇研究怎样组织 | Elicit 先提取论文信息,再进行综合 | 当前问答关注各篇具体发现与条件;下一版综述工作流按逐篇证据、主题分组和正文检查组织 |
用户现有做法也是重要参照。访谈中,有人把摘要整理成文档交给 AI,有人先按主题分类生成,再回到编辑器修改;也有人认为反复解释不如自己改。这说明新产品增加的步骤会直接影响使用意愿。
因此,Lito 保留项目与对话这些熟悉的操作,把已有论文的比较、正文修改和原文核验放在同一任务中。研究主题明确后即可开始,原文按需查看,完成的正文可以复制或导出。功能投入集中在多篇材料是否齐全、修改后要求是否保留、引用是否对应这些直接影响写作的问题上。
1.5 产品定位
访谈表明,生成初稿已经进入用户日常工作。Lito 选择集中处理初稿前后的具体问题:让研究材料保持在同一项目中,比较时取得各篇必要证据,修改时延续要求,核验时返回对应原文。
同一项目中的论文可反复用于问答和比较。用户修改正文时,可以继续使用此前的材料、写作要求和引用;对结论有疑问时,可以从回答打开原文。
本期优先处理论文遗漏、修改后要求丢失和引用错配,再扩展编辑与导出功能。用户可以配置自己的模型服务,配置页面提供必要字段、连接结果和修改入口。
试用时与用户原有做法比较:完成正文需要多久,同一要求重复解释了几次,关键观点的依据是否容易找到。
二、产品目标
2.1 产品目标与指标
| 目标 | 衡量方式 | 当前依据与后续检查 |
|---|---|---|
| 提高研究回答的可用程度 | 以案例级任务达成率为核心,结合回答档位、关键错误与同题变化 | 用固定题集逐题比较,记录目标问题是否解决及具体退步 |
| 减少连续修改中的损失 | 检查已确认要求、事实与来源是否延续 | 多轮案例逐轮评分,记录被删除、改错或未澄清的内容 |
| 方便核验关键观点 | 引用对象正确性、原文定位和回查操作 | 内容评分与来源检查分别记录 |
| 减少写作过程中的重复劳动 | 用户采用段落、修改轮次、重复说明次数和任务耗时 | 通过真实试用与原有做法比较 |
| 显示处理进度,支持停止、重试和继续提问 | 上传、生成、停止、重试和回访的完成情况 | 结合功能验收与真实任务日志检查 |
V1.0 与 V1.1 的评分口径及逐题说明见评测结果。固定题用于检查版本变化,真实试用用于判断使用价值。
2.2 功能模块与分工
| 模块 | 主要职责 | 输出 |
|---|---|---|
| 账户与个人模型 | 登录、个人模型配置、访问权限 | 登录状态与可用模型 |
| 项目与文献 | 组织研究背景、文件、处理状态和使用范围 | 本次任务可用材料 |
| 研究问答 | 理解问题、取得证据、比较与生成 | 回答、引用和任务状态 |
| 连续修改 | 读取此前回答,执行新增修改要求 | 新一轮正文与来源关联 |
| 原文核验 | 展示文献、原文及定位信息 | 文献、原文与定位信息 |
| 历史、复制与导出 | 保存会话,支持回访、复制与导出 | 历史会话、复制文本与导出文件 |
| 内部评测与诊断 | 关联题目、回答、证据和运行过程 | 问题归因、版本比较与回归案例 |
2.3 主要设计取舍
| 设计问题 | 本期选择 | 原因与代价 |
|---|---|---|
| 先收集完整要求,还是先生成初稿 | 用户明确问题和材料后即可开始,偏好在后续补充 | 符合看到正文后再判断的写作习惯;需要处理跨轮要求和歧义 |
| 先扩充材料来源,还是处理已有文献 | 优先已有论文中的理解、比较与修改 | 能直接服务当前目标用户,也便于把回答问题定位到具体原文;材料搜集仍需用户完成 |
| 核验是否每次必经 | 回答保留引用,原文按需打开 | 保持写作连续性;来源入口需要容易发现,重要疑问应在回答中准确表达 |
| 优先全文编辑器,还是对话修改 | 本期以对话修改和复制与导出为主 | 先解决事实、结构与引用保持;精细局部修改仍会使用外部编辑器 |
| 增加模型调用,还是先处理重复检索 | 根据证据缺口补查,为正文与修改保留资源 | 控制无效等待;长任务需要逐项判断取得了什么、还缺什么 |
具体执行与数据传递见产品架构总览。
三、需求总述
3.1 产品边界
| 项目 | 范围 |
|---|---|
| 主要输入 | 用户已有的论文、研究背景、问题和写作要求;当前研究验收以可提取文本的中英文 PDF 为主 |
| 主要输出 | 文献解释、比较、综述初稿、修改后的正文,以及引用与原文查看入口 |
| 使用方式 | 单用户在项目和会话中完成任务,个人配置语言模型 |
| 当前重点 | 文献处理、多篇证据、连续修改、引用核验、任务完成与结果保存 |
| 下一版重点 | 综述工作流:逐篇整理证据、分配主题、写作、检查和修改 |
| 范围外 | 开放式论文搜集、整篇论文自动完成、多人协同编辑和计费系统 |
| 待评审体验 | 选段修改、差异接受与撤销、单稿编辑、正式参考文献表与 Word 导出 |
3.2 数据关系
一个用户可以管理多个研究项目,一个项目关联一组文献和研究要求;会话保存具体任务,消息保存每轮提问与回答。回答中的引用关联真实文献及原文位置,显示编号可以变化,来源身份保持稳定。
| 数据对象 | 归属与用途 | 关键规则 |
|---|---|---|
| 用户与模型配置 | 用户管理自己的模型连接与凭据 | 普通用户可以配置个人模型;管理权限与个人配置权限分别控制 |
| 项目与文件关联 | 项目组织本次研究的材料 | 本次请求保存所选范围;改变范围影响后续请求 |
| 文献与索引 | 原文件用于核验,索引用于查找证据 | 解析片段保留文献、页码和相邻关系 |
| 会话与消息 | 保存任务、回答和修改过程 | 新回答保留为新轮次,已有正文可回看 |
| 引用与原文位置 | 将论述关联到来源 | 续问和重新检索后仍指向相同文献;位置不可用时保留来源查看 |
| 运行与评测记录 | 内部检查检索、生成与评分 | 关联具体请求和版本,访问范围受控 |
3.3 用户操作流程
- 注册或登录;需要验证邮箱时可重发邮件,也可退出换号。
- 配置个人模型,或选择已有可用模型;管理页可返回进入前的位置。
- 新建或进入项目,上传论文,填写必要的研究背景。
- 查看逐文件处理状态,选择本次提问的材料范围。
- 提出问题、比较维度或综述要求,系统显示处理进度。
- 阅读回答,按需要打开引用查看原文。
- 继续补充要求、压缩篇幅、调整结构或纠正内容,形成新一轮回答。
- 复制或导出结果,之后从历史会话继续研究。
用户也可以直接进入已有项目或会话,从当前任务继续。提纲与偏好允许在阅读初稿后补充。
3.4 优先级
P0 支撑一次完整研究任务,并处理资料权限、关键内容与结果丢失问题;P1 改善重复使用和结果整理;P2 进入后续方案评估。优先级表示需求重要性,完成状态通过版本记录追踪。
| 优先级 | 需求 | 排序理由 |
|---|---|---|
| P0 | 登录与个人模型、材料范围、上传处理、问答与比较、综述初稿、连续修改、引用、历史、停止与重试、基础复制导出 | 任一关键步骤阻塞,用户便无法完成任务或判断结果 |
| P1 | 结构化来源状态、回答问题反馈、复杂导出与编辑体验 | 减少重复核验、整理正文和描述问题的操作 |
| 下一版 P0 | 固定综述工作流 | 15篇任务仍有事实解释与正文交付问题,需要按步骤改善 |
| P2 | 更多文件格式、协作与其他扩展 | 根据试用需求的频次、影响和开发成本排序 |
回答中的事实错误按 P0 问题处理。P1 的来源状态指拟增加的状态字段与查看界面。
3.5 异常处理
| 异常 | 用户看到什么 | 可执行操作与保存要求 |
|---|---|---|
| 邮箱未验证 | 当前账号、验证说明和重发入口 | 重发、退出换号;刷新后仍可操作 |
| 模型连接失败或额度不足 | 连接失败原因,避免泄露凭据 | 修改配置或切换模型,保留未发送输入 |
| 部分文件解析失败 | 逐文件标明成功与失败 | 重试或移除失败文件,成功文件继续可用 |
| 选定文件尚未可检索 | 显示处理状态及受影响范围 | 等待或调整范围,明确本次使用材料 |
| 证据不足或相互冲突 | 说明缺少的依据,呈现不同条件下的发现 | 补充材料、缩小问题或查看原文 |
| 请求超时、限流或主动停止 | 区分失败、等待与已停止 | 保存已有会话与输出,允许重新发起 |
| 内容检查发现问题 | 围绕具体事实、条件、引用或任务要求修改 | 保存最终输出与实际状态 |
| 检查器格式错误或超时 | 作为技术故障重试检查 | 已有正文保留,运行记录标明故障 |
| 引用位置缺失或资料不可访问 | 显示定位或访问状态 | 允许的情况下查看文献;历史回答保留明确提示 |
四、功能需求
FR(Functional Requirement)为功能需求编号,用于关联需求、开发与验收记录。P0 为核心需求,P1 为体验改进;优先级与完成状态分别记录。
功能需求索引
| 编号 | 需求名称 | 优先级 | 详情 |
|---|---|---|---|
| FR-01 | 材料范围 | P0 | 4.2 项目、材料范围与上传 |
| FR-02 | 导入与处理状态 | P0 | 4.2 项目、材料范围与上传 |
| FR-03 | 研究背景与写作要求 | P0 | 4.3 研究背景与写作要求 |
| FR-04 | 文献问答 | P0 | 4.4 文献问答与多篇比较 |
| FR-05 | 跨论文比较 | P0 | 4.4 文献问答与多篇比较 |
| FR-06 | 综述初稿 | P0 | 4.5 综述初稿 |
| FR-07 | 证据不足与冲突 | P0 | 4.4 文献问答与多篇比较 |
| FR-08 | 引用与原文 | P0 | 4.7 引用与原文核验 |
| FR-09 | 连续修改 | P0 | 4.6 连续修改与历史 |
| FR-10 | 历史与回访 | P0 | 4.6 连续修改与历史 |
| FR-11 | 进度、停止与恢复 | P0 | 4.8 进度、停止与恢复 |
| FR-12 | 复制与导出 | P0 | 4.9 复制、导出与反馈 |
| FR-13 | 来源状态标记 | P1 | 4.7 引用与原文核验 |
| FR-14 | 问题反馈 | P1 | 4.9 复制、导出与反馈 |
| FR-15 | 账户与模型配置 | P0 | 4.1 账户与模型配置 |
4.1 账户与模型配置
FR-15,P0。 普通用户可以在产品设置和模型菜单进入个人模型管理,添加、编辑并选择自己的模型。配置包括提供商、接口、模型与所需凭据;只有需要的字段才要求填写。管理员管理系统资源,个人模型管理保持独立入口。
登录、邮箱验证和模型配置页均提供明确的返回或退出操作。用户主动管理模型时,完成或取消后返回原页面;首次使用需要模型时,配置完成后继续任务。
验收: 用普通账号完成添加、切换和返回;验证另一个账号无法读取或使用其私有配置。连接失败时可以修改重试,页面和日志不输出完整密钥。
4.2 项目、材料范围与上传
FR-01、FR-02,P0。 用户将论文放入项目,查看逐文件处理状态,并确定当前对话使用的文件或项目范围。处理过程保留原文件、文本、表格与原页之间的关联。
批量任务中成功与失败分别显示。重试失败文件时,其余已就绪文件保持可用。发起问答前,用户能辨认当前可用材料;范围发生变化后,下一次请求使用新的选择。
操作示例: 用户为“平台信任机制”项目上传一组论文,随后只选择其中两篇比较。若一篇仍在处理,界面显示受影响文件,用户可以等待或重新选择。材料不足时提示用户,确认调整范围后再继续回答。
保存规则: 每次请求保存当时选择的材料范围。后续新增文件用于新请求,已有回答与引用保留原来的关联。文件移除与原始资料删除分别处理,具体影响按第五章的数据规则确定。
验收: 使用包含无关论文的项目检查范围约束;检查批量上传中的部分失败、重试和移除。结构切片与表格处理通过正文、表头、数值和表注的对应关系检查。
4.3 研究背景与写作要求
FR-03,P0。 用户可补充研究主题、自己的模型或正文、比较维度、篇幅和结构偏好。项目中的要求适用于该项目,用户本次消息说明当前任务。
后续指令明确改变已有要求时,按新要求执行;没有改变的要求继续保留。回答说明哪些观点来自用户的研究设想,哪些结论来自文献。
验收: 连续提出“最后统一评述—补回主题引导—缩短篇幅”,逐轮检查此前要求;检查用户假设是否被误写成论文结论。
4.4 文献问答与多篇比较
FR-04、FR-05、FR-07,P0。 单篇回答解释用户关心的概念、方法、机制和结论;多篇比较按共同维度组织,说明不同研究对象与条件,引用跟随具体发现。
检索根据问题取得证据。明确比较或逐篇任务需要关注每篇材料,相关段落同时保留解释、限制条件和必要的上下文。资料没有支持的内容应说明缺口;相互矛盾的发现分别交代条件与来源。
操作示例: 用户选定两篇论文,提出“比较它们解释交易信任的方式,说明研究对象、主要机制和结论”。回答按这些维度组织,每篇的具体发现对应各自来源;研究对象或成立条件不同的地方,在相应比较项说明。
| 情况 | 输出要求 |
|---|---|
| 两篇均取得相应证据 | 比较共同问题、不同解释与研究发现,按论述标明来源 |
| 一篇相关,一篇未取得足够内容 | 说明缺失的比较项,按可用证据回答,并提供补充或核验方向 |
| 结论看似矛盾 | 先核对对象、变量含义和成立条件,再说明分歧 |
| 回答包含数值 | 同时交代指标、单位及决定解释的条件,引用对应原文 |
| 用户只需要简短结论 | 压缩背景和重复说明,保留决定结论含义的条件与来源 |
验收: 对照固定题检查必答点、具体发现、指标单位和条件;多篇题逐篇检查覆盖与来源。工具检索结果与最终回答分别评价,以定位证据在哪里丢失。
4.5 综述初稿
FR-06,P0。 用户提供主题与论文范围后,可指定结构、篇幅和组织方式,也可以先生成,再据正文调整。回答提供完整正文,各段围绕主题组织文献,说明相关发现及其联系。
逐篇要求需要同时检查覆盖、具体发现与引用;篇幅要求按题目约定检查。运行过程应为正文和必要修改保留资源,仅输出进度通知时,记为任务未完成。
操作示例: 用户要求将15篇论文按主题整理,再写成600–900字综述,每篇至少一个要点和引用。第一轮形成主题与文献分组,续问根据已选材料写成正文。每篇需要有与主题相关的实际发现;各段说明文献间的联系,控制背景介绍和重复内容的篇幅。
用户只提出“帮我写综述”时,先结合项目背景判断主题与材料;缺少研究主题或材料范围时简短确认。已有明确主题时可先给初稿,用户再调整组织方式。
验收: 按任务要求检查主题组织、逐篇具体内容、机制解释、来源与篇幅。上述15篇案例执行600–900字要求,其余任务使用各自约定。具体案例结果在版本记录维护。
下一版拟按“逐篇整理证据—确定主题与文献分组—生成正文—检查—修改”组织综述任务。
4.6 连续修改与历史
FR-09、FR-10,P0。 用户在现有回答上提出缩写、改结构、补充论证或纠错,系统返回修改后的完整文本。有效事实、要求和引用随修改保留,出现前轮错误时应明确纠正相关内容。
刷新页面或重新打开会话后,可以找到已有消息与来源。新轮次保留与前文的关联,避免新回答覆盖旧内容。
操作示例: 用户先要求“把与本文的关系放到最后统一讨论”,再要求“各节开头补一句主题引导”。第二次修改应增加引导,同时保留最后统一评述的结构。若随后要求缩写,优先删除重复解释,检查核心发现与引用是否仍然完整。
| 新指令 | 处理规则 |
|---|---|
| 增加要求 | 与仍有效的旧要求一并执行 |
| 明确替换要求 | 采用新要求,保留无冲突的事实和来源 |
| 修改范围不明确 | 结合当前回答判断;涉及整稿或局部的明显歧义时简短确认 |
| 指出事实错误 | 依据材料核对并纠正,后续回答沿用纠正后的内容 |
| 改变材料范围 | 新一轮按新范围形成论述,引用重新核对;历史回答可回看 |
验收: 完成连续修改后刷新、退出再登录;检查原回答与新回答均可访问。对照已知错误案例检查续问是否继续沿用错误。
4.7 引用与原文核验
FR-08,P0;FR-13 结构化来源状态,P1。 用户点击引用,查看文献、引文及可用页码;原文位置用于核对具体结论。引用编号可以随正文顺序调整,每个引用仍关联原来的文献。
遇到重复句、位置缺失或解析差异时,提供实际可用的查看信息。回答说明实际检查了哪些材料。拟为摘要整理、待核实等来源补充结构化状态,在来源查看处呈现并随修改保留。
操作示例: 用户对某个奖励机制的描述有疑问,点击该句引用。来源查看展示对应论文和原文,用户能继续打开所在页,阅读奖励对象与领取条件。关闭来源查看后返回原回答,继续提出修改。
| 核验情况 | 展示与行为要求 |
|---|---|
| 原文位置明确 | 展示文献身份、相关原文和可用页码,支持打开相应位置 |
| 引用包含多个来源 | 各来源分别可查看,用户能辨认每篇支持什么 |
| 引用定位不唯一 | 展示实际匹配信息与文献入口,便于继续查找 |
| 仅取得摘要 | 按摘要中的信息回答,核验表述与实际材料一致 |
| 后续修改改变引用顺序 | 显示编号与当前回答一致,引用继续关联正确文献 |
验收: 检查引用对象、原文连续性、数字和页码;通过跨轮重新检索验证编号不串篇。仅核对摘要的案例中,回答准确表达检查范围。拟增加的来源状态字段与界面列入第六章待定事项。
4.8 进度、停止与恢复
FR-11,P0。 处理中显示当前步骤和停止入口。主动停止、模型服务故障、证据不足和检查器故障分别处理,保留已有结果。
内容检查给出具体事实或证据问题时,供后续修改与补查;格式解析错误或超时按技术故障重试。重试和重新发起请求在记录中可区分。
验收: 检查停止后再次提问、服务失败后重试、检查器故障以及浏览器刷新。核对用户可见状态与实际任务状态一致。
4.9 复制、导出与反馈
FR-12,P0;FR-14,P1。 用户复制指定回答,或导出会话文本与 Markdown。操作应明确所选范围,文字与相应回答一致。单稿、Word 和正式参考文献表的导出方式列入待定事项。
问题反馈拟关联具体回答,允许用户填写问题描述;内部通过关联记录查看任务与材料,减少用户重复说明。
验收: 核对复制、导出的文本与选定范围;反馈功能实现时检查账号权限、回答关联和提交结果提示。
五、非功能需求
5.1 性能与稳定性
按页面、文献准备和模型任务分别测量。每次记录模型、材料规模、缓存状态和并发条件,便于解释差异。
| 项目 | 指标与采集方式 | 验收安排 |
|---|---|---|
| 页面加载 | 首次与再次打开的资源量、主要内容可见时间、可交互时间 | 同浏览器和网络比较,检查首页与文档资源缓存 |
| 文献处理 | 每文件耗时、成功率、失败原因;按页数和表格情况分组 | 用28篇材料检查首次处理与缓存复用 |
| 研究响应 | 发起至首段正文、完整回答的耗时,检索等待单独记录 | 单篇、两篇比较、15篇综述分别统计中位数与P95,并附样本量 |
| 服务稳定性 | 成功、失败、取消、重试及重试成功率 | 按原因分组,主动取消单列 |
| 并发 | 排队时间、完成率与资源使用 | 以2–3名同时使用作为首阶段验收规模 |
| 结果保存 | 刷新、退出、重开后的消息与引用完整性 | 在完成、停止和异常三类状态分别检查 |
性能目标在同一环境测量后确定。功能验收检查处理状态、结果保存和失败重试。
5.2 安全、隐私与数据生命周期
- 服务端校验用户对项目、文献、会话和个人模型的访问权限;隐藏页面入口与数据权限分别验证。
- 密钥输入、保存、回显与日志脱敏统一处理,普通用户无法读取其他用户的私有凭据。
- 说明哪些材料会发送给模型、解析和诊断服务,内部诊断数据按角色控制访问。
- 区分从项目移除文件与删除原始资料。删除前说明受影响范围;删除后历史回答中的来源显示实际状态。
- 明确原文件、索引、会话、日志与备份的保留和清理规则,并检查恢复后的访问权限。
资料删除规则与日志保留周期见第六章待定事项。
5.3 易用性与兼容性
正文保持可读的行宽和字号,表格、长引用与多轮消息可以浏览。模型选择、个人设置、来源查看和验证页面均有明确的进入与退出方式。
关键操作支持键盘焦点和可识别标签。浅色、深色主题和窄屏分别检查。首阶段覆盖桌面常用浏览器,同时检查窄屏下导航、弹层和正文是否遮挡。
5.4 埋点与使用指标
以下为采集设计,实施时统一事件命名、去重规则和权限。统计字段使用内部标识与状态;正文和原文仅在授权的诊断记录中保存,密钥不进入埋点或日志。
| 事件 | 关键字段 | 用途 |
|---|---|---|
| 模型配置结果 | 提供商类型、成功或失败类别 | 找到首次使用阻碍 |
| 文件处理完成 | 文件标识、页数、耗时、结果 | 观察材料准备成功率 |
| 研究任务发起与结束 | 请求标识、项目标识、版本、时长、结束原因 | 计算完成率并区分取消与故障 |
| 引用打开 | 回答标识、来源标识、定位结果 | 观察核验入口使用及失败情况 |
| 后续修改发起 | 前轮回答标识、会话标识 | 关联连续修改过程 |
| 复制或导出 | 回答或会话标识、导出类型 | 观察复制与导出行为 |
| 回答反馈 | 回答标识、问题类别 | 形成可追踪的改进案例 |
埋点记录用户是否复制或导出,试用访谈记录实际采用的段落、手工修改量和满意程度。分析修改次数时,同时查看任务是否完成、用户改了什么。
5.5 质量验收与发布
使用当前题集与V2评测模板及评分规范。完整题集包含60个质量案例、75轮输入,以及38项可靠性检查;其中质量输入分为65轮对话和10条工具题。
版本比较固定题目、评分要求和执行范围,分别统计案例达成率、整体档位、关键错误与工具维度,保留未执行项和判分依据。执行批次、分数与调整理由统一见版本记录。
后续发布检查建议如下,待评审确认:
- 功能准入: 登录、个人配置、上传、问答、引用、停止和回访等P0流程通过;账号越权与凭据泄露等阻断问题关闭。
- 质量回归: 按约定要求检查重点案例与案例级任务达成率,并逐题分析退步。相同范围下3–4分数量不低于参考版本,0–1分数量不增加;新增关键错误单独处理。
- 体验验收: 真实用户完成一次生成、修改和核验,记录采用内容、等待与剩余操作。
第二项使用参考版本的同范围结果,评审确认后作为发布规则执行。对于本轮重点修复的案例,逐项确认对应问题已经消除;其他案例出现退步时,检查原因和影响。评分明细与运行证据在版本记录和本地评测目录维护。
六、风险与待定事项
6.1 主要风险
| 风险 | 可能影响 | 处理思路与验证方式 |
|---|---|---|
| 文献机制、数字或条件解释错误 | 用户采用了错误论述 | 同时检查结论、成立条件及对应原文,用原题和相近问法复测 |
| 多篇或长任务遗漏、未交付正文 | 用户需要补问或重新整理 | 检查逐篇证据、阅读分配和结束前状态;推进综述工作流 |
| 多轮修改损失要求或错配引用 | 修改成本增加,来源不可信 | 保留文献身份与历史要求;逐轮检查事实、要求和来源 |
| PDF与表格解析失真 | 后续检索和回答依据错误 | 检查原页、表头、数值、单位与表注,保留解析失败提示 |
| 模型服务波动与费用增加 | 等待过长,任务中断 | 记录耗时、调用与用量,提供停止、重试与配置入口 |
| 账号和资料隔离缺陷 | 私有材料或密钥暴露 | 服务端权限校验与跨账号验收,诊断记录脱敏 |
| 用户原有做法已经足够方便 | 新产品增加操作,难以留存 | 用真实写作任务比较采用程度与操作成本,减少低价值步骤 |
| 基础项目或外部服务变化 | 升级后功能与行为变化 | 保留本地改动与版本记录,升级时检查关键流程和固定题 |
6.2 待定事项
| 事项 | 建议方案 | 下一步 |
|---|---|---|
| 当前需求状态 | 以V1.1为产品参考,功能要求与发布事实分别维护 | 对照实现与验收记录补齐需求状态 |
| 来源状态与反馈 | 来源状态界面与反馈按P1设计,回答中的事实错误按P0处理 | 确定字段、入口和保存规则 |
| 综述工作流 | 作为下一版重点,先覆盖已有15篇任务 | 确定每一步使用什么材料、生成什么结果,以及修改后重做哪些步骤 |
| 性能目标 | 按任务类型测量,结合真实试用确定门槛 | 补同环境耗时与并发数据 |
| 数据删除与保留 | 删除操作说明对原文件、索引和历史引用的影响 | 确定产品规则与保留周期 |
| 编辑与导出 | 评审选段修改、单稿、Word 与正式参考文献表需求 | 结合用户整理正文的实际操作确定方案 |
| 版本质量门槛 | 比较相同题目的结果,逐项复核关键错误 | 评审第五章的发布规则 |
| 竞品与用户采用 | 从多篇比较、连续修改两类任务开展同题试用 | 记录原有做法与Lito的输出和操作 |