打开 Lito
Lito文档
打开 Lito

产品需求

产品版本:V1.1

Lito 面向已有研究方向和参考文献的研究写作者,支持文献问答、多篇比较、中文综述初稿、连续修改与原文核验。用户在项目中组织材料,通过对话完成研究与写作,并将结果带回自己的写作工具。

一、需求分析

1.1 目标用户

优先服务正在撰写文献综述或研究评述的研究生,以及承担同类任务的研究写作者。他们通常已经确定研究方向、收集了一组中英文论文,需要理解材料、比较发现,并说明已有研究与自己课题的关系。

用户情况 当前做法 主要需要
已有材料,尚未形成清楚的论述结构 整理摘要,请 AI 分类或生成初稿 看清文献之间的关系,围绕研究问题组织正文
已有初稿,需要连续修改 补充范文、研究背景和细致指令,逐轮调整 保留已经确认的要求,减少反复解释
对结论、数字或引文有疑问 打开论文,手动寻找相应段落 从回答直接找到文献和原文位置

首批试用优先邀请已有一组论文、需要反复调整综述的用户。他们有明确材料与正在推进的任务,可以直接比较使用前后的正文和操作。

用户选择主要依据任务,而非专业或年级:是否需要综合多篇文献,是否会继续修改,是否需要核验关键观点。对于只问一个概念、已有工具修改一次便能采用的用户,先保留直接问答的轻量体验;对于尚未收集材料的用户,论文搜集由原有工具完成。

1.2 场景与问题

场景 触发情况 用户遇到的问题 期望结果
S01 理解论文 读到不熟悉的方法、机制或结论 摘要不足以解释细节,关键条件需要翻阅正文 清楚解释,并给出相应原文
S02 比较文献 多篇论文讨论相近问题 逐篇介绍容易重复,不同对象与条件容易混在一起 按共同维度比较,保留差异和来源
S03 形成综述 已有主题与材料,需要组织初稿 内容容易罗列,缺少主题之间的联系 连贯正文,能据此继续调整
S04 连续修改 初稿方向基本正确,结构或篇幅需要调整 新要求生效时,旧要求、事实或引用可能丢失 修改后的完整文本,保留仍有效的内容
S05 核验观点 对某个结论、数字或引文存疑 回答与原文之间来回查找费时 找到真实来源,判断是否采用

这些场景会出现在同一项任务中。例如,用户先了解几篇论文,再按研究对象比较,生成综述后调整结构,最后检查其中的关键结论。

1.3 调研依据

已有材料包括四位同学的访谈和一次个人写作实践。三位受访者已经使用 AI 辅助写作,反馈集中在文献组织、研究联系与修改成本。

观察 需求判断 对应设计
有人认为反复解释不如自己改;有人用现有工具修改一次即可采用 操作成本影响使用意愿 允许直接提问、先看正文,再按需要深入修改
内容容易逐篇罗列,难以说明文献与本文的关系 初稿需要围绕研究问题组织 支持研究背景、比较维度和主题要求
用户看到初稿后,才逐渐明确满意的写法 修改也是形成想法的过程 后续修改保留用户已经提出的要求
个人实践先调整评述位置,再补回主题引导 后续指令需要延续此前决定 检查后续修改是否保留原有结构和事实
未核实摘要的提示在改写中丢失,补回后又混进正文 来源状态应随材料保留 计划在来源查看处保留核验状态

据此,本期优先解决文献组织与连续修改。引用核验作为写作过程中的必要操作,在用户需要时展开。初始探索中的逐步审核流程改为以对话和正文为主:用户先得到可判断的内容,再决定补材料、改结构还是核对原文。

这个选择也带来要求:减少前置填写后,系统需要从实际问题和后续修改中识别任务,并保留已经明确的要求。对于材料范围、篇幅等会直接影响结果的歧义,应进行简短确认;其余偏好允许边写边调整。

试用记录同时保存用户采用的段落、仍需手工处理的部分,以及重复说明同一要求的次数。

查看用户访谈与写作实践 →

1.4 竞品分析

与 Lito 相关的产品主要有三类:支持长期任务的通用对话工具、围绕资料阅读的研究助手,以及按步骤完成文献整理的研究工具。以下根据官方产品说明比较其定位与操作方式。

产品 主要用途 典型使用方式 与研究写作的关系
ChatGPT Projects 将长期任务的文件、指令和对话集中在项目中 上传材料、设置项目要求,在对话中提问和修改,也可使用 Canvas 起草文档 项目保留研究背景,对话适合逐步补充要求,文档编辑支持正文调整。官方说明
NotebookLM 理解和整理用户提供的资料 添加来源,围绕材料提问、综合内容,通过引用查看相关原文 将资料阅读与来源回查放在同一过程中,方便理解文献和检查回答依据。官方说明
Elicit 按研究问题搜集、筛选论文,提取信息并生成研究报告 提出问题,经过论文搜集、筛选和信息提取,再综合为报告 把文献整理拆成明确步骤,提取的信息用于后续研究综合。官方说明

比较结论。 从上述使用方式看,ChatGPT Projects 以项目和对话组织持续工作,NotebookLM 把提问与资料阅读结合起来,Elicit 将文献搜集、筛选、提取和报告生成组织成流程。这些产品已经提供了材料管理、资料问答和研究综合的不同做法,Lito 的设计重点是如何将这些操作用于已有论文的中文综述写作。

设计问题 竞品提供的参考 Lito 的选择
同一组材料如何反复使用 ChatGPT Projects 将文件、指令和对话保存在项目中 按研究主题组织项目,论文与研究背景可用于多次问答和修改
用户怎样提出写作要求 ChatGPT 的对话与 Canvas 支持起草和调整内容 用户明确问题和材料后即可开始,结构、篇幅和表达偏好可在看到正文后补充
怎样检查回答依据 NotebookLM 通过引用连接回答与原文 在具体论述处保留引用,点击后查看论文、原文和可用定位信息
多篇研究怎样组织 Elicit 先提取论文信息,再进行综合 当前问答关注各篇具体发现与条件;下一版综述工作流按逐篇证据、主题分组和正文检查组织

用户现有做法也是重要参照。访谈中,有人把摘要整理成文档交给 AI,有人先按主题分类生成,再回到编辑器修改;也有人认为反复解释不如自己改。这说明新产品增加的步骤会直接影响使用意愿。

因此,Lito 保留项目与对话这些熟悉的操作,把已有论文的比较、正文修改和原文核验放在同一任务中。研究主题明确后即可开始,原文按需查看,完成的正文可以复制或导出。功能投入集中在多篇材料是否齐全、修改后要求是否保留、引用是否对应这些直接影响写作的问题上。

1.5 产品定位

访谈表明,生成初稿已经进入用户日常工作。Lito 选择集中处理初稿前后的具体问题:让研究材料保持在同一项目中,比较时取得各篇必要证据,修改时延续要求,核验时返回对应原文。

同一项目中的论文可反复用于问答和比较。用户修改正文时,可以继续使用此前的材料、写作要求和引用;对结论有疑问时,可以从回答打开原文。

本期优先处理论文遗漏、修改后要求丢失和引用错配,再扩展编辑与导出功能。用户可以配置自己的模型服务,配置页面提供必要字段、连接结果和修改入口。

试用时与用户原有做法比较:完成正文需要多久,同一要求重复解释了几次,关键观点的依据是否容易找到。

二、产品目标

2.1 产品目标与指标

目标 衡量方式 当前依据与后续检查
提高研究回答的可用程度 以案例级任务达成率为核心,结合回答档位、关键错误与同题变化 用固定题集逐题比较,记录目标问题是否解决及具体退步
减少连续修改中的损失 检查已确认要求、事实与来源是否延续 多轮案例逐轮评分,记录被删除、改错或未澄清的内容
方便核验关键观点 引用对象正确性、原文定位和回查操作 内容评分与来源检查分别记录
减少写作过程中的重复劳动 用户采用段落、修改轮次、重复说明次数和任务耗时 通过真实试用与原有做法比较
显示处理进度,支持停止、重试和继续提问 上传、生成、停止、重试和回访的完成情况 结合功能验收与真实任务日志检查

V1.0 与 V1.1 的评分口径及逐题说明见评测结果。固定题用于检查版本变化,真实试用用于判断使用价值。

2.2 功能模块与分工

模块 主要职责 输出
账户与个人模型 登录、个人模型配置、访问权限 登录状态与可用模型
项目与文献 组织研究背景、文件、处理状态和使用范围 本次任务可用材料
研究问答 理解问题、取得证据、比较与生成 回答、引用和任务状态
连续修改 读取此前回答,执行新增修改要求 新一轮正文与来源关联
原文核验 展示文献、原文及定位信息 文献、原文与定位信息
历史、复制与导出 保存会话,支持回访、复制与导出 历史会话、复制文本与导出文件
内部评测与诊断 关联题目、回答、证据和运行过程 问题归因、版本比较与回归案例

2.3 主要设计取舍

设计问题 本期选择 原因与代价
先收集完整要求,还是先生成初稿 用户明确问题和材料后即可开始,偏好在后续补充 符合看到正文后再判断的写作习惯;需要处理跨轮要求和歧义
先扩充材料来源,还是处理已有文献 优先已有论文中的理解、比较与修改 能直接服务当前目标用户,也便于把回答问题定位到具体原文;材料搜集仍需用户完成
核验是否每次必经 回答保留引用,原文按需打开 保持写作连续性;来源入口需要容易发现,重要疑问应在回答中准确表达
优先全文编辑器,还是对话修改 本期以对话修改和复制与导出为主 先解决事实、结构与引用保持;精细局部修改仍会使用外部编辑器
增加模型调用,还是先处理重复检索 根据证据缺口补查,为正文与修改保留资源 控制无效等待;长任务需要逐项判断取得了什么、还缺什么

具体执行与数据传递见产品架构总览

三、需求总述

3.1 产品边界

项目 范围
主要输入 用户已有的论文、研究背景、问题和写作要求;当前研究验收以可提取文本的中英文 PDF 为主
主要输出 文献解释、比较、综述初稿、修改后的正文,以及引用与原文查看入口
使用方式 单用户在项目和会话中完成任务,个人配置语言模型
当前重点 文献处理、多篇证据、连续修改、引用核验、任务完成与结果保存
下一版重点 综述工作流:逐篇整理证据、分配主题、写作、检查和修改
范围外 开放式论文搜集、整篇论文自动完成、多人协同编辑和计费系统
待评审体验 选段修改、差异接受与撤销、单稿编辑、正式参考文献表与 Word 导出

3.2 数据关系

一个用户可以管理多个研究项目,一个项目关联一组文献和研究要求;会话保存具体任务,消息保存每轮提问与回答。回答中的引用关联真实文献及原文位置,显示编号可以变化,来源身份保持稳定。

数据对象 归属与用途 关键规则
用户与模型配置 用户管理自己的模型连接与凭据 普通用户可以配置个人模型;管理权限与个人配置权限分别控制
项目与文件关联 项目组织本次研究的材料 本次请求保存所选范围;改变范围影响后续请求
文献与索引 原文件用于核验,索引用于查找证据 解析片段保留文献、页码和相邻关系
会话与消息 保存任务、回答和修改过程 新回答保留为新轮次,已有正文可回看
引用与原文位置 将论述关联到来源 续问和重新检索后仍指向相同文献;位置不可用时保留来源查看
运行与评测记录 内部检查检索、生成与评分 关联具体请求和版本,访问范围受控

3.3 用户操作流程

  1. 注册或登录;需要验证邮箱时可重发邮件,也可退出换号。
  2. 配置个人模型,或选择已有可用模型;管理页可返回进入前的位置。
  3. 新建或进入项目,上传论文,填写必要的研究背景。
  4. 查看逐文件处理状态,选择本次提问的材料范围。
  5. 提出问题、比较维度或综述要求,系统显示处理进度。
  6. 阅读回答,按需要打开引用查看原文。
  7. 继续补充要求、压缩篇幅、调整结构或纠正内容,形成新一轮回答。
  8. 复制或导出结果,之后从历史会话继续研究。

用户也可以直接进入已有项目或会话,从当前任务继续。提纲与偏好允许在阅读初稿后补充。

3.4 优先级

P0 支撑一次完整研究任务,并处理资料权限、关键内容与结果丢失问题;P1 改善重复使用和结果整理;P2 进入后续方案评估。优先级表示需求重要性,完成状态通过版本记录追踪。

优先级 需求 排序理由
P0 登录与个人模型、材料范围、上传处理、问答与比较、综述初稿、连续修改、引用、历史、停止与重试、基础复制导出 任一关键步骤阻塞,用户便无法完成任务或判断结果
P1 结构化来源状态、回答问题反馈、复杂导出与编辑体验 减少重复核验、整理正文和描述问题的操作
下一版 P0 固定综述工作流 15篇任务仍有事实解释与正文交付问题,需要按步骤改善
P2 更多文件格式、协作与其他扩展 根据试用需求的频次、影响和开发成本排序

回答中的事实错误按 P0 问题处理。P1 的来源状态指拟增加的状态字段与查看界面。

3.5 异常处理

异常 用户看到什么 可执行操作与保存要求
邮箱未验证 当前账号、验证说明和重发入口 重发、退出换号;刷新后仍可操作
模型连接失败或额度不足 连接失败原因,避免泄露凭据 修改配置或切换模型,保留未发送输入
部分文件解析失败 逐文件标明成功与失败 重试或移除失败文件,成功文件继续可用
选定文件尚未可检索 显示处理状态及受影响范围 等待或调整范围,明确本次使用材料
证据不足或相互冲突 说明缺少的依据,呈现不同条件下的发现 补充材料、缩小问题或查看原文
请求超时、限流或主动停止 区分失败、等待与已停止 保存已有会话与输出,允许重新发起
内容检查发现问题 围绕具体事实、条件、引用或任务要求修改 保存最终输出与实际状态
检查器格式错误或超时 作为技术故障重试检查 已有正文保留,运行记录标明故障
引用位置缺失或资料不可访问 显示定位或访问状态 允许的情况下查看文献;历史回答保留明确提示

四、功能需求

FR(Functional Requirement)为功能需求编号,用于关联需求、开发与验收记录。P0 为核心需求,P1 为体验改进;优先级与完成状态分别记录。

功能需求索引

编号 需求名称 优先级 详情
FR-01 材料范围 P0 4.2 项目、材料范围与上传
FR-02 导入与处理状态 P0 4.2 项目、材料范围与上传
FR-03 研究背景与写作要求 P0 4.3 研究背景与写作要求
FR-04 文献问答 P0 4.4 文献问答与多篇比较
FR-05 跨论文比较 P0 4.4 文献问答与多篇比较
FR-06 综述初稿 P0 4.5 综述初稿
FR-07 证据不足与冲突 P0 4.4 文献问答与多篇比较
FR-08 引用与原文 P0 4.7 引用与原文核验
FR-09 连续修改 P0 4.6 连续修改与历史
FR-10 历史与回访 P0 4.6 连续修改与历史
FR-11 进度、停止与恢复 P0 4.8 进度、停止与恢复
FR-12 复制与导出 P0 4.9 复制、导出与反馈
FR-13 来源状态标记 P1 4.7 引用与原文核验
FR-14 问题反馈 P1 4.9 复制、导出与反馈
FR-15 账户与模型配置 P0 4.1 账户与模型配置

4.1 账户与模型配置

FR-15,P0。 普通用户可以在产品设置和模型菜单进入个人模型管理,添加、编辑并选择自己的模型。配置包括提供商、接口、模型与所需凭据;只有需要的字段才要求填写。管理员管理系统资源,个人模型管理保持独立入口。

登录、邮箱验证和模型配置页均提供明确的返回或退出操作。用户主动管理模型时,完成或取消后返回原页面;首次使用需要模型时,配置完成后继续任务。

验收: 用普通账号完成添加、切换和返回;验证另一个账号无法读取或使用其私有配置。连接失败时可以修改重试,页面和日志不输出完整密钥。

4.2 项目、材料范围与上传

FR-01、FR-02,P0。 用户将论文放入项目,查看逐文件处理状态,并确定当前对话使用的文件或项目范围。处理过程保留原文件、文本、表格与原页之间的关联。

批量任务中成功与失败分别显示。重试失败文件时,其余已就绪文件保持可用。发起问答前,用户能辨认当前可用材料;范围发生变化后,下一次请求使用新的选择。

操作示例: 用户为“平台信任机制”项目上传一组论文,随后只选择其中两篇比较。若一篇仍在处理,界面显示受影响文件,用户可以等待或重新选择。材料不足时提示用户,确认调整范围后再继续回答。

保存规则: 每次请求保存当时选择的材料范围。后续新增文件用于新请求,已有回答与引用保留原来的关联。文件移除与原始资料删除分别处理,具体影响按第五章的数据规则确定。

验收: 使用包含无关论文的项目检查范围约束;检查批量上传中的部分失败、重试和移除。结构切片与表格处理通过正文、表头、数值和表注的对应关系检查。

4.3 研究背景与写作要求

FR-03,P0。 用户可补充研究主题、自己的模型或正文、比较维度、篇幅和结构偏好。项目中的要求适用于该项目,用户本次消息说明当前任务。

后续指令明确改变已有要求时,按新要求执行;没有改变的要求继续保留。回答说明哪些观点来自用户的研究设想,哪些结论来自文献。

验收: 连续提出“最后统一评述—补回主题引导—缩短篇幅”,逐轮检查此前要求;检查用户假设是否被误写成论文结论。

4.4 文献问答与多篇比较

FR-04、FR-05、FR-07,P0。 单篇回答解释用户关心的概念、方法、机制和结论;多篇比较按共同维度组织,说明不同研究对象与条件,引用跟随具体发现。

检索根据问题取得证据。明确比较或逐篇任务需要关注每篇材料,相关段落同时保留解释、限制条件和必要的上下文。资料没有支持的内容应说明缺口;相互矛盾的发现分别交代条件与来源。

操作示例: 用户选定两篇论文,提出“比较它们解释交易信任的方式,说明研究对象、主要机制和结论”。回答按这些维度组织,每篇的具体发现对应各自来源;研究对象或成立条件不同的地方,在相应比较项说明。

情况 输出要求
两篇均取得相应证据 比较共同问题、不同解释与研究发现,按论述标明来源
一篇相关,一篇未取得足够内容 说明缺失的比较项,按可用证据回答,并提供补充或核验方向
结论看似矛盾 先核对对象、变量含义和成立条件,再说明分歧
回答包含数值 同时交代指标、单位及决定解释的条件,引用对应原文
用户只需要简短结论 压缩背景和重复说明,保留决定结论含义的条件与来源

验收: 对照固定题检查必答点、具体发现、指标单位和条件;多篇题逐篇检查覆盖与来源。工具检索结果与最终回答分别评价,以定位证据在哪里丢失。

4.5 综述初稿

FR-06,P0。 用户提供主题与论文范围后,可指定结构、篇幅和组织方式,也可以先生成,再据正文调整。回答提供完整正文,各段围绕主题组织文献,说明相关发现及其联系。

逐篇要求需要同时检查覆盖、具体发现与引用;篇幅要求按题目约定检查。运行过程应为正文和必要修改保留资源,仅输出进度通知时,记为任务未完成。

操作示例: 用户要求将15篇论文按主题整理,再写成600–900字综述,每篇至少一个要点和引用。第一轮形成主题与文献分组,续问根据已选材料写成正文。每篇需要有与主题相关的实际发现;各段说明文献间的联系,控制背景介绍和重复内容的篇幅。

用户只提出“帮我写综述”时,先结合项目背景判断主题与材料;缺少研究主题或材料范围时简短确认。已有明确主题时可先给初稿,用户再调整组织方式。

验收: 按任务要求检查主题组织、逐篇具体内容、机制解释、来源与篇幅。上述15篇案例执行600–900字要求,其余任务使用各自约定。具体案例结果在版本记录维护。

下一版拟按“逐篇整理证据—确定主题与文献分组—生成正文—检查—修改”组织综述任务。

4.6 连续修改与历史

FR-09、FR-10,P0。 用户在现有回答上提出缩写、改结构、补充论证或纠错,系统返回修改后的完整文本。有效事实、要求和引用随修改保留,出现前轮错误时应明确纠正相关内容。

刷新页面或重新打开会话后,可以找到已有消息与来源。新轮次保留与前文的关联,避免新回答覆盖旧内容。

操作示例: 用户先要求“把与本文的关系放到最后统一讨论”,再要求“各节开头补一句主题引导”。第二次修改应增加引导,同时保留最后统一评述的结构。若随后要求缩写,优先删除重复解释,检查核心发现与引用是否仍然完整。

新指令 处理规则
增加要求 与仍有效的旧要求一并执行
明确替换要求 采用新要求,保留无冲突的事实和来源
修改范围不明确 结合当前回答判断;涉及整稿或局部的明显歧义时简短确认
指出事实错误 依据材料核对并纠正,后续回答沿用纠正后的内容
改变材料范围 新一轮按新范围形成论述,引用重新核对;历史回答可回看

验收: 完成连续修改后刷新、退出再登录;检查原回答与新回答均可访问。对照已知错误案例检查续问是否继续沿用错误。

4.7 引用与原文核验

FR-08,P0;FR-13 结构化来源状态,P1。 用户点击引用,查看文献、引文及可用页码;原文位置用于核对具体结论。引用编号可以随正文顺序调整,每个引用仍关联原来的文献。

遇到重复句、位置缺失或解析差异时,提供实际可用的查看信息。回答说明实际检查了哪些材料。拟为摘要整理、待核实等来源补充结构化状态,在来源查看处呈现并随修改保留。

操作示例: 用户对某个奖励机制的描述有疑问,点击该句引用。来源查看展示对应论文和原文,用户能继续打开所在页,阅读奖励对象与领取条件。关闭来源查看后返回原回答,继续提出修改。

核验情况 展示与行为要求
原文位置明确 展示文献身份、相关原文和可用页码,支持打开相应位置
引用包含多个来源 各来源分别可查看,用户能辨认每篇支持什么
引用定位不唯一 展示实际匹配信息与文献入口,便于继续查找
仅取得摘要 按摘要中的信息回答,核验表述与实际材料一致
后续修改改变引用顺序 显示编号与当前回答一致,引用继续关联正确文献

验收: 检查引用对象、原文连续性、数字和页码;通过跨轮重新检索验证编号不串篇。仅核对摘要的案例中,回答准确表达检查范围。拟增加的来源状态字段与界面列入第六章待定事项。

4.8 进度、停止与恢复

FR-11,P0。 处理中显示当前步骤和停止入口。主动停止、模型服务故障、证据不足和检查器故障分别处理,保留已有结果。

内容检查给出具体事实或证据问题时,供后续修改与补查;格式解析错误或超时按技术故障重试。重试和重新发起请求在记录中可区分。

验收: 检查停止后再次提问、服务失败后重试、检查器故障以及浏览器刷新。核对用户可见状态与实际任务状态一致。

4.9 复制、导出与反馈

FR-12,P0;FR-14,P1。 用户复制指定回答,或导出会话文本与 Markdown。操作应明确所选范围,文字与相应回答一致。单稿、Word 和正式参考文献表的导出方式列入待定事项。

问题反馈拟关联具体回答,允许用户填写问题描述;内部通过关联记录查看任务与材料,减少用户重复说明。

验收: 核对复制、导出的文本与选定范围;反馈功能实现时检查账号权限、回答关联和提交结果提示。

五、非功能需求

5.1 性能与稳定性

按页面、文献准备和模型任务分别测量。每次记录模型、材料规模、缓存状态和并发条件,便于解释差异。

项目 指标与采集方式 验收安排
页面加载 首次与再次打开的资源量、主要内容可见时间、可交互时间 同浏览器和网络比较,检查首页与文档资源缓存
文献处理 每文件耗时、成功率、失败原因;按页数和表格情况分组 用28篇材料检查首次处理与缓存复用
研究响应 发起至首段正文、完整回答的耗时,检索等待单独记录 单篇、两篇比较、15篇综述分别统计中位数与P95,并附样本量
服务稳定性 成功、失败、取消、重试及重试成功率 按原因分组,主动取消单列
并发 排队时间、完成率与资源使用 以2–3名同时使用作为首阶段验收规模
结果保存 刷新、退出、重开后的消息与引用完整性 在完成、停止和异常三类状态分别检查

性能目标在同一环境测量后确定。功能验收检查处理状态、结果保存和失败重试。

5.2 安全、隐私与数据生命周期

  • 服务端校验用户对项目、文献、会话和个人模型的访问权限;隐藏页面入口与数据权限分别验证。
  • 密钥输入、保存、回显与日志脱敏统一处理,普通用户无法读取其他用户的私有凭据。
  • 说明哪些材料会发送给模型、解析和诊断服务,内部诊断数据按角色控制访问。
  • 区分从项目移除文件与删除原始资料。删除前说明受影响范围;删除后历史回答中的来源显示实际状态。
  • 明确原文件、索引、会话、日志与备份的保留和清理规则,并检查恢复后的访问权限。

资料删除规则与日志保留周期见第六章待定事项。

5.3 易用性与兼容性

正文保持可读的行宽和字号,表格、长引用与多轮消息可以浏览。模型选择、个人设置、来源查看和验证页面均有明确的进入与退出方式。

关键操作支持键盘焦点和可识别标签。浅色、深色主题和窄屏分别检查。首阶段覆盖桌面常用浏览器,同时检查窄屏下导航、弹层和正文是否遮挡。

5.4 埋点与使用指标

以下为采集设计,实施时统一事件命名、去重规则和权限。统计字段使用内部标识与状态;正文和原文仅在授权的诊断记录中保存,密钥不进入埋点或日志。

事件 关键字段 用途
模型配置结果 提供商类型、成功或失败类别 找到首次使用阻碍
文件处理完成 文件标识、页数、耗时、结果 观察材料准备成功率
研究任务发起与结束 请求标识、项目标识、版本、时长、结束原因 计算完成率并区分取消与故障
引用打开 回答标识、来源标识、定位结果 观察核验入口使用及失败情况
后续修改发起 前轮回答标识、会话标识 关联连续修改过程
复制或导出 回答或会话标识、导出类型 观察复制与导出行为
回答反馈 回答标识、问题类别 形成可追踪的改进案例

埋点记录用户是否复制或导出,试用访谈记录实际采用的段落、手工修改量和满意程度。分析修改次数时,同时查看任务是否完成、用户改了什么。

5.5 质量验收与发布

使用当前题集与V2评测模板评分规范。完整题集包含60个质量案例、75轮输入,以及38项可靠性检查;其中质量输入分为65轮对话和10条工具题。

版本比较固定题目、评分要求和执行范围,分别统计案例达成率、整体档位、关键错误与工具维度,保留未执行项和判分依据。执行批次、分数与调整理由统一见版本记录

后续发布检查建议如下,待评审确认:

  1. 功能准入: 登录、个人配置、上传、问答、引用、停止和回访等P0流程通过;账号越权与凭据泄露等阻断问题关闭。
  2. 质量回归: 按约定要求检查重点案例与案例级任务达成率,并逐题分析退步。相同范围下3–4分数量不低于参考版本,0–1分数量不增加;新增关键错误单独处理。
  3. 体验验收: 真实用户完成一次生成、修改和核验,记录采用内容、等待与剩余操作。

第二项使用参考版本的同范围结果,评审确认后作为发布规则执行。对于本轮重点修复的案例,逐项确认对应问题已经消除;其他案例出现退步时,检查原因和影响。评分明细与运行证据在版本记录和本地评测目录维护。

六、风险与待定事项

6.1 主要风险

风险 可能影响 处理思路与验证方式
文献机制、数字或条件解释错误 用户采用了错误论述 同时检查结论、成立条件及对应原文,用原题和相近问法复测
多篇或长任务遗漏、未交付正文 用户需要补问或重新整理 检查逐篇证据、阅读分配和结束前状态;推进综述工作流
多轮修改损失要求或错配引用 修改成本增加,来源不可信 保留文献身份与历史要求;逐轮检查事实、要求和来源
PDF与表格解析失真 后续检索和回答依据错误 检查原页、表头、数值、单位与表注,保留解析失败提示
模型服务波动与费用增加 等待过长,任务中断 记录耗时、调用与用量,提供停止、重试与配置入口
账号和资料隔离缺陷 私有材料或密钥暴露 服务端权限校验与跨账号验收,诊断记录脱敏
用户原有做法已经足够方便 新产品增加操作,难以留存 用真实写作任务比较采用程度与操作成本,减少低价值步骤
基础项目或外部服务变化 升级后功能与行为变化 保留本地改动与版本记录,升级时检查关键流程和固定题

6.2 待定事项

事项 建议方案 下一步
当前需求状态 以V1.1为产品参考,功能要求与发布事实分别维护 对照实现与验收记录补齐需求状态
来源状态与反馈 来源状态界面与反馈按P1设计,回答中的事实错误按P0处理 确定字段、入口和保存规则
综述工作流 作为下一版重点,先覆盖已有15篇任务 确定每一步使用什么材料、生成什么结果,以及修改后重做哪些步骤
性能目标 按任务类型测量,结合真实试用确定门槛 补同环境耗时与并发数据
数据删除与保留 删除操作说明对原文件、索引和历史引用的影响 确定产品规则与保留周期
编辑与导出 评审选段修改、单稿、Word 与正式参考文献表需求 结合用户整理正文的实际操作确定方案
版本质量门槛 比较相同题目的结果,逐项复核关键错误 评审第五章的发布规则
竞品与用户采用 从多篇比较、连续修改两类任务开展同题试用 记录原有做法与Lito的输出和操作

产品设计见架构与功能机制,评测方法见评测体系,实际改进与结果见版本记录

图表