设备端录音摘要,先看重点再核对原声
转写回答“录音里说了什么”,摘要帮助你先理解“主要讲了什么”。言灵在 iPhone 上生成带时间戳的转写,再用内置模型整理标题和摘要;原始录音与完整转写仍会保留,方便你核对具体表达。
为什么只有转写还不够?
一段一小时的录音即使已经变成文字,也可能包含重复、停顿、题外话和大量口语表达。逐行阅读完整转写,仍然接近重新听一遍。
摘要适合充当入口:先建立全局印象,再搜索关键人物、术语或数字,最后回到对应原声确认。它不是替代原始材料,而是缩短找到重点的路径。
言灵如何整理长内容?
- 先在设备端把音频生成分段转写。
- 较长转写会按约 10,000 字符分块整理。
- 各部分摘要完成后,再整合成一个主题和正文。
- 最终结果保存在本地,用户可以编辑摘要标题和正文。
摘要由随 App 提供的 Qwen3.5 0.8B 4-bit MLX 模型在 iPhone 上生成。规则要求只依据输入,尽量合并重复内容、保留不重复的具体信息和不确定性,不把猜测补成事实。不过,生成式摘要仍可能遗漏、误解或过度概括,因此重要信息必须回听原声。
摘要会使用什么语言?
言灵会使用与输入内容相同的主要语言生成标题和摘要,而不是把内容默认翻译成另一种语言。例如,以中文为主的录音通常生成中文摘要;混合语言、口音和专有名词的结果仍应以真机实际输出为准。
首发转写以中文普通话为主要验证对象,英文作为辅助,不承诺覆盖所有语言。摘要能力应以兼容 iPhone 上的真实录音结果为准。
转写、摘要和原声分别负责什么?
| 内容 | 最适合做什么 | 不应该替代什么 |
|---|---|---|
| 摘要 | 快速了解主题、重点和大致结构 | 正式纪要、引用核验、法律记录 |
| 转写 | 搜索名称、术语、数字和具体表达 | 在噪音或重叠发言下的人工校对 |
| 原声 | 确认语气、上下文和准确措辞 | 快速浏览整段长录音 |
三者组合的价值在于:摘要负责缩小范围,文字负责找到位置,原声负责最后确认。
摘要适合快速浏览、发现主题和辅助检索;它不应直接承担逐字引用、说话人归因、法律记录、正式决策记录或行动项分派。
摘要适合哪些录音?
- 需要先掌握讨论主题的会议或小组交流。
- 希望在课后快速回顾结构的课程和讲座。
- 需要保留原始表达、同时提高整理效率的采访与访谈。
- 较长的口述想法、研究笔记或语音资料。
对于极短录音、只有一个简单提醒的内容,摘要可能没有必要。对于医疗、法律、财务决策或公开引用,摘要不能代替专业判断与人工核验。
当前能力边界
言灵当前不会自动区分说话人,也不会生成带责任人的行动项或标准会议纪要。摘要没有逐句引用标记;你可以通过转写的时间位置回听相关原声,但仍要自行判断哪段音频支持某项结论。
处理速度和结果会受设备、语言、收音质量、噪音、口音及多人重叠说话影响。当前处理在 App 前台进行;切到后台时暂停,返回后恢复。
常见问题
摘要会上传到云端生成吗?
言灵的摘要模型随 App 提供,核心摘要在 iPhone 上生成。更多数据路径请看言灵会上传录音吗。
可以编辑摘要吗?
可以编辑摘要的标题和正文,也可以复制摘要。当前完整转写可以查看、搜索、回听和复制,但不能在正式界面中编辑。
能自动生成会议行动项吗?
当前没有专门的行动项提取与负责人分配功能。需要正式执行的事项,应由参会者根据原声和实际决策人工确认。
摘要支持多长的录音?
言灵为长内容设计了分段整理流程,但不对单条录音承诺“无限长度”。能否顺利处理还取决于设备资源、文件质量和可用存储空间。
不必从头读完,仍然保留核对路径
了解长录音整理的完整流程,或看看言灵如何用录音资料库保存、搜索和分类处理结果。