AI 生成 PPT“去 AI 味”评价方法
“像不像人写的”太主观。把它拆成六个可以逐项核对的维度,再用统一材料、盲评和返工时间比较结果。
六个评分维度
原文忠实度
权重 25%
- 低分
- 脱离材料补写结论,或遗漏关键前提。
- 高分
- 核心结论、限制和因果关系都能回到输入材料。
事实可追溯
权重 20%
- 低分
- 数字、日期、主体或引用没有来源,出现无法核验的信息。
- 高分
- 关键数字与专有名词可逐项核对,未知信息明确保留为空或待确认。
标题具体性
权重 15%
- 低分
- 大量使用“赋能发展”“凝心聚力”等脱离页面内容的空泛标题。
- 高分
- 标题能概括本页对象、动作或结论,换到另一份汇报时不能直接套用。
语言自然度
权重 15%
- 低分
- 翻译腔、机械排比、四字口号和同义反复明显。
- 高分
- 句式接近日常职场表达,长短有变化,保留材料原有语气与术语。
信息密度
权重 15%
- 低分
- 一页只有口号式大字,或条目很多但每条没有有效信息。
- 高分
- 每页围绕一个清楚主题,保留必要细节,同时没有明显溢出和堆叠。
版式重复度
权重 10%
- 低分
- 连续页面机械重复同一种卡片结构,内容关系与版式无关。
- 高分
- 版式随对比、流程、时间、列表等内容关系变化,重复有明确理由。
统一测试流程
- 01
固定同一份脱敏输入材料、目标页数、受众、使用场景和提示要求。
- 02
所有工具从新任务开始;首次输出不做人工润色,不使用不同的补充提示。
- 03
保存完整输入、首次输出、测试日期、产品版本、耗时和失败信息。
- 04
由至少两名评审独立按六个维度打 0—5 分,再记录分歧和平均分。
- 05
继续把结果修到同一交付标准,记录人工修改分钟数和修改类型。
- 06
公开原文件、输出文件、评分明细和失败页;无法公开时说明脱敏规则。
0—5 分怎么解释
- 0 分
- 该维度存在明显问题,不能直接用于交付。
- 1—2 分
- 能看出基本意图,但需要较多人工重写或重排。
- 3 分
- 达到初稿水平,仍有可定位的修改项。
- 4 分
- 大部分可保留,只需少量针对性修改。
- 5 分
- 在当前材料与测试条件下未发现明显问题。
一票否决项
- 出现无法从输入材料或公开来源核验的关键事实、数字或引用。
- 遗漏会改变结论的重要条件、风险或限制。
- 存在文字溢出、严重遮挡、无法辨认等影响阅读的问题。
- 包含涉密、敏感、未经授权或不应进入第三方服务的内容。
常见问题
- “去 AI 味”是不是把文字写得更口语?
- 不是。自然语言只是一个维度,更重要的是忠实于材料、标题具体、信息密度合适、事实可追溯,并减少与内容关系无关的机械版式重复。
- 这套分数是二狗PPT内置功能吗?
- 不是。本页是一套人工评测方法,用于规范后续案例和工具横评。当前不把它描述为产品内置评分或自动质检功能。
- 为什么还要记录人工修改时间?
- 首次输出分数不能完整代表交付成本。记录从初稿到统一交付标准的修改时间,才能比较事实核对、文字重写和版式调整分别花了多少工作。
- 二狗PPT目前在这套方法下得多少分?
- 当前尚未发布使用统一材料、双评审和完整输出文件的正式结果,因此不公布推测分数。正式结果应与输入材料、输出文件、评分明细和失败项一起发布。