张路.
POSTS · · 6 分钟阅读

让不会讲的人也能被看见

成果评审有两种失真几乎必然发生:会说的占便宜,以及把计划当成果。这两件事都不该由「谁讲得好」来决定。

评审现场发生了什么

任何一场做过几十个项目的横向评比,最后都会出现同一种争议:第一名到底是做得最好,还是讲得最好。

这不是谁的错。评委一天听三十个汇报,注意力是有限资源;讲得清楚、节奏好、有金句的那个自然占便宜。而且更隐蔽的一层是:汇报天然鼓励讲计划。已经做完的事只有一件,没做完的可能性有无数种——把 PPT 的后三页填成路线图,比老老实实说「我们只跑通了一个场景」要好看得多。

AI 成果访谈openagent.world)想处理的就是这两件事。

三条硬规则

站上把规则写在最显眼的地方,就三条:

  • 不评价口才
  • 不把计划当成果
  • 同一模型统一评分

第三条的完整表述是:全部项目使用同一模型、同一提示词和同一套权重评分,本轮不进行人工改分。

「本轮不进行人工改分」这句话看起来是在限制自己,实际上是这套方法唯一能立住的支点。一旦允许人工调整,前面所有的一致性都白做了 —— 因为人工改分正是主观尺度差异重新进来的入口

一次访谈 1–2 分钟

流程只有三步:

01 语音确认        02 亮点梳理        03 统一评分
姓名·部门·项目     事实·产物·待补充    六维总分·结果排序

一次只问一个问题。 AI 根据你的回答决定下一句是澄清、追事件、追变化还是追边界,不机械把题库问完。这不是固定题库,是一套成果对话方法——用最短路径找到三样东西:

  • 一个真实事件
  • 一项可查看的成果依据
  • 一个尚未闭环的问题

最后一项常被忽略,但它其实是判断真假的最强信号:真做过事的人,一定说得出还有哪里没搞定。

另外,事实、判断、计划分开记录,信息不足时明确标注「待补充」,不让含糊的表述混进已完成的那一栏。

两条路,同一把尺子

现场和远程并行,但评价标准不因参与方式改变:

  • 现场 —— 工作人员用电脑看板录音,手机 ChatGPT Voice 负责语音提问与自适应追问
  • 远程自主 —— 网页直接开始,不需要管理员生成专属链接、也不用装 ChatGPT 客户端;实时服务异常时自动降级到普通六题模式

两种方式最终都进入同一个候选队列、同一个转写流程和同一套六维评分体系。

录音、转写、亮点、评分和报告共享同一个候选项目标识——这一条听起来像工程细节,但凡组织过评审的人都知道,「张三的录音配到李四的项目上」这种事一旦发生,整轮结果的可信度就没了。

允许重来,是为了降低口才的权重

提交前可以不限次数重录,不消耗机会。正式提交后仍可再访谈,最多累计 3 次,以最新一次的录音、转写和评分为准,同时保留历次录音、实时问答记录和操作记录。

这个设计和「不评价口才」是同一件事的两面:如果只有一次机会,紧张的人就吃亏了;允许重来之后,「讲得流畅」这件事的权重自然被压下去,剩下的就只有你到底做了什么。

保留历次记录则是为了另一件事——可追溯。以最新一次为准是评分口径,不代表前面几次就该消失。

适合什么场景

需要在短时间内横向评比几十上百个项目、又不希望结果取决于谁更会讲的组织。

用之前值得先看站上那份准备清单:知道它会问什么,反而能让 1–2 分钟里说的东西更实。