🌐 由英文原文自动翻译。 查看原文
如何判断候选人在带回家测试中使用了AI
你把这份答案读了两遍。行文流畅、结构清晰、每个要点都命中——但读起来不像任何一个具体的人写的。没有个人观点,没有毛边,没有一句话听起来像是那个跟你打过电话面试的人说的话。你打开一个新标签页,把题目粘贴进ChatGPT。一字不差,答案就在那里。
这种情况现在已经很常见了。与其感到懊恼,不如提前想好应对方案。
为什么这比过去的"作弊"更难应付
过去照抄论坛上的答案,既偷懒又容易被抓到。AI生成的文字则不同——它往往质量真的不错,针对你提出的具体问题量身定制,而且用简单搜索根本查不出来。你现在要抓的不再是抄袭,而是要判断眼前这个人是否真的具备答案所展现出的思考能力,还是说他只有借助工具才能"表现出"这种能力。
这个区分很重要,因为老实说:对某些岗位而言,善用AI本身就是工作的一部分。而对另一些岗位来说,这恰恰是你想要测试排除掉的东西。
书面答案中值得留意的迹象
以下任何一项单独出现都不能证明什么。但多项同时出现时,就值得多留意一下。
- 答案面面俱到得有点可疑。 真实的人在时间压力下写东西,通常会选边站、抓大放小,或者某一部分明显写得比较薄弱。而AI生成的内容往往各个角度都覆盖得很均匀,读起来更像一份总结,而不是一个决策。
- 用词突然跳档。 一个求职信和LinkedIn消息都写得很平实的候选人,突然在居家测试里冒出"赋能""整体性""多维度"这类他此前从未用过的词。
- 答的是你"想问"的问题,而不是你"实际问"的问题。 有些按提示词作答的人会直接把你的问题粘贴进聊天机器人,而机器人往往会不知不觉地把你具体的措辞磨平,变成一个更通用版本的问题。
- 没有任何"凌乱感"。 没有被划掉的推理线索,没有"我不确定所以我假设了X"这类表述。真实的工作痕迹通常都带着接缝。
面试现场值得留意的迹象
在视频面试中,破绽表现得不太一样:
- 眼神移向镜头外的某个固定点,尤其是紧接着要给出详细或技术性回答之前。
- 停顿的时间太长,不像是在"思考",但又太短,不像是在"慢慢阅读屏幕"——之后给出的答案往往完整得不太符合"临场发挥"的状态。
- 回答与追问衔接不上。有人照着生成的内容念出第一个问题的答案时表现得不错,但你一问"为什么选这个方案而不是那个更明显的替代方案",立刻就卡壳了。
最后这一点是你手上最有用的测试方法。AI几乎可以对任何问题给出不错的初步回答。但要为一个自己并没有真正推理过的立场做现场辩护、面对一个它没预见到的问题——AI就差得多了。
具体该怎么做
先重新设计测试题,而不是先重新审视你的怀疑。 如果每个候选人都交出类似的、打磨得很光滑但略显套路化的答案,那问题可能出在你的题目上。只有一个标准答案的题目很容易外包给聊天机器人。而要求候选人针对你这家公司特有的、混乱的、真实情境做出决策的题目——尤其是加入只有你才知道的限制条件——就很难被令人信服地伪造出来。
在任何书面作业后面都加一个现场追问环节。 居家测试结束后花五分钟问"跟我讲讲你是怎么得出这个结论的",这比死盯着文字找蛛丝马迹更能有效区分真本事和借来的光鲜。问问他们做过的某个决定,以及为什么没有选择别的方案。真正想过的人能继续往深处走;没想过的人则走不下去。
提前决定使用AI是否会成为取消资格的理由,并且把这一点讲清楚。 有些岗位确实需要善用AI工具——写作、研究,以及部分销售和市场工作。如果一刀切禁止使用AI却又无法真正执行,只会教会候选人如何把它藏起来。更诚实的做法是提前说明:"用你在实际工作中会用的任何工具都行,但要准备好在面试中解释并为每一个决定辩护。"这样一来,测试就从一场"纯洁性审查"重新变成了它本该测的东西——这个人能否借助他实际会用到的任何辅助手段,产出真正靠得住的判断力。
没有确凿证据,就别妄加指责。 "这读起来可能是AI生成的"只是一种直觉,不是证据。用这种直觉去质问对方,通常只会让诚实的候选人变得防御性十足,而让不诚实的候选人下次准备得更充分。用后续的对话去求证,而不是用指控去质问。
监考真正能起作用的地方,以及它做不到的地方
对于限时的现场测评,带有诚信评分的监考——标记切换标签页、异常停顿、或房间里出现第二个声音——能堵住这个问题里最粗糙的那部分,这也是为什么AssessFit的测试都在带诚信评分的监考下进行。但它无法告诉你一篇居家论文是不是在提交前两天借助AI起草的,而且没有任何工具能做到这一点。正因为存在这个盲区,现场追问才比任何检测手段都更重要:它测的是理解力,而不仅仅是内容的来源。
归根结底,这是一个判断力的问题
坦白讲,你真正要做的并不是抓AI使用。你要弄清楚的是,一个人能否在毫无准备的问题面前思考、做出决定,并为这个决定辩护。这本来就一直是真正的测试内容,即便在AI出现之前也是如此——只不过现在伪装"表面上的胜任力"变得更容易了,而伪装"真正的深度"依然很难。把你的流程建立在考察深度之上,表面的东西自然就没那么重要了,即便它看起来似乎很重要。
每月免费测评 5 位候选人,永久免费。无需信用卡。
免费开始