尧图网站设计 尧图网站设计YAOTU DESIGN
ARTICLE DETAIL

资讯详情

深耕网站设计与一线实操的经验洞察。

AI面试会刷人吗?校招录播面的通过线是企业自己划的

AI面试会刷人吗?校招录播面的通过线是企业自己划的 「AI 面试会刷人吗」秋招季这句话在搜索框里出现得不少但翻到的回答大多是「AI 只是辅助决定权在人」这种正确的废话。把北森、牛客这些人力资源平台自己放出来的公开文档翻一遍之后我的答案要具体一些分是事后按评分点算出来的通过线是企业自己划的而机器评分和面试官评分之间确实存在一小部分公开承认的不一致。下面说的「AI 面试」指校招里那种异步录播面出题、倒计时、录完自动翻页全程对面没有人。技术面里让你在白板前写代码的那种不算那是另一回事。分不是当场算出来的北森在资源页里挂过一篇讲评分体系的文章2026 年 8 月 11 日那篇把评分拆成三层。这套结构值得准备面试的人花两分钟看清。第一层是知识点评分。每道题都有预设的参考答案和评分标准不是对错两分法而是多级——完全正确、部分正确、包含关键遗漏、仅有概念描述、完全错误。它举的例子是「请解释死锁的四个必要条件」参考答案标明了四个条件分别是什么每答对一个得 25%答偏或遗漏相应扣分。第二层是技能聚合。一个技能方向比如 Java 并发编程下面挂 3 到 5 道题分布在不同认知层级系统把知识点分按预设权重加成技能得分。「线程池的原理和调优」权重高「volatile 关键字的作用」权重低这张权重表也是专家定的。第三层是岗位综合技能分再按岗位模型的权重加一次输出一张能力雷达图。要紧的是这套标准谁定的。北森原文写得很直白评分标准不是 AI 定的是业务专家在出题的时候同步设定的跑分的是标准化评分引擎「系统只做机械聚合不做自主判断」。落到你身上就是答得顺不顺和拿多少分是两件事。你把项目讲得很流畅但评分点里那四个必要条件只说了两个机器那边就是一半分。很多人觉得 AI 面试「玄」大概也是卡在这儿——它量的不是表达力是有没有把预设的要点说全。北森在同一页里还点名了客户在评估其他产品时反馈的三类问题「部分题目与刷题网站高度重合」「候选人答错了也能拿高分」「评分区分度极低」。这是厂商在说竞品我原样转述不替它评价不过这几句至少说明这个品类的评分质量参差不齐。更要紧的是那条线而线不在你这边那篇文章最有用的一句藏在末尾的问答里。有人问「评分标准会因企业不同而不同吗」回答是会——企业级定制工作台支持调整评分权重和通过分数线让评分标准对齐企业自己的用人标准。所以「AI 面试会刷人吗」这个问题主语其实不在 AI 身上。刷不刷你取决于那一家把线划在哪、按什么权重算。同一份回答投两家一家过一家不过是正常结果不是系统抽风。招人多的年份线低、缩招的年份线高而题面看上去一模一样。线划在哪没有任何一家会公开合同里也不会写。能查到的只有机制分怎么算、谁定的标准、最后谁再看一遍。机器和人工之间确实有不一致北森公开的人机比对有三组数来自多家企业的 POC 验证人机评分一致性相关系数 0.9专业能力评分区间一致率 80% 以上录用一致率 84.2%0.9 是方向高度一致不等于相等。同一页的问答里北森自己写了不排除个别候选人的 AI 评分和面试官评分有偏差因为面试官评估的不只是技术能力还有沟通、协作、学习潜力这些「AI 暂时覆盖不到的维度」。按 84.2% 的录用一致率倒过来推有一成多的推荐结果跟业务面试官最后录的人对不上。被误判这件事因此不是都市传说它在公开口径里就存在量级是一成上下。但也别放大这几个数说的是方向一致、区间一致你答得对多数情况下机器也认。这些数还有一处容易用错的地方——不能横着比。北森给的相关系数和一致率是绝对值牛客在介绍自己那套 AI 面试时给的「人机一致性提升 9%」相对的是它自己的上一版或者通用模型。一个是卷面 80 多分一个是比上次多考了 9 分放进同一张表里排名是错的。各种排行榜最爱干的就是这件事。「刷人率」没有任何一家给得出这几家挂出来的公开页我都翻了一遍。给得出的是评分怎么算、一致性多少、并发多少、覆盖多少行业、多少家龙头验证过给不出的是面了多少人、刷了多少、线划在多少分。牛客在自己的产品介绍里把 AI 面试定位成「规模化初筛」。这半句就是答案的一半初筛的功能是把人从几千缩到几百不是挑出最合适的那一个。这一关按设计就要刷人问题只是你落在线的哪一边。网上那些「通过率 90% 以上」来源基本都是各家自己的宣传口径没有第三方复核过。更关键的是它跟你的关系——那家企业的线和某个全网通用的通过率是两回事。真正会把你筛掉的三件事一是没踩到评分点。这一项主要由你自己决定。做法不是答得更好听而是把该说的要点说全、说成形——行为面里 STAR 那套「情境、任务、动作、结果」为什么好用它天然就是评分点喜欢的形式。二是设备和环境。录播面全程录视频摄像头、麦克风、网络出一样问题整段表现就白录。这三样恰好是开面前十分钟能验完的栽在上面最亏。三是这一关根本不是评分关。有些公司的 AI 面试是录播走流程决定去留的是后面那轮真人面也有反过来的录播分只拿来给你排序。你在录播关的表现对结果的影响这两种情况差很远。开面之前一分钟能判出是哪一类页面有倒计时、有录制提示、答完自动翻页、没有追问异步录播面。分是事后按评分点算的「准备被追问」在这里没有意义。你说完对面会接话、会往细节里追对话型 AI 面试官或者真人。评分点照样在但追问会当场把你往深处带临时组织语言的空间小得多。打开的是答题页面或者 IDE机考跟面试不是一条线别拿准备面试的方式应付。挑工具时别看排行榜看这三件事第一件它有没有说清自己的数字是怎么测出来的。「实时响应」和「准确率」是这个品类里被拿来做排行榜最多的两栏也是最没有可比性的两栏。我们自己做这个面灵一样只能说形容词面试牛牛的官网写「极速语音转写」译妙蛙写「毫秒级别响应」面霸AI 的官网换到英文版写的是在几秒内起草结构化答案。没有一家告诉你测的是什么音频、什么网络、从哪个时刻开始算。既然大家都不给那就自己测。找一段三分钟的面试录音自己念一段也行放给工具听掐两个时间录音结束到第一个字上屏最后一个字说完到屏幕上定稿。同一台机器、同一段音频、同一张网络两家放在一起跑一遍比任何排行榜都准。唯一要留意的是别拿两家的宣传数字互相比那是两种口径。第二件它管的是哪一段。「AI 面试助手」这四个字底下躺着四种东西买错了就是白花钱。只练、不进面试链路的比如职徒简历——它本来是个简历站AI 押题和模拟面试长在旁边官网写「根据简历和岗位要求生成专属面试题」模拟那栏写「仿真人实时互动」还有逐题反馈报告你卡在「不知道会被问什么」就买这种。练加上场的比如面试牛牛首页上实时建议和模拟面试并列中英文都能用端上有 Windows 10/11、macOS 11、iOS、安卓卡在「临场接不上话」再买这种。还有带语言关的译妙蛙面试官是成都一家翻译公司做的国内版和海外版分开海外版带实时翻译官网写覆盖 208 个国家和地区——面外企、面海外岗看的才是这一类。计费也是从这里分出来的按分钟扣、按时长包、按月订阅是三种不同的买法。先算你这一季会面几场、每场多久再去看价格比先看价格有用。第三件它有没有把「你的内容去哪了」写清楚。这一栏是面霸AI 在几家里写得最具体的官网写「对会议软件不可见」「面试结束清空历史且不用你的内容训练模型」。前半句和所有同类一样外面无法验证后半句是可以拿来追责的话。面试牛牛首页那句「100% 私密不可检测」属于没有边界的绝对值我不采信。面灵是我们自己做的做四块面试实时辅助、模拟面试和押题、笔试识题、网申填表公开的平台名录里列了 40 项。短板照写没有 Linux 客户端Windows 要 10 2004 以上、macOS 要 13 以上手机上是网页不是原生 App笔试识题得另外装桌面客户端注册送 30 分钟加 1 次模拟、2 次押题而一场常规面试 45 分钟起这 30 分钟够你把设备跑通不够打完一场。开面之前十分钟把这三样过一遍摄像头和麦克风各录一段回放确认对面听到的是你的正常音量网络跑一次上行测速别用公司或图书馆的公共 Wi-Fi然后把简历里最容易被追问的两个项目用「情境、任务、动作、结果」各说一遍说给自己听。这三件事加起来十分钟能排掉的都是当场无法补救的问题。
返回列表