摘要:从岗位任务选择少量关键能力,为同一岗位准备一致的核心问题和岗位相关追问,记录回答中的行为证据。AI可以辅助拟题,不能通过语气、表情或姓名自动判断候选人能力。
适用对象:小型企业HR、招聘服务工作室与用人经理。本文提供交付设计与模拟演练,不代表已经验证的客户收入案例。
先看结论与交付范围
任务能力矩阵、六道核心问题、追问卡、时间安排、行为证据表和面试官试问记录。
本项目最小范围:一个岗位的需求访谈、JD初稿、六道结构化问题、追问提示与人工记录表;不筛选简历、不自动录用或淘汰候选人。试点工具预算:50~400元(试点预算假设,不含人工)。预算是规划假设,模型价格和客户账号费用在实施时另行核实。
完整实施步骤
1. 先选能问清的能力
一个面试时间有限,不要覆盖几十种抽象能力。选择三至四个与真实工作任务直接相关的主题,比如优先级沟通、信息核验和问题升级。每个主题写出为什么对岗位重要,来源必须是岗位访谈或批准JD。没有工作依据的问题不纳入正式题库。
2. 把问题写成具体经历或场景
行为题请候选人描述经历,情景题给定岗位相关条件,避免套出一个标准口号。不要询问公司保密信息,也不要要求提供前雇主客户名单或受限制数据。允许候选人使用匿名场景,重点是本人采取了什么动作、依据是什么以及如何核验结果。
3. 统一核心问题与基本顺序
同一岗位使用一致的核心问题,减少随意聊天带来的不可比信息。面试官可以澄清含糊部分,但追问应仍围绕岗位能力。OPM的结构化面试资料可作为方法参考,不代表已经满足所有地区的招聘要求;客户应由HR确定实际适用流程。
4. 追问补证据而非设陷阱
为每题准备“你负责哪部分”“如何判断有效”“还有什么限制”等追问。不要预设候选人夸大,也不靠故意激怒来测抗压。若回答缺少某个情景条件,记录证据不足并适度澄清,而不是让AI把空白推断为负面人格特征。
5. 用行为锚点指导人工记录
记录事实、行动和结果,不写“感觉不靠谱”一类标签。对岗位相关回答可以预先定义需要观察的要素,但不让模板自动给出录用结论。培训面试官区分“没有问到”与“不能胜任”,防止把访谈设计不足归咎于个人能力。
6. 先内部试问再用于招聘
用虚构案例或内部角色扮演试问,检查题目能否在时间内回答,追问是否容易重复,以及两个面试官是否理解同一题。修订的是题库可用性,不将试问样本当作验证预测效度。真实候选人资料无需进入服务方的演示包。
7. 建立审核与版本控制
题库跟随JD版本,核心职责变更时重新确认问题,避免旧题测试已不需要的能力。每题记录owner、source_ref、approved_at和review_due;交付可编辑记录表并说明不支持自动评分、情绪识别或跨人排名。客户如果提出这些功能,需要单独讨论风险,不能顺手加入。
填写示例与输入输出对照
项目协调岗位的情景题可以是“两个客户都要求周五交付,但关键人员只有一位”。记录候选人是否澄清约束、沟通优先级与记录决策,而不是评价声音是否自信。不同合理路径均可保留供人工讨论。
| 原始情况 | 处理动作 | 可检查输出 |
|---|---|---|
| 问题:你是否抗压 | 改写为岗位约束明确的情景 | 不推断人格或情绪 |
| 候选人回答团队完成了 | 追问本人负责的动作与依据 | 区分团队结果与个人贡献 |
| 面试官没有问到某项 | 标记未采集而不是能力不足 | 人工决定是否补问 |
可复制的提示词
将客户授权资料放在独立的输入区域,并与规则分隔;先使用脱敏或虚构样本。提示词不能替代程序校验与业务审核,不要把密钥和不必要的个人信息放进对话。
只根据approved_role_tasks生成面试问题。输出question_id、job_task、core_question、followups、observable_evidence、source_ref。禁止涉及无关个人属性、情绪识别、人格推断和自动录用建议。没有岗位依据的题放入rejected并解释原因。
字段与证据记录
| 字段 | 用途 | 模拟填写 |
|---|---|---|
| role_id | 岗位编号 | ROLE-001 |
| task | 真实工作任务 | 每周整理客户项目进度 |
| competency | 岗位相关能力 | 识别风险并说明下一步 |
| question | 统一问题 | 请描述一次发现交付延期风险的经历 |
| evidence_anchor | 记录依据 | 情境、本人行动与可核验结果 |
| source_ref | 需求来源 | manager-brief第2项 |
| approval | HR与用人经理确认 | pending |
这张表是本项目共同的记录字典,不代表所有字段都可直接写入客户系统。实际接入前需确认字段类型、允许值、负责人和版本;未知值保留为空,原始资料与整理结果分开保存。人工审批的操作者与时间应由可信系统记录,而不是由模型填成“已批准”。
验收演练与失败处理
| 用例 | 输入情况 | 预期处理 | 验收证据 |
|---|---|---|---|
| V1 | 问题:你是否抗压 | 改写为岗位约束明确的情景 | 不推断人格或情绪 |
| V2 | 候选人回答团队完成了 | 追问本人负责的动作与依据 | 区分团队结果与个人贡献 |
| V3 | 面试官没有问到某项 | 标记未采集而不是能力不足 | 人工决定是否补问 |
先人工写出预期输出,再运行模板或流程;对实际结果分别标注通过、失败和待确认。验收阈值是双方事先约定的规则,不是工具默认给出的评分。模拟测试通过仅说明这些样本符合条件,不能保证未覆盖的输入同样正确。发现关键错误时暂停受影响步骤,保留原始记录,以人工方式继续处理必要业务。
报价与商业边界
将题库设计与面试官训练拆开。六题加追问、一次内部试问和一次修订可作为试点;现场培训、多岗位差异和后续题库维护按新增工时计,不按题目越多越值钱推销。
正式报价列明输入数量、交付格式、批准人、修改轮次和反馈期限。客户改变已经确认的业务范围属于变更,服务方未忠实落实已确认要求属于修错,两者要分别记录。AI订阅费低不等于项目人工成本低,尤其不要漏算核验、培训和售后时间。任何参考价都不是已成交证明。
七天试单计划
| 时间 | 当天重点 | 完成条件 |
|---|---|---|
| 第1天 | 先选能问清的能力 | 保存与“先选能问清的能力”对应的输入、处理说明和客户确认;若依据不够,记录待办而不是假装完成。 |
| 第2天 | 把问题写成具体经历或场景 | 保存与“把问题写成具体经历或场景”对应的输入、处理说明和客户确认;若依据不够,记录待办而不是假装完成。 |
| 第3天 | 统一核心问题与基本顺序 | 保存与“统一核心问题与基本顺序”对应的输入、处理说明和客户确认;若依据不够,记录待办而不是假装完成。 |
| 第4天 | 追问补证据而非设陷阱 | 保存与“追问补证据而非设陷阱”对应的输入、处理说明和客户确认;若依据不够,记录待办而不是假装完成。 |
| 第5天 | 用行为锚点指导人工记录 | 保存与“用行为锚点指导人工记录”对应的输入、处理说明和客户确认;若依据不够,记录待办而不是假装完成。 |
| 第6天 | 先内部试问再用于招聘 | 保存与“先内部试问再用于招聘”对应的输入、处理说明和客户确认;若依据不够,记录待办而不是假装完成。 |
| 第7天 | 建立审核与版本控制 | 保存与“建立审核与版本控制”对应的输入、处理说明和客户确认;若依据不够,记录待办而不是假装完成。 |
风险与不适用情形
- 材料服务不是自动招聘决策系统
- 不得从姓名、声音、照片推断人格或工作能力
- 当地招聘、隐私与无障碍要求应由客户HR和专业人员核对
所有案例与数字均已标为演示或估算,不构成收入保证、招聘决定、法律意见或效果承诺。涉及专业或高风险事项时先由客户指定负责人确认,超出能力或权限的部分不要自动执行。
常见问题 FAQ
能给一个统一正确答案吗?
复杂工作场景通常没有唯一答案,应记录岗位相关行为证据和合理限制。
要上传候选人录音吗?
制作题库不需要真实候选人录音;如有后续记录需求应另行确认授权和数据边界。
核心问题固定是否不能追问?
可以做岗位相关澄清,但应保留一致的核心问题并记录追问内容。
官方参考与适用范围
参考资料用于核对基础方法或工具能力;本文的报价、演练、检查标准与项目方案为编辑设计,不是官方推荐套餐。查阅日期:2026-09-03。
继续实践
配套AI招聘JD与结构化面试材料完整资料包提供离线手册、可编辑模板与本地校验示例。更多方向见AI副业实战频道。
工具选型与提示词资料
适合阅读工具评测、工具推荐、对比测评类文章后继续转化。
0 回复