支撑岗

AI训练师

模型训练数据准备、RLHF标注、对齐数据构建

参考薪资 15-30K
220知识点
73学时
23520积分
17工具
开始学习
CHAPTER 01

岗位说明

模型训练数据准备、RLHF标注、对齐数据构建

本课程路径为【AI训练师】量身设计,聚焦AI支撑与保障方向。 岗位描述:模型训练数据准备、RLHF标注、对齐数据构建。 学习路径分3个阶段递进:AI核心理论(58个知识点,涵盖机器学习) → 大模型应用(52个知识点,涵盖大模型) → 数据可信(110个知识点,涵盖数据科学与数据工程、AI安全伦理与合规)。 参考薪资:15-30K。需要掌握17个工具。 建议按顺序学习,基础阶段(了解级)快速建立概念框架,核心阶段(理解级)深入掌握关键技术,实践阶段(熟练级)达到工程应用能力。

岗位分类
支撑岗
参考薪资
15-30K(月·一线城市参考)
学习规模
220 个知识点 · 约 73 学时 · 17 个工具
已上线课程
221 节可直接学习
CHAPTER 02

现状与前景

AI训练师是大模型对齐的关键角色。RLHF标注、对齐数据构建、安全评估——这些工作直接决定大模型的输出质量。随着大模型商业化,AI训练师正从"标注员"升级为"AI行为设计师"。

CHAPTER 03

招聘数据

薪资区间

15-30K

数据来源于主流招聘平台 AI 岗位统计,一线城市 3-5 年经验参考。

岗位竞争力和成长

完成全部 220 节课程并通过面试题测试,可获得 23520 成长积分,覆盖该岗位 17 个核心工具与全部技能要求。

CHAPTER 04

能力雷达图

机器学习大模型安全合规数据工程
机器学习 100
大模型 96
安全合规 88
数据工程 85
CHAPTER 05

工具树(17)

数据标注 · 6
LLM框架 · 1
AI对话 · 2
AI办公 · 1
AI提示词管理 · 2
PromptfooPromptHub
其他 · 5
gpt_4odeepseek_v3qwen_25glm_4kimi_chat
CHAPTER 06

项目树

大模型RLHF对齐训练

构建偏好数据并对模型进行人类反馈强化学习对齐

领域模型微调

基于行业数据微调垂直领域大模型提升专业能力

模型评测体系搭建

设计多维评测基准全面评估模型能力与安全

Agent行为调优

优化智能体的指令遵循与工具调用行为表现

日常工作任务

  • 每日构建与清洗SFT训练数据
  • 每日标注偏好数据(pairwise比较)
  • 按项目执行模型微调与训练任务
  • 每周运行评测基准并分析结果
  • 每周迭代Prompt与系统指令
  • 每日分析模型Bad Case并优化
  • 按项目编写训练实验报告

核心交付物

训练数据集模型评测报告实验记录文档对齐策略方案

协作对象

算法工程师数据标注主管产品经理评测工程师
CHAPTER 07

学习目录(可直达课程)

第1篇系统
系统1 节
  1. 了解 欢迎来到AIQZ.CC 6分钟
第2篇机器学习篇
AI概论6 节
  1. 浅读 AI符号主义学派 19分钟 · 80分
  2. 浅读 连接主义复兴与深度学习崛起 18分钟 · 80分
  3. 浅读 深入asyncio事件循环与协程调度机制 19分钟 · 80分
  4. 浅读 生成式与判别式模型对比 20分钟 · 80分
  5. 浅读 自监督学习原理与应用 19分钟 · 80分
  6. 浅读 Agent与自主系统:AI前沿趋势 18分钟 · 80分
机器学习基础7 节
  1. 浅读 交叉验证:评估模型泛化能力的标准方法 16分钟 · 80分
  2. 浅读 编译期计算的艺术:模板元编程 15分钟 · 80分
  3. 浅读 C++结构化绑定与std::tie 20分钟 · 80分
  4. 浅读 让特征尺度统一的三大变换法宝 18分钟 · 80分
  5. 浅读 用什么标准挑选最佳模型的指南 23分钟 · 80分
  6. 浅读 Bagging还是Boosting到底怎么选 14分钟 · 80分
  7. 浅读 系统化搜索最佳正则系数的方法 17分钟 · 80分
监督学习算法9 节
  1. 浅读 L1加L2混搭的弹性网络正则化 17分钟 · 80分
  2. 浅读 用多项式拟合曲线的非线性回归法 16分钟 · 80分
  3. 浅读 Rust unsafe五大超能力 21分钟 · 80分
  4. 浅读 ID3信息增益分裂准则 14分钟 · 80分
  5. 浅读 种一片树来投票的随机森林入门 19分钟 · 80分
  6. 理解 XGBoost为何用二阶导数优化目标函数 19分钟 · 120分
  7. 理解 求解最大间隔超平面的数学推导 17分钟 · 120分
  8. 理解 KNN靠什么量远近的距离度量 19分钟 · 120分
  9. 理解 解决零概率问题的拉普拉斯平滑 18分钟 · 120分
无监督学习5 节
  1. 理解 K-Means++初始化:更优簇心选择策略 18分钟 · 120分
  2. 理解 t-SNE高维数据可视化降维 18分钟 · 120分
  3. 理解 用核函数搞定非线性的核PCA 28分钟 · 120分
  4. 理解 深入自编码器重构误差阈值设定 23分钟 · 120分
  5. 理解 Apriori频繁项集:关联分析基础 22分钟 · 120分
强化学习6 节
  1. 理解 搞懂强化学习里的状态转移 23分钟 · 120分
  2. 理解 用贝尔曼迭代求解值函数 22分钟 · 120分
  3. 理解 Q-Learning核心:贝尔曼方程如何更新Q值 23分钟 · 120分
  4. 理解 直接优化策略的策略梯度定理 23分钟 · 120分
  5. 理解 TRPO信任区域策略优化算法 21分钟 · 120分
  6. 理解 DDPG连续控制:深度强化学习实战 22分钟 · 120分
模型评估与选择6 节
  1. 理解 时间序列专属的交叉验证法 21分钟 · 120分
  2. 理解 Group交叉验证:分组数据评估 22分钟 · 120分
  3. 理解 mAP与Hamming Loss 19分钟 · 120分
  4. 理解 CUPED:A/B测试方差缩减 24分钟 · 120分
  5. 理解 数据陷阱:辛普森悖论 23分钟 · 120分
  6. 理解 排列重要性:比内置重要性更可靠 23分钟 · 120分
AutoML与神经架构搜索3 节
  1. 理解 Auto-Sklearn:自动化机器学习 18分钟 · 120分
  2. 理解 HyperOpt超参数搜索框架原理 21分钟 · 120分
  3. 理解 进化算法NAS:物竞天择选架构 22分钟 · 120分
时间序列分析与预测3 节
  1. 理解 ARIMA/SARIMA:传统时间序列方法 23分钟 · 120分
  2. 理解 TFT时序融合Transformer预测模型 17分钟 · 120分
  3. 理解 多元时序预测:多变量联动建模 18分钟 · 120分
图分析与网络科学3 节
  1. 理解 特征向量中心性:影响力传播的度量 17分钟 · 120分
  2. 理解 GIN:图结构表示的上限探索 18分钟 · 120分
  3. 理解 SPARQL查询语言:知识图谱的SQL 17分钟 · 120分
因果推断与因果发现4 节
  1. 理解 中介变量与前门准则的因果效应估计方法 22分钟 · 120分
  2. 理解 PC算法骨架发现与Meek规则定向 20分钟 · 120分
  3. 理解 因果发现的鲁棒性:应对混杂挑战 21分钟 · 120分
  4. 理解 uplift模型评估指标Qini与AUUC 20分钟 · 120分
强化学习进阶与实战4 节
  1. 理解 DQN改进:Double/Dueling/Prioritized 19分钟 · 120分
  2. 理解 分层强化学习:用层次结构攻克复杂决策任务 17分钟 · 120分
  3. 理解 深入解析RLHF在大模型对齐中的工程细节 28分钟 · 120分
  4. 理解 强化学习模型该怎么评估才靠谱 19分钟 · 120分
概率编程与贝叶斯建模2 节
  1. 理解 条件随机场CRF:序列标注利器 21分钟 · 120分
  2. 理解 共轭模型与指数族分布:贝叶斯建模的数学优雅 21分钟 · 120分
第3篇大模型篇
大模型原理8 节
  1. 浅读 大模型参数缩放规律 20分钟 · 80分
  2. 浅读 Transformer架构改进RoPE GQA SwiGLU 19分钟 · 80分
  3. 浅读 Grok开源模型家族 16分钟 · 80分
  4. 浅读 大模型涌现能力的触发条件 18分钟 · 80分
  5. 浅读 大模型超参数缩放规律 18分钟 · 80分
  6. 浅读 指令遵循能力训练与评估 19分钟 · 80分
  7. 浅读 大模型模式识别与归纳能力 17分钟 · 80分
  8. 浅读 上下文学习ICL的失败模式 16分钟 · 80分
大模型微调与对齐8 节
  1. 浅读 多任务混合微调怎么操作 17分钟 · 80分
  2. 浅读 RLAIF用AI反馈替代人类标注做对齐 21分钟 · 80分
  3. 浅读 对齐税:对齐之后能力下降了怎么办 20分钟 · 80分
  4. 浅读 LoRA低秩适配:用极少参数微调大模型的秘密 17分钟 · 80分
  5. 浅读 宪法AI:用规则约束AI行为 18分钟 · 80分
  6. 浅读 越狱攻击有哪些手段怎么防 24分钟 · 80分
  7. 浅读 遗忘学习:让大模型忘掉不该知道的 17分钟 · 80分
  8. 浅读 神经元级模型编辑方法 21分钟 · 80分
大模型部署与推理9 节
  1. 浅读 GPTQ二阶量化:Hessian信息驱动 16分钟 · 80分
  2. 浅读 推测解码与KV Cache加速 19分钟 · 80分
  3. 浅读 投机解码推理加速技术 18分钟 · 80分
  4. 浅读 批量推理Batching工程实践 23分钟 · 80分
  5. 浅读 MLC-LLM:跨平台大模型部署推理框架 20分钟 · 80分
  6. 理解 Triton推理服务器多后端部署 17分钟 · 120分
  7. 理解 SYCL异构并行编程加速大模型推理 20分钟 · 120分
  8. 理解 离线推理缓存优化实战方案 20分钟 · 120分
  9. 理解 移动端大模型压缩部署全流程实战 18分钟 · 120分
多模态大模型5 节
  1. 理解 CLIP ViT视觉编码器深入 18分钟 · 120分
  2. 理解 多模态模型实时交互技术 20分钟 · 120分
  3. 理解 多模态模型视频理解技术 25分钟 · 120分
  4. 理解 PaLM-E具身多模态架构深入剖析 22分钟 · 120分
  5. 理解 交互式世界模型技术 22分钟 · 120分
分布式训练7 节
  1. 理解 同步SGD分布式训练原理 17分钟 · 120分
  2. 理解 ZeRO-1/2/3阶段划分选型指南 19分钟 · 120分
  3. 理解 GPipe流水线并行原理 18分钟 · 120分
  4. 理解 Interleaved交叉流水线实战 18分钟 · 120分
  5. 理解 混合并行策略选择指南 20分钟 · 120分
  6. 理解 分布式训练故障恢复与断点续训 15分钟 · 120分
  7. 理解 TorchTitan:PyTorch大模型训练框架 18分钟 · 120分
端侧大模型与边缘部署4 节
  1. 理解 GGUF加llama.cpp:端侧量化部署 25分钟 · 120分
  2. 理解 llama.cpp跨平台推理与多后端配置 15分钟 · 120分
  3. 理解 端侧推理批处理优化策略 21分钟 · 120分
  4. 理解 端云协同推理路由策略 23分钟 · 120分
高级Agent框架与多智能体5 节
  1. 理解 Agent短期记忆向量数据库 20分钟 · 120分
  2. 理解 Voyager我的世界Agent:技能库怎么建 23分钟 · 120分
  3. 理解 LangGraph持久化与时间旅行 22分钟 · 120分
  4. 理解 AutoGen ConversableAgent:对话协议设计 19分钟 · 120分
  5. 理解 多智能体评测基准 17分钟 · 120分
小语言模型与端侧AI5 节
  1. 理解 DeepSeek-Coder:代码小模型 15分钟 · 120分
  2. 理解 DeepSeek-V3:MoE大模型架构 21分钟 · 120分
  3. 理解 GGUF与GGML:大模型端侧格式之争 18分钟 · 120分
  4. 理解 LanceDB列式向量数据库与端侧AI 15分钟 · 120分
  5. 理解 让SLM学会调用工具:函数调用能力实现 29分钟 · 120分
第4篇计算机基础篇
计算机网络1 节
  1. 理解 负载均衡算法与架构选型指南 24分钟 · 120分
第5篇数据科学与数据工程篇
数据为中心AI范式9 节
  1. 浅读 数据完整性与一致性检查实战 20分钟 · 80分
  2. 浅读 数据质量评分卡设计实战 17分钟 · 80分
  3. 浅读 灾难性遗忘缓解方法全解 15分钟 · 80分
  4. 浅读 InfLLM与StreamingLLM长上下文方案 16分钟 · 80分
  5. 浅读 飞轮数据筛选与过滤策略 19分钟 · 80分
  6. 浅读 数据质量怎么自动把关?评估循环 14分钟 · 80分
  7. 浅读 MixUp与CutMix数据增强策略对比 17分钟 · 80分
  8. 浅读 跨领域增强:让增强策略适应你的场景 20分钟 · 80分
  9. 浅读 加数据还有用吗?边际收益递减规律 18分钟 · 80分
合成数据生成7 节
  1. 浅读 合成数据保真度怎么测?统计检验方法 19分钟 · 80分
  2. 浅读 隐私预算怎么分?差分隐私分配策略 15分钟 · 80分
  3. 浅读 领域数据不够?用大模型来扩充 24分钟 · 80分
  4. 浅读 检测大模型生成数据中的偏见方法 20分钟 · 80分
  5. 浅读 表格合成数据好不好?评估指标全盘点 17分钟 · 80分
  6. 浅读 金融数据不能随便用?合成数据来救场 15分钟 · 80分
  7. 浅读 合成数据自带标注:自动化标注的捷径 16分钟 · 80分
数据标注与管理9 节
  1. 浅读 多人标注不一致怎么办?一致性提升方法 19分钟 · 80分
  2. 浅读 大标注任务怎么拆?任务分解方法 17分钟 · 80分
  3. 浅读 ZeRO三阶段显存优化与FSDP实现 16分钟 · 80分
  4. 浅读 混合精度训练:BF16/FP16/FP8怎么用 22分钟 · 80分
  5. 浅读 模型告诉你该标啥:主动学习的反馈机制 17分钟 · 80分
  6. 浅读 计算机视觉主动学习实战应用 21分钟 · 80分
  7. 浅读 标注者水平不一样?质量分层方法 16分钟 · 80分
  8. 浅读 写代码自动标注:程序化标注方法 25分钟 · 80分
  9. 浅读 弱监督生成的标注行不行?质量评估方法 18分钟 · 80分
隐私计算9 节
  1. 浅读 联邦学习参与者怎么激励?机制设计 18分钟 · 80分
  2. 浅读 FedAvg为何能收敛:数学推导揭秘 17分钟 · 80分
  3. 浅读 Reward Model训练与Bradley-Terry建模 22分钟 · 80分
  4. 浅读 差分隐私指数机制原理 16分钟 · 80分
  5. 浅读 秘密共享协议与安全多方计算 20分钟 · 80分
  6. 浅读 恶意安全模型与攻防分析 25分钟 · 80分
  7. 浅读 机密计算架构与TEE技术 23分钟 · 80分
  8. 浅读 机密计算联盟与行业标准 17分钟 · 80分
  9. 理解 DP-SGD:差分隐私随机梯度下降 21分钟 · 120分
数据治理与合规8 节
  1. 理解 OpenLineage数据血缘追踪标准 22分钟 · 120分
  2. 理解 Continuous Batching:动态批处理推理 15分钟 · 120分
  3. 理解 LLM推理显存规划:权重KV Cache与激活预估 13分钟 · 120分
  4. 理解 数据目录构建与元数据管理 24分钟 · 120分
  5. 理解 元数据治理流程设计:从采集到消费的闭环管理 22分钟 · 120分
  6. 理解 数据生命周期管理全流程 21分钟 · 120分
  7. 理解 数据脱敏匿名化技术方案 22分钟 · 120分
  8. 理解 数据加密策略与实施 22分钟 · 120分
特征工程与特征平台6 节
  1. 理解 训练服务偏差诊断与修复 24分钟 · 120分
  2. 理解 特征存储架构设计 22分钟 · 120分
  3. 理解 特征全生命周期管理 20分钟 · 120分
  4. 理解 特征监控与漂移检测体系 28分钟 · 120分
  5. 理解 实时特征一致性保障方案 22分钟 · 120分
  6. 理解 Tecton企业级特征平台 21分钟 · 120分
AI数据管道工程6 节
  1. 理解 Airflow DAG设计:数据管道编排 20分钟 · 120分
  2. 理解 Pachyderm数据版本控制管道工具 15分钟 · 120分
  3. 理解 Apache Superset:数据可视化平台 14分钟 · 120分
  4. 理解 DataRobot:自动化机器学习平台 10分钟 · 120分
  5. 理解 数据漂移检测与自动告警 22分钟 · 120分
  6. 理解 Schema演进管理:让数据结构变更不再伤筋动骨 18分钟 · 120分
数据治理与MLOps4 节
  1. 理解 Apache Atlas:元数据管理与血缘追踪 22分钟 · 120分
  2. 理解 Tecton托管特征平台与实时服务 21分钟 · 120分
  3. 理解 特征血缘追踪与依赖管理 19分钟 · 120分
  4. 理解 多重比较校正与错误控制 21分钟 · 120分
第6篇AI安全伦理与合规篇
对抗攻防9 节
  1. 理解 PGD投影梯度下降对抗攻击方法 17分钟 · 120分
  2. 理解 通用对抗扰动UAP攻击原理 19分钟 · 120分
  3. 理解 MemGPT分层记忆架构与Letta实践 21分钟 · 120分
  4. 理解 LLM Guard:大模型输入输出安全过滤方案 18分钟 · 120分
  5. 理解 对抗鲁棒性评估方法 22分钟 · 120分
  6. 理解 多扰动对抗训练方法 24分钟 · 120分
  7. 理解 对抗防御中的区间界限传播IBP方法 25分钟 · 120分
  8. 理解 对抗T恤物理攻击 23分钟 · 120分
  9. 理解 打印拍照鲁棒性分析 23分钟 · 120分
模型安全5 节
  1. 理解 查询预算优化策略 26分钟 · 120分
  2. 理解 梯度投毒攻击 23分钟 · 120分
  3. 理解 投毒检测算法 21分钟 · 120分
  4. 理解 BadNet后门攻击:原理与防御方案 21分钟 · 120分
  5. 理解 模型指纹技术 22分钟 · 120分
隐私保护技术5 节
  1. 理解 DP精度损失分析:理论与实践 18分钟 · 120分
  2. 理解 成员推断攻击原理与防范 22分钟 · 120分
  3. 理解 联邦学习差分隐私实践 20分钟 · 120分
  4. 理解 Shadow Model攻击技术 24分钟 · 120分
  5. 理解 成员推断防御策略全览 23分钟 · 120分
AI红队测试5 节
  1. 理解 AI红队威胁建模方法论 19分钟 · 120分
  2. 理解 AI安全漏洞修复优先级排序:先修什么后修什么 22分钟 · 120分
  3. 理解 Prompt注入攻击案例库 23分钟 · 120分
  4. 理解 GCG自动化越狱算法 19分钟 · 120分
  5. 理解 AI红队覆盖率评估方法 25分钟 · 120分
AI法规与合规6 节
  1. 理解 EU AI Act高风险AI分类 24分钟 · 120分
  2. 理解 EU AI Act透明度义务 25分钟 · 120分
  3. 理解 生成式AI服务管理办法 25分钟 · 120分
  4. 理解 NIST AI风险管理之Map职能 20分钟 · 120分
  5. 理解 NIST AI RMF治理结构设计 22分钟 · 120分
  6. 理解 算法审计持续监控机制 25分钟 · 120分
AI伦理与社会影响6 节
  1. 理解 算法群体公平性原理 21分钟 · 120分
  2. 理解 训练中去偏见:学习过程中的公平约束 22分钟 · 120分
  3. 理解 AI问责制框架设计 20分钟 · 120分
  4. 理解 AI创造的新职业版图 23分钟 · 120分
  5. 理解 AI对劳动市场影响:哪些岗位会消失或新生 18分钟 · 120分
  6. 理解 AI军备控制:全球治理怎么管住AI武器化 21分钟 · 120分
提示词安全与越狱攻防5 节
  1. 理解 间接Prompt注入RAG攻击 19分钟 · 120分
  2. 理解 防住Prompt注入:代码与提示词泄露攻防 21分钟 · 120分
  3. 理解 LLM-as-Judge输出安全审查机制 19分钟 · 120分
  4. 理解 HarmBench与AdvBench安全评测基准 21分钟 · 120分
  5. 理解 区块链审计日志不可篡改存证 21分钟 · 120分
AI内容安全与审核3 节
  1. 理解 上下文敏感的AI内容审核方案 20分钟 · 120分
  2. 理解 多模态内容审核系统构建 24分钟 · 120分
  3. 理解 内容审核策略配置体系 22分钟 · 120分
AI治理与法规合规4 节
  1. 理解 美国NIST AI风险管理框架 20分钟 · 120分
  2. 理解 AI伦理四大原则:公平透明与隐私保护 19分钟 · 120分
  3. 理解 AI伦理培训怎么做:提升团队素养指南 22分钟 · 120分
  4. 理解 AI安全基准对比:Anthropic与OpenAI方案 23分钟 · 120分
AI可解释性与机制解释4 节
  1. 理解 特征归因方法 18分钟 · 120分
  2. 理解 特征叠加:高维空间的信息编码 25分钟 · 120分
  3. 理解 AI机制解释性研究入门指南 21分钟 · 120分
  4. 理解 逆强化学习:从行为推断奖励 21分钟 · 120分
AIQZ.CC · AI训练师岗位说明书 · 返回星图选择岗位 · 2026