在 V2 已经招到 5 个以上全职远程的小伙伴了,目前都已经稳定在职,团队还在继续扩充
目前的缺口有 LLM 后训练的算法工程师岗位,AIGC 创作的内容运营岗位,AI 伴侣产品岗位
美国主体公司,有自己的 GPU 集群,支持远程全职,欢迎投递
岗位薪资标准:20-40k/月
- 负责大语言模型的 SFT 、偏好优化及相关后训练工作;
- 建设训练数据的采集、清洗、去重、标注和质量评估流程;
- 设计模型评测集和评价指标,分析训练前后的能力变化;
- 组织候选回答生成、人工评审和高质量训练样本生产;
- 优化训练参数、数据配比、上下文长度和 Chat Template ;
- 完成模型训练、推理部署、版本管理和线上效果跟踪;
- 根据产品反馈定位模型、数据、Prompt 或推理环节的问题。
- 熟悉 Python 、PyTorch 、Transformers 等技术栈;
- 有大语言模型 SFT 、LoRA/QLoRA 或偏好优化实战经验;
- 理解生成模型的数据格式、损失计算、上下文截断和训练流程;
- 能够独立完成数据处理、训练实验、效果评测和问题分析;
- 具备良好的实验设计能力,重视数据隔离、可复现性和评测可信度;
- 对语言质量、指令遵循、多轮对话和长上下文能力有判断力;
- 具备较强的工程能力和跨团队沟通能力。
- 有对话模型、角色扮演、互动叙事或创意写作模型经验;
- 熟悉 TRL 、PEFT 、vLLM 、DeepSpeed 或同类工具;
- 有 DPO 、KTO 、奖励模型或人工反馈数据经验;
- 有模型评测、数据标注平台或线上模型迭代经验;
- 有可展示的模型、数据集、代码或实验报告。
符合的同学欢迎投递简历至以下渠道(投递默认为可以接受小型任务测试):
联系邮箱( Base64 ):cGVhY2hsYW5kYWlAZ21haWwuY29t
联系 TG ( Base64 ):QGN6YWs5