大模型AI Coding实习生
岗位摘要
建设并优化LLM/Agent评测平台,形成实验、评测、回归与数据闭环;设计和优化AI Coding产物评估标准,对生成的前端页面、组件、工具等进行多维度质量评估;参与LLM训练数据建设,包括编码任务设计、数据合成、数据清洗、质量筛选与问题归因
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 建设并优化LLM/Agent评测平台,形成实验、评测、回归与数据闭环
- 设计和优化AI Coding产物评估标准,对生成的前端页面、组件、工具等进行多维度质量评估
- 参与LLM训练数据建设,包括编码任务设计、数据合成、数据清洗、质量筛选与问题归因
- 打造可复用的工具与技能体系,提升扩展效率与规模化交付能力
- 参与AI Coding/Agent相关产品研发,围绕真实场景持续迭代
任职要求
- 计算机、软件工程、人工智能、数据科学等相关专业在读,具备良好的编程基础
- AI原生思维,重度使用Vibe Coding,能判断代码质量,有能力用大模型出色完成项目
- 精通Python、TypeScript、Golang、Rust等一门或多门语言
- 具备良好的代码理解、结构化分析和问题归因能力,能将模糊问题拆解为清晰可判断的问题
- 对前端页面、交互体验或工程产物有审美判断,能识别“能跑”和“好用、可交付”之间的差异
加分项
- 熟悉 Codex、Cursor、Claude Code、GitHub Copilot、Devin 等 AI Coding 工具,锐评各主流大模型和 Agent 产品的调性
- 有 LLM 应用、Prompt Engineering、Agent、RAG、模型评测相关经验
- 熟悉 React、Vue、Next.
- js、Tailwind CSS 等前端技术栈,或有前端项目、组件库、低代码平台、设计系统、个人 AI 工具项目经验
- 有数据合成、SFT / RLHF / DPO 数据构建、Benchmark、自动化评测或 Eval Platform 相关经验
- 在面试时能直接 show off 你的项目、代码、技术博客和上述
- 不墨守陈规:敢于质疑权威,敢于引领而非跟随, Strong opinions, weakly held.
- 有品味:不满足于仅仅编写能跑的代码,对代码、文档、产品的美感有追求
- 知其所以然:不背八股,而是在实践中理解计算机系统的本质
- 深入参与 AI Coding / Agent 从产品、数据、评测到工程基建的完整链路
- 接触 LLM 训练数据、Eval Platform、Rubric、Tools & Skills 等核心工作
- 获得 AI × Coding × Data × Product Experience × Engineering Infra 的综合实践经验
- 和算法、工程、产品团队一起探索人机共创 coding 的新范式
福利待遇
- 深入参与AI Coding/Agent从产品、数据、评测到工程基建的完整链路
- 接触LLM训练数据、评测平台、评估标准、工具与技能等核心工作
- 获得AI、编码、数据、产品体验与工程基础设施的综合实践经验
- 与算法、工程、产品团队一起探索人机共创编码的新范式
工作地址
北京海淀区大恒科技大厦12F
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。