DataHub 关键词情报 · 数据更新至 2026-07-22
xAI工程与基础设施招聘
本页聚焦xAI工程与基础设施相关岗位,便于用户比较岗位职责、地点、薪资标注和详情入口。
活跃公司
- xAI142 · 100.0%
热门地点
- 美国142 · 100.0%
岗位方向
- 工程与基础设施142 · 100.0%
OPEN ROLES
代表岗位
前台大使/安全专员
以积极的态度欢迎和问候员工、承包商和访客;确保只有授权人员进入现场;充当接待人与新员工/现场访客之间的联络人;监控门禁系统、访客管理系统和火灾报警系统;协助现场访客办理签到和签退手续;监督ID徽章归还流程
工程师
监控和管理门禁控制、视频监控、警报及其他安全技术;使用Slack、Jira等协作工具与内部合作伙伴沟通;识别、评估并响应安全警报和事件,并进行适当升级;在紧急情况下支持应急通知和群发通信系统
安全运营中心经理
领导和管理一个由全职员工和供应商承包商组成的多元化全球安全运营中心团队,负责排班、培训、指导和绩效评估,以打造高绩效团队;制定、实施和维护全面的标准操作程序,以标准化流程并实现持续卓越的运营
安全专员
与现场安保人员协同,作为现场安全问题的即时响应人员;定期检查数据中心设备与人员;支持安全运营协调员进行现场安保力量的监督;审计安全程序并识别流程改进点;记录所有安全相关事件并提供详细报告;协助组织并参与应急演练,保持紧急情况下的准备状态
收入运营工程师
设计、实施和优化跨销售、营销和客户成功的端到端收入流程,以推动可预测的收入增长和运营效率;担任Salesforce销售云专家和系统所有者,为1000多名用户管理配置、定制和管理,包括对象、流程、自动化、验证规则和安全设置
GTM技术架构师
拥有并扩展GTM技术栈(HubSpot、Clay、Gong、内部工具);架构和自动化工作流程,以消除手动GTM任务;构建系统以支持与产品遥测数据关联的基于消耗的预测模型;为领导层可见性开发仪表板和报告
高级基础设施工程师
开发和优化软件,以在本地、虚拟机和机密云环境中调配和管理xAI的基础设施,支持美国政府项目的高效扩展;提高基础设施的可靠性、性能和成本效益,以在安全的机密环境中支持大规模AI和应用工作负载
应用工程师
推动核心产品及底层模型的开发与增强,跨职能协作交付端到端AI解决方案;识别痛点,确定产品规格,为政府或企业用例设计和构建基于LLM的软件;对模型进行基准测试并开发评估框架,以评估性能、解决弱点,确保符合客户标准
前端工程师
开发并维护grok.com及API的前端服务;专注于实现高性能、用户体验出色的用户界面;主要使用React与NextJS进行渲染;精通关于性能、可访问性和前端安全性的最佳实践;具备UI和UX设计经验者优先
质量保证工程师
测试规划与策略:为Grok Chat、Grok Voice和Grok Imagine制定、记录并执行全面的测试计划和测试用例,确保覆盖功能、性能和可用性方面;手动与自动化测试:执行手动测试,并参与开发自动化测试脚本,以验证跨平台(Web、iOS、Android)的产品功能、性能和可靠性
产品安全工程师
主导以安全为重点的多模态AI能力开发和进步;创新算法以优化神经网络性能,同时嵌入强大的安全措施;建立评估框架和基准,以评估和改进AI安全成果;与专家合作,将注重安全的AI功能集成到高影响力、以用户为中心的产品中
多媒体工程师
使Grok的实时虚拟形象产品变得快速、可扩展且可靠;帮助推进音频和游戏玩法研究,并将突破性创新部署给数百万用户;执着于每一毫秒和字节,确保跨丰富产品套件和用户平台的端到端质量和性能;精通低延迟系统和协议,如WebSocket和WebRTC
后端工程师(产品安全)
构建分布式系统,以大规模执行安全性和完整性保障;创建监控和审核框架,以提前应对风险;与其他AI专家合作,构建安全功能;以快速和精准的方式推动项目从概念到生产;积极主动的问题解决者,能将想法变为现实
后端工程师
设计和实施可扩展的后端系统,以支持Grok的AI驱动媒体体验,确保高性能和可靠性;与跨职能团队(包括前端工程师和AI研究人员)合作,提供引人入胜、媒体丰富的功能;构建和优化大规模数据管道,以处理和分析多模态数据,推动Grok媒体能力的持续改进
后端工程师
创新大规模实验框架,支持快速迭代,保持Grok在AI前沿地位;与顶尖工程师组成的跨职能团队合作,交付AI驱动的功能,吸引并赋能用户;设计和开发由Grok驱动的高性能、个性化聊天系统,确保全球用户的可靠性和可扩展性
企业代理工程师
与混乱的系统集成,编排复杂的工作流程,并利用AI改造业务运营;构建全栈解决方案,拥有从构思到部署的端到端产品执行所有权;与团队紧密合作,将尖端AI进步整合到稳健可靠、以用户为中心的解决方案中
Android工程师
塑造尖端的移动体验,将技术专长与敏锐的产品感相结合,为用户提供卓越的体验;负责大型生产级应用的架构设计,体现技术卓越性;承担强烈的责任感和主动性,能够身兼多职,负责大范围的工作;优化应用的性能、稳定性和可靠性
资金基础设施工程师
在裸机Kubernetes上设计、实施和运营全自动、容错的基础设施;支持其他工程团队的基础设施功能请求和实时系统调试;为高可用、大规模分布式生产系统执行计划内维护和跨区域灾难恢复;在基础设施和应用程序的各个层面维护监管和合规标准(特别是PCI标准)
软件工程师
为iOS/Android平台上的X Chat打造愉悦且安全的移动体验;专注于性能和用户界面,确保无缝、加密的交互;推动技术和产品决策,与设计师和工程师协作;在全球范围内部署创新、安全的功能,最大化用户影响力
沙盒服务工程师
构建和维护一个安全、可扩展的沙盒服务系统,为模型提供受控的计算环境访问;在大型集群上配置容器和虚拟机,使模型能够交互式地控制这些远程环境;支持模型运行代码、构建软件、与工具交互,甚至控制具有用户界面的应用程序
可观测性工程师
设计和实施可扩展的指标、日志和追踪可观测性基础设施;构建能够处理海量数据摄取的高性能遥测管道;开发API、查询引擎和用户界面,使工程师能够实时洞察其服务状态;定义并推行全公司范围内的仪表化、告警和可靠性最佳实践
媒体工程师
构建下一代大规模视频服务;使用高性能语言(Rust、C++或Go)贡献并重建核心媒体处理和分发管道;专注于每一毫秒和像素,确保跨丰富产品套件和用户平台的大规模端到端媒体质量和性能;至少拥有5年工作经验
Mac应用工程师
开发和优化基于Swift的大规模Mac应用程序;构建大规模数据管道、资产管理和UI原型的基础设施;开发和实施应用程序性能、可用性和可靠性的量化评估;优化和精炼代码以实现实时响应;开发和实施在macOS环境中处理复杂、长时间运行任务的策略
媒体工程师
确保Grok音频产品快速、可扩展且可靠;推动音频研究,并将突破性创新部署给数百万用户;关注每一毫秒和字节,确保跨丰富产品套件和用户平台的端到端音频质量和性能;精通低延迟系统和协议,如WebSocket和WebRTC
数据平台软件工程师
设计和实现高吞吐量、低延迟的数据摄取和传输系统;扩展和优化支持实时工作负载的多租户Kafka基础设施;针对高要求的生产流水线,扩展和调优Spark、Flink和Trino;构建接口、API和流水线,使团队能够在PB级别查询、处理和移动数据
后端工程师
负责为grok.com和公司API提供动力的后端服务开发;专注于编写高可扩展和可靠的服务,以高效处理每秒数万次查询;使用Rust语言维护整个后端技术栈;具备Rust或C++的专家级知识;拥有设计、实施和维护可靠且可水平扩展的分布式系统的经验
AI评估与强化学习工程师
构建RLHF工具,收集并整合终端用户的偏好和反馈,使模型能够基于真实世界使用情况进行迭代自我改进;开发数据管道和AI评估框架,从终端用户视角跟踪模型性能、安全性、用户满意度以及留存和参与度等指标
iOS工程师
构思并打造令人愉悦、直观的用户体验,重新定义人们在移动设备上与AI的交互方式;痴迷于每一个像素、动画和交互,确保体验感觉神奇且无缝;构建极速、高性能的系统,每一毫秒都至关重要;推动技术和产品决策,与AI研究人员和工程师合作,在全球范围内部署最先进的模型
应用工程师
设计和构建跨各种产品表面的推荐算法;利用xAI的所有基础设施和AI技术栈,显著提升用户体验;编写数据管道和训练任务,持续从产品数据中学习;通过实时实验收集用户反馈,迭代和改进算法;确保机器学习系统的可扩展性和效率
广告工程师
参与xAI工作的全流程,包括分布式系统和产品功能的构思、实验、实施和维护;利用xAI的所有基础设施和AI技术栈,显著增强广告产品;负责运营驱动X公司大部分收入的系统和产品;拥有5年以上行业经验,构建大规模、高性能的广告产品
广告平台工程师
利用最新的Grok模型为广告堆栈的所有阶段提供支持,包括候选选择、排名、拍卖、广告系列优化、创意生成和广告主体验;拥有并运营系统和产品,驱动大部分收入;拥有3年以上行业经验,从事大规模、高吞吐量的AI驱动广告产品开发
工程师
对用户报告的Grok功能问题进行分类和解决,包括API集成、应用程序功能和AI响应行为,旨在快速解决以恢复用户使用;通过电子邮件、聊天、论坛等渠道与用户进行富有同理心且清晰的沟通,将复杂的技术概念转化为易于理解的解释
前端工程师
构建全栈解决方案,负责从构思到部署的端到端产品执行;与研发团队紧密合作,将尖端AI进展融入稳健可靠的用户中心解决方案;通过迭代开发流程,与客户密切合作,收集反馈、完善功能并改进产品以应对现实世界的挑战
卓越工程师
负责交付打磨精良、端到端的用户功能,提升用户体验并扩展服务规模;与产品和研究团队紧密合作,将前沿的交互概念转化为现实;直接助力突破性进展,重新定义利用先进AI的可能性;专注于编写高度可扩展且可靠的前端和API,以高效处理每秒数万次查询
卓越工程师
负责构建AI编码工具,赋能下一代工程师;交付经过打磨、端到端的用户功能,提升用户体验并扩展服务规模;与产品和研究团队紧密合作,将前沿交互概念转化为现实产品;直接推动利用先进AI重新定义可能性的技术突破
语音AI解决方案工程师
设计和构建端到端的语音AI解决方案,从理解客户痛点,到规划产品规格,再到部署基于LLM的语音界面;对语音模型进行基准测试、编写评估报告或分析性能,以识别语音识别、合成或自然语言理解方面的弱点
视觉/视频理解集成工程师
设计并构建端到端AI解决方案,从理解客户痛点、确定产品规格到部署基于视觉语言模型的视觉界面;对视觉模型进行基准测试、编写评估报告或分析性能,以识别图像识别、目标检测或视觉理解方面的弱点
Android工程师
塑造尖端的移动体验,将技术专长与敏锐的产品感相结合,提供能引起用户共鸣的卓越产品;在任何特定时间,处理最关键的产品或技术挑战;具备强烈的产品感和高标准,能够构建直观且令人愉悦的用户体验
沙盒服务工程师
构建和维护一个安全、可扩展的系统,为模型提供安全、受控的计算环境访问;在大型集群上配置容器和虚拟机,授予模型对这些远程环境的交互式控制权;工作范围涵盖全栈:从集群级别的海量作业编排和资源调度,到节点上的文件系统性能微调
后端工程师
开发和维护支撑公司产品(如grok.com和API)的后端服务;专注于编写和维护高可扩展性、高可靠性的服务,能够高效处理每秒数万次查询;在多个Kubernetes集群(本地和云端)上托管服务
前端工程师
开发和维护xAI用于支持grok.com和API的生产系统前端;构建具有长期可维护性的代码库;在构建用户界面时,专注于性能和可用性;对复杂前端项目的实现有良好的理解;具备NextJS的专家知识
后端工程师
开发和维护支撑grok.com及API的生产系统;构建高可扩展、高可靠的生产基础设施;倾听用户反馈,解决用户痛点;主要使用Rust语言进行后端开发;具备设计、实现和维护可靠、水平可扩展分布式系统的经验
工程师
作为首要联系人,在每一次客户互动中体现X Money对信任和卓越的承诺;通过电话、聊天和电子邮件清晰、同理心且准确地回应客户咨询,解决与登录访问、卡片使用、交易状态、转账和账户设置相关的问题
财务平台工程师
设计、开发和维护FP&A平台与工具,包括用于财务规划、预算、预测和差异分析的数据管道、仪表板和自动化工作流;构建和优化来自多个来源(ERP系统、BI工具、数据库和外部API)的数据集成管道,以确保准确、实时的财务数据可用性
网络软件与服务工程师
构建软件、服务和框架,赋能网络开发工程师;亲自动手处理网络管理的各个方面,包括指标收集、配置、零接触配置、监控和自动修复;为xAI的生产网络和辅助网络推动自动化优先的解决方案;开发可扩展的工具,简化复杂流程,并确保坚如磐石的可靠性
站点可靠性存储工程师
开发和优化软件以管理艾字节级数据,为从事先进人工智能模型研究的xAI研究人员提供高效可靠的数据访问;提升xAI存储基础设施的可靠性、性能和成本效益,以支持大规模人工智能研究工作负载;与研究人员紧密合作,了解他们的数据使用场景,并定制存储解决方案以满足其需求
工程师
开发和调优基于RDMA的通信系统,利用NVIDIA GPU和Mellanox网卡(InfiniBand, RoCE)实现节点间的超高速数据传输;实施和优化GPUDirect RDMA,以实现GPU和网络接口之间的直接内存访问,最小化CPU开销
高级网络工程师 - 超级计算团队
构建和优化流量平台,自动化并简化跨数十个本地和云集群的生产推理引擎生命周期管理,处理负载均衡、路由、过载控制、身份验证/授权、传输加密等核心流量原语;使用Envoy、NGINX等L4/L7代理管理、扩展和优化xAI的生产推理能力
高性能网络工程师
开发和调优基于RDMA的通信系统,利用NVIDIA GPU和Mellanox网卡(InfiniBand, RoCE)实现节点间的超高速数据传输;实施和优化GPUDirect RDMA,以实现GPU与网络接口之间的直接内存访问,最小化CPU开销
软件工程师 - 超级计算团队
设计、实施和维护超级计算环境的稳健、可扩展基础设施;监控和优化系统性能,确保高可用性和最短停机时间;开发自动化工具和脚本,以简化操作并提高系统可靠性;排查分布式系统、网络和存储解决方案中的复杂问题
存储与数据库工程师
设计、构建并上线新功能和改进,旨在统一各存储系统间的通用组件;深入分析性能问题,与客户合作并提供解决方案,以满足客户的延迟、可用性和数据持久性要求;领导并推动与同事一起进行事件响应和恢复,审查并参与事件事后分析,并为此设定高标准
基础设施工程师
运营全球最大的GPU超级计算集群,用于AI训练和生产模型服务;实施基础设施即代码最佳实践,增强部署流水线;确保生产环境中的服务交付具有鲁棒性和安全性;同时管理本地集群和云服务提供商;协助为内部研究人员和实时外部流量实施安全最佳实践
硬核工程师
设计、构建和实施一个大规模分布式系统,为世界最大的超级计算集群之一提供动力;深入底层技术栈,对GPU、Linux内核、网络和文件系统等多样化系统进行性能分析、调试和优化,以实现峰值效率
前端工程师(内部开发者工具)
开发内部开发者工具;构建和改进用于调试本地环境的应用程序;构建和改进用于可视化生产数据的应用程序;提升整个组织的生产力;能够在没有设计师帮助的情况下创建直观的用户界面;具备出色的沟通能力,能够简洁准确地与团队成员分享知识
内部开发者工具工程师
开发和改进内部开发者工具;构建用于调试本地环境的应用程序;构建用于可视化生产数据的应用程序;构建用于加速CI管道的应用程序;致力于提升整个组织的生产力;有使用Docker和Kubernetes的经验
基础设施可靠性工程师
定义并执行基础设施可靠性和可扩展性的技术战略;构建和维护自动化、可观测性和控制平面,以确保跨数据中心、混合云/本地环境的健康运行;领导事件响应、深入根本原因分析和事后复盘,推动实际修复
IT系统工程师
在Windows和Linux服务器上构建、管理和支持复杂的应用程序堆栈;提供Windows和Linux故障排除及技术支持;部署、配置和支持VMware技术,包括vCenter、ESX和Horizon
网络工程师
协助定义配置和架构标准;为新平台的资质认证做出贡献;根据文档化程序,在企业办公室和接入点(POP)配置网络设备;配置和管理企业电路;持续改进配置标准和运营流程;具备BGP配置和管理的基本理解
安全威胁管理工程师
推动流程、程序和自动化的持续改进,以提高团队的质量和效率;参与24/7待命轮换,执行安全事件响应;指挥安全事件并向利益相关者更新状态;识别和开发新的检测用例,并优化现有检测;与其他团队合作制定技术方向和技术解决方案
高级网络安全工程师
担任网络安全领域的专家,特别是在防火墙、VPN、IDS/IPS、路由协议(如BGP、OSPF)和交换技术方面;根据运营和安全需求,管理和更新企业网络中的防火墙配置;为应对不断变化的威胁和需求,部署新的防火墙、交换机、路由器和网络安全设备
技术团队成员(平台安全)
设计和构建基于AI的安全工具和代理(使用Grok),以识别、分析和缓解X平台基础设施及面向客户的X应用程序中的漏洞;主动识别需要解决的安全问题,并负责端到端的设计和实施;在整个组织中协作并担任安全倡导者,推动技术决策
强化学习环境全栈工程师
构建供智能体和强化学习参与者交互的沙盒用户界面;为已构建的环境创建任务,并以编程方式验证任务完成情况;享受远程工作模式;具备扎实的React.js专业经验(需熟悉Hooks、现代状态管理,TypeScript优先)——必需
全栈工程师
构建高质量、交互式的沙盒用户界面,提供卓越的打磨效果和用户体验;开发强大的后端服务以支持应用程序运行;以编程方式生成任务,并为任务完成实施可靠的验证逻辑;享受远程工作模式;具备强大的React.js专业经验(包括Hooks、现代状态管理)——必需
AI安全导师
使用专有软件为涉及安全协议、风险场景和政策合规的项目提供标签、注释和输入;支持交付高质量的策划数据,以增强AI的韧性和伦理对齐;与技术团队合作,开发能够提升AI检测和抵抗不安全行为能力的任务
多模态工程师
创建并推动议程,以提升实时世界模拟能力;提高数据质量,开发数据过滤/生成技术,并进行数据研究;创建评估框架和内部基准;设计并实施有效且高效的算法,以实现最先进的模型性能;与产品团队合作,共同推动模型能力和端到端用户体验的边界
多模态工程师
创建并推动议程,以提升图像和视频生成及编辑能力;提高数据质量,开发数据过滤/生成技术,并进行数据研究;创建评估框架和内部基准;设计并实施有效且高效的算法,以实现最先进的模型性能;在预训练和后训练阶段工作,并与产品团队合作,推动模型能力和端到端用户体验的边界
工程师
开发和改进用于先进推理与训练软件栈的低层CUDA内核优化;使用Nsight等工具对单GPU和多GPU操作进行性能分析、调试和优化;理解GPU内存层次结构和计算能力;在低层CUDA内核中实现深度学习文献中的最新方法
数据采集与网络爬虫软件工程师
构建和管理处理数百PB至EB级数据的高吞吐量PB级数据处理系统;设计和运营处理每秒数十万至数百万次操作的大规模分布式系统和流水线;管理大型云计算集群上的工作负载;为AI训练预处理数据集;构建和运营大规模爬虫,清晰、简洁地收集和传达需求
搜索/检索系统工程师
为LLM智能体设计和开发实时、网络规模的搜索引擎,核心目标是支持最大化的真理寻求能力;设计和开发先进技术,用于在万亿级文档规模下进行跨模态的精确、高效的搜索索引、检索和排名;将搜索引擎与xAI的核心模型集成,以提高实时智能体交互的准确性、速度和相关性,确保智能体能够识别并优先处理真实信息,同时最小…
数据工程师
设计和实施涉及CPU和GPU处理的PB级、高吞吐量数据处理系统;设计和实施用于编排复杂数据管道的工具;设计和实施创新工具,以大规模提高预训练和后训练中跨不同模态的数据可发现性和数据质量
多模态人工智能工程师
创建并推动工程议程,以实现涵盖图像、视频和音频等多种模态的超人类多模态能力(包括理解和生成);在预训练规模上,提高数据质量,开发数据过滤/生成技术,并进行数据研究;创建评估框架和内部基准
编译器/运行时工程师
开发内部JAX或编译器/运行时功能,以满足基于不同硬件架构(Hopper, Grace Blackwell)的高性能大规模LLM训练需求;开发和使用创新工具,用于调试分布式程序、分析训练步骤和随时间变化的内存消耗
多模态后训练工程师
开发用于媒体数据(图像、视频、音频)的可扩展人工和合成数据收集系统;构建用于大规模图像、视频和音频数据管道、管理和注释的基础设施;优化实时生成的推理和蒸馏过程;与跨职能团队合作,将先进的AI解决方案集成到生产环境中
AI基础设施工程师
设计和实施用于模型服务的可扩展分布式基础设施,例如负载均衡、自动扩缩容、批处理调度和全局KV缓存系统;通过主动监控、容错设计和严格测试,确保推理服务的可靠性,目标为100%正常运行时间、0%错误率和良好的尾部性能
软件工程师(数据管道与评估框架)
创建和维护用于智能体、数据和模型评估任务的框架;为AI智能体构建运行环境;开发自动化常见工作流程的工具;改进大规模强化学习任务中的警报、指标和错误处理机制;重构现有的智能体、数据、评估和训练框架,以提高模块化程度
多模态软件基础设施工程师
设计、构建和实施大规模分布式训练系统;对多模态模型训练和推理进行性能分析、调试和GPU利用率优化;构建用于多模态数据管理和爬取的可扩展基础设施;进行硬件/软件/算法协同设计;与Omni团队和产品团队的其他成员合作,共同推动模型能力和端到端用户体验的边界
全模态视频数据工程师
与爬虫团队合作,发现和获取视频数据集;构建可扩展的视频数据管理和处理基础设施;设计实验以评估视频数据集的性能;创新并优化用于扩展视频预训练数据的配方;紧跟用于准备多模态训练数据的最新技术;具备强大的机器学习实验设计能力
多模态音频工程师
创建并推动研究议程,以提升多模态音频能力,包括视频音频生成、音频理解、音频生成、音乐生成和语音生成;改进音频和多模态数据集的数据质量,开发先进的标注、过滤、增强和合成数据生成技术,并进行深入的数据研究
多模态工程师 - 视频生成(智能体与强化学习)
为短期和长期视频生成开发智能体规划器;设计和收集人类/合成数据;开发数据生成技术,例如字幕生成;为视频生成构建评估和奖励模型;研究用于提升视频理解/生成和智能体训练的训练方案;在通过改进数据或模型显著提升神经网络能力和性能的研究方面有成功记录
强化学习基础设施工程师
设计和实施最先进的分布式强化学习系统;分析、调试和优化系统性能;与工程师进行软件和算法的协同设计;具备构建、调试和优化大规模分布式训练系统的经验;具备构建异步强化学习训练框架的经验;熟练掌握 Python、Jax 或 Rust
相关搜索词
这些词用于覆盖真实搜索需求,也方便用户继续定位公司、城市、岗位方向和薪资信息。