高级爬虫工程师(大模型方向)
岗位摘要
结合大模型应用需求,设计和优化高效、智能化的爬虫系统,进行多源数据采集;逆向分析目标网站及接口,绕过反爬机制(如验证码、动态加载、JS加密、IP封锁等),确保数据采集稳定性;针对大模型数据预处理要求,优化爬虫数据格式和质量,提升数据对训练和推理的适用性
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 结合大模型应用需求,设计和优化高效、智能化的爬虫系统,进行多源数据采集
- 逆向分析目标网站及接口,绕过反爬机制(如验证码、动态加载、JS加密、IP封锁等),确保数据采集稳定性
- 针对大模型数据预处理要求,优化爬虫数据格式和质量,提升数据对训练和推理的适用性
- 结合大模型场景,自动化处理反爬机制变化,并提供灵活的技术解决方案
- 与大模型研发团队紧密合作,确保爬虫采集的数据能够有效支持模型训练与应用
- 跟进最新的反爬技术与反制策略,持续优化爬虫架构和性能
任职要求
- 本科及以上学历,计算机科学、人工智能、网络安全等相关专业
- 3年以上爬虫开发及逆向工程经验,有大模型或AI相关领域的爬虫应用经验者优先
- 熟悉并能绕过常见的反爬技术(如动态网页加载、验证码、JS加密等)
- 精通Python或其他编程语言,熟悉爬虫框架(如Scrapy、Selenium、Playwright等)
- 熟悉大模型训练和数据处理流程,能够根据模型需求调整数据抓取策略
- 熟悉常见网络协议(HTTP/HTTPS)和接口抓取,能够对复杂数据进行高效提取和清洗
- 具备良好的分析能力和解决问题的能力,能够应对复杂的反爬挑战
- 加分项:有大规模数据抓取与处理经验,尤其是针对大模型训练数据的采集和优化
- 加分项:熟悉数据加密与解密技术,能够破解复杂的加密算法
- 加分项:具备AI或大模型领域的技术背景,能够理解和支持模型数据需求
加分项
- 有大规模数据抓取与处理经验,尤其是针对大模型训练数据的采集和优化
- 熟悉数据加密与解密技术,能够破解复杂的加密算法
- 具备AI或大模型领域的技术背景,能够理解和支持模型数据需求
- 具有竞争力的薪资待遇与丰富的福利
- 与顶尖AI团队合作的机会,参与大模型应用开发与优化
- 灵活的工作环境与技术创新的空间
- 完善的职业发展和培训机会,助力技能提升和成长
福利待遇
- 具有竞争力的薪资待遇与丰富的福利
- 与顶尖AI团队合作的机会,参与大模型应用开发与优化
- 灵活的工作环境与技术创新的空间
- 完善的职业发展和培训机会,助力技能提升和成长
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。