一、公司简介
暂无公司介绍
二、热招城市
北京市
三、热招岗位
•智算高级研发专家(大模型推理引擎方向)
岗位介绍:1、负责分离式架构推理引擎的研发工作,包括方案设计、编码、测试方案设计与执行、性能画像等;2、追踪前沿技术,并进行落地探索,包括但不限于友商方案比对、开源方案调研、阅读论文、性能数据分析等;3、进行显存相关的优化工作,比如KVCache压缩、卸载等。
招聘条件:1、本科及以上学历,计算机科学、人工智能、大数据等相关专业,5年及以上相关工作经验;2、具有人工智能、深度学习算法、建模开发、模型训练推理经验者优先;3、熟悉并行策略、通信优化、KVCache、任意一种加速器并能够进行性能Profiling、算子优化、算子融合等优先;4、熟悉开源推理引擎,比如vLLM、SGLang、TensorRT-LLM等、模型量化压缩技术者优先;5、具备较强的学习能力、独立发现并解决问题的能力,较强的工程能力且有实际工程项目经验。
•安全大模型首席专家(J13179)
岗位介绍:1、面向AI应用场景设计开发AI工程和软件平台,包括语料数据工程,prompt工程,混合多级检索RAG加速工程、模型训练降本、推理加速、前处理后处理等;2、关注业界最新发展趋势,主动探索相关业务领域的创新场景和体验,包括但不限于AI辅助测试、代码生成,诊断,知识问答等;3、负责大模型AI4Test数据质量工程、prompt工程、评测工程优化研究和落地,负责微调语料数据提取、检查、清洗、数据质量评估,RAG向量库构建,包括上下文知识文档切片、小文本自动分类、多态数据转换,负责X-shot、COTprompt工程实践;4、负责全场景AI推理框架的架构设计、技术选型、关键技术研究及核心代码开发工作;5、负责设计,开发,训练和优化大模型,跟踪和研发代码大模型的预训练、持续训练、SFT、RLHF、模型量化等技术;6、研发基于大模型、RAG、Agents的代码理解、代码生成、代码修复、智能问答、漏洞精准精测、恶意行为检测、敏感信息检测等下游应用;7、研究和实现大模型安全关键技术,保障大模型内容安全和对抗安全,并在隐私风险、威胁评估、内容风控等领域进行应用,提供自动化评测能力;8、深入了解如K8S,Knative,Serverless,WASM,IaC等主流及新兴云原生技术,特别在应用托管领域与大模型结合的演进方向;9、跟踪最新的学术研究,将最新的研究成果引入到产品模型开发中。
招聘条件:1、本科及以上学历,计算机通信或相关专业,有大模型算法开发/大模型工程开发工作经验;2、熟悉机器学习、算法优化、大模型技术及衍生的RAG工程、Agent工程技术;3、熟悉常用推理框架PyTorch或TensorFlow框架,掌握其原理和使用;4、熟悉大模型虚拟化/异构计算/GPU/RDMA网络/K8S异构资源调度和异构资源组网等技术;5、精通至少一种编程语言(如python,Java,C++);6、有大型的大模型应用落地开发经验,例如知识问答、自动化BI、内容文摘生成、多模态等领域应用。在知识加工、语料生成、Prompt工程优化、LLM模型微调、模型效果评测等领域有具体实践;7、熟悉大模型算法应用及业界主流的平台及框架,如langchain/LlamaIndex,有基于上述平台或框架完整搭建并参与过相关项目落地或开源社区的贡献者优先;8、有网络安全领域实践应用和数据安全领域实践应用,有智能体等应用平台建设和开发经验优先。
•端侧智能产品专家(J13412)
岗位介绍:1、端侧智能产品体系规划:牵头开展端侧智能产品体系规划,构建覆盖芯模部件、智能终端、平台能力及行业应用的AI产品体系,统筹现有产品AI升级和新产品布局。2、端侧智能能力体系建设:围绕端侧智能共性能力建设,依托格物平台及雁飞终端体系,构建模型管理、AI推理、智能体、多模态等能力底座,支撑产品智能化升级。3、组织开展产品打造及落地:围绕工业制造、消费电子、社会服务等重点领域,推进现有产品AI升级和智能终端打造,推动产品市场化、规模化发展。
招聘条件:1.本科及以上学历,计算机科学与技术、电子信息工程、通信工程、软件工程、自动化、人工智能等相关专业优先。2.行业经验:5年以上端侧智能产品相关工作经验,熟悉工业制造、消费电子、社会服务至少一个核心细分领域。3.专业能力:(1)智能硬件规划能力:熟悉物联网终端硬件架构、传感器、边缘芯片,掌握端侧算力、功耗、存储约束,能结合硬件选型评估AI部署可行性。(2)端侧智能融合能力:具备模型轻量化、模型蒸馏、推理优化及端侧部署能力,推动AI能力在端侧、边侧、芯模部件及行业终端高效落地。(3)具备端侧智能业务理解能力,可针对实际场景规划、设计、迭代相关产品,推动产品规模化。4.有运营商/物联网头部企业端侧智能产品经历优先。
更多职位见职位列表


