← 岗位列表 第 1 / 20 张 · 已收藏 0 个

大模型推理优化实习生

寒武纪 北京 基础软件部 应届

芯片 / 半导体 近一周新增

岗位职责: 1、参与分布式推理系统建设,提供行业领先的LLM/多模态模型解决方案; 2、针对大语言模型(LLM)、视觉生成(如Diffusion Models)等场景,开展端到端推理性能优化,重点降低推理延迟、提升吞吐量; 3、深度优化推理框架,提升框架在异构硬件上的扩展性与易用性; 4、开发自动化性能分析工具,实现推理瓶颈的快速定位与优化建议生成。 岗位要求: 1、计算机、电子工程、自动化、数学等相关专业优先,2028届在校生; 2、熟悉linux环境下 C++/Python编程,具备CUDA/BANGC等异构编程经验;…

岗位要求: 1、计算机、电子工程、自动化、数学等相关专业优先,2028届在校生; 2、熟悉linux环境下 C++/Python编程,具备CUDA/BANGC等异构编程经验; 3、了解LLM或者视觉生成模型原理: a)大模型推理框架:vLLM/SGLang/FasterTransformer/TensorRT-LLM

挂了 6 天 读全文 →

实习生-推理优化

优刻得-W 上海 应届 本科

通信 / 计算机 / IT

职位描述 (Job Description): 我们正在寻找一位对技术充满好奇心、渴望探索未知领域的算法工程师加入我们的团队。在这个岗位上,你可以和你的导师共同完成: 核心职责 (Key Responsibilities): 全链路性能优化与研究(核心重点): 深入研究并优化从上层框架(vLLM/Sglang)到 PyTorch,再到 CUDA/NCCL 以及底层硬件(GPU/网络互联)的完整调用链路。 针对大模型推理和分布式训练场景,搭建性能理论模型(Performance Modeling),识别系统瓶颈。 设计并实现精细化的性能监控系统,量化分析算力利用率(MFU/HFU)及通信开销。…

2027年毕业生优先 需要保证至少4个月的实习,每周出勤4天。 优秀实习生可以转正

挂了 12 天 读全文 →

C++ 图形渲染开发工程师

光峰科技 深圳 算法分部

消费电子

岗位职责 1. 渲染引擎开发与优化 - 负责基于 OpenSceneGraph(OSG)+ OpenGL Core 4.5 的渲染引擎架构设计、开发与性能优化。 - 维护多投影仪通道管线:离屏相机(Offscreen Camera)、G-buffer 烘焙、Warp 几何校正、后处理合成与多屏输出拓扑。 - 编写与优化 GLSL Shader,处理材质、光照、阴影、多投影融合(Blending)等实时渲染效果。 - 负责超大纹理加载和渲染优化。 2. 三维算法与场景管线 - 集成与维护 Open3D / Assimp / Eigen / Ceres / OpenCV 等库,支撑模型导入导出、…

挂了 25 天 读全文 →

Java后端开发工程师

星环科技-U 上海 数据平台产品部 3-5年 本科

通信 / 计算机 / IT

工作职责: 1、负责大数据行业领域相关应用产品研发; 2、参与java后端系统及Web前端的研发,及时解决项目涉及到的技术问题; 3、根据产品需求,能够完成需求分析与设计,编码,测试等工作; 4、参与项目产线部署,性能监控及后台服务性能效率优化工作; 5、参与需求调研与项目计划制定、项目开发成果跟踪、项目现场部署维护; 6、有高并发系统设计和开发经验,有微服务开发经验,有docker和k8s使用经验。 职位要求: 1. 计算机相关专业,本科及以上学历; 3到5年互联网/企业级Java应用开发经验; 2. 丰富的Java Web项目开发经验,对Java、Spring、MyBatis、MySql…

职位要求: 1. 计算机相关专业,本科及以上学历; 3到5年互联网/企业级Java应用开发经验; 2. 丰富的Java Web项目开发经验,对Java、Spring、MyBatis、MySql/Oracle、Redis等有丰富实践经验,熟练掌握应用技能、了解实现原理;有基于业务场景的中间件应用实践,掌握至少一种消息中间

挂了 1 个月 读全文 →

Java工程师/资深工程师

浩辰软件 西安 5-10年

通信 / 计算机 / IT

1、 负责/参与项目需求分析、技术架构设计与持续优化,根据业务规划及技术规划持续改善系统架构方案; 2、 负责云平台业务微服务的需求分析、设计、文档编写及核心功能代码编写; 3、 负责对所属模块进行单元测试,指导开发组内初中级工程师的代码开发; 4、 负责解决开发过程中的技术难题。 5、定期对研发项目进行复盘

1、熟悉多线程及高并发技术,具备扎实的基础算法及数据结构; 2、 熟悉SpringCloud微服务框架、同步异步调用、消息列队、缓存(Redis)等技术; 3、 熟练Mysql数据库设计、分库分表等技术,熟悉Redis/Mongodb等nosql技术; 4、 熟悉MQ、分布式事务、分布式锁的机制与原理,有分布式、微服务

挂了 1 个月 读全文 →

大模型系统优化工程师

第四范式 上海 / 北京 硬核技术研发部

AI / 大模型

工作职责 面向企业级机器学习和生成式人工智能应用,负责推理框架研发、性能优化及国产信创硬件适配优化,具体包括但不限于: - 负责大模型推理框架的开发与优化,提升推理性能、资源利用率和系统稳定性; - 面向国产信创卡、GPU 及其他异构硬件平台,开展推理框架适配、移植和优化工作; - 结合业务场景,进行软硬件协同优化,降低推理成本,提升部署和交付效率; - 参与生成式人工智能相关基础组件和解决方案的研发与落地。 岗位要求 - 熟练掌握至少一种编程语言,如 C++ / Java / Python,并有较大规模项目开发经验;…

岗位要求 - 熟练掌握至少一种编程语言,如 C++ / Java / Python,并有较大规模项目开发经验; - 扎实掌握数据结构、算法、操作系统、数据库等计算机基础知识,了解并行计算或分布式计算; - 对推理框架、系统优化和企业级 AI 基础设施研发感兴趣,具备较强的问题分析和技术钻研能力。 加分项 - 有推理框

挂了 2 个月 读全文 →

AI应用架构师

云汉芯城 未标注 架构组 5-10年 本科

芯片 / 半导体

岗位定位 负责公司 AI 应用体系的架构设计与落地,围绕大模型、AI Agent、RAG、知识库、工作流自动化、多模态和企业系统集成等方向,构建可复用、可扩展、可评估的 AI 应用解决方案,推动 AI 能力在业务场景中的规模化应用。 岗位职责 负责企业级 AI 应用架构设计,包括大模型接入、RAG架构设计与优化、Agent 工作流、工具调用、权限体系、数据闭环、评测体系等核心模块设计。 负责 AI Agent 平台能力建设,包括 Planning、Memory、Tool Use、Multi-Agent、任务编排、上下文管理、失败重试与执行追踪等。…

任职要求 本科及以上学历,计算机、人工智能、软件工程、自动化、数学等相关专业优先。 5 年以上软件研发或架构经验,至少 1 年以上大模型 / AI 应用 / Agent / RAG 相关实践经验。 熟悉主流大模型能力与应用方式,如 GPT、Claude、Gemini、Qwen、DeepSeek、Llama 等,有实际项

挂了 3 个月 读全文 →

游戏服务端开发工程师

网易 杭州 水滴事业部 不限 本科

互联网 近一周新增

1、负责产品服务端框架与模块的设计和开发; 2、负责服务器相关工具开发和维护; 3、负责深入优化服务端性能与质量,提升产品稳定性; 4、同策划及客户端人员进行有效沟通,分析、解决各种服务端的问题;5、有以下经验优先:AI相关服务端功能,包括AI推理服务集成、智能NPC系统、AIGC内容生成等

1、本科及以上学历,计算机、软件工程及通信等相关专业优先; 2、3年及以上服务端开发经验,有线上维护经验优先; 3、熟悉C/C++/Golang任一,熟悉Python/Lua任一,熟悉常见的数据结构和算法; 4、熟悉分布式架构,有大DAU和高承载优化经验优先; 5、熟悉mongodb,redis相关优化优先; 6、具备

昨天挂出 读全文 →

资深 AI 平台架构师-上海

沐曦股份-U 上海 IT 5-10年 本科

芯片 / 半导体 近一周新增

负责规划并推动企业数字员工平台从 Quick Win 走向规模化应用,整合现有 Agent 与 Skill 能力,围绕真实业务场景形成可验证闭环,并逐步建全安全、弹性、可治理的 Agent Infra 和成熟的企业级 SkillHub。 本岗位兼顾架构规划与关键工程落地,需要能够基于业务价值和现有基础制定分阶段实施路线,完成技术选型与边界判断,并亲自推动关键能力落地。 一、岗位职责 •数字员工平台规划与分阶段落地:结合业务目标、现有技术资产和发展阶段,制定从 Quick Win、能力完善到规模化应用的实施路线,明确各阶段目标、优先级、建设边界和交付成果。…

二、任职要求 •通常具备 5 年以上后端、平台或分布式系统研发经验;具有突出平台建设成果者优先。 •主导或深度参与过至少一个复杂平台、基础设施或系统集成项目,并具有从方案设计、核心开发到上线运行的实际交付经验。 •熟练掌握至少一种主流后端开发语言及相关技术体系,具备 API、数据库、异步任务、系统集成和生产问题排查等实

挂了 3 天 读全文 →

【星火X计划-实习】面向超长程任务的大模型智能体技术研究(J14621)

科大讯飞 合肥 / 北京 应届 硕士

AI / 大模型 近一周新增

【课题介绍】 随着通用大模型在深度推理、软件工程、复杂工具调用能力上的不断提升,模型正在从“完成短流程任务”迈向“可靠承担长期开放任务”。本课题围绕仓库级大型软件工程智能体、超长时程任务规划与工具使用、复杂智能体轨迹数据合成、模型自我验证与自主校准等关键技术方向开展研究,构建能够理解目标、分解任务、调用工具、从反馈中学习并在失败后自主恢复的智能体模型。 你将结合真实业务流程,研究从轨迹数据构造、监督微调、强化学习、测试时计算到在线学习的完整技术闭环;建立核心评测体系,推动 Agent 在复杂软件工程、深度研究、企业工作流等高价值场景中的规模化应用。…

1、28届及以后在读硕士及以上学历,计算机科学、人工智能、自动化、电子信息、数学等相关专业,其他专业但具备突出研究和动手能力者同样欢迎; 2、对大模型智能体具有强烈兴趣,具备扎实的大模型算法和训练基础,能够持续跟踪论文和开源项目,并将研究思路转化为可验证的实验方案,有大模型训练、数据构建研究、Agent等方向实战经验者

挂了 4 天 读全文 →

Java工程师(J11734)

锦浪科技 杭州 3-5年 本科

新能源 / 储能 近一周新增

1、主导光伏领域智慧能量管理系统、逆变器工况分析的设计、核心代码开发、系统优化等工作; 2、协助产品经理梳理产品需求,设计相应技术方案,并根据方案主导研发工作的开展和落地; 3、主导攻克例如逆变器复杂工况、系统高稳定性等带来的各种挑战和技术难关; 4、用技术驱动业务,用技术影响和改变光伏逆变器领域。

1、具备5年及以上的服务端开发经验,有物联网行业的开发经验,光伏逆变器领域尤佳; 2、Java基础扎实,精通IO、多线程、集合、JVM等,熟悉Linux常用命令,熟悉MySQL,对Spring、MyBatis等开源框架有深入理解; 3、精通分布式系统的设计和应用,对分布式事务、分布式缓存、微服务、消息中间件、负载均衡等

挂了 5 天 读全文 →

大模型分布式优化工程师(J14477)

中科曙光 北京 / 上海 / 深圳 / 南京 / 成都 / 青岛 / 郑州 / 天津

通信 / 计算机 / IT 近一周新增

(满足以下任意一方向): 1. 负责dense/moe/多模态/强化学习等模型的大规模分布式优化,持续提高大规模分布式场景的算力利用率; 2. 负责大模型训练框架及相关定制通信算子的开发、调试、优化与维护; 3. 负责大规模训练容错库相关开发,优化在超大规模场景下的快速恢复; 4. 负责超大规模集群下的训练性能建模; 5. 跟踪分布式前沿优化技术和社区动态,持续改进产品性能;

1. 掌握现代c++,python编程,熟悉linux系统及程序调试分析方法,熟悉cuda编程模型,了解常见AI芯片架构及底层硬件原理,了解并行计算、异构计算、分布式系统等相关知识。 2. 掌握pytorch高性能编程方法,熟悉Megatron、DeepSpeed、Transformer Engine、Verl、Sli

挂了 6 天 读全文 →

智能驾驶HIL开发工程师

岚图汽车 上海 / 武汉 3-5年 本科

汽车

岗位职责 1.平台整体设计与开发:负责智驾域控器数据回灌引擎的设计、开发与迭代,持续提升多车型、多数据形态的接入效率,支撑算法团队的问题复现与验证需求。 2.数据获取与缓存链路:负责数据取数链路与缓存服务的规划与优化,保障数据获取的成功率、时效性与存储成本可控。 3.服务端与上下游对接:负责引擎服务端能力建设,包括任务接入、状态流转、设备治理与健康上报,以及与数据平台、存储等上下游系统的对接与联调。 4.回灌编排与执行:负责回灌任务的编排与执行保障,管理多节点协同运行的稳定性,持续降低新车型、新数据形态的接入成本。…

任职要求 1.本科及以上,计算机/自动化/车辆/机器人相关专业,3 年以上后端或仿真开发经验。 2.Python 基本功扎实:熟悉多进程/多线程、异常与资源管理、日志体系;能读懂并重构数千行历史模块。 3.Linux 环境开发熟练:熟悉进程管理、文件系统、Shell 脚本与网络排障(SSH/SCP、超时重试、日志定位)

挂了 7 天 读全文 →

AI-Agent平台研发工程师

天数智芯 上海 天数研究院 应届 硕士

芯片 / 半导体

岗位介绍 天数智芯致力于打造国际领先的通用GPU与AI算力平台。 随着大模型与AI Agent快速发展,AI正在重塑芯片设计、软件开发与经营管理。我们不仅要把模型接进日常工具,更要回答更长远的问题:现有业务与研发流程如何被AI系统性赋能;哪些工作可以由可编排、可授权、可审计的Agent承担;以及如何从「辅助人完成任务」演进到可落地的数字员工——在明确职责、权限与验收标准下,持续完成一类岗位级工作。 为此,我们正在建设面向公司研发与经营的内部AI应用平台:将文档、流程、项目材料与数据资产接入统一的身份与权限体系,并由Agent在授权范围内完成检索、分析、整理、撰写与流程协作。…

任职要求 1.计算机、电子工程、人工智能或相关理工科专业,硕士及以上学历 具备完整功能的独立交付能力(接口、数据、测试与异常处理);有相关实习或项目经验的应届硕士亦可考虑 2.熟练使用 Python,熟悉主流 Web 框架与关系型数据库;具备 TypeScript / React 或 C++ 经验更佳 3.具备系统与架

挂了 8 天 读全文 →

【2027校招】软件开发工程师(J13936)

启明星辰 成都 / 北京 应届 硕士

通信 / 计算机 / IT

1. 参与了解项目、产品的需求分析及系统设计; 2. 参加相关产品、项目的开发,负责产品模块的研发; 3. 根据开发规范与流程完成模块的开发、自测、联调; 4. 负责编写设计文档、部署文档、用户手册等技术文档; 5. 及时处理和解决开发过程中出现的技术问题,并提供解决方案;

1、统招硕士及以上学历,计算机、软件工程、通信、电子信息等相关专业; 2、热爱编程,基础扎实,熟练掌握 Java、C、C++、Go、Python 任意一门主流开发语言及相关技术生态,具备规范的编码习惯与扎实的代码功底; 3、掌握面向对象编程思想、常用数据结构与算法,熟悉基础网络协议与通信原理; 4、具备AI辅助编程实践

挂了 14 天 读全文 →

大算力芯片架构师(J10701)

云天励飞-U 深圳 / 西安 10年以上 硕士

AI / 大模型

岗位职责: 1、负责云端AI推理处理器的架构定义,包括计算单元、内存系统、互连架构、功耗管理模块等核心模块的设计 2、针对Transformer、CNN等主流AI大模型模型的特点,优化处理器指令集、数据流和并行计算能力; 3、与算法团队紧密合作,分析AI模型的计算模式与瓶颈,提出硬件架构的定制化解决方案; 4、跟踪AI芯片、云端推理服务、大模型推理加速等领域的前沿技术,提前布局技术方向。

任职资格: 1、计算机科学、电子工程、微电子等相关专业硕士及以上学历,10年以上芯片架构设计经验 2、精通计算机体系结构,熟悉GPU/TPU/NPU等AI处理器设计原理,有成功流片经验; 3、对云端推理场景的挑战(如多租户资源隔离、动态负载均衡、低精度量化)有深刻理解; 技术能力: 1、精通C/C++/Python,具

挂了 1 个月 读全文 →

java应用开发工程师

星环科技-U 南京 数据平台产品部 3-5年 本科

通信 / 计算机 / IT

工作职责: 1、负责大数据行业领域相关应用产品研发; 2、参与java后端系统及Web前端的研发,及时解决项目涉及到的技术问题; 3、根据产品需求,能够完成需求分析与设计,编码,测试等工作; 4、参与项目产线部署,性能监控及后台服务性能效率优化工作; 5、参与需求调研与项目计划制定、项目开发成果跟踪、项目现场部署维护; 6、有高并发系统设计和开发经验,有微服务开发经验,有docker和k8s使用经验。 职位要求: 1. 计算机相关专业,本科及以上学历; 3到5年互联网/企业级Java应用开发经验; 2. 丰富的Java Web项目开发经验,对Java、Spring、MyBatis、MySql…

职位要求: 1. 计算机相关专业,本科及以上学历; 3到5年互联网/企业级Java应用开发经验; 2. 丰富的Java Web项目开发经验,对Java、Spring、MyBatis、MySql/Oracle、Redis等有丰富实践经验,熟练掌握应用技能、了解实现原理;有基于业务场景的中间件应用实践,掌握至少一种消息中间

挂了 2 个月 读全文 →

【校招】内生安全模型架构青年研究员-安全基模中心

上海人工智能实验室 上海 安全基模中心

AI / 大模型

1.负责下一代大模型基础架构研究,围绕 Attention、SSM、MoE、可寻址记忆、循环推理和动态计算等方向制定技术路线; 2.推进新架构的算法设计、原型实现、模型训练和规模化验证,研究相适配的优化器、训练稳定性及系统效率问题; 3.建设 AI Coding Agent 驱动的智能研发流程,支持模型模块、优化算法和高性能算子的自动生成、测试、评测与迭代; 4.将架构创新与安全场景结合,研究安全状态适配、记忆与路由安全,以及可审计、可回滚的长程智能体机制。

1.计算机、人工智能、机器学习、自然语言处理、电子工程、应用数学等相关专业博士毕业; 2.对大模型基础架构具有深入理解,熟悉 Transformer、Attention、MoE、RNN/SSM、长上下文、记忆机制或动态计算中的多个方向; 3.具有模型核心结构研发经验,能够独立完成问题定义、算法设计、代码实现、模型训练、

读全文 →

【REDstar】搜广推索引存储架构工程师

小红书 北京 / 上海 REDstar 顶尖人才计划 应届 本科

互联网 近一周新增

1、深度参与小红书社区搜索/推荐/广告业务,满足产品、算法对于核心引擎或者基础平台的功能需求; 2、参与搜索引擎、推荐引擎、模型预测、向量检索等基础系统、平台的设计、研发及调优工作,提升效率降低成本; 3、参与高效存储和高性能混合检索引擎,包括并不限于正排KV索引、KKV索引、时序索引等; 4、参与抽象通用的业务开发框架与组件,提升业务支持效率,将现有技术逐步平台化和产品化。

1、本科及以上学历,计算机等相关专业优先; 2、基础功底扎实,熟悉Linux/Unix平台上的C++编程,熟悉网络编程-多线程编程,具有良好的编程和工程实现能力; 3、有分布式系统开发、或算法Serving服务开发及性能优化(如结合GPU/FPGA)经验的优先; 4、有互联网企业实习经验优先; 5、有编程竞赛获奖经验或

今天挂出 读全文 →

【星火X计划-实习】面向自主持续学习的基础大模型训练技术研究(J14620)

科大讯飞 合肥 / 北京 应届 硕士

AI / 大模型 近一周新增

【课题介绍】 我们认为未来的通用大模型不仅需要根据人类提供的数据和奖励进行训练,还需要能够主动探索环境、发现知识与技能缺口、从交互反馈中持续学习,并逐步形成自我改进和自主进化能力。 本课题围绕Reasoning RL、Agentic RL、自主持续学习与递归式自我改进等关键技术方向开展研究,探索从离线训练、在线强化学习、环境交互学习到模型自主生成目标、自主构造训练数据、自主验证和持续更新的完整技术体系,构建具备深度推理、复杂决策、长期探索和持续自我提升的下一代大模型。 你将研究从奖励建模、可验证强化学习、策略优化、过程监督,到智能体环境交互、在线学习的完整技术验证;…

1、28届及以后在读硕士及以上学历,计算机科学、人工智能、自动化、电子信息、数学、物理等相关专业;其他专业但具备突出研究和动手能力者同样欢迎; 2、对强化学习、大模型推理、智能体和自主学习具有强烈兴趣,具备扎实的大模型强化学习算法和训练基础,熟悉PPO、GRPO、OPD等常见的大模型后训练和强化学习算法,拥有大语言模型

挂了 4 天 读全文 →

上下滑换卡片 · 右滑喜欢 · 左滑跳过