多模态大模型应用算法实习生
小红书 · 其他项目
1、跟踪大模型应用、训练优化、强化学习等前沿进展,追求极致,将相应技术应用到多模态内容理解和生成等小红书实际的业务场景; 2、跟踪大模型多模态算法的前沿进展,负责多模态搜索、精排、对话、工具调用、文生图、强化学习等相关算法优化。
小红书 · 其他项目
1、跟踪大模型应用、训练优化、强化学习等前沿进展,追求极致,将相应技术应用到多模态内容理解和生成等小红书实际的业务场景; 2、跟踪大模型多模态算法的前沿进展,负责多模态搜索、精排、对话、工具调用、文生图、强化学习等相关算法优化。
赛力斯
1. 负责自动驾驶系统中端到端轨迹生成核心算法的设计、开发与优化,重点攻克两段式/一段式轨迹生成方案在复杂场景下的落地难题。 2. 主导导航任务、换道任务的轨迹生成算法研发,结合实际道路环境(如拥堵)提升轨迹的安全性、舒适性与效率。 3. 负责纵向控制模型(如跟车、加减速、停车)与横向控制模型(如路口、车道保持)的算法设计、参数调优及工程化实现。 4. 参与轨迹生成算法与感知、定位、规划模块的协同调试,解决跨模块数据交互、时序同步等技术问题,保障系统端到端性能。 5. 跟踪行业前沿技术动态(如大模型在轨迹生成中的应用、强化学习优化策略),推动算法迭代升级,撰写技术文档与专利。
宁德时代
一、岗位职责描述: 1. 算法研究:负责电力储能系统算法研究与设计(电池系统、水冷/消防系统等),提升储能系统运行经济与可靠性。负责“源-网-荷-储”协同调控算法(如多时间尺度优化调度、分布式资源聚合控制、需求响应策略)的研究与开发,支撑新型电力系统高效运行; 2. 算法开发与验证:完成算法的代码实现、仿真验证及硬件在环测试,确保算法精度、实时性与鲁棒性。基于实际运行数据持续迭代优化算法。 3. AI大模型融合应用研究:探索AI大模型在储能状态估计、运营效益和寿命提升、源网荷储调控中的创新应用。 二、岗位要求: 1. 博士学历;…
面壁智能
面向真实场景中的机器人操作任务,参与具身智能算法研发与工程落地,打通从三维感知、动作规划到机器人执行的完整链路,推动具身模型在真实机器人平台上稳定运行。 岗位职责 1. 负责机器人三维视觉与环境感知算法研发,包括目标检测与分割、深度与点云处理、物体位姿估计、空间关系理解等,为抓取和操作提供可靠的感知信息。 2. 负责机器人运动与轨迹规划算法开发,结合运动学、碰撞检测及执行约束,实现机械臂抓取、搬运、双臂协作等任务,优化动作的精度、平滑性与执行效率。 3. 参与机器人控制与软硬件联调,完成相机及手眼标定、坐标系转换、传感器同步、控制接口适配和轨迹执行,定位并解决真机运行中的偏差、抖动、延迟等问…
深信服 · 深信服科技
· 负责 AI 编程工具 / 代码审查工具 Costrict 中 Coding Agent 的算法设计与实现,包括代码生成、代码补全、代码理解、自动修复、代码审查等能力。 · 参与 Agent 核心链路建设:任务规划、工具调用、上下文管理、代码检索与 RAG、多轮交互、执行反馈与自我修正。 · 跟进并落地大模型在代码场景的微调与优化,如 SFT、RLHF/DPO、Prompt Engineering、评测集构建与效果分析。 · 与后端、产品、前端协作,将算法能力工程化落地,并持续优化 Agent 的准确性、响应速度与稳定性。…
宇树科技
一、环境感知与空间建模 基于LiDAR、相机、IMU等传感器,开展点云处理、目标检测与跟踪、多传感器融合及可通行区域分析; 构建融合占据栅格、点云地图、拓扑地图、语义地图及场景图的分层环境表示; 研究语义地图、3D空间建模及场景空间关系推理,为导航规划提供环境信息。 二、导航规划与具身智能 面向足式机器人,研发室内外复杂环境下的全局规划、局部避障、轨迹优化与运动跟踪算法; 解决长距离、跨区域及跨楼层导航中的路径规划、重定位、状态恢复和到达验证,以及电梯、楼梯、门等关键节点的交互问题; 研发动态障碍物预测、局部重规划及异常恢复能力;…
大陆集团
职位介绍 强化学习 Q-learning 深度学习 深度学习框架 工作职责 1. 负责对接上游,整合处理环境模型信息,开发数据处理及测评工具 2. 负责自动驾驶泊车APA/HPA决策规划算法软件开发与调试 任职要求 1. 熟悉数值优化原理及工程实现,熟悉图搜索、曲线拟合等几何方法 2. 熟悉Hybrid A*、RRT、StateLattice等至少一种路径规划算法,具有泊车量产经验 3. 了解无人车/机器人强化学习或逆强化学习相关算法,了解至少一种深度学习框架 4. 硕士及以上学历,具有车辆工程、计算机、自动化及导航等专业知识优先,精通C++及python 5. 具备团队协作精神,有较好的表…
小红书 · 其他项目
1、跟踪大模型应用、训练优化、强化学习等前沿进展,追求极致,将相应技术应用到多模态内容理解和生成等小红书实际的业务场景; 2、跟踪大模型多模态算法的前沿进展,负责多模态搜索、精排、对话、工具调用、文生图、强化学习等相关算法优化。
小鹏汽车
岗位目标 负责单手、双手、affordance point、loco-manipulation及BFM相关能力,当前以在研为主,持续承担真实作业结果。 工作职责 1. 负责机器人操作与运动智能相关产品规划,面向真实作业场景梳理移动、操作及全身协同等能力需求,明确需求优先级、版本目标及验收标准。 2. 深入机器人实际任务和使用场景,将作业需求拆解为具体算法能力要求,协同算法团队明确功能边界、接口及关键性能指标。 3. 参与机器人真机测试与能力验证,围绕任务成功率、运动精度、稳定性、执行效率及异常恢复等关键问题进行分析,推动算法及系统持续迭代。…
智谱 · AI院
职位描述 和现有团队一起研究,提升大模型在漏洞攻防方向的安全能力。 核心职责 1. 设计并落地面向漏洞挖掘的大模型训练方案,涵盖预训练语料构建、指令微调以及基于人类/AI 反馈的强化学习环节; 2. 探索提升模型在自动源码审计、逆向工程、动态调试、模糊测试、漏洞利用程序(Exp)构建等安全场景下推理能力的技术路径; 3. 搭建并持续迭代模型安全能力评测体系和多维度的基准测试集; 4. 研究最前沿的漏洞安全攻防技术,包括漏洞挖掘、漏洞利用、缓解措施绕过 5. 跟踪最新的漏洞情报,即时复现热点/重点目标的高危0day/nday漏洞,丰富模型训练/测试数据集 职位要求 1. 计算机、网络安全或相关…
科大讯飞
【课题介绍】 随着通用大模型在深度推理、软件工程、复杂工具调用能力上的不断提升,模型正在从“完成短流程任务”迈向“可靠承担长期开放任务”。本课题围绕仓库级大型软件工程智能体、超长时程任务规划与工具使用、复杂智能体轨迹数据合成、模型自我验证与自主校准等关键技术方向开展研究,构建能够理解目标、分解任务、调用工具、从反馈中学习并在失败后自主恢复的智能体模型。 你将结合真实业务流程,研究从轨迹数据构造、监督微调、强化学习、测试时计算到在线学习的完整技术闭环;建立核心评测体系,推动 Agent 在复杂软件工程、深度研究、企业工作流等高价值场景中的规模化应用。…
中科曙光
(满足以下任意一方向): 1. 负责dense/moe/多模态/强化学习等模型的大规模分布式优化,持续提高大规模分布式场景的算力利用率; 2. 负责大模型训练框架及相关定制通信算子的开发、调试、优化与维护; 3. 负责大规模训练容错库相关开发,优化在超大规模场景下的快速恢复; 4. 负责超大规模集群下的训练性能建模; 5. 跟踪分布式前沿优化技术和社区动态,持续改进产品性能;
海格通信
1.负责智能体平台的核心算法设计与架构落地,围绕大模型驱动的智能体(Agent)完成平台化能力建设,包括多智能体编排、任务规划、工具调用与执行链路设计; 2.负责智能体应用研发,设计并实现基于大模型的人机协作、自动规划、记忆管理与反思调优等机制,提升智能体在复杂任务上的稳定性与执行效率; 3.负责Skill市场的算法与能力建设,设计技能封装、语义检索、技能编排与复用机制,持续丰富并运营平台技能生态; 4.负责MCP(Model Context Protocol)服务的研究与落地,设计统一工具接入协议、上下文管理与工具调用方案,打通智能体与外部工具、系统的能力边界;…
交控科技
1、面向城市轨道交通智能化、自主化和安全高效运行需求,开展大模型、多模态学习、世界模型及具身智能等前沿技术与行业应用研究,重点探索智能感知、认知、决策、规划与控制等关键方向; 2、承担或核心参与国家级、省部级、公司级重大科研项目,突破模型训练与推理、具身感知与交互、强化学习及机器人自主决策等核心技术,完成核心算法和系统验证攻关; 3、推动科研成果产出与转化,形成高水平论文、发明专利及自主知识产权,并协同相关团队推进技术在实际业务和产业场景中的落地应用。
小鹏汽车
岗位目标 负责灵巧操作的技术机会与产品价值判断,当前以预研为主,以可复现实验推动能力进入真实任务并持续成长。 工作职责 1. 负责灵巧操作相关场景和任务研究,结合用户需求、现有替代方案、技术成熟度及落地成本,识别值得投入的重点方向,制定阶段性能力目标和产品路线。 2. 负责灵巧操作、触觉感知等相关能力的产品定义和优先级管理,将真实任务拆解为操作策略、感知反馈、控制及数据等能力需求;协同算法、硬件和本体团队评估不同技术方案对任务效果、系统复杂度和成本的影响。 3. 深入参与原型及机器人真机实验,围绕任务成功率、操作稳定性、泛化能力、执行效率及失败案例开展分析,区分模型、数据、控制、本体及传感器…
科大讯飞
【课题介绍】 我们认为未来的通用大模型不仅需要根据人类提供的数据和奖励进行训练,还需要能够主动探索环境、发现知识与技能缺口、从交互反馈中持续学习,并逐步形成自我改进和自主进化能力。 本课题围绕Reasoning RL、Agentic RL、自主持续学习与递归式自我改进等关键技术方向开展研究,探索从离线训练、在线强化学习、环境交互学习到模型自主生成目标、自主构造训练数据、自主验证和持续更新的完整技术体系,构建具备深度推理、复杂决策、长期探索和持续自我提升的下一代大模型。 你将研究从奖励建模、可验证强化学习、策略优化、过程监督,到智能体环境交互、在线学习的完整技术验证;…
埃夫特
1.负责VLA(视觉-语言-动作)相关模型及多模态算法的研发与迭代,实现大模型在机器人上的应用。 2.负责算法框架的研发,并开展VLA模型的训练、微调与部署工作。 3.处理多模态数据,构建高质量训练的数据集,优化模型泛化能力与鲁棒性。 4.推动VLA模型在机器人场景落地,解决模型部署过程中的相关技术难题,确保机器人能在真实场景中完成长流程、高动态的操作任务。 5.跟踪VLA领域前沿技术,开展模型相关预研与创新,并在自有机器人平台上进行复现、改进和部署。 6.探索强化学习(RL)在复杂场景及复杂任务中的实际应用。
银河通用
岗位职责: · 负责感知模型、运动控制及操作 Policy 在人形机器人上的实机部署,打通多传感器输入、状态估计、模型推理、决策控制和执行器反馈的完整闭环。 · 负责相机、深度相机、激光雷达、IMU、编码器、力/力矩及触觉等传感器的选型、驱动开发、接入、标定与数据验证,建设多传感器时间同步、坐标变换和数据管理机制。 · 负责机器人上下位机、计算平台、控制器、驱动器及传感器之间的通信链路开发,基于 ROS/ROS 2、DDS、UDP、CAN/CAN-FD、EtherCAT 等技术实现实时、稳定的数据传输。 · 优化图像、点云、机器人状态、控制指令及模型推理数据链路,解决控制周期、通信时延、数据…
无问芯穹
我们正在探索如何通过 Agent Harness Engineering 构建下一代 AI Infra 推理系统。你将参与即将开源的推理引擎研发,围绕算法优化、系统优化、服务优化、框架优化、编译优化与算子优化开展全链路技术探索,打造高性能、高易用、低功耗、跨平台的推理产品。 同时,你将探索如何利用 Codex、Claude Code、OpenCode 等 Coding Agent,结合 Skills / Plugins / Hooks / MCP、知识与上下文管理、多 Agent 协作、流程与工具设计、编译及自动验证技术,构建可持续迭代的 Agent 研发系统。…
长安汽车
1.负责多模态大模型的算法研发与系统构建,推动CV与LLM的深度融合。 2.设计并实现视觉理解、图像/视频内容生成、跨模态检索等核心模块,支持工业级多模态应用落地。 3.开展多模态Agent系统开发,构建具备视觉感知能力的智能体决策与交互框架。 4.跟踪前沿技术动态,推动技术创新与业务场景结合。
小马智行
1. 行为预测前沿算法研发: 参与研发下一代端到端或基于大语言模型(LLM)的社会车/行人意图与轨迹预测算法,应对极其复杂的博弈与交互场景; 2. 多模态大模型落地 (Issue Triage): 探索并应用多模态大模型(如视频+点云+文本序列),针对海量路测接管 Case 进行智能分析与自动化诊断(Issue Triage),挖掘并提炼长尾场景(Corner Cases),加速数据闭环; 3. AI Agent 智能体构建: 开发基于大模型的 AI Agent 框架,用于自动化场景仿真、数据自动标注、多智能体交互演练及模型效果的自动化评估;…
寒武纪 · 软件一部
岗位职责 · 分析国内外先进大模型的模型结构和训练方法,挖掘性能优化空间,参与优化方案的设计与实现。 · 开展大模型训练性能预估与仿真,分析计算、通信和显存开销,优化并行策略和资源配置。 · 基于 Megatron-LM、DeepSpeed、PyTorch FSDP、verl 等框架,参与预训练、后训练及并行策略相关 Infra 开发。 · 跟踪 MoE、Attention、RLHF、Agentic RL 等前沿技术,解决大模型训练中的性能问题。 职位要求 · 计算机、电子信息、软件工程、自动化等相关专业,本科及以上学历。…
北京智源 · 产品及运营中心
岗位介绍: 我们正在寻找一位懂技术、会表达、能动手、热爱开源的伙伴,负责具身智能与世界模型方向的开源影响力建设。 这不是一个单纯的内容运营岗位。你需要能够理解项目代码和技术方案,与研发工程师顺畅沟通,把复杂技术讲清楚,并通过技术内容、开发者社区、开源活动和生态合作,让更多开发者了解、使用并参与我们的项目。 我们希望你是一个比较全面的“技术型开源运营”:既能写技术文章、维护开发者社区,也能运行项目、制作 Demo、参与活动策划,并推动开源项目持续成长。 岗位职责: 1. 制定开源运营策略 深入理解具身智能、世界模型及相关开源项目,制定项目发布、内容传播、社区增长和开发者生态建设计划,持续提升项…
上海人工智能实验室 · 安全基模中心
1. 安全训练与自主进化机制,包括大模型后训练核心算法,包括 SFT、PPO、GRPO、DAPO 、OPD、SAO等主流强化学习方法; 2. 研究面向下一代大模型的内生安全架构,探索将安全能力原生融入模型参数、记忆、注意力、MoE 等核心结构,并支持大模型(含 MoE 架构)的基于算子开发的高效训练与调优,训练基础设施与最佳实践; 3. 结合团队具体任务场景,将模型架构与 RL 技术落地为可交付的模型能力,持续提升模型的安全性、推理与泛化能力; 4. 结合当前智能体上的安全场景,将harness与模型架构进行更深结合,形成具备自调整,自组织能力的内生安全人工智能系统
小鹏汽车
岗位目标 围绕 World Model、Value / Evaluation Model、RL、生成式 Rollout 与 Simulation,推动机器人算法训练、评测和验证体系持续演进,提升算法研发效率和真机迭代速度。 工作职责 1. 负责世界模型、RL、仿真评测等方向的技术产品规划,识别算法研发中的关键瓶颈和能力机会,制定阶段目标及演进路线。 2. 协同算法团队推进 Value / Evaluation Model、World Model、生成式 Rollout、RL 与 Simulation 等技术能力建设,判断不同方案的适用边界、投入价值和优先级。…
越疆科技
1. 参与人形机器人全身运动控制、步态规划、平衡控制及轨迹优化算法研发; 2. 参与动力学建模、状态估计、MPC/WBC、强化学习运动控制等模块开发; 3. 参与仿真环境搭建、算法验证、Sim2Real及真机调试; 4. 分析运动控制问题,持续优化稳定性、鲁棒性和运动性能。
中创新航
1. 新能源汽车动力电池故障预警与诊断的大数据算法模型搭建; 2. 动力电池SOH、寿命预测的大数据模型、物理模型或电化学模型的开发 3. 动力电池测试数据的深度挖掘与分析; 4. 撰写算法设计文档 5. 负责算法的优化与工程化代码开发; 6. 机器学习AI算法库搭建
黑芝麻智能
【职位总结】 我们正在寻找一名VLA大模型算法工程师,负责视觉语言动作模型在机器人平台上的训练、评测与部署。你将连接多模态理解、策略学习和机器人真机控制,围绕数据采集、模型微调、动作生成、Sim-to-Real及端侧推理建立完整技术闭环,推动VLA能力从模型验证走向真实任务落地。 【核心职责】 1.VLA模型研发:研究并实现Transformer、VLM、Diffusion/Flow Matching、Action Token和Policy Model等技术,完成模型选型、复现、微调与架构改进。 2.机器人数据工程:建设遥操作采集、轨迹切分、清洗、标注、数据配比和增强流程,提升数据质量、任务…
德明利
期待对大模型后训练技术有热情,希望在真实业务场景中打磨模型、从部署到调优再到评测全链路实践的同学加入,与我们一起打造贴合存储行业场景的专属大模型解决方案,共同成长。 1、负责SFT(监督微调)、DPO(直接偏好优化)、RL(强化学习)等大模型后训练算法的研究与开发,优化模型训练流程,提升模型在各类任务中的性能与表现,增强模型的泛化能力和适应性; 2、负责Coding、翻译、多模态等垂直领域大模型的全流程研发工作,包括需求分析、模型架构设计、数据处理、模型训练与评估,打造贴合行业场景需求的专属大模型解决方案;…