说不清条件?直接问一句 →(例:合肥的BMS要几年经验)
要求 计算机视觉 共 1160 条 · 其中近一周 20 条 已筛选: 清除
【岗位职责】 负责下一代 Feed-Forward 3D/4D Reconstruction Foundation Model 与 Gaussian Splatting 研发,从多相机长序列视频中恢复真实世界的三维几何、动态信息与可渲染场景,构建自动驾驶 4D GT 与 Digital World。 • 研发自动驾驶多相机、多时序 3D/4D 重建大模型; • 构建静态场景与动态交通参与者的统一几何和时空表征; • 研究 Feed-Forward Gaussian / Dynamic Gaussian,实现高效、高保真的数字场景重建;…
计算机视觉 Python C++ 算法与AI AI / 大模型
面向真实场景中的机器人操作任务,参与具身智能算法研发与工程落地,打通从三维感知、动作规划到机器人执行的完整链路,推动具身模型在真实机器人平台上稳定运行。 岗位职责 1. 负责机器人三维视觉与环境感知算法研发,包括目标检测与分割、深度与点云处理、物体位姿估计、空间关系理解等,为抓取和操作提供可靠的感知信息。 2. 负责机器人运动与轨迹规划算法开发,结合运动学、碰撞检测及执行约束,实现机械臂抓取、搬运、双臂协作等任务,优化动作的精度、平滑性与执行效率。 3. 参与机器人控制与软硬件联调,完成相机及手眼标定、坐标系转换、传感器同步、控制接口适配和轨迹执行,定位并解决真机运行中的偏差、抖动、延迟等问…
计算机视觉 MATLAB Python 算法与AI 芯片 / 半导体
职位介绍 岗位职责: 1. 算法研究与实现:设计、开发并优化基于位置(PBVS)、图像(IBVS)和混合的视觉伺服控制算法,针对不同应用场景(对位、补偿等)设计视觉误差模型。 2. 视觉与运动系统建模:熟悉相机成像模型与标定模型(单目 / 双目 / 多目)、机器人或运动平台的运动学模型,处理坐标系统一与转换问题(相机坐标、产品坐标、世界坐标、运动轴坐标)。 3. 系统集成与工程落地:将视觉伺服算法部署至实际系统,与机械、电气、软件团队协同完成系统集成,参与现场调试,解决实际生产环境中的稳定性与鲁棒性问题。 4 性能优化与测试:设计自动化测试流程,包括仿真测试和实物验证,优化算法的实时性等。…
计算机视觉 需求分析 C++ 算法与AI 机器人 / 智能装备
1、针对典型的传感器和机器人应用,研发传感器数据的前处理算法(如滤波、时空补偿等),以及传感器的内外参标定算法, 2、针对工业机器人(如焊接机器人、搬运机器人、装配机器人等)和复合机器人(融合移动、操作等多种功能的机器人)的应用场景,负责视觉、力觉、触觉、声音等多类型传感器的感知算法开发工作。根据不同机器人的作业需求(如精准定位、工件识别、力控装配、表面质量检测、环境声音识别等),设计并实现相应的感知算法,为机器人的自主操作、智能决策和精准执行提供核心算法支持,确保机器人在复杂工业环境中能稳定、高效地完成各项任务, 3、深入研究并开发多传感器数据融合算法,将视觉传感器(如工业相机、3D 视觉…
计算机视觉 FPGA 深度学习 算法与AI 通信 / 计算机 / IT
工作职责: 1、负责飞行器的定位导航算法研究及实现; 2、负责优化飞行器运动行为(定位导航、路径规划、避障算法等); 3、传感器信息融合及栅格地图创建; 4、提高规划导航算法效率并优化软件架构。
大陆集团 城市未标注
职位介绍 感知算法 感知机 检测算法 信息检索 自动驾驶 模式识别 算法研究 立体视觉 GA算法 深度学习 岗位职责: 1. 负责ADAS、Parking、城区/高速NOA场景下的感知算法研发和工程落地,包括视觉/Lidar融合模型、Occupancy Network 网络、动/静态目标多任务模型等; 2. 探索使用端到端、时序等高效学习算法检测周围环境信息和交通参与者信息,探索云端算法性能上限,同时结合端侧算力算子实现量产落地; 3. 掌握数据挖掘、标注、训练、部署及badcase回归等闭环链路,并伴随业务开展持续优化;掌握通过数据闭环持续迭代模型的能力。…
C++ Python 计算机视觉 算法与AI 通信 / 计算机 / IT
1. 负责工业自动化场景下的2D视觉、3D视觉、感知算法及解决方案研发。 2. 参与感知算法平台、通用算法组件或感知应用的设计与开发。 3. 面向工业场景,解决目标识别、定位、测量、检测等感知问题。 4. 参与传感器选型、算法验证、性能优化及产品落地,持续提升感知系统的稳定性与泛化能力。 该岗位包含三个发展方向 方向一:感知算法工程师(平台) 定位:偏平台技术开发,面向通用感知问题,设计和开发高性能、可复用的算法及核心技术组件。 方向二:感知算法开发工程师(产品) 定位:偏产品开发,负责感知算法在工业产品中的设计、开发、优化与维护。…
1.负责多模态大模型的算法研发与系统构建,推动CV与LLM的深度融合。 2.设计并实现视觉理解、图像/视频内容生成、跨模态检索等核心模块,支持工业级多模态应用落地。 3.开展多模态Agent系统开发,构建具备视觉感知能力的智能体决策与交互框架。 4.跟踪前沿技术动态,推动技术创新与业务场景结合。
多模态 计算机视觉 大模型 算法与AI 通信 / 计算机 / IT
【方向一:多模态感知算法】 ·基于相机/激光雷达/毫米波等多源传感器,开展融合感知、视频目标识别与跟踪、交通事件识别等算法研发; ·大小模型协同与端侧大模型轻量化,算法在智能交通、机器人、低空等场景的落地部署。 【方向二:AI智能体与大模型应用】 ·面向能源调度、设备运维等场景,设计调度Agent、预测Agent、运维Agent等多智能体系统; ·基于大模型API与Agent框架,落地自然语言查询、异常告警、运营播报等智能应用。 【方向三:电力电子与控制算法】 ·光伏、储能、充电桩等场景的变流器/逆变器控制算法设计(双向功率控制、并网/离网策略等);…
机器学习 深度学习 Python 算法与AI 机器人 / 智能装备
岗位职责 · 参与具身智能 VLA(Vision-Language-Action)模型的算法研发,探索视觉、语言与机器人动作之间的理解、推理与决策能力。 · 参与 VLA 模型的数据构建、预处理、训练、微调及评测,持续提升模型在真实机器人任务中的泛化能力和执行效果。 · 参与视觉、语言、动作等多模态信息的建模与融合,研究机器人对环境的感知、理解、决策与动作生成能力。 · 针对机器人实际任务,参与模型算法设计与优化,将大模型能力与机器人运动控制、操作技能等进行结合。 · 参与模型在仿真及真实机器人上的部署、测试与迭代,分析模型在真实场景中的问题并持续优化。…
C++ 嵌入式 计算机视觉 算法与AI 机器人 / 智能装备
1、负责SLAM核心算法研发,包括视觉SLAM(如ORB-SLAM、VINS)、激光SLAM(如LOAM、LeGO-LOAM)或多传感器融合SLAM(视觉+IMU+LiDAR+GPS)的算法设计、开发与调试,实现无人机在复杂环境下的高精度定位与建图; 2、负责前端感知算法优化,包括特征提取与匹配、关键帧选择、回环检测等模块的性能提升,解决运动模糊、光照变化、纹理缺失等复杂场景下的算法鲁棒性问题; 3、负责后端优化算法实现,包括基于图优化的位姿估计(如g2o、Ceres Solver)、多传感器时空标定与数据融合,降低累积误差,提升定位精度与地图一致性;;…
计算机视觉 MATLAB Python 算法与AI 芯片 / 半导体
岗位职责: 1.算法研发:负责ISP Pipeline核心算法开发与优化,包含3A、降噪、HDR、色彩校正、锐化、Gamma、畸变校正等,适配各类CMOS Sensor。 2.仿真与落地:使用Matlab/Python做算法建模仿真,C/C++完成工程化实现;配合IC团队完成算法硬化、硬件适配与芯片验证。 3.画质调优:针对低照度、逆光、运动等安防典型场景,完成主客观画质调优,优化信噪比、动态范围等核心指标。 4.性能优化:结合芯片硬件资源,优化算法复杂度、带宽、功耗与延迟,适配芯片量产需求。 5.技术预研与迭代:跟进AI-ISP、多帧融合等前沿技术,沉淀技术文档,解决量产及终端成像问题。…
岗位职责: 1、负责公司在指定区域(东南亚/东亚/中东)的市场开拓与销售闭环,达成年度营收与客户增长目标; 2、深度理解本地零售业态(如便利店、商超、快时尚、药妆等),识别高潜力客户并建立信任关系; 3、向客户精准传递公司AI+BI解决方案价值,包括客流分析、销量预测、门店效率优化等核心场景; 4、协调售前、产品、技术团队,完成客户需求调研、POC(概念验证)、方案定制与商务谈判; 5、与本地系统集成商(SI)、支付平台、POS厂商建立生态合作,构建渠道销售能力; 6、收集市场反馈与竞品动态,反哺产品本地化迭代与定价策略优化;…
机器学习 深度学习 计算机视觉 算法与AI 通信 / 计算机 / IT
岗位职责: 图像领域的研究 1. 负责计算机视觉算法和深度学习算法等前沿技术的研发并应用到实际产品中 2. 负责视频图像、自然语言中的目标检测、分类、识别、分割、语义理解等前沿技术的研发和实现 3. 负责机器学习、深度神经网络模型的训练、优化、实现
1、负责激光/视觉slam定位、建图、状态估计、多传感器融合等算法的研发 ; 2、负责定位建图相关算法的仿真平台搭建、仿真验证、仿真数据维护 ; 3、负责与定位建图算法相关的早期验证数据采集; 4、负责试产过程中与定位相关传感器的性能评估、极限、门限指标确定与验证结果评定 ; 5、负责试产过程中内外测用户数据分析、量产后售后问题分析。
计算机视觉 机器学习 深度学习 算法与AI AI / 大模型
【课题介绍】 本课题聚焦通用原生多模态大模型研发中的核心技术瓶颈,围绕原生多模态模型架构、多模态数据智能治理、高效预训练与对齐、多模态理解与推理、高分辨率图像和长视频建模、大规模分布式训练优化及模型评测等核心方向,构建具备统一感知、深度理解、复杂推理和可靠生成能力的通用多模态模型体系。 针对多模态模型训练过程中存在的模态表征差异大、图文语义对齐困难、视觉信息压缩损失、多模态数据质量参差、不同模态与任务训练失衡、高分辨率及长视频计算成本高、细粒度感知能力不足、多模态幻觉突出等问题,开展系统性研究。通过协同优化模型架构、视觉编码器、模态连接模块、预训练目标、数据配比、损失权重、课程学习及分布式训…
Python PyTorch 深度学习 算法与AI 通信 / 计算机 / IT
1. 参与多模态智能体及视觉内容分析相关算法的研发与优化。 2. 探索大模型与外部工具协同的任务规划、多轮推理和自主决策方法。 3. 参与模型数据构建、训练适配、推理优化及工程验证。 4. 建设模型评测体系,持续提升算法的准确性、鲁棒性、泛化能力和可解释性。 5. 开展前沿技术调研、论文复现和原型验证,推动研究成果在实际场景中落地。
机器学习 数据挖掘 计算机视觉 算法与AI 新能源 / 储能
1. 新能源汽车动力电池故障预警与诊断的大数据算法模型搭建; 2. 动力电池SOH、寿命预测的大数据模型、物理模型或电化学模型的开发 3. 动力电池测试数据的深度挖掘与分析; 4. 撰写算法设计文档 5. 负责算法的优化与工程化代码开发; 6. 机器学习AI算法库搭建
计算机视觉 C++ Python 算法与AI 机器人 / 智能装备
岗位职责 1、负责基于视觉-惯性-雷达(VLIO)融合SLAM算法研发与优化; 2、设计并实现闭环检测、回环优化模块; 3、实现局部/全局重定位与退化场景下鲁棒性优化; 4、参与建设计与online/offline建图算法实现; 5、跟进技术指标验证; 6、快速学习并尝试新算法与工具,支持技术弹性拓展。 任职条件 1、硕士及以上学历,计算机视觉、机器人感知方向; 2、熟悉SLAM主流算法(LIO-SAM、VINS、ALOAM、R3LIVE、VLOAM、ORBSLAM、Fastlio、Fastlvio等); 3、熟悉视觉/LiDAR/IMU时间同步与标定;…
C++ 嵌入式 计算机视觉 算法与AI 机器人 / 智能装备
1、负责SLAM核心算法研发,包括视觉SLAM(如ORB-SLAM、VINS)、激光SLAM(如LOAM、LeGO-LOAM)或多传感器融合SLAM(视觉+IMU+LiDAR+GPS)的算法设计、开发与调试,实现无人机在复杂环境下的高精度定位与建图; 2、负责前端感知算法优化,包括特征提取与匹配、关键帧选择、回环检测等模块的性能提升,解决运动模糊、光照变化、纹理缺失等复杂场景下的算法鲁棒性问题; 3、负责后端优化算法实现,包括基于图优化的位姿估计(如g2o、Ceres Solver)、多传感器时空标定与数据融合,降低累积误差,提升定位精度与地图一致性;…
计算机视觉 Python C++ 算法与AI 芯片 / 半导体
1.负责高端工业视觉检测(AOI)系统中精密缺陷检测、微小公差测量的核心算法设计与开发(如复杂端面形态分析、微小凸起/缺口识别); 2.突破常规2D矩形ROI处理的局限,运用极坐标展开、轮廓曲线提取等方式,将复杂的2D图像特征映射为1D信号,结合拓扑结构进行精准分析; 3.建立极其鲁棒的数学与几何模型,克服工业现场的脏污、倒角、机械斜率及常规形态学操作(如开/闭运算)带来的平滑副作用; 4.完成从理论模型验证(Python/SciPy)到工业级高效部署(C++ / 边缘计算)的全流程闭环,保证算法的极致精度与稳定性。
大模型 强化学习 机器学习 算法与AI 通信 / 计算机 / IT
岗位职责: 1、负责大语言模型LLM后训练阶段的核心算法研发与模型迭代,包括但不限于SFT、Reward Model训练以及强化学习DPO,GRPO,GSPO,Agentic RL等,持续提升模型作为Agent大脑的逻辑推理能力、指令遵循能力。 2、负责基于大模型的智能体架构设计与开发,探索多智能体协同机制、复杂任务拆解规划以及工具调用(Tool-use)能力。 3、构建并优化Agent系统的自我进化与自我演化机制,持续提升Agent在实际业务中的自主决策、工作流执行与闭环优化能力。 5、针对业务场景痛点进行模型与智能体调优,探索并解决模型幻觉问题,攻坚长上下文,复杂场景下的多轮对话策略与记…
计算机视觉 深度学习 Python 算法与AI 通信 / 计算机 / IT
1. 负责移动端图像算法研发、移植与落地,包括识别、分割、检测等相关算法; 2. 基于 Android/iOS 平台,完成算法模型轻量化、算子优化、推理部署; 3. 和产品、客户端、测试团队配合,完成算法效果验收、版本迭代,撰写算法方案、评估报告; 4. 跟进图像 / 视觉前沿技术,做技术预研,沉淀端侧图像算法方案。
多模态 深度学习 PyTorch 算法与AI 芯片 / 半导体
主要职责: * 研发和优化基于深度学习、计算机视觉的目标检测、分割、识别与预测算法(如车道线、交通标志、红绿灯、路沿、动态障碍物、轨迹预测等)。 * 设计多传感器(摄像头、激光雷达、毫米波雷达等)融合的环境感知方案,提升系统的稳定性和精度。 * 构建大规模场景数据集,设计数据挖掘与标注策略,优化模型训练 pipeline。 * 针对实际场景中的长尾问题(如极端天气、遮挡、低光照等)进行算法优化与创新。 * 将算法部署到车载计算平台(如 NVIDIA、地平线等),实现高性能实时推理。
计算机视觉 Python C++ 算法与AI 芯片 / 半导体
【职位总结】 我们正在寻找一名环境感知算法工程师,负责割草机器人和机场无人底盘的视觉及多传感器感知算法研发。你将围绕障碍物检测、语义分割、可通行区域识别和目标跟踪,提升系统在弱光、雨雾、扬尘、逆光及复杂动态环境中的感知准确性与稳定性。 【核心职责】 1.视觉感知算法研发:负责目标检测、语义/实例分割、可通行区域识别、边界检测及目标跟踪算法的设计、训练与优化。 2.多传感器融合感知:融合相机、2D/3D激光雷达、毫米波雷达和超声波数据,提升近场盲区、低能见度及动态障碍物场景下的可靠性。 3.复杂环境适配:针对雨雾、弱光、逆光、阴影、扬尘、草丛摆动和反光目标等长尾问题,制定数据与模型优化方案。…
深度学习 计算机视觉 PyTorch 算法与AI 机器人 / 智能装备
1.对接各视觉产品深度学习方向需求,深入理解业务需求,提供深度学习算法解决方案,主导或协助深度学习项目交付,保障交付物满足业务需求 2.负责公司深度学习技术发展路径规划,攻坚前沿技术; 3。负责深度学习小组的团队管理与建设工作。
1、负责机器人视觉感知算法研发,包括图像目标检测、语义分割、实例分割等深度学习模型的设计、训练、优化与部署; 2、负责双目立体视觉算法研发,包括双目标定、立体校正、立体匹配、深度估计、点云生成等算法开发与优化; 3、负责点云数据处理相关算法研发,包括点云滤波、聚类、分类、目标分割、三维目标检测、障碍物识别等; 4、负责深度学习模型训练、调优及部署,持续优化模型精度、推理速度和资源占用,满足嵌入式平台实时运行要求; 5、负责模型部署与推理加速,包括 TensorRT、ONNX Runtime、NPU 推理框架的适配与优化;…
计算机视觉 PyTorch 算法与AI 通信 / 计算机 / IT
1. 算法研发与优化:低空视觉感知类算法设计、开发与持续优化,包括但不限于目标检测与识别、图像分割、三维重建、运动估计、场景理解等。 2. 行业应用定制:深入钻研农业、林业、城市建设等应用方向,将视觉感知算法与实际行业应用深度融合,定制开发契合具体场景的算法解决方案。 3. 项目落地与迭代:主导或参与低空视觉感知(综合利用卫星、无人机、地面传感等设备数据)相关项目的落地实施,包括需求调研、方案设计、算法开发、集成测试,以及后期的现场调试、效果评估与迭代优化。
Python 深度学习 TensorFlow 算法与AI 汽车
1.参与泊车感知模型的设计、开发与优化,基于深度学习框架(如TensorFlow、PyTorch)构建高效、准确的感知模型,实现对车辆周围环境(包括车位、障碍物、行人等)的精准识别与定位。 2.负责数据处理与分析,收集、标注泊车相关数据,对数据进行预处理和增强,以提高模型训练效果;深入分析模型性能指标,根据实际情况优化模型结构和训练策略。 3.跟踪前沿技术,研究并引入新的算法和技术,提升泊车感知模型的性能和竞争力;参与团队技术交流与分享,推动团队整体技术水平提升。 4.负责解决模型开发和部署过程中的技术问题,对模型进行持续的维护和升级,确保模型在实际场景中的稳定性和可靠性。
打通虚拟与现实的边界!与顶尖科学家/架构师并肩,用顶级人才重构世界模型(World Models)与 Omni 生成式音视频时代。 关于这个角色 从文本生成到世界模型(World Models),从扩散模型(Diffusion/DiT)到 Omni 全模态与拟真物理世界的重构——AGI 的下一场硬仗,正在音视频与多模态战场全面打响! 我们不需要一个死板的“简历搬运工”,我们寻找的是一位“懂技术演进、有极客追求、人际敏感度极高”的 Talent Architect(人才架构师)。你将作为技术团队的杠杆,帮我们把全球最聪明的脑细胞,聚集到最前沿的音视频与世界模型战场上。…
机器学习 计算机视觉 多模态 算法与AI 机器人 / 智能装备
1、参与人形机器人及通用机器人具身智能算法研发,围绕多模态感知、环境理解、决策规划和运动控制等方向,探索机器人在真实场景中的任务执行与交互能力; 2、根据项目方向,参与以下一项或多项算法研发工作:视觉感知与空间定位,包括vSLAM/3D SLAM、三维重建、多传感器融合定位、目标检测、语义分割及点云处理等;具身大模型,包括视觉-语言-动作(VLA)模型、多模态信息对齐、模型微调及语言指令到机器人动作的映射;决策与控制,包括强化学习、模仿学习、扩散策略、轨迹规划及机器人运动控制等; 3、参与算法训练、测试与优化,基于真实或仿真数据开展实验设计、模型评估、问题分析和算法迭代;…
计算机视觉 Linux C++ 前端与客户端 芯片 / 半导体
岗位职责: 1. 设计、实现、维护底层海光自研图像算子库工作。 2. 高性能计算领域相关的优化工作,结合CPU架构特点优化性能。参与客户应用优化支持,分析客户应用程序行为,解决客户应用在公司产品上的性能瓶颈。 3. 完成特定图像处理算法的编码实现、调试与性能调优工作 岗位要求: 1、图像处理、计算机视觉、模式识别等相关专业本科及以上学历,5年及以上图像处理算法研发相关工作经验,具备扎实的数字图像处理理论基础; 2、精通图像滤波、边缘检测、形态学处理等常规图像算法的原理与工程实现; 3、掌握相机标定全流程技术,熟练理解主流标定算法的底层逻辑,精通透视变换、双线性插值、图像重映射算法实现机制;…
大模型 强化学习 机器学习 算法与AI 通信 / 计算机 / IT
岗位职责: 1、负责大语言模型LLM后训练阶段的核心算法研发与模型迭代,包括但不限于SFT、Reward Model训练以及强化学习DPO,GRPO,GSPO,Agentic RL等,持续提升模型作为Agent大脑的逻辑推理能力、指令遵循能力。 2、负责基于大模型的智能体架构设计与开发,探索多智能体协同机制、复杂任务拆解规划以及工具调用(Tool-use)能力。 3、构建并优化Agent系统的自我进化与自我演化机制,持续提升Agent在实际业务中的自主决策、工作流执行与闭环优化能力。 5、针对业务场景痛点进行模型与智能体调优,探索并解决模型幻觉问题,攻坚长上下文,复杂场景下的多轮对话策略与记…
职位简介: 大疆的计算机视觉算法工程师围绕各产品线的视觉链路,覆盖影像增强、检测跟踪、三维建图与自动化真值标注,把 CV 前沿能力压进大疆每一款智能硬件产品。 工作职责: 负责计算机视觉算法相关研究和开发,并落地产品。包括但不限于: 1. 负责研发基于多种传感器的实时深度算法、3D场景在线建图、动静态目标检测跟踪和语义识别; 2. 负责研发影像增强相关算法,如:视频超分、视频插帧、图像评价、图像增强与生成等; 3. 负责基于激光/视觉的大范围城市场景离线三维建图、多圈多时段数据融合、自动化语义地图构建,以及基于地图的在线定位;…
深度学习 计算机视觉 Python 算法与AI 机器人 / 智能装备
1. 参与视觉大模型开发、微调与轻量化改造,适配机器人相机、端侧嵌入式芯片; 2. 负责机器人场景视觉数据集清洗、标注、图文配对构建,配合完成SFT模型微调、数据迭代优化; 3. 协助优化三维视觉、目标检测、语义分割、跨场景目标识别算法,适配居家、商用复杂真实场景; 4. 协助完成模型量化、蒸馏、算子优化与机器人端侧部署、真机调试; 5. 跟进视觉大模型SOTA技术,完成技术调研、文档输出,配合跨部门完成算法联调。
机器学习 深度学习 PyTorch 算法与AI 通信 / 计算机 / IT
1、参与智能文档处理相关的视觉算法技术研发,包括但不限于图像分类,图像分割,图像生成、无监督半监督学习等; 2、根据项目需求,对现有算法进行改进和优化,提高算法性能; 3、协助团队完成产品落地,确保算法在实际应用中的稳定性和可靠性; 4、参与团队内部技术分享,持续提升自身技术水平;
1.基于 Feedforward 3DGS(前馈式三维高斯溅射)的实时三维重建方案研发与落地,服务于自动驾驶仿真系统; 2.将 Feedforward 3DGS 重建结果高效接入自动驾驶仿真引擎,提升仿真环境中的静态/动态场景重建质量与运行效率; 3.深度参与仿真引擎的重建数据流与渲染管线设计,优化 3DGS 表示在闭环仿真中的加载、更新与交互性能。
【你将参与什么】 · 参与下一代 3D/4D Reconstruction Foundation Model 与 Gaussian Splatting 研发,面向真实自动驾驶场景研究统一几何、动态建模与高保真可渲染场景表示。 · 团队拥有 千卡级 GPU 算力资源 和大规模真实自动驾驶多相机、多时序数据,优秀研究成果支持进一步沉淀并投稿 CVPR / ICCV / ECCV / NeurIPS / ICLR / SIGGRAPH 等顶级会议。 【核心方向】 · Feed-Forward 3D/4D Reconstruction:D4RT、VGGT、PI3、DUSt3R / MASt3R;…
Momenta 上海 北京 苏州 广州 深圳 杭州 5-10年 本科
1.负责自动驾驶量产项目落地,全面负责智能驾驶软件方案的客户项目交付管理工作 2.负责设计需求合理的项目计划,拉通内外部合作方建立流畅的沟通机制,并落地执行 3.建立过程跟踪机制和管理机制,持续发现并改进内外合作中的问题 4.负责跨团队合作中的流程梳理和外部关系维护,管理和协调内外部合作伙伴
职位简介: 大疆的计算机视觉算法工程师围绕各产品线的视觉链路,覆盖影像增强、检测跟踪、三维建图与自动化真值标注,把 CV 前沿能力压进大疆每一款智能硬件产品。 工作职责: 负责计算机视觉算法相关研究和开发,并落地产品。包括但不限于: 1. 负责研发基于多种传感器的实时深度算法、3D场景在线建图、动静态目标检测跟踪和语义识别; 2. 负责研发影像增强相关算法,如:视频超分、视频插帧、图像评价、图像增强与生成等; 3. 负责基于激光/视觉的大范围城市场景离线三维建图、多圈多时段数据融合、自动化语义地图构建,以及基于地图的在线定位;…
计算机视觉 FPGA 深度学习 算法与AI 通信 / 计算机 / IT
工作职责: 1、负责飞行器的定位导航算法研究及实现; 2、负责优化飞行器运动行为(定位导航、路径规划、避障算法等); 3、传感器信息融合及栅格地图创建; 4、提高规划导航算法效率并优化软件架构。
【你将参与什么】 · 参与面向自动驾驶的 Generative World Model 研发,研究可预测、可生成、可交互的未来世界建模能力,为自动驾驶训练、仿真和决策学习提供生成式世界模型基础。 · 团队拥有 千卡级 GPU 算力资源 和海量真实自动驾驶多相机视频、时序数据,优秀研究成果支持进一步沉淀并投稿 CVPR / ICCV / ECCV / NeurIPS / ICML / ICLR 等顶级会议。 【核心方向】 · Video Generation:Video Diffusion、DiT、Flow Matching、多相机视频生成;…
计算机视觉 深度学习 多模态 算法与AI 通信 / 计算机 / IT
1. 核心模型研发:负责研发面向3D场景理解的先进AI模型,重点聚焦于图像与点云的多模态融合,应用于语义分割、实例分割、目标检测、场景重建等任务。 2. 多模态融合架构设计:探索和设计高效的融合范式(如前融合、特征级融合、结果级融合),以充分发挥图像(纹理、颜色)与点云(几何、深度)的互补优势,提升模型在复杂环境下的鲁棒性与精度。 3. 3D感知算法创新:深入研究基于点云、体素、网格或多视角图像的3D感知算法。 4. 模型轻量化与芯片级优化:对多模态大模型进行轻量化设计、知识蒸馏、量化与硬件友好型结构搜索,确保算法能通用GPU上实现极致的性能、能效与低延迟。…
1. 负责多模态与智能文档理解关键技术研究,面向科学文献、技术报告等复杂文档,提升文本、图像、表格、公式等内容的识别、结构化与语义理解能力。 2. 研究文档结构建模、图文语义对齐与跨页信息关联等方法,实现从元素解析到内容理解的能力提升,支撑高质量训练语料构建与科学信息检索。 3. 建设训练数据与评测体系,研究数据合成、质量筛选及自动化评估方法,系统评估解析准确性、结构完整性、语义一致性与下游应用效果。 4. 开展多模态模型训练、适配与推理优化,与工程团队协作推动研究成果在大规模文档处理中的落地,兼顾效果、效率与稳定性。…
职位描述 你将负责政企 AI 产品或解决方案从需求发现到交付落地的完整链路。面对委办局、科研院所、央国企、运营商、工业企业等客户,把“想用 AI”进一步拆成清晰的业务流程、可验证的产品能力和可交付的技术方案。你可以从产品规划出发,也可以从售前方案切入。你会与算法、研发、架构、数据和交付团队一起工作,将 MiniCPM 系列模型、知识库、RAG、多智能体、数字员工及私有化一体机能力,落到数字员工、公文办公、情报研判、质量质检、装备管理等真实场景中。我们期待你既能看懂客户的业务,也能把方案推进到上线和持续迭代。…
机器学习 深度学习 大模型 算法与AI 通信 / 计算机 / IT
1、负责政企客户的大模型项目技术支持,包括但不限于CV算法、Prompt工程、算法编排。 2、持续建设和优化交付技术体系和工具; 3、客户现场的定制化实践经验沉淀、反馈与建议,转化为大模型产品团队的迭代需求,推动产品能力的持续优化与升级。
Python PyTorch 深度学习 算法与AI AI / 大模型
岗位职责: 1.负责或参与具身智能 Vision-Language-Action(VLA)、World Action Model(WAM)及多模态机器人基础模型的研究与开发。 2.研究视觉、语言、机器人状态、动作、力觉、触觉等多模态信息的统一表征、融合建模和时序预测方法。 3.基于机器人真实数据和人类示范数据,开展多模态预训练、行为克隆、指令微调、策略学习及跨任务泛化研究。 4.研究适用于机械臂和人形机器人的动作表示,包括关节动作、末端轨迹、关键点轨迹、Task-Space Action、Action Chunk 及接触/力相关动作表示。…
工作职责: 1. 负责硬件测试自动化工具/平台的设计、开发与持续优化,基于Python/LabVIEW等构建可扩展的自动化测试框架,提升测试效率以及硬件测试自动化率; 2. 引入AI技术(机器学习、深度学习、计算机视觉、LLM/智能体等)与自动化测试结合落地以下方向:测试用例智能生成、仪器仪表控制、测试数据的分析及缺陷分析等; 3. 打通硬件自动化测试全链路,持续提升硬件测试自动化率与测试效率; 4. 跟踪AI+测试前沿技术,开展可行性验证并推动在项目中的落地; 5. 负责项目DFT设计,硬件原理图、PCB可测试性评审;…
1、进行核心技术方案的选型、论证与落地,攻克跨模态语义对齐、模态特征融合、异构数据理解等关键技术难题。 2、跟踪全球多模态大模型前沿技术的发展趋势,结合业务场景输出技术演进路线图,推动模型持续迭代升级。 3、模型研发与优化:牵头多模态理解大模型的后训练、微调、对齐等核心研发环节,负责模型结构设计、损失函数优化、训练策略制定,提升模型在跨模态检索、内容理解、图文生成、视觉问答等任务的性能表现。 4、
C++ Python 计算机视觉 算法与AI 芯片 / 半导体
1、负责ADAS/AD高级别自动驾驶系统产品功能需求和技术规范定义,整理编制相关需求文档 2、负责需求分析及分解,技术问题追踪,细化用户场景 3、负责高级自动驾驶系统架构定义,落实方案并识别技术风险,确保系统设计的合理性和可行性 4、针对自研芯片进行系统层面架构的制定与细化,提出芯片和算法需求 5、跨团队、跨部门沟通合作解决产品关键问题