【星火X计划-实习】超长上下文大模型结构建模技术研究(J14622)

科大讯飞

合肥 / 北京 算法与AI 硕士 近一周新增 挂了 5 天

【课题介绍】 本课题聚焦千万级超长上下文通用大模型建模核心难题,针对当前线性注意力、稀疏注意力两大主流技术阵营的固有缺陷,围绕线性运算复杂度保障、时序位置敏感性与超长外推能力、次线性KV缓存优化三大核心主线,开展融合式注意力建模创新研究,构建高精度、低开销、强泛化的千万级长序列建模体系。 当前线性注意力路线可实现严格线性算力复杂度、彻底规避传统Transformer平方复杂度瓶颈,但存在时序位置建模精度不足、超长序列位置外推偏移、局部语义捕捉能力弱的问题;稀疏注意力路线通过自适应稀疏采样大幅降低计算开销,保留精准时序建模能力,但存在采样复杂度不稳定、极长序列缓存冗余、外推泛化上限低的缺陷。…

编号 ox423f2h · 来源原文 ↗

【星火X计划-实习】面向超长程任务的大模型智能体技术研究(J14621)

科大讯飞

合肥 / 北京 算法与AI 应届 硕士 近一周新增 挂了 5 天

【课题介绍】 随着通用大模型在深度推理、软件工程、复杂工具调用能力上的不断提升,模型正在从“完成短流程任务”迈向“可靠承担长期开放任务”。本课题围绕仓库级大型软件工程智能体、超长时程任务规划与工具使用、复杂智能体轨迹数据合成、模型自我验证与自主校准等关键技术方向开展研究,构建能够理解目标、分解任务、调用工具、从反馈中学习并在失败后自主恢复的智能体模型。 你将结合真实业务流程,研究从轨迹数据构造、监督微调、强化学习、测试时计算到在线学习的完整技术闭环;建立核心评测体系,推动 Agent 在复杂软件工程、深度研究、企业工作流等高价值场景中的规模化应用。…

编号 1va1pmip · 来源原文 ↗

【星火X计划-实习】面向自主持续学习的基础大模型训练技术研究(J14620)

科大讯飞

合肥 / 北京 算法与AI 应届 硕士 近一周新增 挂了 5 天

【课题介绍】 我们认为未来的通用大模型不仅需要根据人类提供的数据和奖励进行训练,还需要能够主动探索环境、发现知识与技能缺口、从交互反馈中持续学习,并逐步形成自我改进和自主进化能力。 本课题围绕Reasoning RL、Agentic RL、自主持续学习与递归式自我改进等关键技术方向开展研究,探索从离线训练、在线强化学习、环境交互学习到模型自主生成目标、自主构造训练数据、自主验证和持续更新的完整技术体系,构建具备深度推理、复杂决策、长期探索和持续自我提升的下一代大模型。 你将研究从奖励建模、可验证强化学习、策略优化、过程监督,到智能体环境交互、在线学习的完整技术验证;…

编号 3rxan24m · 来源原文 ↗

【星火X计划-实习】原生多模态通用大模型算法研究(J14619)

科大讯飞

合肥 / 北京 算法与AI 应届 硕士 近一周新增 挂了 5 天

【课题介绍】 本课题聚焦通用原生多模态大模型研发中的核心技术瓶颈,围绕原生多模态模型架构、多模态数据智能治理、高效预训练与对齐、多模态理解与推理、高分辨率图像和长视频建模、大规模分布式训练优化及模型评测等核心方向,构建具备统一感知、深度理解、复杂推理和可靠生成能力的通用多模态模型体系。 针对多模态模型训练过程中存在的模态表征差异大、图文语义对齐困难、视觉信息压缩损失、多模态数据质量参差、不同模态与任务训练失衡、高分辨率及长视频计算成本高、细粒度感知能力不足、多模态幻觉突出等问题,开展系统性研究。通过协同优化模型架构、视觉编码器、模态连接模块、预训练目标、数据配比、损失权重、课程学习及分布式训…

编号 1ef4esze · 来源原文 ↗

【星火X计划-实习】面向超大尺寸通用LLM的预训练Infra工程(J14618)

科大讯飞

合肥 / 北京 算法与AI 应届 硕士 近一周新增 挂了 5 天

【课题介绍】 通用大模型预训练在LLM训练周期中占比最高,预训练效果优劣很大程度上依赖底层训练基础设施的规模、稳定性和效率。当模型尺寸迈向千亿和万亿级别,集群规模从千卡扩展到万卡甚至更大规模时,预训练框架变成一项系统工程:如何在框架层实现效率、显存和通信的均衡。研究与训练调度平台协同实现超大集群在数周乃至数月中保持稳定高效训练;研究在硬件故障频发情况下保证训练任务不中断等。本课题聚焦于构建和优化面向大模型预训练的高性能、高可用训练基础设施,为模型团队提供稳定、高效可扩展的训练工程底座。 【课题挑战】 1、结合具体结构的规模化并行方案设计:针对万亿参数模型结构信息结合训练集群体系结构,设计多维…

编号 2lrew863 · 来源原文 ↗

【星火X计划-实习】面向超大尺寸MoE的大EP推理工程优化(J14617)

科大讯飞

合肥 / 北京 算法与AI 应届 硕士 近一周新增 挂了 5 天

【课题介绍】 本课题聚焦超大规模 MoE 大模型超大专家并行(EP128 以上) 场景下的核心瓶颈,围绕跨节点高带宽通信优化、动态专家负载均衡、多并行维度协同调度三大主线,构建低通信开销、高资源利用率、低尾部延迟的 MoE 分布式推理体系。 针对 EP 规模扩张带来的 all-to-all 通信拥塞、专家访问热度倾斜、跨机通信时延激增、调度与路由开销放大等核心痛点开展研究;打通路由策略、通信算法、分布式调度器、底层通信库的协同优化,建立从专家路由、流量调度、动态负载重平衡到框架层落地的完整技术方案;支撑百专家乃至上千专家规模 MoE 大模型在大规模 GPU 集群高效部署,建立面向线上业务 M…

编号 5wbx3npb · 来源原文 ↗

【星火X计划-实习】面向大模型高效训推的算子研发与极致优化(J14616)

科大讯飞

合肥 / 北京 算法与AI 应届 硕士 近一周新增 挂了 5 天

【课题介绍】 算子是释放硬件算力的关键,大模型训练推理效率优化关键在于算子效率,算子效率直接决定了训推框架的整体效率。但实际训练推理中观测到的算力利用率往往远低于硬件峰值,算子效率成为制约上层大模型框架发挥硬件极限能力的关键瓶颈。如何深度挖掘硬件特性,实现算子和通信原语的高效实现与极致优化,直接决定了AI基础设施的效能。本课题专注于对大模型训推过程中的关键算子进行极致效率优化,在充分理解硬件架构基础上,通过工程师的"心灵手巧"设计、研发高效算子、优化关键算子效率,解决算力、通信、访存等关键算子瓶颈。 【课题挑战】 算子开发面临的主要挑战在于如何贴近硬件微架构,实现接近理论算力与通信带宽极限的…

编号 2wgstqty · 来源原文 ↗

【星火X计划-实习】大规模集群下超大尺寸模型推理性能极致优化(J14615)

科大讯飞

合肥 / 北京 算法与AI 硕士 近一周新增 挂了 5 天

【课题介绍】 本课面向超大尺寸通用大模型规模化的 API 服务场景,基于国产异构算力芯片构建大规模、高性能的分布式推理集群。围绕多级 KVCache、实时动态计算调度、弹性异构基础设施等核心任务,通过工程技术的持续创新,不断追求用户延迟体验、服务成本以及可靠性工程等方面的极致优化,构建高性价比的大模型 API 服务能力,加速形成普惠的token经济。 【课题挑战】 1、大规模发散流量场景下,用户请求动态变化、业务负载高度随机、异构算力瓶颈差异显著、云际异构集群间流量峰谷波动大,在保障用户体验的同时需实现跨集群、跨资源池的全局负载最优分配与潮汐弹性调度,逼近集群吞吐与资源利用率极限;…

编号 2aiucef5 · 来源原文 ↗

【星火X计划-实习】面向通用大模型智能体强化学习的Infra工程(J14610)

科大讯飞

合肥 / 北京 算法与AI 应届 硕士 近一周新增 挂了 5 天

【课题介绍】 当前大模型 RL 后训练面临多模型(策略/价值/参考/奖励/验证器)并存带来的显存压力、生成回滚与梯度更新的同步等待、海量轨迹数据的传输存储开销等核心痛点;而 AgentRL 场景中,智能体需与十万级并发环境实例进行数十至上百轮交互,长程上下文累积、环境状态异构性与故障频发、推理与训练速度失配等问题进一步加剧系统复杂度。两类场景在分布式通信拓扑优化、经验流数据管道、显存感知调度、容错恢复与资源弹性等层面具有高度一致的系统挑战。本课题将针对上述瓶颈,设计统一的异步流水线架构与动态资源调度器,突破多模型混合训练与大规模环境并行的扩展限制,大幅缩短 RL 迭代周期,显著提升 GPU …

编号 32uzwr18 · 来源原文 ↗

10 / 30 AI / 大模型

【星火X计划-实习】端到端语音底座大模型研究(J14613)

科大讯飞

合肥 / 上海 / 西安 算法与AI 近一周新增 挂了 5 天

【课题介绍】 本课题聚焦"端到端语音大模型"这一下一代人机语音交互的核心底座,突破当前"识别—理解—对话"级联架构在延迟、误差累积、副语言信息丢失上的固有瓶颈,构建以语音为中心、直接从声学信号完成语义理解与交互决策的统一大模型体系。课题以端到端实时语音交互大模型框架为统一建模底座,向下支撑端到端语音同传翻译与长上下文语音识别两大专项能力攻坚,形成"一个底座 + 两项深水区能力"的技术布局。 传统语音交互采用 ASR → LLM → TTS 的级联管线,存在三大结构性缺陷:一是多模块串行带来的高首包延迟与误差逐级放大;…

编号 1cisxszu · 来源原文 ↗

11 / 30 AI / 大模型

【星火X计划-实习】音频生成大模型研究(J14612)

科大讯飞

合肥 / 上海 算法与AI 近一周新增 挂了 5 天

【课题介绍】 本课题聚焦"端到端语音生成大模型"这一语音合成范式变革的核心方向,突破传统 TTS 在音质自然度、音色/韵律/情感可控性、零样本泛化、多说话人多轮交互生成上的固有瓶颈,构建以大语言模型为语义骨架、以扩散/多 token预测为声学生成引擎的端到端高保真语音生成体系。课题围绕LLM + DiT/MTP 端到端语音生成框架、通用音频生成 tokenizer、多人多轮细粒度指令语音生成三大核心主线,打造高保真、强可控、广泛化的通用语音生成大模型。本课题聚焦"发声之口",为课题“端到端语音底座大模型研究”提供高质量语音输出能力,二者合力构成完整的端到端语音交互链路。…

编号 5xa1au7p · 来源原文 ↗

12 / 30 AI / 大模型

【星火X计划-实习】面向复杂任务的下一代Agent Harness 关键技术研发(J14623)

科大讯飞

合肥 / 北京 研发(未细分) 硕士 近一周新增 挂了 5 天

【课题介绍】 随着基础大模型能力持续提升,Agent 的核心瓶颈正在从“模型能不能做”转向“系统能不能让模型稳定、安全、低成本地完成复杂任务”。本课题,重点研究长程任务执行、上下文与记忆、可靠工具调用、状态恢复、端云协同、安全控制和 Trace/Eval,建设可扩展、可恢复、安全可控、成本可度量的 Agent 运行系统。课题将以 Coding Agent 为重点验证场景,并覆盖深度研究、数据分析、浏览器操作和企业流程自动化等真实任务,打通“理解目标—获取信息—制定计划—调用工具—验证结果—修正错误—交付成果”的完整闭环。…

编号 5qba75r3 · 来源原文 ↗

13 / 30 AI / 大模型

PMO及PMO管理岗位(J14565)

科大讯飞

合肥 职能与支持 5-10年 本科 挂了 8 天

1. 负责PMO(项目管理办公室)体系的建设与持续优化,包括项目管理流程、模板、工具、方法论及知识库的制定与推广。 2. 统筹管理组织内重点项目组合,开展项目立项评审、进度监控、风险预警、资源协调及交付质量评估。 3. 组织项目复盘与绩效分析,定期输出项目健康度报告、PMO运营分析报告及管理改进建议,支撑管理层决策。 4. 主导项目管理能力体系建设,包括项目经理梯队培养、认证支持(如PMP/PRINCE2)、赋能培训及胜任力建模。 5. 协同各业务部门推进跨职能项目协同机制落地,推动项目治理标准化、数字化与可视化管理。

编号 zmgzwnwa · 来源原文 ↗

14 / 30 AI / 大模型

嵌入式测试工程师(J14569)

科大讯飞

成都 测试与质量 应届 本科 挂了 8 天

1、负责教育软硬一体化产品全流程质量保障,覆盖软硬件及上层教育应用,开展专项测试,支撑产品迭代与量产交付; 2、参与需求与技术方案评审,独立开展测试设计,识别软硬件适配等测试风险,跟进问题闭环,输出产品质量报告; 3、优化测试流程、用例与工具;探索自动化、专项测试技术,应用AI工具赋能测试开发,提升测试效能。

编号 1g84k6i9 · 来源原文 ↗

15 / 30 AI / 大模型

市场经理-培训与项目策划方向(J14575)

科大讯飞

合肥 职能与支持 本科 挂了 8 天

1、协助前端岗位能力研究,参与调研访谈、数据整理及能力画像的初步设计,参与训战课程体系的内容研发,协助课程大纲编写、学习路径图整理及课件制作 2、协助业务经验萃取与转化,整理案例、话术、工具,输出课程素材及作战手册 3、培训运营:推进训战项目全流程运营,训前筹备、演练组织、现场助教、通关考核、训后评估 4、内容传播:参与训战项目宣传,采用线上学习、短视频、图文等形式进行内容运营,放大训战影响力 5、支持重点客户演示方案开发,协助收集竞品信息、整理演示脚本及对抗话术库

编号 53s1q7is · 来源原文 ↗

16 / 30 AI / 大模型

AI研究算法工程师-人机交互算法方向(J14576)

科大讯飞

合肥 算法与AI 硕士 挂了 8 天

1. 负责人机交互(HCI)方向的前沿算法研究与技术落地,包括但不限于多模态感知(语音、视觉、手势、眼动等)、自然交互建模、意图理解与预测、交互反馈优化等; 2. 设计并实现面向智能终端、AI助手、AR/VR等场景的实时、低延迟、高鲁棒性人机交互算法方案; 3. 参与跨模态数据采集、标注规范制定及高质量交互数据集构建,支撑模型训练与效果评估; 4. 与产品、工程团队协同,完成算法从原型验证、性能调优到系统集成与线上部署的全流程推进; 5. 跟踪国内外人机交互与AI交叉领域的最新研究成果,持续推动技术创新与专利布局。

编号 5vazfjun · 来源原文 ↗

17 / 30 AI / 大模型

【星火X计划】面向复杂场景的全双工多模态交互系统研发(J14501)

科大讯飞

合肥 算法与AI 挂了 8 天

【课题介绍】 本课题致力于研发一套面向复杂场景(智能座舱、机器人等)的全双工多模态交互系统,针对当前交互系统在多人、高噪声环境下误触发率高、对话无法自然打断、异常插话、交互体验生硬等关键问题,围绕“多模态与多通道音频流式融合”、“复杂动态声学环境鲁棒性”、“‘人人/人机’交互毫秒级判定”以及“端侧受限算力下的极低时延部署”等核心技术难题展开创新性研发。通过深度整合视觉视线、唇动特征与声纹语义等多维信息,打破传统单向唤醒机制的束缚,实现“边看边听边说、极速响应、无感打断、不乱接话”的拟人化自然交互体验。 【课题挑战】 1、端到端多模态流式数据融合与极致低时延的冲突:全双工交互要求响应时延低于 …

编号 5oibn9y9 · 来源原文 ↗

18 / 30 AI / 大模型

【星火X计划】跨模态医学影像大模型研究(J14500)

科大讯飞

广州 算法与AI 1-3年 挂了 8 天

【课题介绍】 本课题聚焦临床真实场景下医学影像多模态大模型核心技术研发,针对CT、MRI、DR等多类型医学影像数据,联合影像报告、病历体征等多维度信息,研究影像跨模态统一表征、临床推理、智能诊断与自适应泛化技术。当前通用多模态大模型存在影像领域知识缺失、影像特征捕捉不足、临床逻辑推理薄弱、场景泛化性差等问题,难以满足精准诊断、病灶筛查、预后评估等临床刚需。课题将围绕医学影像多模态数据对齐、降噪、影像思维链推理机制、长尾病灶自适应学习、影像诊断智能体构建四大核心方向开展系统性研究,突破通用大模型在医学影像领域的落地瓶颈,搭建集高质量数据构建、领域预训练、指令微调、临床推理优化、智能交互诊断于一…

编号 5bc08rcj · 来源原文 ↗

19 / 30 AI / 大模型

【星火X计划】高可信低幻觉大模型技术研究(J14499)

科大讯飞

合肥 算法与AI 挂了 8 天

【课题介绍】 本课题聚焦大模型在复杂推理任务(如数学推导、代码生成、步骤批改等)中准确度不足、存在幻觉与逻辑跳跃的核心难题。针对当前大模型强化学习中基于结果监督(ORM)存在的奖励稀疏、信用分配困难等技术瓶颈,围绕基于Harness的生成策略优化、过程监督奖励模型(PRM)强化学习、以及推理期算力扩展三大核心主线,开展高可靠、强逻辑推理能力的融合优化建模研究。 当前主流的ORM范式虽然易于获取数据,但在长链路推理中极易出现“过程错误但结果碰巧正确”的虚假关联,且无法为模型提供细粒度的纠错引导,导致强化学习陷入奖励稀疏陷阱;…

编号 325wapzb · 来源原文 ↗

20 / 30 AI / 大模型

【星火X计划】基于跨专科、自适应的医疗复杂循证推理技术的“超级医生助手”研发(J14498)

科大讯飞

合肥 / 北京 算法与AI 挂了 8 天

【课题介绍】 本课题以“超级医生助手”为建设目标,核心攻关跨专科自适应的医疗复杂循证推理技术,围绕医疗复杂任务动态规划、长上下文循证推理、医疗多模态融合决策、跨专科智能体协同推理四大核心主线,构建覆盖基层及等级医院辅诊、个性化治疗方案、急重症快速决策、多学科疑难会诊等场景的医疗复杂循证推理技术体系。 针对优质医疗资源刚需缺口巨大、疑难重症精准诊疗难、专家智慧难以规模化复制等问题,当前医疗AI在多学科疑难会诊、复杂合并症诊断、急重症快速决策和跨专科协同诊疗等场景无重大技术突破,诊疗助理产品仍停留在单一环节的浅层应用辅助,整体处于“专科割裂、人工串联”的状态,亟需构建“诊疗规划-长文循证-模态融…

编号 47mhy90j · 来源原文 ↗

21 / 30 AI / 大模型

【星火X计划】端到端语音底座大模型研究(J14497)

科大讯飞

合肥 / 上海 / 西安 算法与AI 挂了 8 天

【课题介绍】 本课题聚焦"端到端语音大模型"这一下一代人机语音交互的核心底座,突破当前"识别—理解—对话"级联架构在延迟、误差累积、副语言信息丢失上的固有瓶颈,构建以语音为中心、直接从声学信号完成语义理解与交互决策的统一大模型体系。课题以端到端实时语音交互大模型框架为统一建模底座,向下支撑端到端语音同传翻译与长上下文语音识别两大专项能力攻坚,形成"一个底座 + 两项深水区能力"的技术布局。 传统语音交互采用 ASR → LLM → TTS 的级联管线,存在三大结构性缺陷:一是多模块串行带来的高首包延迟与误差逐级放大;…

编号 5jtjuovi · 来源原文 ↗

22 / 30 AI / 大模型

【星火X计划】音频生成大模型研究(J14496)

科大讯飞

合肥 / 上海 算法与AI 挂了 8 天

【课题介绍】 本课题聚焦"端到端语音生成大模型"这一语音合成范式变革的核心方向,突破传统 TTS 在音质自然度、音色/韵律/情感可控性、零样本泛化、多说话人多轮交互生成上的固有瓶颈,构建以大语言模型为语义骨架、以扩散/多 token预测为声学生成引擎的端到端高保真语音生成体系。课题围绕LLM + DiT/MTP 端到端语音生成框架、通用音频生成 tokenizer、多人多轮细粒度指令语音生成三大核心主线,打造高保真、强可控、广泛化的通用语音生成大模型。本课题聚焦"发声之口",为课题“端到端语音底座大模型研究”提供高质量语音输出能力,二者合力构成完整的端到端语音交互链路。…

编号 5pibbx6w · 来源原文 ↗

23 / 30 AI / 大模型

【星火X计划】实时音视频一体化生成关键技术研究(J14494)

科大讯飞

合肥 算法与AI 挂了 8 天

【课题介绍】 本课题面向实时交互场景的音视频一体化数字人生成技术,围绕数字人的语音、表情动作、声场环境和视频画面进行统一建模,构建具备高拟人度、高可控性、高音频质量、长时一致性和低延迟流式生成能力的数字人生成基座。 当前数字人生成多采用“文本/语义理解、TTS、唇驱、表情动作驱动、视频渲染”级联链路,工程上易落地,但在真实交互中容易出现多模态割裂问题:语音与口型同步但情绪、表情和动作不一致;人物与背景画面的光照、空间和运动关系不稳定;声场、背景音、环境氛围与视频画面缺乏统一建模;长时生成中人物身份、音色、动作风格和画面细节逐步漂移;…

编号 5ltnh2ff · 来源原文 ↗

24 / 30 AI / 大模型

【星火X计划】面向复杂任务的下一代Agent Harness 关键技术研发(J14502)

科大讯飞

合肥 / 北京 研发(未细分) 硕士 挂了 8 天

【课题介绍】 随着基础大模型能力持续提升,Agent 的核心瓶颈正在从“模型能不能做”转向“系统能不能让模型稳定、安全、低成本地完成复杂任务”。本课题,重点研究长程任务执行、上下文与记忆、可靠工具调用、状态恢复、端云协同、安全控制和 Trace/Eval,建设可扩展、可恢复、安全可控、成本可度量的 Agent 运行系统。课题将以 Coding Agent 为重点验证场景,并覆盖深度研究、数据分析、浏览器操作和企业流程自动化等真实任务,打通“理解目标—获取信息—制定计划—调用工具—验证结果—修正错误—交付成果”的完整闭环。…

编号 5hdatvbq · 来源原文 ↗

25 / 30 AI / 大模型

【星火X计划】面向超大尺寸通用LLM的预训练Infra工程(J14507)

科大讯飞

合肥 / 北京 算法与AI 硕士 挂了 8 天

【课题介绍】 通用大模型预训练在LLM训练周期中占比最高,预训练效果优劣很大程度上依赖底层训练基础设施的规模、稳定性和效率。当模型尺寸迈向千亿和万亿级别,集群规模从千卡扩展到万卡甚至更大规模时,预训练框架变成一项系统工程:如何在框架层实现效率、显存和通信的均衡。研究与训练调度平台协同实现超大集群在数周乃至数月中保持稳定高效训练;研究在硬件故障频发情况下保证训练任务不中断等。本课题聚焦于构建和优化面向大模型预训练的高性能、高可用训练基础设施,为模型团队提供稳定、高效可扩展的训练工程底座。 【课题挑战】 1、结合具体结构的规模化并行方案设计:针对万亿参数模型结构信息结合训练集群体系结构,设计多维…

编号 4tjtctv1 · 来源原文 ↗

26 / 30 AI / 大模型

【星火X计划】面向通用大模型智能体强化学习的Infra工程(J14506)

科大讯飞

合肥 / 北京 算法与AI 硕士 挂了 8 天

【课题介绍】 当前大模型 RL 后训练面临多模型(策略/价值/参考/奖励/验证器)并存带来的显存压力、生成回滚与梯度更新的同步等待、海量轨迹数据的传输存储开销等核心痛点;而 AgentRL 场景中,智能体需与十万级并发环境实例进行数十至上百轮交互,长程上下文累积、环境状态异构性与故障频发、推理与训练速度失配等问题进一步加剧系统复杂度。两类场景在分布式通信拓扑优化、经验流数据管道、显存感知调度、容错恢复与资源弹性等层面具有高度一致的系统挑战。本课题将针对上述瓶颈,设计统一的异步流水线架构与动态资源调度器,突破多模型混合训练与大规模环境并行的扩展限制,大幅缩短 RL 迭代周期,显著提升 GPU …

编号 1e8zzzol · 来源原文 ↗

27 / 30 AI / 大模型

【星火X计划】面向超大尺寸MoE的大EP推理工程优化(J14505)

科大讯飞

合肥 / 北京 算法与AI 硕士 挂了 8 天

【课题介绍】 本课题聚焦超大规模 MoE 大模型超大专家并行(EP128 以上) 场景下的核心瓶颈,围绕跨节点高带宽通信优化、动态专家负载均衡、多并行维度协同调度三大主线,构建低通信开销、高资源利用率、低尾部延迟的 MoE 分布式推理体系。 针对 EP 规模扩张带来的 all-to-all 通信拥塞、专家访问热度倾斜、跨机通信时延激增、调度与路由开销放大等核心痛点开展研究;打通路由策略、通信算法、分布式调度器、底层通信库的协同优化,建立从专家路由、流量调度、动态负载重平衡到框架层落地的完整技术方案;支撑百专家乃至上千专家规模 MoE 大模型在大规模 GPU 集群高效部署,建立面向线上业务 M…

编号 62byddkr · 来源原文 ↗

28 / 30 AI / 大模型

【星火X计划】面向大模型高效训推的算子研发与极致优化(J14504)

科大讯飞

合肥 / 北京 算法与AI 硕士 挂了 8 天

【课题介绍】 算子是释放硬件算力的关键,大模型训练推理效率优化关键在于算子效率,算子效率直接决定了训推框架的整体效率。但实际训练推理中观测到的算力利用率往往远低于硬件峰值,算子效率成为制约上层大模型框架发挥硬件极限能力的关键瓶颈。如何深度挖掘硬件特性,实现算子和通信原语的高效实现与极致优化,直接决定了AI基础设施的效能。本课题专注于对大模型训推过程中的关键算子进行极致效率优化,在充分理解硬件架构基础上,通过工程师的"心灵手巧"设计、研发高效算子、优化关键算子效率,解决算力、通信、访存等关键算子瓶颈。 【课题挑战】 算子开发面临的主要挑战在于如何贴近硬件微架构,实现接近理论算力与通信带宽极限的…

编号 45sdjngr · 来源原文 ↗

29 / 30 AI / 大模型

【星火X计划】大规模集群下超大尺寸模型推理性能极致优化(J14503)

科大讯飞

合肥 / 北京 算法与AI 硕士 挂了 8 天

【课题介绍】 本课面向超大尺寸通用大模型规模化的 API 服务场景,基于国产异构算力芯片构建大规模、高性能的分布式推理集群。围绕多级 KVCache、实时动态计算调度、弹性异构基础设施等核心任务,通过工程技术的持续创新,不断追求用户延迟体验、服务成本以及可靠性工程等方面的极致优化,构建高性价比的大模型 API 服务能力,加速形成普惠的token经济。 【课题挑战】 1、大规模发散流量场景下,用户请求动态变化、业务负载高度随机、异构算力瓶颈差异显著、云际异构集群间流量峰谷波动大,在保障用户体验的同时需实现跨集群、跨资源池的全局负载最优分配与潮汐弹性调度,逼近集群吞吐与资源利用率极限;…

编号 2sw8ljdw · 来源原文 ↗

30 / 30 AI / 大模型

【星火X计划】超长上下文大模型结构建模技术研究(J14521)

科大讯飞

合肥 / 北京 算法与AI 硕士 挂了 8 天

【课题介绍】 本课题聚焦千万级超长上下文通用大模型建模核心难题,针对当前线性注意力、稀疏注意力两大主流技术阵营的固有缺陷,围绕线性运算复杂度保障、时序位置敏感性与超长外推能力、次线性KV缓存优化三大核心主线,开展融合式注意力建模创新研究,构建高精度、低开销、强泛化的千万级长序列建模体系。 当前线性注意力路线可实现严格线性算力复杂度、彻底规避传统Transformer平方复杂度瓶颈,但存在时序位置建模精度不足、超长序列位置外推偏移、局部语义捕捉能力弱的问题;稀疏注意力路线通过自适应稀疏采样大幅降低计算开销,保留精准时序建模能力,但存在采样复杂度不稳定、极长序列缓存冗余、外推泛化上限低的缺陷。…

编号 17ou1us7 · 来源原文 ↗

这一批看完了

共 893 个符合条件的岗位,刚才这一批 30 张 · 第 1 页

已经收藏 0 / 1024 个

← 换成「一张一张做决定」的卡片模式

← 列表 1 / 30