说不清条件?直接问一句 →(例:合肥的BMS要几年经验)
要求 Hadoop 共 596 条 · 其中近一周 14 条 已筛选: 清除
大模型 Hadoop Spark 安全与运维 通信 / 计算机 / IT
【岗位职责】 1. 持续洞察国内外AI与威胁情报前沿技术,制定未来3-5年AI-Native情报能力中台的技术发展路线图,探索情报生产、分析与分发的新范式。 2. 引入大模型、图关联等前沿AI算法,深度结合安全底层机理,大幅提升威胁检测的准确率,将误报率降至行业极低水平。 3. 基于海量数据深度挖掘高级威胁模式与关联关系,构建AI-情报生产数据飞轮,驱动AI模型的训练与迭代,以此孵化具有独特价值的新型情报检测引擎。 4. 建立行业领先的情报评测指标体系,构建端到端的技术反馈闭环,精准追溯能力短板,驱动内部技术架构进行系统性改进。…
立讯精密 昆明 上海 苏州 常熟 昆山 华东园区 应届 本科
一、IT程序设计工程师 1.负责生产相关系统的迭代开发及持续优化 2.负责数字化相关应用系统的规划与开发 3.负责新项目需求分析/规划设计/开发导入 4.负责开发相关新技术研究及落地导入 二、IT网络工程师 1.负责网络设备的配置、安装和维护工作 2.参与网络故障排除和问题诊断,协助解决网络故障和连接问题 3.支持网络安全团队,参与基础安全措施的实施和监控 4.网络设备的更新和升级,确保网络设备的稳定性和安全性等事项 三、大数据开发工程师 1.负责数据底的ETL和业务需求开发,掌握工厂运营相关的业务流程和数据模型 2.掌握大数据开发,离线和实时开发流程,掌握开发技能 ,能需求场景开发用户的需…
SQL MySQL PostgreSQL 通信 / 计算机 / IT
岗位职责: 1. 设计、开发和维护高效、可扩展的数据管道(Data Pipeline)。 2. 负责数据仓库(Data Warehouse)的主题数据构建、优化和管理。 3. 编写ETL(Extract, Transform, Load)脚本,确保数据从多个来源高效集成。 4. 与数据分析师和业务团队合作,理解数据需求并提供技术支持。 5. 优化数据存储和查询性能,确保数据平台的高可用性和稳定性。 6. 监控数据流程,及时发现并解决数据质量问题。 7. 开发和维护数据接口和API,支持内部和外部数据访问 8. 撰写和维护相关技术文档 任职要求: 1. 教育背景: 计算机科学、信息技术、数学、…
Java Spring Scala 数据 通信 / 计算机 / IT
-负责大数据平台的部署和规划建设; 转换业务需求,参与数据仓库(离线、实时)和数据应用的建设、开发和维护(需出差)。
Java Python Scala 数据 通信 / 计算机 / IT
岗位职责: 1、理解业务需求,负责数据采集、清洗、存储程序以及实时数据计算的开发以及相应优化工作; 2、参与需求分析、并完成需求设计相应文档的编写; 3、支持业务部门的数据需求,参与BI应用开发,报表制作。 任职要求: 1、计算机相关专业本科以上学历,数据开发工作经验一年以上,有保险行业数据开发工作经验优先考虑; 2、熟练掌握Java/Python/Scala等至少一门编程语言; 3、掌握数据库知识,较强的SQL/ETL开发能力; 4、了解Hadoop生态圈大数据技术,如Hive,Hbase,Spark等,掌握阿里DataWorks、Quick BI、DataV等工具的使用。…
Hadoop Spark Flink 产品 通信 / 计算机 / IT
岗位职责 1. 数据平台规划与设计: ○ 负责数据平台产品的全生命周期管理,包括需求分析、功能设计、落地交付及迭代优化,聚焦数据源管理、数据处理、数据标注等核心能力,与训推平台深度配合,构建高效的数据流转闭环。 ○ 设计支持多场景的数据管理模块,覆盖数据接入、清洗、存储、标注、版本控制等全流程功能。 2. 技术架构理解与落地: ○ 深入理解数据平台技术架构(如大数据组件、分布式计算、数据存储方案等),与架构师、算法及工程团队协作,输出可落地的产品方案。 ○ 推动数据标注工具、自动化数据处理流程(ETL/数据清洗)等功能的开发与优化。…
1、负责用户增长场景的推荐算法研发(召回/排序/策略/多模态/LLM),提升推荐系统全链路效率; 2、负责消息PUSH与触达算法,优化推送时机、频次与内容生成,提升用户拉新与活跃; 3、负责广告投放算法,面向新用户/流失用户精准触达,包括价值预估、RTA出价、素材优选及 Agent 投放能力建设; 4、探索因果推断、强化学习等方法在用户增长中的应用,搭建通用因果平台,为PUSH、激励等业务场景赋能
岗位职责: 1、电商场景下的流量分发体系建设; 2、电商场景下的广告平台建设。 任职要求: 1、计算机及相关专业本科及以上学历,具有扎实的代码功底,熟悉常用的算法和数据结构; 2、精通C++或者Java语言和框架,熟悉了解Python语言,具有良好的编程习惯,熟悉Linux开发环境,掌握设计模式; 3、掌握多线程及高性能的设计编码及性能调优,有高并发应用开发经验,对服务治理体系有充分的理解和应用; 4、熟悉Hadoop/Hive/HBase/Spark/Flink/ES等计算框架,熟悉Docker技术及Kubernetes容器调度系统; 5、具备互联网广告业务的系统架构开发经验;…
1、负责设备数据、传感数据、业务数据的采集、清洗、处理、统计与建模分析; 2、基于Python、SQL、大数据框架进行数据开发、特征处理、数据可视化; 3、进行数据质量治理、数据分析、异常挖掘,支撑设备性能优化与业务决策; 4、维护数据流程、数据接口,输出数据分析报告与技术文档。
方向1——营销风控算法: 岗位职责 1、结合营销业务场景(如优惠券、补贴、活动奖励、游戏等),设计并实现针对虚假交易、批量注册、套现、团伙等异常行为的实时风控算法。 2、利用机器学习、深度学习及相关数据分析技术,对用户行为和交易数据进行实时监控与分析,识别可疑行为和潜在风险; 3、与业务、产品和风控团队紧密合作,定义并完善风控指标体系,持续跟进风险案例并制定对应策略; 4、设计并实现高效、稳定的风控数据处理流程,包括数据清洗、特征工程、模型训练及线上预测部署; 5、持续跟踪电商行业风险趋势及新技术发展,及时更新和升级风控算法与策略,提升整体防控能力。…
SQL MySQL Hadoop 研发(未细分) 通信 / 计算机 / IT
⼯作职责: 1. 负责大数据产品、分析型数据库产品、NoSQL 数据库相关技术方案系统架构设计 2. 基于客户需求与产品技术特性,抽象产品通用需求,设计有技术优势的产品系统架构 3. 推动产品技术架构在项目上的落地,并标准化产品技术方案,完善产品知识体系 4. 构建产品场景技术指标,完成技术⽅案验证、产品能⼒验证及性能优化⼯作 岗位要求: 1. 本科以上计算机或相关专业学历 2. 熟练使⽤SQL语⾔及调优,掌握⾄少⼀种数据库(RDBMS/MPP)系统的使⽤,如Oracle/DB2/MySQL等 3. 熟悉主流⼤数据技术,熟悉大数据技术原理,有Hadoop、HBase、Hive、Spark、K…
1、担任数据治理、主数据、数据资产类项目的项目经理,能够独立承担大型主数据或数据治理项目,能够管理团队成员。; 2、领导和制定项目计划并组织实施,把控项目进度、交付质量和成本核算满足公司要求,保证按期完成数据治理等项目的交付及回款; 3、负责与客户进行沟通协调,了解客户需求,全面负责数据治理等项目的咨询和规划及落地,领导团队为客户设计数据治理咨询方案和落地方案; 4、负责客户管理,深度把握客户需求,挖掘客户潜在需求,建立和巩固客户关系。
岗位职责(具体工作内容) 1.参与滴滴国际化数据体系建设 2.参与数据采集、ETL、建模、开发、分析等标准化搭建 3.参与数据体系化流程化治理 4.参与业务问题拆解、转化、沟通与解决赋能 任职资格(学历、目标院校、语言、技能、性格等要求) 1.了解大数据生态/数据开发/分析/产品优先,包括但不限于Hadoop、Spark、Flink、StarRocks 2.熟悉Java/Python/shell任意一门编程语言,熟练使用SQL、Excel等常用办公工具 3.具备快速学习能力、逻辑思维能力和团队精神,有较强的责任心和学习积极性 4.每周实习>=4天,实习周期>=6个月,北京高校、可快速到岗、有…
1. 负责车辆控制系统方案设计,处理车辆运行产生的有价值数据。 2. 运用机器学习相关技术,对海量数据进行处理和分析,挖掘相关信息,建立模型,分析关键因素,优化相关产品。 3. 基于大数据平台,提取、处理业务数据,通过数据分析和数据挖掘,给出直观的结论及业务洞见。
SQL 数据仓库 Hadoop 后端与架构 通信 / 计算机 / IT
1、计算机相关专业,本科及以上学历,3年以上开发相关经验,数据oracle、DB2,有MPP数据库开发经验优先。 2、负责数据仓库ETL流程的优化及解决ETL相关技术问题、ETL流程监控,保障数据平台架构稳定性 3、按照数据仓库模型,业务数据集市模型进行数据开发等; 4、根据业务需要,协助开发看板报表、用户个性化报表等。 任职资格:
1、数据处理与分析 (1)利用华为云大数据平台工具(如Hadoop、Spark等)进行大规模数据的存储、处理和分析; (2)完成数据的采集、清洗、转换和加载(ETL)工作,确保数据质量与一致性; (3)熟练使用可视化工具,可根据业务需求,设计和开发高效的数据处理流程,支持实时和离线数据分析。 2、项目开发与交付 (1)参与基于华为云大数据平台和帆软BI的项目开发,负责需求分分析、技术选型、架构设计和代码实现,要求有接口开发能力; (2)与业务团队紧密合作,理解业务需求,提供数据支持和解决方案; (3)编写技术文档,包括项目设计文档、用户手册和运维手册,确保项目交付的完整性和可维护性。…
Linux 分布式 Java 数据 通信 / 计算机 / IT
工作职责 1. 参与大数据产品后台架构设计与研发。 2. 配合业务需求完成产品迭代、功能开发与维护。 3. 参与线上问题排查与分析,协助解决用户使用过程中的技术问题。
1. 系统架构设计与技术规划 - 负责自动驾驶数据闭环平台的整体架构设计,涵盖数据采集、传输、存储、预处理、标注、模型训练、仿真评测等核心模块的技术选型与方案制定 - 设计高可用、高扩展性的分布式系统架构,支持PB级海量数据处理及千亿级样本的高效管理与检索 - 制定平台技术演进路线,结合行业趋势(端到端模型、BEV感知、Occupancy网络等)优化架构设计,确保技术前沿性 - 面向未来机器人业务,规划跨域数据闭环技术路线,支撑多模态感知与决策系统的数据需求 2. 数据飞轮与自动化流水线建设 - 搭建云端数据飞轮基础设施,构建从数据采集、清洗、挖掘、标注到模型训练、部署的完整自动化闭环 - …
Python Linux Git 算法与AI 医疗器械 / 医药
1. 医疗数据平台开发与维护 · 参与医疗数据湖仓模块开发,使用Python/SQL处理DICOM影像、FHIR临床数据及病理切片数据; · 协助搭建数据ETL Pipeline,学习使用Airflow/DolphinScheduler进行工作流编排与监控; · 参与开发数据脱敏与合规处理工具,学习PHI去标识化技术(k-匿名、数据掩码)及医疗数据安全法规(HIPAA/《个人信息保护法》)。 2. 数据质量与标注工具支持 · 开发医疗数据预处理模块:影像格式转换(DICOM解析)、电子病历文本清洗与结构化(NER基础);…
Linux Python Java 数据 通信 / 计算机 / IT
岗位职责: 1. 负责离线计算基础组件&平台的开发和维护工作,保证系统的稳定、高效 2. 参与离线数据处理架构设计,提升数据开发效率和数据质量 工作内容: 1. 负责离线计算基础组件(Hadoop、Spark、Hive等)的优化和稳定性建设 2. 负责离线数据平台建设,提升数据开发、调度和运维效率 3. 解决离线数据处理中的性能瓶颈和稳定性问题
方向1——营销风控算法: 岗位职责 1、结合营销业务场景(如优惠券、补贴、活动奖励、游戏等),设计并实现针对虚假交易、批量注册、套现、团伙等异常行为的实时风控算法。 2、利用机器学习、深度学习及相关数据分析技术,对用户行为和交易数据进行实时监控与分析,识别可疑行为和潜在风险; 3、与业务、产品和风控团队紧密合作,定义并完善风控指标体系,持续跟进风险案例并制定对应策略; 4、设计并实现高效、稳定的风控数据处理流程,包括数据清洗、特征工程、模型训练及线上预测部署; 5、持续跟踪电商行业风险趋势及新技术发展,及时更新和升级风控算法与策略,提升整体防控能力。…
Java Scala Python 数据 通信 / 计算机 / IT
1.负责大数据需求开发工作,完成项目模块的交付。 2.负责对客户/公司内部等大数据需求方提供技术支持。 3.参与大数据平台的建设、运维以及性能调优
Python Java Git 测试与质量 AI / 大模型
岗位职责: · 负责数据平台(数据采集、离线/实时计算、数据服务、调度系统等)的功能测试、接口测试、集成测试与回归测试; · 设计数据质量校验方案,保障数据链路端到端的准确性、完整性、一致性(如对账、字段校验、血缘影响面分析); · 参与性能测试与稳定性测试,验证海量数据场景下平台的高并发与容错能力; · 跟踪缺陷生命周期,做好线上问题复盘与根因分析,推动质量问题闭环; · 推动 CI/CD 流水线中的质量卡点建设,提升平台发布效率与稳定性。 岗位要求: · 本科及以上学历,计算机相关专业,3 年及以上测试开发经验;…
1. 数据采集与集成,设计并实现数据采集方案; 2. 数据存储与管理,设计和优化数据存储架构,选择合适的数据库或数据仓库; 3. 数据处理与构建,开发和维护数据处理管道,支持批量处理或实时流处理;优化数据处理效率,解决数据延迟、冗余等问题,提升数据流转性能; 4. 数据质量与安全,建立数据质量监控机制,识别并修复数。
职位简介: 关键字:多模态湖仓、数据资产、数据治理与服务 如果说大模型是AI时代的“大脑”,那么数据就是它的“神经元”与“血液”。我们相信,模型效果的边界,由数据基建的上限决定。在这个岗位上,你不是简单的“查数工具人”,而是负责构建支撑千亿参数模型训练的自研数据基座。你将直面EB级数据的实时流转、清洗与配比难题,用极致的系统性能,缩短模型迭代的数据准备时间从“周”到“小时”。 工作职责: 1. 湖仓:设计AI场景的湖仓一体架构(Iceberg / Delta Lake / Hudi)处理 PB 级数据,主导多模态湖仓整体架构(结构化 + 非结构化 + 向量数据统一存储与访问);…
Java Hadoop Spark 后端与架构 芯片 / 半导体
岗位职责: 1.⾼性能jdk研发⼯作 2.JDK核⼼模块优化⼯作,如:基础库/JIT/GC等 3.Java经典应⽤场景的的性能分析和优化,如:经典benchmark(specjbb/specpower),⼤数据(Hadoop,Spark)等 任职要求: 1.计算机/电⼦/通讯相关专业 2.熟悉java常⽤性能分析⼯具和⼿段,如JFR/asyncprofile等 3.熟悉jdk各种常⽤基础库代码,如:string,treemap,hashmap等 4.了解JVM虚机核⼼组件及⼯作原理,如有相关优化经验更好,如C1/C2/GC等 5.具备编译相关基础知识,有相关实际项⽬经验更好 6.具备计算机体…
Linux 分布式 Java 数据 通信 / 计算机 / IT
工作职责 1. 负责大数据产品后台架构设计与研发。 2. 根据业务需求对产品进行迭代与维护。 3. 跟踪并解决用户使用产品过程中的疑难问题。
大模型 RAG Hadoop 安全与运维 通信 / 计算机 / IT
【岗位职责】 1. 持续洞察国内外AI与威胁情报前沿技术,制定未来3-5年AI-Native情报能力中台的技术发展路线图,探索情报生产、分析与分发的新范式。 2. 引入大模型、图关联等前沿AI算法,深度结合安全底层机理,大幅提升威胁检测的准确率,将误报率降至行业极低水平。 3. 基于海量数据深度挖掘高级威胁模式与关联关系,构建AI-情报生产数据飞轮,驱动AI模型的训练与迭代,以此孵化具有独特价值的新型情报检测引擎。 4. 建立行业领先的情报评测指标体系,构建端到端的技术反馈闭环,精准追溯能力短板,驱动内部技术架构进行系统性改进。…
1、担任数据治理、主数据、数据资产类项目的项目经理,能够独立承担大型主数据或数据治理项目,能够管理团队成员。; 2、领导和制定项目计划并组织实施,把控项目进度、交付质量和成本核算满足公司要求,保证按期完成数据治理等项目的交付及回款; 3、负责与客户进行沟通协调,了解客户需求,全面负责数据治理等项目的咨询和规划及落地,领导团队为客户设计数据治理咨询方案和落地方案; 4、负责客户管理,深度把握客户需求,挖掘客户潜在需求,建立和巩固客户关系。
Spark Hadoop Flink 后端与架构 芯片 / 半导体
岗位职责: 1. 深入掌握 Spark、 Hadoop、 Trino、 StarRocks、Flink 等大数据引擎。负责性能调优,精准定位性能瓶颈、故障卡点问题。 2. 熟练使用 TPCDS、 HiBench 等常用大数据Benchmark 工具,进行性能测试和多维度性能评估和优化(包括吞吐量、延迟、资源使用等等)。 3. 根据业务需求制定并实施基于Hygon 硬件平台的大数据引擎性能优化方案,包括内存、计算调度、向量化计算、IO 等方面的优化。 4. 跟踪大数据领域前沿技术与行业发展趋势,输出落地性技术方案支持公司发展。 5. 与团队共享技术经验,提高团队整体技术能力和工作效率。…
整体方向:在多国家、多语言、文化差异大、冷启动力度强的环境下,负责用户全生命周期(拉新-激活-留存-召回)的增长模型建设,以下条件满足其中之一即可 1. 负责海外新用户推荐算法的研发,包括召回/排序/策略等核心模块,提升新用户的消费规模和留存 2. 负责海外新用户广告投放算法,面向新用户精准触达,包括媒体事件回传优化、价值预估、素材优选、RTA流量优选 3. 负责海外用户消息PUSH与触达算法,优
1、负责从源系统到大数据平台的全量及增量数据同步方案设计与开发。 2、解决异构数据源的高并发、低延迟同步难题,确保数据的一致性与完整性。 3、针对小文件多、数据维度复杂等特点,优化同步策略,防止数据倾斜。 4、利用Shell/Python脚本编排复杂的任务,实现自动化运维、异常监控及告警机制。 5、对Spark/Hive SQL及Python脚本进行深度性能调优,解决大规模数据计算中的资源瓶颈。 6、沉淀通用的ETL组件与脚本库,提升团队开发效率。
MySQL PostgreSQL SQL 数据 通信 / 计算机 / IT
牵头数据分析类项目全流程研发工作。 1、对接业务端数据分析需求,牵头形成数据分析方案,组织数据源探查、脚本编写和执行、结果分析工作。 2、对接数据分析项目,基于大数据平台或报表工具开展报表类、接口类应用开发工作,负责研发过程管理。 3、对接数据分析项目,组织线上化应用的技术运维。
SQL MySQL Hadoop 后端与架构 通信 / 计算机 / IT
⼯作职责: 1. 负责大数据产品、分析型数据库产品、NoSQL 数据库相关技术方案系统架构设计 2. 基于客户需求与产品技术特性,抽象产品通用需求,设计有技术优势的产品系统架构 3. 推动产品技术架构在项目上的落地,并标准化产品技术方案,完善产品知识体系 4. 构建产品场景技术指标,完成技术⽅案验证、产品能⼒验证及性能优化⼯作 岗位要求: 1. 本科以上计算机或相关专业学历 2. 熟练使⽤SQL语⾔及调优,掌握⾄少⼀种数据库(RDBMS/MPP)系统的使⽤,如Oracle/DB2/MySQL等 3. 熟悉主流⼤数据技术,熟悉大数据技术原理,有Hadoop、HBase、Hive、Spark、K…
SQL 数据仓库 Hadoop 后端与架构 通信 / 计算机 / IT
1、计算机相关专业,本科及以上学历,3年以上开发相关经验,数据oracle、DB2,有MPP数据库开发经验优先。 2、负责数据仓库ETL流程的优化及解决ETL相关技术问题、ETL流程监控,保障数据平台架构稳定性 3、按照数据仓库模型,业务数据集市模型进行数据开发等; 4、根据业务需要,协助开发看板报表、用户个性化报表等。 任职资格:
SQL 数据仓库 Hadoop 后端与架构 通信 / 计算机 / IT
1、计算机相关专业,本科及以上学历,3年以上开发相关经验,数据oracle、DB2,有MPP数据库开发经验优先。 2、负责数据仓库ETL流程的优化及解决ETL相关技术问题、ETL流程监控,保障数据平台架构稳定性 3、按照数据仓库模型,业务数据集市模型进行数据开发等; 4、根据业务需要,协助开发看板报表、用户个性化报表等。 任职资格:
特斯拉 上海 AI与数据分析 AI& Data Analytics
The Role We're looking for a Data Engineer to join our Data Engineering team and play a pivotal role in shaping how Tesla leverages data across its Sales, Delivery, and Service lifecycle. You'll design, build, and scale our Enterprise Data Warehouse and AI/BI-powered intelligent solutions — directl…
数据治理 机器学习 深度学习 数据 通信 / 计算机 / IT
(一)数据治理体系搭建与战略规划 1.主导制定事业部 AI 数据治理中长期战略与技术路线,结合业务场景(如政府审计、企业监管、智能决策等)明确数据治理目标、范围与优先级,对齐公司 AI 产品发展规划。 2.建立并迭代 事业部AI 数据治理标准体系,包括数据分类分级标准、元数据管理规范、数据质量评价体系、标注规范(如 NLP 文本标注、CV 图像标注、语音转写标注)、数据安全与合规准则,覆盖结构化、非结构化(文本、图像、语音)、半结构化及 AI 生成数据。 3.设计 AI 数据治理架构,参与数据治理工具链(如数据清洗工具、标注工具、质量监测工具、数据血缘分析工具)的规划与落地,推动治理流程自动…
岗位要求: 1.重点本科以上学历,计算机、电子、通信相关专业; 2.熟悉Linux操作系统原理,网络基础知识扎实; 3.熟悉至少一门开发语言,如Shell/Python/Java/Golang/C++等,有开发经验; 4.学习能力强,优秀的分析和解决问题能力; 加分项: 1.精通Linux操作系统; 2.熟悉Hadoop、Kafka、ELK等大数据生态组件,或擅长其中一项; 3.了解服务器硬件相关知识; 职位描述 1.负责大规模分布式系统可靠、稳定、高效运行; 2.制订和优化运维解决方案,包括但不限于弹性扩容、故障自愈、性能调优和防攻击等;…
1. 负责公司业务数据的ETL工作,完成数据抽取、清洗、加工、转换与加载,保障数据质量与数据时效性 2. 负责数据报表开发、数据模型构建,支撑业务数据分析、数据可视化与业务决策需求 3. 负责数据相关的API开发与维护,对接业务系统与前端应用,保障数据接口的稳定与高效 4. 参与AI场景应用的落地工作,实现数据预处理、模型应用与相关功能开发 5. 负责大数据平台的日常维护与优化,跟进大数据领域新技术,推动数据技术在业务场景的落地应用 6. 配合业务部门完成数据需求调研、数据分析与技术支持,解决数据相关的技术问题 7. 负责数据相关文档的编写与维护,保障数据流程的可追溯性与可维护性 8. 参与…
大模型 多模态 RAG 算法与AI 通信 / 计算机 / IT
1.负责Data Agent设计开发,包括智能数据治理、智能数据分析等,主导Data Agent在实际业务场景中的技术落地与优化,实现Agent对数据和业务的深度准确分析理解; 2.工程化落地大模型智能应用形态,独立负责AI应用从0到1的端到端开发交付,前端交互页面、后端服务、AI 能力集成三层全栈闭环,研发交付真正可用、可上线的产品; 3.参与数据仓库、业务知识库、本体和知识图谱等构建,以及大模型和AI应用部署; 4.跟进大模型人工智能等前沿技术演进,主导技术选型评估; 负责完成上级交办的其他产品研发规划和研发预研工作。
Java Python Spark 算法与AI AI / 大模型
1、负责推荐算法的研究、从零开发和优化,为业务提供高效、准确、个性化的推荐策略和解决方案; 2、根据海量数据和业务需求进行数据预处理、特征提取和数据挖掘,构建数据模型并对其进行评估和优化,保证算法质量和效果; 3、负责推荐系统的架构设计、开发和维护,包括用户画像、物品标签、数据存储和检索等模块,实现系统的高可用性和扩展性; 4、与业务部门紧密合作,深度挖掘用户需求,为产品和服务提供数据支持和决策依据,推动业务的发展和增长; 5、跟踪和学习行业前沿技术,持续提升自身技能水平,为团队和公司带来更多的价值和创新思路。
职位简介: 关键字:多模态湖仓、数据资产、数据治理与服务 如果说大模型是AI时代的“大脑”,那么数据就是它的“神经元”与“血液”。我们相信,模型效果的边界,由数据基建的上限决定。在这个岗位上,你不是简单的“查数工具人”,而是负责构建支撑千亿参数模型训练的自研数据基座。你将直面EB级数据的实时流转、清洗与配比难题,用极致的系统性能,缩短模型迭代的数据准备时间从“周”到“小时”。 工作职责: 1. 湖仓:设计AI场景的湖仓一体架构(Iceberg / Delta Lake / Hudi)处理 PB 级数据,主导多模态湖仓整体架构(结构化 + 非结构化 + 向量数据统一存储与访问);…
Java Scala Python 数据 通信 / 计算机 / IT
1.负责大数据需求开发工作,完成项目模块的交付。 2.负责对客户/公司内部等大数据需求方提供技术支持。 3.参与大数据平台的建设、运维以及性能调优。
Java MyBatis Hadoop 数据 通信 / 计算机 / IT
1. 负责统一数据服务平台(OneService)的架构设计、研发与持续优化,构建公司级标准、高效、智能的数据消费入口,支持自然语言查询、报告生成等多种数据访问方式; 2. 规划并建设指标管理体系,包括指标定义、血缘、版本、生命周期等模块,打造规范化、工具化的指标生产与管理流程,保障口径一致与结果准确; 3. 持续提升平台的数据服务能力,支持 BI 报表、自助分析、API 调用、运营活动等多样化消费场景,推动数据在经营分析、运营决策中的智能化落地; 4. 探索并集成大语言模型(LLM)与语义建模能力,提升用户通过自然语言与数据交互的体验与效率,降低数据使用门槛;…
岗位职责: 负责数据仓库中某个业务条线的业务需求分析,模型设计等;
SQL MySQL Hadoop 安全与运维 通信 / 计算机 / IT
1.处理生产工单。 2.系统巡检及监控生产状态。 3.周末及节假日值班。 4.编写运维文档。 5.负责相关系统的升级及维护工作。 6.故障处理与恢复。
SQL MySQL Hadoop 安全与运维 通信 / 计算机 / IT
1.处理生产工单。 2.系统巡检及监控生产状态。 3.周末及节假日值班。 4.编写运维文档。 5.负责相关系统的升级及维护工作。 6.故障处理与恢复。
Hadoop Spark Flink 数据 芯片 / 半导体
1. 负责公司PB级自动驾驶全域数据平台的架构设计、规划与迭代,支撑多模态数据的实时/离线处理、AI训练与仿真验证。 2. 主导数据湖仓、车云一体平台的架构选型与技术落地,保障平台高可用、高性能与高稳定,驱动自动驾驶算法持续迭代。 3. 构建并推动数据治理、安全合规、资源优化体系,提升数据质量、处理效率与资源利用率,支撑模型泛化与系统验证。 4. 指导团队攻克数据处理、存储、调度等技术瓶颈,把控平台研发进度与架构风险,协同算法、车端等团队推进复杂项目落地。
• Support the development of data governance standards and contribute to building a data quality control platform based on Brunei’s data landscape. • Plan and drive the development of data engineering solutions that solutions balance functionality, and non-functional requirements. • Support the des…