阿里巴巴(通义千问)
阿里巴巴通义实验室于2022年成立,由阿里云CTO周靖人主导,推出Qwen系列大模型。Qwen已开源300+模型、累计下载超6亿次,覆盖0.5B至480B全尺寸,是国内开源活跃度最高的大模型之一。
阿里云智能-多模态大模型算法工程师/专家-模型训练与应用-杭州/北京
1. 计算机科学、软件工程、人工智能、数学等相关专业硕士及以上学历,具备扎实的机器学习与深度学习基础,以及较强的问题分析、定义和解决能力。 2. 具备语音、视频或其他多模态模型的项目经验,熟悉 ASR、TTS、Omni、视频生成等一个或多个方向,并有实际系统落地经历。 3. 熟悉大模型后训练与对齐技术,包括监督微调、偏好优化、强化学习、持续学习等,能够结合实际问题设计并验证模型优化方案。 4. 具备数据构建、模型训练和效果评测的完整实践经验,能够基于评测结果定位问题,并通过数据、模型或策略优化持续提升系统效果。 5. 持续关注人工智能领域的前沿进展,对技术创新有热情,具备探索复杂问题、推动技术突破和应对挑战的自驱力。 6. 具备良好的工程实现、实验分析和跨团队协作能力,能够推动算法方案从原型验证走向稳定交付。 加分项 1. 具备复杂业务场景下端到端落地经验,能够独立或主导完成需求分析、方案设计、模型优化、系统部署及效果验证。 2. 具备商业化项目交付经验,能够准确理解客户需求、识别核心业务痛点,并将真实场景转化为可执行、可验证的技术方案。 3. 在 NeurIPS、ICLR、ICML、ACL、CVPR、INTERSPEECH 等人工智能领域会议或期刊发表过高质量论文者优先。
阿里云智能-大模型智能算法专家-杭州/北京
1、计算机科学、软件工程、数学、统计学等相关专业,硕士及以上学历 2、具备独立的从业务需求到算法工程转化和落地能力,在自然语言理解NLU/自然语言生成NLG、对话机器人、搜索推荐、知识图谱等一个或多个领域有大规模场景落地经验 3、在大模型LLM相关技术方向有实战经验者优先,比如LLM训练和优化、Agent/Multi-Agent的研发和建设、大模型推理以及大模型评估等一个或多个方向有实际经验 3、熟悉掌握Python/Java/C++中至少一门语言,有大型系统的算法模型开发和优化经验,熟练掌握至少一种深度学习框架(PyTorch、TensorFlow、Caffe等) 4、有会议、期刊上发表学术论文,有相关算法比赛(Kaggle等)获奖经验的同学优先
实习经历
30亿红包换流量,技术负责人离职,千问的商业迷思与变现焦虑
公开信息显示,林俊旸出生于1993年,本科毕业于北京大学北京大学计算机科学与技术专业,硕士阶段则转而攻读语言学与应用语言学,研究领域涵盖自然语言处理与多模态表示学习。