阿里巴巴M6
阿里达摩院万亿大模型
官网: 立即访问
所属分类: AI训练模型
工具介绍
阿里巴巴M6具体信息
阿里巴巴M6是阿里巴巴达摩院研发的超大规模中文多模态预训练模型,英文全称Multi-Modality-to-Multi-Modality Multitask Mega-transformer,简称M6。它以统一框架同时支持文本、图像等多模态信息的理解与生成,定位为面向通用人工智能的“基础模型”。M6参数规模从百亿、千亿、万亿一路跃迁至10万亿,成为全球最大的AI预训练模型。与传统AI相比,它具备更强的认知与创造能力,尤其擅长设计、写作与问答,在电商、制造、文艺、科研等领域应用前景广阔。
阿里巴巴M6的主要功能包括:1. 文本理解与生成:支持问答、写作与文案创作,如为天猫虚拟主播创作直播剧本;2. 文生图:将文字描述转化为高清图片,清晰度达1024×1024,可设计服饰、商品等;3. 图生文:为商品图片自动生成精准丰富的描述文案;4. 跨模态搜索:建立文本与图片的匹配能力,提升淘宝、支付宝等平台的搜索与内容认知精度;5. 智能设计:作为AI助理设计师服务于犀牛智造,结合潮流趋势快速完成服装设计并模拟试穿效果。目前M6已在超40个场景落地,日调用量上亿次。
阿里巴巴M6的使用方式便捷,主要有三种:一是通过M6服务化平台(m6.aliyun.com)在线调用,平台提供完备工具,让大模型“开箱即用”,算法人员与普通用户均可直接使用;二是通过ModelScope等开源社区加载M6系列模型,编写少量代码即可完成推理与微调;三是面向企业,可在阿里云机器学习平台PAI上,结合Whale分布式训练框架对M6进行再训练、精调与部署。整体上,注册账号、选择模型并发起调用,几分钟内即可完成。
阿里巴巴M6的核心优势有四:其一,超大规模,参数达10万亿,远超同期谷歌、微软的万亿级模型,能力更强;其二,多模态多任务,以统一框架处理文本与图像的理解、生成,“一专多能”;其三,低碳高效,首创MoE专家并行、CPU offload、共享解除等创新技术,仅用512张GPU、10天即训练出10万亿模型,同等参数规模下能耗仅为GPT-3的1%;其四,商业落地成熟,作为国内首个商业化多模态大模型,已在电商、制造等40多个场景稳定运行,形成完整产业闭环。
与同类大模型相比,阿里巴巴M6特点鲜明:对标GPT-3,M6同为超大规模预训练模型,但更强调多模态能力,同等参数规模下能耗仅为GPT-3的1%;对标OpenAI DALL·E,M6将图像生成清晰度从256×256提升至1024×1024,更贴近工业化应用;对标英伟达、谷歌的万亿模型(分别需3072张A100、2048张TPU),M6仅用480张V100完成训练,能耗降低超八成、效率提升近11倍。此外,M6依托电商生态与海量中文语料,在中文理解、跨模态搜索、智能设计等本土化场景上优势明显。
问:阿里巴巴M6是开源的吗?答:部分模型已通过ModelScope等社区开源,同时提供服务化平台供在线调用。问:使用M6需要自备超算集群吗?答:不需要,通过服务化平台按需调用即可,普通用户无需自行训练大模型。问:M6支持哪些输入输出?答:支持文本与图像,可完成文生文、文生图、图生文及跨模态检索等任务。问:M6与ChatGPT有何区别?答:M6是面向多模态理解与生成的通用预训练模型,侧重设计、搜索、写作等工业场景;ChatGPT则聚焦对话式文本生成。问:M6在电商中有哪些应用?答:已应用于商品文案生成、服饰智能设计、跨模态搜索及虚拟主播剧本创作等场景。
阿里巴巴M6数据分析
数据更新于 2026-08-01,每月更新一次,预计15号之前完成更新,数据仅统计主域名:aliyun.com。
总访问量
26,230,000
环比变化
-5.22%
平均停留
00:09:10
跳出率
23.65%
- 直接访问 65.13%
- 搜索引擎 24.22%
- 展示广告 0.22%
- 引荐流量 8.13%
- 社交媒体 1.40%
- 邮件 0.31%
- 其他 0.59%
- China 84.87%
- Hong Kong 4.55%
- United States 2.85%
- Singapore 1.64%
- Taiwan 1.11%