11月19日,蚂蚁数科在在2024年世界互联网大会乌镇峰会上正式发布AI数据合成与生产平台AIGD,可通过大规模合成互联网所不覆盖的高质量、高价值垂直语料数据,帮助科技厂商进行 AI 模型训练。

“未来的AI应用需要大量稀缺且难以获取的长尾数据,如自动驾驶中的极端天气与极端路况数据,具身智能训练所需要的复杂场景数据。在此背景下,数据合成成为关键。”蚂蚁数科AI科技技术负责人、蚂蚁天玑实验室主任李哲介绍。

AIGD具备 PB 级数据生产能力,支持数据从生成到训练全流程自动化处理,自动化率80%。此外,平台自研15余种数据合成工具,目前可以合成图片、视频、3D模型、多模态图文视频对、多轮对话、语音信号、心率脑电信号、结构化交易数据等多模态数据,以满足多种应用场景下的 AI 模型训练需求。