模型|中科院自动化所发布通用AI平台 可实现图文音“无缝转换”
新华社北京7月12日电(采访人员董瑞丰)从检索图像、描述视频 , 到吟诗作赋、续写文章 , 再到识别语音、双语翻译 , 虚拟人“小初”日前亮相2021世界人工智能大会 , 展示了图、文、音三种模态的智能转换和生成 。
【模型|中科院自动化所发布通用AI平台 可实现图文音“无缝转换”】“小初”具备这样的能力 , 得益于一个名为“紫东太初”的跨模态通用人工智能平台 。 该平台由中国科学院自动化研究所研发 , 基于国产化基础软硬件 , 仅采用一个大模型 , 即可“锻炼”人工智能在视觉、文本、语音多个场景的理解能力 。
中科院自动化所所长徐波介绍 , “大数据+大模型+多模态”将改变当前单一模型对应单一任务的人工智能研发范式 , 多模态大模型将成为不同领域的共性平台技术 , 是迈向通用人工智能的重要路径探索 。
“‘紫东太初’实现了图、文、音三种模态的统一表达 , 以图生音 , 以音生图 , 将开拓AI在视频配音、语音播报、标题摘要、海报创作等更多元场景的应用 。 ”徐波说 。
据了解 , 中科院自动化所构建了中文预训练模型、语音预训练模型、视觉预训练模型 , 并通过跨模态语义关联 , 构建了三模态预训练大模型 。 (完)
- 从几个月到几分钟,NLP模型运行效率暴涨,小公司也能玩大模型
- 腾讯文档|从事展览3d模型设计,你需要具备那些能力?---模大狮网
- 英伟达|NVIDIA Triton 推理引擎公开课上新:基于多实例 GPU 和 K8s 的大规模 CV 模型部署实践
- 肠道菌群|肠道菌群又有新“用途”:建立非酒精性脂肪肝发病预警模型
- iPhone14|中科院:招博士后,研发7nm芯片技术
- aiXcoder XL智能编程大模型发布:自然语言一键生成方法级代码
- AI自己写代码让智能体进化!OpenAI的大模型有“人类思想”那味了
- 中科院南海所林间特聘研究员当选欧洲科学院院士
- 字节跳动 AI Lab 提出多模态模型:X-VLM,学习视觉和语言多粒度对齐
- 电子商务|虚拟化身动作不协调?Meta开源肌肉骨骼动力学模型MyoSuite
