AI“百模大战”风向变了?360、美图先后出招 视觉大模型上演“神仙打架” 天天快报
2023-06-22 14:43:38 来源:华夏时报
随着AI大模型研发应用热潮持续高涨,记者注意到,赛道内的玩家开始将重心从语言大模型转向视觉大模型。近期,Adobe、Meta、360、美图等多家国内外互联网头部企业纷纷发表大模型成果,为本就火热异常的AI市场再添了一把火。
“人工智能在视频领域的应用越来越受到重视。”中国通信工业协会两化融合委员会副会长吴高斌向《华夏时报》记者表示,这些大型AI模型的发布为企业间的竞争带来了新的动力。企业之间的竞争将促进技术创新和进步,同时也将带来更好的产品和服务。竞争还将促进企业间的合作和共享资源,从而更好地满足市场需求。
海内外视觉大模型“神仙打架”
(资料图)
在鳞次栉比的语言大模型、多模态大模型纷纷涌现之后,“视觉大模型”成为又一个兵家必争之地。日前,美图发布AI视觉大模型MiracleVision,一同发布的还有AI视觉创作工具WHEE、AI数字人生成工具DreamAvatar、美图AI助手RoboNeo等7款产品。
据介绍,MiracleVision具有强大的视觉表现力和创作力,能从绘画、设计、影视、摄影、游戏、3D、动漫等视觉创作场景反推技术演化。与市面上其他大模型不同,它尤其擅长亚洲人像摄影、国风国潮、商业设计等生成方向。
美图公司创始人、董事长兼首席执行官吴欣鸿在接受《华夏时报》记者采访时表示:“美图大模型的核心优势是‘懂美学’,C端用户基础足够大,大模型冷启动的获客成本低,美图目前有2.43亿的月活用户,全球VIP会员数为719万,能在短时间去验证产品成功与否。不同于其他厂商,美图大模型聚焦于美学(画面画质设计等),未来如果非要竞争,会在美学上面去‘卷’。”
无独有偶,360也日前正式发布“360智脑-视觉大模型”。 360创始人周鸿祎表示,大语言模型是构建视觉大模型的基础,多模态能力增强的核心是借助了大语言模型的认知、推理、决策能力。同时,视觉大模型也是“360智脑”的重要能力组成,能够看懂图片,未来还能看懂视频、听懂声音。
海外企业也已经开始在视觉大模型上布局。日前,社交媒体巨头Meta宣布,将向研究人员开放一个名为I-JEPA的“类人”人工智能模型的部分组件,该模型可以比现有模型更准确地分析和完成未完成的图像,而不是像其他生成式人工智能模型那样,只根据附近的像素进行推断。
Meta公司首席人工智能科学家杨立昆曾公开指出,当前的GPT自回归模型存在缺乏规划、推理的能力,未来GPT系统或将被抛弃,并给出了他认为的正确答案——世界模型。据称I-JEPA是第一个基于其愿景关键组成部分的AI模型,能比现有模型更准确地分析和完成未完成的图像。
除此之外,Meta还发布了语音生成AI模型“Voicebox”,支持从文本中生成语音,能够根据仅两秒长的样本匹配音频风格,并将文本样本转换为另一种语言,在给定单独的语音样本的情况下,并能够以说话者的原始语音朗读翻译后的文本内容,目前支持六种语言:英语、法语、德语、西班牙语、波兰语和葡萄牙语。
而早在今年4月,Adobe便将其Adobe Firefly功能(类ChatGPT产品)集成在Premiere Pro、After Effects、Audition、Remix等音视频产品矩阵中,为用户提供一键生成内容、剪辑、调色、更换音乐等功能。
从“语言大模型”到“视觉大模型”
《中国人工智能大模型地图研究报告》显示,从全球已发布的大模型数量及分布来看,中国和美国大幅领先,超过全球总数的80%。同时,欧洲、俄罗斯、以色列等越来越多的研发团队也在投入大模型研发。但值得注意的是,我国在计算机视觉等领域的大模型还较少。
究其原因,北京智源研究院访问首席科学家颜水成向《华夏时报》记者表示:“现在视觉模型发展稍微滞后的主要原因,是因为视觉大模型吃算力吃得比文本要大很多,所以我们也期待芯片更快速的发展,甚至有可能把非GPU其他的芯片融合在一起来做。现在大家见到的模型一般千卡级比较常见,但可能明年就有人会用万卡级来做。”
而在北京智源人工智能研究院院长黄铁军看来,视觉领域是大模型领域下一个浪潮的重点。他指出,视觉大模型和语言大模型背后的思想方法和基本路线是异曲同工的,只是输入的数据变成了图像和视频,训练出来的模型则具有一定的通用视觉语言能力,一种是之前提到的AIGC(人工智能自动生成内容),可以生成图像和艺术品,“还有一种更基本的能力,就是看到世界之后,得首先能把这个世界(万物)分清。”
对于视觉大模型的发展,不少机构也表达出看好的态度。中金研究发布的研报认为,计算机视觉未来有望实现更高程度的自动化、高精度和低功耗,进一步丰富元宇宙的内容生态,降低进入门槛。计算机视觉的进步引领了三维重建和动捕技术快速成熟,并逐渐在各自的领域积累技术进步。计算机视觉未来有望迎来更高程度的自动化、更高的精度,以及更低的功耗,逐渐在移动端实现更好的视觉效果,被应用在大量下游行业,逐渐迈向连接物理世界和数字世界的长期愿景。
中信证券研究也表示,在设计领域,大模型引领数字设计走向智能设计,相关工业设计软件结合GPT等技术,可应用在设计规划、布局优化、插件助手、草图绘制等场景,工业设计软件有望在AI升级的大趋势下迎来新一轮生产力革命。
(文章来源:华夏时报)
关键词:
[责任编辑:]
相关阅读
- (2023-06-22)AI“百模大战”风向变了?360、美图先后出招 视觉大模型上演“神仙打架” 天天快报
- (2023-06-22)焦点!10月是什么星座_10月5号是什么星座
- (2023-06-22)全球快消息!当虹科技(688039.SH):大连虹途拟减持不超2.9045%股份
- (2023-06-22)前沿热点:高温天气持续 河北省启动重大气象灾害高温Ⅳ级应急响应
- (2023-06-22)岱庙市场监管所组织召开茶叶过度包装行业培训暨约谈会
- (2023-06-22)公司经营地址变更的资料及流程图_公司经营地址变更的资料及流程 焦点速看
- (2023-06-22)短讯!格但斯克是哪个国家_格但斯克
- (2023-06-22)天天消息!月经是什么原理_月经是什么
- (2023-06-22)当前焦点!一起来看流星雨百度云链接-一起来看流星雨百度云
- (2023-06-22)赣南医学院、九江学院主要负责同志调整 热消息
- (2023-06-22)中信银行成都分行开展“守住钱袋子·护好 幸福家”金融知识万里行主题快闪活动
- (2023-06-22)快消息!“6·21国际乐器演奏日”中国主会场活动在泰州黄桥举行
- (2023-06-22)汝河路街道被授予“河南省双拥共建示范单位”
- (2023-06-22)北海市三个“全区首创”打造开放包容国际人才高地-全球视讯
- (2023-06-22)贵州大学茶学院:创新宣教载体 推动以学促干
- (2023-06-22)一起泼水狂欢吧 第23届洛带客家水龙季开幕
- (2023-06-22)世界时讯:粤港湘海关“跨境一锁”快速通关成功开通
- (2023-06-22)劲拓股份:截至本公告日,吴限先生持有公司股份约7973万股 环球新消息
- (2023-06-22)海象新材:公司股东鲁国强减持计划实施完毕,期间减持公司股份约97万股_当前动态
- (2023-06-22)夏至前的田野
- (2023-06-22)广东、山东省养老金补发开始,2023年退休职工能一次性补发1700元吗?
- (2023-06-22)环球热推荐:乌军反攻进展艰难,美国或暗中对俄政坛下手,俄外长曝光重要消息
- (2023-06-22)养老金调整方案(最新)2023年公布了吗?1954年出生,养老金能多涨200元吗?|每日资讯
- (2023-06-22)韩国第一夫人又出访越南啦!穿紫裙亮相太风光,罕见换风格很惊艳-当前热文
- (2023-06-22)全球快资讯:端午假期第一天 成都周边高速部分路段车多缓行
- (2023-06-22)世界观热点:本世纪末或消失80%?喜马拉雅冰川正加速融化
- (2023-06-22)环球最新:lumene极地面霜_lumene
- (2023-06-22)环球快消息!央行:要加强金融监管、纪检监察与审计监督的贯通协同
- (2023-06-22)天房发展:副总经理满峄峰因个人原因辞职
- (2023-06-22)保德县张洁简介_张洁简介