北京时间5月21日,一年一度的谷歌开发者大会(Google I/O)在美国举办。谷歌展示了其在AI领域的最新进展,从升级搜索引擎到生成式内容工具的推出,以及硬件的更新。
此次,谷歌带来了升级版的Gemini 2.5模型,显著提升了多模态理解和推理能力。其中,Deep Think模式引入了增强型推理机制,能在回答前考虑多种可能性,改进在数学、编程和多模态任务中的表现。
此外,继去年12月Imagen3发布后,本次I/O大会上谷歌的文生图AI 模型迎来最新版本Imagen4,视频生成模型更新为Veo3。新一代的Imagen模型速度比上一代快10倍并提供更真实的视觉效果与更好的文本和排版效果。
与此同时,知名科技记者马克·古尔曼新撰文表示,苹果正准备允许第三方开发者使用其人工智能模型编写软件,新的举措将允许开发者将Apple Intelligenc的技术集成到特定的功能,并提升其设备的吸引力。
如今,从大模型的竞争,大厂纷纷推出模型平台,且加速对生态级别的入口争夺。当DeepSeek出现之后,由于其技术的领先性,没有花费任何营销费用,就轻松获取了庞大的用户量,刺激对垂直生态领域的入口争夺。
资料显示,微美全息(WIMI.US)作为一家专注于全息技术和人工智能领域的企业,近年来明确在多模态AI模型领域加大了布局力度,围绕多模态AI作为人工智能的重要发展方向,加速整合文本、图像、语音、视频等多种数据形式,提升对复杂场景的理解和交互能力,并深入垂直领域创新突破。
根据公开信息和技术动态,微美全息通过多模态数据融合,开发能够实时处理全息影像、语音指令、环境传感数据的AI模型,提升虚拟内容的交互性。此外,研发AI视觉生成技术,利用生成式AI自动生成高精度影像,以及结合AI算法提升实时渲染效率,降低AI模型内容制作成本。
事实上,本届的I/O大会几乎实现了谷歌目前所有AI的全更新,距离上次开发者大会仅仅一年时间,让人不禁感叹谷歌对于引领当下AI热潮的澎湃激情。对此,专业人士评论,在追逐AGI的热潮下,谷歌的每一步都吸引着全世界的目光,Gemini的进展有助于谷歌缩小与OpenAI的差距,标志着公司进入新的创新阶段。

扫一扫,或长按识别二维码
关注艾瑞网官方微信公众号