获悉,SemiAnalysis全新硬核爆料,OpenAI正在训练一个规模介于GPT-4.1和GPT-4.5之间的新模型,而下一代推理模型o4将基于GPT-4.1展开RL训练强化学习。

此前,OpenAI一直在GPT-4o的基础上为o1和o3模型进行RL训练,可以说,o4标志着OpenAI策略的转变,核心原因就在于,他们更换了训练所用的基础模型,非常有望成为OpenAI在推理领域的下一款重磅产品。

在硬科技投资浪潮下,AI与大模型赛道正经历从底层技术突破到应用落地的关键转折期。并且,以ChatGPT为代表的语言类大模型重塑内容生成方式时,多模态模型还在等待它的“iPhone时刻”。
行业方面,市场上新旧产品同台竞技,呈现出立体、多维度的思考,加上随着国内大模型持续迭代与升级,叠加国内GPU供应问题逐步缓解、政策牵引等,全球大模型将经历更长的技术沉淀期,这也意味着更大的想象力空间。

据外媒报道,日前,谷歌为其AI助手Gemini推出全新“计划操作”功能,进一步强化AI在任务管理领域的实用性。该功能允许用户通过文字或语音指令设定Gemini在指定时间自动完成特定任务,并支持重复执行,标志着AI助手从被动响应向主动规划的跨越。
前不久,微软宣布将马斯克旗下人工智能公司 xAI 开发的 Grok 3 和 Grok 3 Mini 模型引入其 Azure AI Foundry 平台。这一举措标志着微软在 AI 基础设施领域的进一步拓展,也可能加剧其与长期合作伙伴 OpenAI 之间的紧张关系。

据了解,微美全息近年来在大模型布局上展现出多维度的战略规划和技术突破,其AI团队通过多次扩展,已经覆盖视觉、语言、语音、知识图谱、机器学习、多模态理解与生成等核心技术攻关,并逐步接入5G、自动驾驶、AIoT、机器人等业务板块全链条能力。
当前,微美全息开发支持文本生成视频、图像生成视频的跨模态内容创作工具,例如通过图生视频技术实现低门槛创作,并适配开源工具链。同时其与接入DeepSeek等通用大模型,构建垂类开源AI生态体系,进一步加速模型在金融、教育、汽车等行业的商业化验证。
事实上,根据中研普华产业研究院的数据,预计到2025年,全球多模态大模型市场规模将达到1280亿美元,2023—2025年复合增长率高达62.3%。大模型正在从大语言模型向原生多模态大模型、世界模型的方向演进,虽有诸多挑战,但大模型与硬件结合,AI的未来仍是一片星辰大海。

扫一扫,或长按识别二维码
关注艾瑞网官方微信公众号