“AI教母”发布全新世界模型,AI再迎里程碑产品! 9月2日,有着“AI教母”美誉的斯坦福大学教授李飞飞带领初创公司World Labs,重磅发布全球首个多模态世界模型Atlas。Atlas是从零完成预训练的全模态世界模型(Omni World Model),可以处理文本、图片、视频、3D深度等各类信息。Atlas采用了多模态自回归扩散 Transformer架构,可以高保真生成、模拟物理世界,具备相机控制生成、空间重建、时空模拟、图像生成等四大能力。 同一时间,谷歌推出两款新模型Gemini 3.8 Flash及Flash Cyber,在智能体工作流及长周期编程方面取得重要进展。谷歌三周前刚刚发布Gemini 3.7 Flash模型,公司加速推动大模型发展。 展望未来,随着大模型技术不断进步、Token成本持续回落,AI下游应用场景有望加速扩展。 1、李飞飞打造首个多模态世界模型,谷歌火速发布Gemini 3.8 Flash 近一段时间,全球科技巨头加速推动大模型发展,竞争日趋激烈。然而,作为前沿领域世界模型,仍有较大进步空间。 斯坦福大学教授李飞飞联合创立的AI公司World Labs,深耕于世界模型领域,公司目标是打造可以生成、重建、模拟任何形式世界的AI大模型,此类模型可以深度理解真实世界逻辑及严谨趋势,还可以帮助机器人规划行动。 9月2日,World Labs发布了新一代多模态世界模型Atlas,采用了多模态自回归扩散 Transformer架构,所有输入的信息都可以被组合进一个空间上下文中,并可以使用相关信息来生成接下来出现的内容,并可以实现3D一致性。 Atlas可以完成如下核心任务: ①相机控制生成(Camera-Controlled Generation) 所谓的相机控制生成,就是输入相机外部参数与内部参数,大模型就可以生成符合物理世界逻辑的视频,甚至可以达成电影级别的运镜。 Atlas可以根据一张或多张图像生成图像或视频,视频长度可达1分钟,分辨率达到1440P。 ②空间重建 Atlas可以根据输入的图像信息来重新构建真实的世界场景,性能已经超越专用于3D重建的先进模型。 ③时空模拟 Atlas根据输入的视频来重新对空间、时间建模,帮助机器人实现“真实世界到仿真工作流”。 ④图像生成 Atlas可以实现文生图像及360度全景图,能够处理复杂的提示词、渲染文本,进而生成多样视觉风格的图像。 与LLM类似,Atlas将多模态信息编入上下文中。与文本上下文不同,Atlas构建的空间上下文(Spatial Context),可以将每张图像锚定在3D空间位置中。有了空间上下文,Atlas就可以帮助用户实现全新的创意控制,比如仅靠两张不相关的图像及其空间上下文便能生成一个模拟世界。 除了Atlas世界模型,谷歌的Gemini 3.8大模型也成为焦点。谷歌三周前刚刚发布Gemini 3.7 Flash,此次快速推出两款新模型Gemini 3.8 Flash及Flash Cyber,标志着谷歌在加速推出新产品。 谷歌认为,Gemini 3.8大模型是现在最强的推理、编程大模型,可以长时间运行智能体来完成复杂的工作。根据Artificial Analysis的独立测评结果,Gemini 3.8智能指数达到59分,输出速度可以达到305 Token/秒。 2、国产开源模型带来Token成本下降,AI应用成行业热点 根据Silicon Data编制的LLM Token支出指数,大模型Token平均支付成本本周初跌破1美元,较今年5月下跌超50%。 LLM Token支出指数回落原因较为复杂,算力芯片性能提升促进Token成本下降,同时国产开源大模型也促进成本下降。 8月底,智谱上线并开源GLM-5.3-Flash(320B-A18B),该模型即为业界热议的匿名模型Ox-Alpha,参数高达3200亿,激活参数180亿。GLM-5.3-Flash能力已经超越GLM-5.2,综合智能指数高达57分,编程能力可以与Claude Opus 4.8相媲美。 8月12日,DeepSeek官网API文档更新,正式确定DeepSeek-V4-Pro-0813。与预览版相比,V4-Pro-0813在智能体方面的能力继续提升,这成为该模型的重要看点。根据媒体援引的官方评测对比表数据,V4-Pro-0813在智能体多项测试中表现大幅提升。 与Anthropic旗舰大模型Claude Fable 5相比,V4-Pro-0813在多项测试中的表现已经十分接近,甚至在部分项目中实现成绩超越。 随着大模型技术持续提升,AI下游应用场景逐渐成为市场热点。日前AI长剧《后西游记》火爆出圈,该剧为国内首部深度使用AIGC全栈技术的长剧,第一季共30集,每一集40分钟。《后西游记》采取边制作、边审、边上线的模式,首批播放的五集内容为《花果山篇》。 依靠强大的AIGC能力,影视院线公司有望提升内容制作效率、降低制作成本。 此外,多家科技巨头持续推动AI消费电子发展,AI PC、AI手机等产品日益丰富,这将为资本市场带来新机遇。 “AI教母”发布全新世界模型,AI再迎里程碑产品!(受益概念股)如下: 1、科大讯飞(002230) 公司旗下有AI唱歌相关技术储备,属于AIGC的应用场景 2、金山办公(688111) 2023上半年,金山办公全面拥抱AI变革,并发布基于大语言模型的智能办公助手WPS AI。 3、华媒控股(000607) 据2025年5月13日投资者关系活动记录表:华媒控股及相关媒体积极拥抱AI时代的到来,在AI应用方面主要涉及三个方面:一是内容生产端,利用新技术辅助采编;二是在分发端,利用AI实现用户的精准到达;三是在媒体产品上开发AI主播及其他智能工具,在提升内容生产效率和传播效率上发挥了重要作用。 4、普联软件(300996) 据2025年5月15日互动易,公司智能体开发平台支持接入DeepSeek大模型,已应用于智能财务共享、智能司库等企业级AIAgent产品,增强产品在人工智能趋势下的市场竞争力。 5、三维天地(301159) 据2025年5月16日机构调研,在AI人工智能应用方面,公司在已经在执行的项目中,增加多个AI应用场景的探索实践20多项,以改善业务效率和客户体验;在数据要素市场化管理技术研究中,公司一直在探索合理商业模式,已制定合理计划和目标,也已有相应落地。 6、税友股份(603171) 据2025年2月13日互动易及2025年2月7日互动易,公司将大语言模型应用于财税咨询、运维等AISaaS场景,基于阿里云部署通义千问大模型并接入DeepSeek模型优化数智化服务。 7、用友网络(600588) 据2024年年度报告,公司发布企业服务垂类大模型YonGPT2.0及100多项智能服务,在公共资源交易、工业装备等领域取得应用进展,覆盖财务、人力等企业服务场景。 8、科锐国际(300662) 据2025年互动易及机构调研,公司实施AI-First战略,基于700GB公共数据和40GB行业数据训练CREEmbedding模型,提升招聘匹配效率;同时接入DeepSeek-R1大模型,探索AI在人力资源场景的深度融合。 9、双良节能(600481) 据2025年3月19日互动易,公司围绕AI应用开发远程运维助手、空冷塔故障预测哨兵等工具,提升研发效率与成本优化。 10、金现代(300830) 据2025年5月15日互动易及2025年6月27日互动易,公司将AI技术LLM/OCR/CV应用于实验室管理系统,实现设备智能取数及自动生成报告,提升实验效率与准确性。 11、延华智能(002178) 据2025年7月7日互动易和2025年5月15日机构调研信息,公司探索医疗AI领域的技术应用与场景落地,计划打造“AI+行业”产品矩阵。 12、通策医疗(600763) 据2025年3月12日互动易,公司AI系统优化诊疗流程,“优领”系统实现牙根设计时间从1小时压缩至30分钟内,基准点提取效率提升8倍,累计节约超10万小时诊疗时间。 13、多伦科技(603528) 据2025年2月27日互动易,多伦科技旗下多伦车检三大平台接入DeepSeek大模型,上线AI车检助手提升服务智能化水平。 14、中水渔业(000798) 据2025年2月25日互动易及2025年4月23日互动易,公司在生产作业中推广运用“海鹰AI金枪鱼智慧渔情预报系统”提高捕捞效率,并开展鱿鱼钓机智能装备等科技创新项目。 15、启迪设计(300500) 据2025年4月30日互动易,公司已完成大语言模型本地化部署,推进AI技术在工程设计全生命周期应用,实现交互式知识管理与智能化设计解决方案,拓展对外技术服务能力。 |