新兴人工智能(AI)初创公司Runway和DeepSeek各自发布了新的基础模型,正式加入与行业顶尖企业的竞争。两家公司均强调,此次发布的新模型在技术层面,其性能优于行业领先的大型科技公司的算法。
Runway新推出的“Gen-4.5”提供文本转视频功能,据评估其生成的视频比前代作品更具现实感。特别是,它不仅能根据用户请求调整摄像机角度、照明、视觉元素等诸多细节,在表现运动及碰撞等物理效果方面也展现了更优的性能。不过,该模型也存在一些限制,例如部分视频元素过早播放或特定对象渲染缺失等。
Runway计划在今年年底前将Gen-4.5模型应用于其所有产品,并表示将在成本和速度方面保持与现有Gen-4相当的水平。该模型在基于英伟达(NVDA)最新AI芯片Blackwell和Hopper的专用集群上进行训练和运行。英伟达CEO黄仁勋解释道:“我们正在合作推动从预训练到事后推理的整个AI生命周期的创新。”
中国初创公司DeepSeek于当日发布了名为“DeepSeek-V3.2”的新型推理专用模型。该模型在某些编程任务上超越了GPT-5,尤其在SWE多语言和Terminal Bench 2.0测试中表现突出。不过,评估认为其尚未超越谷歌(GOOGL)的Gemini系列模型所设定的基准。
DeepSeek-V3.2通过一种新方式实现了分析文本上下文以推理意义的“注意力机制”,从而提高了计算效率。该方法被命名为“DSA”,能够在消耗更少硬件资源的同时保持同等的解析能力。针对需要高性能推理的企业,该公司还同步发布了名为“DeepSeek-V3.2-Speciale”的性能增强版本。该模型通过了国际数学奥林匹克竞赛和信息学奥林匹克竞赛题目的评估,达到了金牌水平的准确率,证明了其性能。
Runway和DeepSeek在AI生态系统中规模相对较小,但正通过资金投入和技术演进快速改变市场规则。特别是在AI视频生成和高级推理领域所构建的技术能力,预计将成为未来与大型企业合作或竞争格局中的核心战略资产。


