Runway与DeepSeek发布新一代基础模型,性能超越行业巨头

Runway与DeepSeek发布新一代基础模型,性能超越行业巨头

快速阅读: Runway AI Inc.和DeepSeek发布新模型,前者Gen-4.5提升文本转视频能力,后者DeepSeek V3.2优化编程和数学任务。Runway获3亿美元投资,估值30亿美元,Gen-4.5性能创新高。DeepSeek V3.2在多语言编程测试中超越GPT-5。

今日,初创公司Runway AI Inc.和DeepSeek发布了两款基础模型,声称其性能可超越业内最大科技公司开发的算法。Runway的新算法Gen-4.5提供文本转视频功能,而DeepSeek则推出了其同名推理模型的更新版本。这家中国初创公司表示,DeepSeek V3.2在编程和数学相关任务上比前一代产品表现更好。

Runway成立于2018年,获得来自Nvidia Corp.、SoftBank Group Corp.等投资者超过3亿美元的资金支持,最近一轮融资估值达30亿美元。该公司通过应用程序接口和基于云的设计工具提供视频生成模型服务。据Runway介绍,Gen-4.5在用于比较AI视频生成器性能的人工智能分析文本到视频基准测试中创造了新纪录。这一成绩部分归功于对模型进行了优化,使其更擅长遵循提示。用户可以要求Gen-4.5自定义片段的摄像角度、光线和其他参数。

此外,Runway称该模型还能生成更真实的视频片段,尤其擅长渲染物理效果,如运动和碰撞。不过,该模型也有一定局限性,有时会提前生成某些效果,偶尔无法渲染用户指定的对象。Runway计划本周内将其Gen 4.5集成至产品中。公司表示,这款新模型将提供与上一代Gen 4相同的性能速度和价格。Runway在其产品中运行Gen 4.5所依赖的AI集群由Nvidia Corp.的Blackwell和Hopper芯片驱动,这些芯片也是训练该模型时使用的。

Nvidia首席执行官Jensen Huang表示:“我们正携手推进AI从预训练到后训练及推理的整个生命周期。”

另一方面,今日推出的另一款前沿模型DeepSeek-V3.2针对推理任务进行了优化,例如调试代码。它在SWE多语言和终端基准2.0编程语言测试中超越了GPT-5,但在谷歌LLC的Gemini模型系列创下的记录面前略逊一筹。推理模型利用称为注意力机制的模块来处理文本。该机制通过审查周围文本确定单词的意义,识别最相关的短语并将其纳入计算。这一过程占用了大型语言模型大量硬件资源。

据DeepSeek介绍,DeepSeek-V3.2采用了新的注意力机制实现方式,称为DSA,减少了模型为确定单词意义所需审查的文本量,从而降低了硬件使用率。对于优先考虑输出质量而非硬件效率的公司,还可以选择使用同时发布的性能优化版本DeepSeek V3.2-Speciale。DeepSeek通过让该大型语言模型回答国际数学奥林匹克竞赛和国际信息学奥林匹克竞赛的试题集来测量其性能,模型在这两项测试中均达到了金牌水平的成绩。

(以上内容均由Ai生成)

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注