Home 综合新闻 这种新的开放加权人工智能模型是为视频和机器人构建的 – CNET

这种新的开放加权人工智能模型是为视频和机器人构建的 – CNET

2
0
Katelyn Chedraoui

尽管技术领导者继续争论漏洞较多的人工智能模型的优点和缺点,但开发人员并没有放慢脚步。 LTX 于周二发布了其开放世界模型的最新版本,称为 LTX-2.5。

LTX-2.5 是一个开放世界模型,与您可能知道的大多数人工智能不同。虽然大师擅长生成文本,但世界模型是复杂的网络,可以将物理世界翻译成生成人工智能可以理解的语言。这个想法是,模型将对我们的世界有深入的了解,从而减少幻觉。想象一下可以在房间里导航而不会撞到任何东西的机器人,或者人工智能视频剪辑,人们知道如何在物体周围移动,而不是像幽灵一样消失在物体中。您可以使用世界模型来模拟数字环境、创建内容并帮助对机器人进行编程。

新模型的改进将减少人工智能产生的视觉伪影(或错误)的数量,并由于新的像素传播过程而在各代之间提供更好的一致性。由于是开放模型,企业可以下载模型并根据自己的需求进行定制;这有助于保护他们的知识产权安全。因此,电影工作室可以使用 LTX-2.5 创建和编辑以其角色为特色的视频剪辑。 LTX-2.5 针对 Nvidia RTX GPU 上的本机推理进行了优化;这意味着开发人员可以在自己的硬件上运行它,并使他们的工作远离基于云的人工智能服务。

LTX-2.5 现在可以从 HuggingFace 和 ComfyUI 等网站下载和使用。

LTX 是漏洞较多的人工智能模型最受欢迎的开发商之一。 LTX 的模式已被 HuggingFace 用户下载超过 3300 万次,其中包括那些根据 LTX 的模式制作自己版本的用户。 OpenAI 和 Google 各自拥有一系列开放式重型模型,分别是 GPT-OSS 和 Gemma 4,但两家公司的封闭式模型数量远远多于开放式重型模型。 Anthropic 没有公开的克劳德模型。

开源倡导者长期以来一直认为,让科技公司公开披露其工具的工作原理是最好的前进方式。在人工智能时代,这种争论变得更加激烈。 Moonshot 的新款 Kimi 3 等流行的中国模型正在以开放格式发布,让开发人员、研究人员和网络安全专家深入了解该系统的工作原理。 7月份有报道称,特朗普政府出于对网络安全威胁的担忧,正在考虑禁止中国和其他外国人工智能模型,许多行业领袖纷纷表示,此举实际上可能威胁网络安全。

尽管大多数人工智能领导者表示不应禁止存在大量漏洞的模型,但主要参与者并不急于发布许多此类模型。 Meta 首席执行官马克·扎克伯格提倡更加开放的人工智能。周一,他发表了一篇长文,概述了他的观点,即漏洞加权模型将为更多人带来“人工智能的好处”。 Meta 还发布了一个名为 Muse Glimmer 的新开放权重模型,并承诺还将发布另一个名为 Spark 1.2 的新模型的权重。

LTX 也有类似的理念。首席执行官兼联合创始人 Zeev Farbman 在最近的一篇文章中写道,政府和私营公司都不会成为私人人工智能模型的良好管理者。一种主要是出于不断变化的政治目标,另一种是出于纯粹的利润。

“它不应该掌握在少数决策者手中,无论他们是在政府还是少数强大的公司中,”法布曼写道。 “最终用户通过他们可以控制和审查的模型做出决定。”

凯特琳·切德拉维

凯特琳·切德拉维

记者2


Katelyn 是 CNET 的记者,报道人工智能,包括聊天机器人以及图像和视频生成器。他的作品探讨了新的人工智能技术如何渗透我们的生活,塑造我们在社交媒体上消费的内容,并影响屏幕后面的人们。他毕业于北卡罗来纳大学教堂山分校,获得媒体和新闻学学位。您可以通过 kchedraoui@cnet.com 联系他。

查看完整的简历

LEAVE A REPLY

Please enter your comment!
Please enter your name here