Meta推出AU-Nets模型 革新文本处理技术

发布时间:2025年7月23日    来源:szf
Meta推出AU-Nets模型 革新文本处理技术

快速阅读: 据相关媒体报道,Meta推出AU-Net,解决中文文本分解难题。该架构基于自回归U-Net,从字节学习,灵活组合单词,提升模型表现。

据Meta公司报道,近日,该公司研究团队推出了一种名为AU-Net的创新架构,旨在解决大语言模型(LLM)领域中文本数据分解的难题。传统分词技术,如字节对编码,虽然广泛使用,但在处理低资源语言或特殊字符结构时效果不佳。AU-Net通过自回归的U-Net结构,直接从原始字节开始学习,灵活地将字节组合成单词和词组,甚至形成多达四个单词的组合,实现多层次的序列表示。

AU-Net的设计灵感来源于医学图像分割领域的U-Net架构,具备独特的收缩路径和扩张路径。收缩路径负责压缩输入的字节序列,将其合并为更高层次的语义单元,以提取文本的宏观语义。扩张路径则负责将这些高层次信息逐步还原,恢复到原始序列长度,同时融合局部细节,使模型能在不同层次上捕捉文本的关键特征。

AU-Net的收缩路径分为三个阶段。第一阶段,模型直接处理原始字节,使用限制注意力机制以保证计算的可行性。第二阶段,在单词边界处进行池化,将字节信息抽象为单词级的语义信息。第三阶段,池化操作在每两个单词之间进行,捕捉更大范围的语义信息,增强模型对文本含义的理解。

扩张路径采用多线性上采样的策略,使每个位置的向量能够根据序列中的相对位置进行调整,优化高层次信息和局部细节的融合。此外,跳跃连接的设计保证了在还原过程中不丢失重要的局部细节信息,从而提升模型的生成能力和预测准确性。

在推理阶段,AU-Net采取自回归的生成机制,确保生成的文本既连贯又准确,同时提高了推理效率。这一创新架构为大语言模型的发展提供了新的思路,展现了更强的灵活性和适用性。

(以上内容均由AI生成)

你可能还想读

三星4nm制程良率突破60%,获超1亿美元AI芯片订单

三星4nm制程良率突破60%,获超1亿美元AI芯片订单

快速阅读: 三星电子4纳米制程良率提升至60%-70%,获美企Tsavorite超1亿美元OPU芯片订单,显示三星在中高端市场重获份额。近期三星还获得中国矿机厂商及特斯拉AI5芯片订单,推进2纳米工艺发展。 12 月 7 日,据韩国媒体《亚 […]

发布时间:2025年12月7日
百度集团:正就分拆昆仑芯进行上市进行评估

百度集团:正就分拆昆仑芯进行上市进行评估

快速阅读: 百度计划分拆昆仑芯科技并筹备上市,预计2026年一季度递交申请,2027年初完成IPO。昆仑芯为百度内部孵化的AI芯片公司,业务增长迅速,2024年营收超10亿元。百度股价受此消息上涨5.01%。 感谢IT之家网友 啊俊 、 D […]

发布时间:2025年12月7日
网红“甲亢哥”直播暴力损毁人形机器人,开发公司起诉索赔

网红“甲亢哥”直播暴力损毁人形机器人,开发公司起诉索赔

快速阅读: 网红IShowSpeed在直播中对人形机器人Rizzbot实施暴力行为,致其严重损坏。Rizzbot开发公司Social Robotics提起诉讼,要求赔偿实际损失和预期利润。 2024年9月,拥有超过5000万粉丝(全平台累计 […]

发布时间:2025年12月7日
AI争议两天内导致PS5、PS4游戏下架

AI争议两天内导致PS5、PS4游戏下架

快速阅读: 顶尖智者预测,未来AI将实现更多功能,各国积极投资,芯片短缺因AI需求激增。目前AI如婴儿,潜力巨大,发展将超越视频游戏等简单应用。 世界顶尖的智者预测,未来人工智能将实现诸多功能,而显然你是正确的!几乎每个国家都在投资人工智能 […]

发布时间:2025年12月7日
英伟达发布CUDA 13.1,引入Tile IR革新GPU编程

英伟达发布CUDA 13.1,引入Tile IR革新GPU编程

快速阅读: 英伟达发布CUDA 13.1,引入CUDA Tile新编程方式,简化AI与加速计算开发,提高代码兼容性和执行效率,支持多代GPU架构。 12月7日,IT之家报道,英伟达本周四发布了全新的CUDA 13.1,这是自2006年CUD […]

发布时间:2025年12月7日
谷歌AI迎头赶上,ChatGPT霸主地位受威胁

谷歌AI迎头赶上,ChatGPT霸主地位受威胁

快速阅读: 谷歌在AI搜索转型初期落后于OpenAI的ChatGPT,但通过Gemini等新产品的推出,逐渐缩小差距,目前在应用下载量和用户参与度上展现强劲增长,正努力重回搜索领域主导地位。 谷歌AI标志 NurPhoto via Gett […]

发布时间:2025年12月7日
政府推AI应用打击非法移民

政府推AI应用打击非法移民

快速阅读: 巴基斯坦政府启动AI应用程序试点,打击非法移民,确保被遣返者不再获签。两部长要求严打假旅行社,改革移民系统,提高签证申请透明度。 伊斯兰堡 —— 联邦政府决定启动一项基于人工智能的应用程序试点项目,以遏制非法移民。该决定是在周五 […]

发布时间:2025年12月7日
摩托罗拉解决方案收购Blue Eye,强化AI安全业务

摩托罗拉解决方案收购Blue Eye,强化AI安全业务

快速阅读: 摩托罗拉解决方案公司2025年第三季度财报超预期,宣布收购Blue Eye,强化公共安全与安保技术。此举促进公司向人工智能视频安全领域发展,提升软件和服务收入,应对传统LMR系统压力。 摩托罗拉解决方案公司近期公布的2025年第 […]

发布时间:2025年12月7日