蚂蚁数科推出多语种视觉大模型训练框架,高效识别文档伪造与逻辑矛盾

发布时间:2025年11月4日    来源:szf
蚂蚁数科推出多语种视觉大模型训练框架,高效识别文档伪造与逻辑矛盾

快速阅读: 蚂蚁数科发布多语种多模态大模型训练框架,解决小语种环境下的语言错乱问题,在CVQA测试中领先,准确率提升9.5%,并推出图像安全框架,增强数字内容风险控制。

近日, 蚂蚁数科在香港金融科技节上发布了一项革命性的技术 ——“多语种多模态大模型训练框架”,旨在解决当前大模型在多语言环境中的应用瓶颈。随着人工智能技术的飞速发展,大模型正逐渐成为提升各行业效率的重要工具。然而,传统以英文为母语的大模型在小语种环境中表现不佳,常常面临 “语言错乱” 和推理信息混乱的问题,这严重制约了其全球化应用。

为应对这一挑战,蚂蚁数科的研究团队开发了这一新框架,并在多文化多语言视觉问答基准测试(CVQA)中取得了显著成果。该框架在埃及阿拉伯语、印尼爪哇语、巴哈萨语及巽他语等资源稀缺的小语种上表现尤为突出,展现出卓越的多语言识别能力,成功跻身榜首。

这一突破的核心在于创新的语言感知优化框架。该框架通过 “以目标语言进行思考” 的机制,结合细粒度多维度的奖励策略与自动化数据解决方案,实现在小语种的深度理解和处理。根据测试结果,与同等规模的开源模型相比,该框架在主流多语言视觉问答(Multilingual Visual Question Answering, VQA)基准测试中准确率提升了约9.5%,在部分任务中甚至优于 GPT-4o 和 Gemini-2.5-flash 等国际主流闭源模型,获得评测总分 第一 。

在安全能力方面,蚂蚁数科还推出了图像安全框架,结合视觉分析与常识推理的伪造识别路径,能够高效识别图像中的视觉不一致性和逻辑矛盾。这一技术不仅能够定位篡改区域,还能进行可解释分析,显著提升数字内容的风险控制能力。

作为蚂蚁数科全球业务的核心技术,这两项能力已在 ZOLOZ 文档识别鉴真产品(RealDoc)中实现了规模化应用,支持119种语言,能够高效处理多语种商务文档、合同和证件,覆盖保险理赔、信贷审核及跨境贸易等多个场景。

(以上内容均由Ai生成)

你可能还想读

校园安防技术效果存疑

校园安防技术效果存疑

快速阅读: 据校园安全杂志报道,布朗大学12月13日发生枪击事件,造成2人死亡、9人受伤,校方计划升级门禁与监控系统;专家质疑包括AI武器识别在内的40亿美元校园安防技术缺乏实证,强调“就地封锁”等基础应急措施更为有效。 2025年12月1 […]

发布时间:2025年12月19日
谷歌Gemini推绘图编辑与AI视频验证功能

谷歌Gemini推绘图编辑与AI视频验证功能

快速阅读: 据不完全统计,谷歌近日更新Gemini应用,新增图像标记指令功能,并将SynthID技术扩展至视频领域,以提升AI生成内容的可验证性与透明度,回应社会对生成式AI溯源的关切。 谷歌近日对Gemini应用推出两项更新,旨在提升用户 […]

发布时间:2025年12月19日
多模型协作提升智能合约审计效果

多模型协作提升智能合约审计效果

快速阅读: 据媒体报道,佐治亚理工学院团队提出LLMBugScanner框架,通过集成多个微调大语言模型协同检测以太坊智能合约漏洞,在108份真实合约测试中将准确率提升至约60%,显著优于单模型方案,为区块链安全审计提供新路径。 智能合约漏 […]

发布时间:2025年12月19日
商汤ACE机器人发布三大技术加速具身AI落地

商汤ACE机器人发布三大技术加速具身AI落地

快速阅读: 记者从商汤科技获悉,其旗下ACE Robotics于近日发布ACE具身研发范式、开源世界模型Kairos 3.0及A1具身超脑模块,构建全栈技术链路,支持115个行业场景,推动具身智能产业化发展。 2025年12月18日,商汤科 […]

发布时间:2025年12月19日
火山引擎发布豆包大模型1.8跻身全球多模态AI第一梯队

火山引擎发布豆包大模型1.8跻身全球多模态AI第一梯队

快速阅读: 据火山引擎消息,该公司在12月18日FORCE原动力大会上发布豆包大模型1.8及Seedance 1.5 Pro音视频模型。前者多模态能力全球领先,日均Token使用量突破50万亿;后者支持毫秒级音画同步与方言识别,企业用户可于 […]

发布时间:2025年12月19日
AI预测2026年全球趋势

AI预测2026年全球趋势

快速阅读: 最新消息显示,受传统智慧与现代趋势影响,2026年将聚焦调适与深耕;商业领域强调协作与绿色转型,地缘政治注重文化互信,体育及文化艺术则推崇平衡、真诚与内在力量。 2026年将是一个充满变革与机遇之年。受多重传统智慧视角启发,各方 […]

发布时间:2025年12月19日
奥里萨邦举办区域AI峰会聚焦可持续未来

奥里萨邦举办区域AI峰会聚焦可持续未来

快速阅读: 12月19日消息,印度奥里萨邦在布巴内斯瓦尔启动“2025区域人工智能影响力峰会”,聚焦可持续AI发展与政府治理应用。作为全国首个出台AI政策的地区,该邦正通过“奥里萨AI使命”推动AI在医疗、教育等场景落地,并加强本土人才培养 […]

发布时间:2025年12月19日
IBM将培训500万印度青年掌握AI等前沿技术

IBM将培训500万印度青年掌握AI等前沿技术

快速阅读: 据IBM公司消息,该公司将在印度启动大规模技能发展计划,目标到2030年为500万学习者提供人工智能、网络安全和量子计算等前沿技术培训,依托SkillsBuild平台推动数字教育普惠,并与全印技术教育委员会合作开展课程融合与师资 […]

发布时间:2025年12月19日