合合信息亮相CCIG2023:多位大咖共话智能文档未来,文档图像内容安全还面临哪些技术难题?

近日,中国图象图形大会(CCIG 2023)(简称“大会”)在苏州圆满落幕。本届大会以“图象图形·向未来”为主题,由中国科学技术协会指导,中国图象图形学学会主办,苏州科技大学承办,特邀谭铁牛院士、赵沁平院士、吴一戎院士等百余位国内外知名学者,来自代表企业的技术专家,共话图像图形学术研究与技术创新趋势,共谋行业新发展。

(金连文主持 《文档图像智能分析与处理》 论坛)

技术论坛《文档图像智能分析与处理》是本次大会的亮点之一,由华南理工大学二级教授、中国图象图形学学会常务理事金连文担任主持,合合信息智能技术平台事业部副总经理、高级工程师丁凯博士出席该论坛,并与来自中科院自动化所、北大、中科大的学术专家,华为等知名企业的研究者们,围绕文档图像处理的前沿技术展开“头脑风暴”,寻找文档图像处理领域的未来进阶方向。

大模型技术提升文字识别效率,智能文档处理难题突破

近期,ChatGPT的爆火让“大模型”技术进入了公众的视野。随着人工智能技术的飞速发展,作为图像图形技术的重要应用场景之一,文档图像智能处理逐步应用到医疗、教育等诸多领域,为各行各业提供更加高效、智能的文档管理和数据分析解决方案,大模型技术的崛起也为文档处理带来了新的机遇。

中国科学院自动化研究所副所长刘成林认为,大模型与光学字符识别(OCR)技术的结合,能够对海量数据进行理解、处理。具体到实践层面,大模型技术还有可观的提升空间。从识别性能来说,大模型技术在场景文本、逻辑版面、文档问答等方面还有很多工作可以做;此外,大模型的可解释性、安全度十分重要,还需要研究者们进行更为深入的探讨。

刘成林就《人工智能大模型时代的文档识别与理解》研究课题进行分享

北京大学邹月娴教授认为,在与文档图像处理技术密切相关的OCR领域中,专业化大规模的预训练模型是可行的。“大模型是一个大的趋势,对于小团队来说做工具是一个非常好的方法,做工具对大家都是有好处的。”邹月娴说。

邹月娴就《视觉-语言预训练模型及迁移学习方法》研究课题进行分享

 华为AI研究员廖明辉提到,企业作为文档图像处理的应用方,普遍面临一个挑战:当有众多API时,维护难度较高,急需一个垂直领域的通用的OCR大模型,能够覆盖所有的使用场景。廖明辉认为,OCR垂直领域的大模型在数据量方面,数据的数量不是最关键的,最关键的是数据的多样性。

除了引入大模型等新技术外,如何实现文档图像的智能分析与处理还面临着诸多来自现实的挑战。丁凯博士认为,文档的多样性和复杂性是文档图像处理中的难点:文档类型和格式繁多,包括报告、合同、发票、证明、证件等。不同类型的文档有不同的格式和布局,例如文档中常常包含图片、表格、图形等各种图像,难以用统一的方法处理。

丁凯就《智能文档处理技术在工业界的应用与挑战》研究课题进行分享

丁凯提到,文档图像中的弯曲、阴影、摩尔纹,字迹不清晰等问题对文档图像的识别与处理产生了影响,刘成林也表示,“过去我们只关注文字,现在文档中的图像也十分重要。但是,现有文档图像识别技术在识别精度和可靠性、可解释性、自适应性等方面还有明显不足,还有很多技术问题有待解决。”

值得关注的是,人工智能大模型的快速发展为文档分析与识别带来了一些机遇,除了解决识别层次的遗留问题,在性能提升、应用拓展上大有可为。合合信息通过ROI提取、干扰去除、形变矫正、图像恢复以及图像增强这一整体架构对文档进行智能扫描与识别分析,将文档图像的弯曲矫正、摩尔纹去除,图像质量大幅提升。

除文档图像的通用场景外,合合信息对特定垂直场景下的图像也能进行预处理,针对手写板图片中出现的反光问题,通过算法模型对反光进行“擦除

由于版面复杂多变、文本内容多样化等原因,文档被拍照、扫描成电子文档过程中时常出现漏字、错位,合合信息持续突破版面分析技术在版面分割、区域间的逻辑关系处理等方面的难题,通过智能文字识别、智能图像处理等核心技术,确定文档中的文字位置、字体、大小和排版方式等信息,实现版面的分析和还原。

  文档篡改检测技术为视觉内容安全提供保障

目前,人工智能的合成技术导致伪造的多媒体信息在网络上泛滥成灾,文本图像显然是重灾区之一。针对资质证书、文案、聊天截图等文本图像的伪造被用于散播谣言、经济诈骗、编造虚假新闻,给个人、社会造成恶劣的负面影响。图像内容安全是AI安全的重点领域,如可对文本篡改痕迹进行精准检测,将为图像内容安全提供保障。

中科大教授谢洪涛指出,随着基于深度学习的伪造与取证技术的出现,目前文本图像的真伪鉴定问题进入了攻防博弈阶段。“文本图像的篡改生成视觉质量高、字体风格统一、背景纹理协调、篡改字迹清晰,文本图像的篡改检测可以说是‘道高一尺、魔高一丈’,适应多种篡改方法、多域空间感知、区域文理区分、时间复杂度适中。”谢洪涛表示。

(谢洪涛就《篡改文本图像的生成与检测》研究课题进行分享)

谢洪涛所在的课题组正在探索基于文本笔迹的文本图像生成,以及基于频域关系的局部纹理差异性建模,最终实现高质量的场景文本图像篡改生成、准确的场景文本图像篡改检测。相关研究可应用于文本图像的多个领域,例如文档图像、自然场景图像、票据图像等。

合合信息在文档图像内容安全领域也进行了深入的部署。据丁凯介绍,合合信息研发了基于深度学习的图像篡改检测技术及相关系统,通过学习图像被篡改后统计特征的变化,该系统智能捕捉图像在篡改过程中留下的细微痕迹,可检测出复制粘贴、拼接、擦除等多种篡改形式,让人工智能准确识别出图片篡改的不同类型并进行针对性的处理,提升识别精度和场景通用性。据悉,合合信息图像篡改检测技术已被银行、保险、制造业等多个行业引入。

作为一家人工智能企业,合合信息依托智能文档处理技术,对复杂场景下的多版式、多语种文字内容进行精准提取,打造的合同机器人、财报机器人及行业解决方案,已在金融、政务、制造、物流等30个行业落地,服务的世界500强公司超过80家。未来,合合信息将持续为全球C端用户和多元行业B端客户提供数字化、智能化的产品及服务,促进AI技术在文档处理领域的应用落地与信息安全保障。

本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若转载,请注明出处:http://www.rhkb.cn/news/33741.html

如若内容造成侵权/违法违规/事实不符,请联系长河编程网进行投诉反馈email:809451989@qq.com,一经查实,立即删除!

相关文章

证件照转数字人只需几秒钟,微软实现首个3D扩散模型高质量生成效果,换装改形象一句话搞定 | CVPR 2023...

转载自 微软亚洲研究院量子位 | 公众号 QbitAI 一张2D证件照,几秒钟就能设计出3D游戏化身! 这是扩散模型在3D领域的最新成果。例如,只需一张法国雕塑家罗丹的旧照,就能分分钟把他“变”进游戏中: △RODIN模型基于罗丹旧…

证件照更换底色(remove.bg包)【Python】

最近正好在办理入职需要用到蓝底的证件照,我目前只有一个白底的,在网上百度很多工具都需要付费,一气之下叫ChatGPT帮我写了一个哈哈哈。 最开始写的不太符合要求,人物旁边都是白色区域(这一段的代码就不上了&#xff…

chatgpt赋能python:Python改变图片背景色:让你的照片更生动

Python改变图片背景色:让你的照片更生动 随着数字摄影技术的进步,人们拍摄照片的数量和质量都得到了大幅提升。但是,有些时候照片的背景色不够理想,可能会影响整体效果。而Python这个流行的编程语言,可以通过图像处理…

安卓新闻客户端

安卓新闻客户端 特别说明:本安卓使用版本较高,因为是课设仓促完成的,现在还有些许BUG,目前还在维护和更新ing~ 完整代码GitHub自行下载导入 GitHub仓库:点击此处 实训报告:点击此处 主界面图 一、需求分析 …

android新闻客户端的实现

制作一个基于聚合新闻数据简单的新闻APP 制作简易新闻App 导航篇[1、使用FragmentViewPager TabLayout自制简易新闻 app主要框架(一)](https://blog.csdn.net/Tobey_r1/article/details/93221486)[2、解析聚合新闻数据,并显示到主界面上&…

高等数学学习笔记——第四十讲——微积分基本公式

1. 问题引入 2. 微积分基本定理(微积分基本公式、牛顿——莱布尼兹公式) 3. 定积分计算示例(利用微积分基本公式) 4. 分段函数的定积分(需分段计算)(引申:具体问题,具体分…

如何利用MATLAB求解积分与微分?

文章目录 前言1 数值微分2 数值积分小结 前言 今天我们要说的就是数值微积分,赶紧看看他和高等数学中的微积分有什么区别吧。本文是科学计算与MATLAB语言专题六第一小节的学习笔记,如果大家有时间的话,可以去听听课,没有的话&…

数学建模学习(22):求解微积分之积分问题详解,超详细!

文章目录 前言不定积分定积分与无穷积分多重积分总结前言 积分是一个很重要的概念,通常分为定积分和不定积分。 我们在这里介绍的就是int函数,调用方式如下: F=int(fun,x) fun是被积函数,x是自变量,当然如果只有一个自变量可以省略。 不定积分 求解如下式子的不定积分:…

[MIT]微积分重点 第五课 积分总览 学习笔记

0.先上本节课目录: 1.函数二是函数一的导数 函数一: H e i g h t y ( x ) Height y(x) Heighty(x) 函数二: S l o p e s ( x ) Slope s(x) Slopes(x) 函数一 -> 函数二: S l o p e s ( x ) d ⁡ y d ⁡ x l i m i t o f …

这可能是关于微积分讲的最好的文章了

最近自己学习深度学习相关的东西,发现需要大量关于微积分的知识作为支撑,于是我在网上找到了这篇关于微积分的好文章,这也是我目前见过的最好的讲解微积分的文章了!要是大学课本这么写,高数怎么可能让那么多同学挂科&a…

用Python学《微积分B》(定积分)

本文主要学习《微积分B》第7章——“定积分的概念和存在条件”,结合课程中的知识进行一些扩展,并用Python辅助求解课后练习题。关于定积分(Definite Integral)的概念,课本中只介绍了“黎曼积分”(Riemann I…

多变量微积分笔记17——通量

在流体运动中,通量是单位时间内流经某单位面积的某属性量,是表示某属性量输送强度的物理量。在大气科学中,包含动量通量、热通量、物质通量和水通量。 本章关于向量和点积的相关知识课参考《线性代数笔记3——向量2(点积&#xff…

以MATLAB的方式实现微积分问题的计算机求解问题及解决方案集锦(二)

前言 关于MATLAB系列的精品专栏大家可参见 MATLAB-30天带你从入门到精通 MATLAB深入理解高级教程(附源码) 喜欢的小伙伴可自行订阅,你的支持就是我不断更新的动力哟! 微积分问题的计算机求解系列 (0001) 试求出以下的曲线积分。 【解】 套用第一类和第二类曲线…

第三单元 用python学习微积分(十九)FTC2(下)和定积分在对数和几何上的应用

本文内容来自于学习麻省理工学院公开课:单变量微积分-定积分在对数和几何上的应用-网易公开课 概率密度_百度百科 概率密度是什么意思_百度知道 正态分布(高斯分布)、Q函数、误差函数、互补误差函数 - htj10 - 博客园 正态分布_百度百科 …

程序员的数学【多元函数微分学】

目录 前言一、多元函数的定义二、偏导数三、高阶偏导数四、梯度五、雅可比矩阵5.1 雅克比矩阵定义5.2 雅克比矩阵示例 六、Hessian矩阵6.1 Hessian矩阵定义6.2 实例演示Hessian矩阵 七、极值判别法则7.1 极值判定条件7.2 实对称矩阵正定负定判定 八、二次型8.1 二次型定义8.2 二…

微积分基础知识note

此部分转自https://blog.csdn.net/zhulf0804/article/details/52238435 方向导数与梯度 在许多问题中,不仅要知道函数在坐标轴方向上的变化率(即偏导数),而且还要设法求得函数在其他特定方向上的变化率。这就是接下来要谈论的方…

用Python学《微积分B》(微积分应用)

微积分是一种非常重要的“数学分析”思想(方法),在许多领域中都有应用,比如:计算平面面积、曲线长度、空间图形的体积、旋转曲面面积和物理学中的“微元法”等。而如何用好“微积分”是这部分学习的重点。要用好微积分…

数学分析(高级微积分)

一、总览 微分学积分学级数论 二、微分学 1. 极限和连续 相关知识:数列的极限、收敛数列之性质、函数极限、函数极限性质、无穷大无穷小、等价无穷下、洛必达法则、函数的连续和间断、极限的求法。 2. 一元/多元函数微分学 相关知识:导数&#xff0…

以MATLAB的方式实现微积分问题的计算机求解问题及解决方案集锦(一)

前言 关于MATLAB系列的精品专栏大家可参见 MATLAB-30天带你从入门到精通 MATLAB深入理解高级教程(附源码) 喜欢的小伙伴可自行订阅,你的支持就是我不断更新的动力哟! 微积分问题的计算机求解系列 (0001) 试求出下面的定积分或无穷积分。 【解】 ① 可以直接求解 >…

高视角!如何认识微积分方法与原理?

编者按>> 恩格斯在《反杜林论》中说:“变数的数学——其中最重要的部分是微积分。”冯诺依曼说:“微积分是近代数学中最伟大的成就,对它的重要性做怎样的估计都不会过分。” 可见微积分在数学中的重要性。通常说的“微积分”由方法和原…