一种利用大模型优化扫描件内容识别质量的方法与框架
# 热门搜索 #
大模型
人工智能
openai
融资
chatGPT
验证码登录
×
发送
登录即代表您已同意AITNT
用户协议
和
隐私政策
登录
登录成功后会自动刷新界面
AITNT公众号
AITNT APP
AITNT交流群
搜索
未登录
首页
AI中心
退出
首页
AI资讯
AI技术研报
AI监管政策
AI产品测评
AI商业项目
AI产品热榜
AI 源力市场
寻求报道
一种利用大模型优化扫描件内容识别质量的方法与框架
申请号:
CN202510907459
申请日期:
2025-07-02
公开号:
CN120689894A
公开日期:
2025-09-23
类型:
发明专利
摘要
本发明涉及人工智能技术领域,尤其涉及一种利用大模型优化扫描件内容识别质量的方法与框架。本发明包括文档图像分析与处理、文字提取与格式化以及利用大模型进行基于上下文的OCR矫正。本发明的目的在于提供一种利用大模型优化扫描件内容识别质量的方法与框架,结合了视觉模型和文本模型等大型语言模型的强大功能,实现了对文档内容和布局的深度理解,精准分析文档布局,识别文本块、表格、图像等不同元素,结合视觉模型的分析结果,将文档内容转换成优美流畅的Markdown格式,并保留文档的原始布局。
技术关键词
噪声数据
图像超分辨率重建
文档解析技术
定位识别技术
保留图像边缘
识别文本块
框架
矫正
答案
布局
图像处理算法
深度学习技术
格式化
图片
人工智能技术
图像分析
边缘检测
饱和度