OCR(光学字符识别)(2026.08.25)
概念编号:089
一句话理解
OCR 把“图片里的字”识别成计算机可以搜索和编辑的文本。
具体解释
OCR 通常包括文字区域检测、字符识别、版面分析和结果校正。现代多模态模型还可能识别表格、手写、印章、公式和图片中的空间关系,但具体能力需要按场景验证。
边界与易混淆概念
- OCR 不等于完整文档理解:识别出文字后,还要理解结构和语义。
- 清晰图片不保证零错误:字体、倾斜、遮挡、低分辨率和复杂背景都会影响结果。
- OCR 结果需要核验:金额、日期、合同条款等重要内容不能盲信。
例子
把纸质合同扫描件转换为可复制文本,或从截图中提取快递单号,都是 OCR。
相关概念
来源
概念卡更新日志
- 2026.08.25|创建概念卡:依据多模态视觉输入和文档处理场景,登记为 089。
🔐 GitHub 评论(Giscus)
正在连接 GitHub 评论…