视频号
    标题 摘要 内容
    详情













    近日,中国电信人工智能研究院(TeleAI)星辰实验室正式开源端到端多模态文档解析模型 TeleOCR。该模型仅 1.2 亿参数,兼顾高性能与轻量化部署能力,在多项权威文档评测榜单取得领先成绩,为政务、金融、科研等领域文档智能化、知识库建设提供开源底座。


    图片


    文档智能解析是大模型落地 RAG 知识库、档案数字化、合同票据处理的核心基础能力。传统文档处理方案多采用 OCR 识别 + 版面分析 + 表格还原的分阶段架构,存在链路复杂、多模块误差累积、公式与科学图表解析能力弱等痛点。星辰实验室自研 TeleOCR 作为统一端到端文档视觉语言模型,打破分阶段处理范式,可一次性完成文字识别、版面还原、表格解析、数学公式提取、科学图表理解,直接输出保留阅读顺序的 Markdown、JSON 结构化结果。


    图片


    性能评测数据显示,TeleOCR 在 OmniDocBench v1.6、PureDocBench 权威文档评测榜单位居前列,并斩获 ICDAR 2026 科学图表解析挑战赛冠军。模型可适配电子文档、扫描件、手机实拍畸变文档、学术论文、政务公文、工业报表等多种素材,对复杂版式、公式、图表场景具备突出处理效果。


    作为轻量化模型,TeleOCR 仅 1.2 亿参数,大幅降低本地部署门槛,普通显存环境即可完成推理,兼顾企业私有化部署的数据安全诉求与算力成本控制。模型代码与权重已对外开源,开发者可基于开源底座二次开发,快速搭建文档解析应用,赋能企业知识库、档案数字化、智能合同审核、科研文献智能处理等业务场景。


    中国电信 TeleAI 星辰实验室持续深耕多模态、大模型、行业人工智能技术研发。TeleOCR 的开源,是实验室推动文档智能技术普惠的重要实践。依托中国电信云网融合优势,星辰实验室将持续迭代开源模型能力,同步通过天翼 AI 平台提供星辰文档理解商用 API 服务,形成 “开源模型 + 企业级商用服务” 双轨供给,助力千行百业高效完成非结构化文档资产数字化,加速行业人工智能落地。