星知
体验星知
核心优势
产品特点
适用场景
星知大模型
新闻资讯
星知智能体
登录
返回列表
视觉大模型遭遇滑铁卢:首个中国古文字OCR评测基准开源
腾讯等机构开源首个覆盖汉字“七体之变”的古文字OCR评测基准,评测显示主流视觉大模型在古文字识别中表现极差,暴露出技术短板
发布时间:
2026/05/20 04:06
|
分类:
人工智能
腾讯混元大模型、SSV数字文化实验室等机构联合多所高校与故宫博物院,推出业界首个完整覆盖汉字"七体之变"演化轨迹的中国古文字感知评测基准"Chronicles-OCR"。该数据集由领域专家多层级交叉标注,含2800张高质量图像,针对不同字体采用不同标注方式。基于该基准评测28个主流多模态大语言模型后发现,主流视觉模型在古早字体端到端检测任务中全军覆没,细粒度识别最高准确率仅27.1%,开启推理模式会使表现进一步下降。评测还揭示视觉大模型易识别载体纹理而非微观笔画风格,该基准开源为视觉大模型优化指明方向。
人工智能
星知
最近发布
微软亮出生物学"世界模型"Project Quine:一个周末筛出抗癌候选物
2026/10/04
亏损超80亿、算力承诺546亿:Anthropic招股书揭开大模型顶流的真实账本
2026/10/04
OpenAI与红帽等联合推进OCE1.0研发,打造面向AI代理的"企业级Kubernetes"
2026/10/03
豆包AI个人助理独立App实锤:定名"小豆"剑指全场景智能生态
2026/10/03