AITP
精选全部 AI 动态AI 日报Agent 接入我的简报我的追踪阅读偏好内容方法关于更新日志信源提报反馈
外观
登录 / 注册
AITOP

古文字识别

共 3 条相关 AI 资讯
7月14日
00:45
00:45Rowan Cheung@rowancheung
一项AI技术成功读取了一卷2000年前因火山喷发而烧成碳的卷轴,识别出其中文字。这卷来自公元79年维苏威火山爆发的碳化文书此前被认为无法阅读。该突破为AI在考古领域树立了新标杆。未来有望用类似方法揭示数千份同样被毁的历史文献。
AI模型碳化卷轴AI考古古文字识别

推荐理由:AI居然能读懂烧成炭的2000年古卷,比考古学家用手揭靠谱多了。快来看看这波操作。
原文
5月27日
20:57
20:57berryxia@berryxia
腾讯HY实验室联合四家机构发布Chronicles-OCR基准测试,专门评估AI对3000年中国古文字的识别能力。测试包含2800张专家标注图像,覆盖甲骨文、金文、篆书等七大类古文字。结果显示28个前沿多模态模型全部失败,最强模型在甲骨文上仅14%准确率,GPT-5和Gemini 2.5 Pro接近0。更反直觉的是,开启推理模式反而降低表现,模型实际依赖载体(如龟壳、青铜器)而非文字本身进行分类。该测试揭示了AI在文化遗产领域的巨大挑战。
AI模型OCR古文字识别多模态模型

推荐理由:这个基准测试戳破了多模态模型在古文字识别上的泡沫——它们根本没在认字,只是认载体。做文化遗产数字化或OCR研究的团队,看完会重新思考模型能力的边界。
原文
5月19日
16:00
16:00berryxia@berryxia
腾讯团队开源了Chronicles-OCR,一个专门用于评估VLLM对古汉字感知能力的基准数据集。该数据集覆盖从甲骨文到草书的3000年演变,包含7种历史字体、2800张来自真实载体的平衡图像。测试任务包括字符定位、细粒度识别、古文字解析和字体分类。结果显示,随着视觉分布的时间漂移,大多数模型的感知能力显著下降。这一工作将AI视觉能力与文化传承紧密结合,为古代历史研究提供了新的工具。
论文古文字识别OCR视觉语言模型

推荐理由:古文字识别是AI视觉的硬核边界,做OCR或文化遗产数字化的团队可以直接用这个基准测试自家模型,看看它们穿越回3000年前还能不能认出字。
原文
精选全部日报登录