首页 > 车圈原创 > 车圈原创 > 谷歌AI破译古籍新巅峰:错误率仅0.56%,准确率媲美人类专家

谷歌AI破译古籍新巅峰:错误率仅0.56%,准确率媲美人类专家

发布时间:2025-11-16 14:04:34来源: 13041198719
11 月 16 日消息,科技媒体 golem 昨日(11 月 15 日)发布博文,报道称谷歌通过其 AI Studio 平台,正测试一款尚未命名的 AI 模型,在破译难以辨认的历史手稿方面已接近人类专家的水平。
 
IT之家援引博文介绍,历史学家 Mark Humphries 使用一套专门开发的基准数据集,系统性地测试了该模型的性能。结果表明,在处理五份高难度历史手稿时,该模型的整体字符错误率约为 1.7%,其中大部分错误涉及标点符号和大小写,而非单词本身。
 
 
 
Humphries 的评估进一步指出,如果排除模糊的标点符号和大小写错误,该 AI 模型的字符错误率将骤降至约 0.56%,相当于每转写 200 个字符才出现一个错误。
 
根据新发现的未知 Gemini 型号转录的奥尔巴尼账簿页面
 
这一惊人的准确度,让其性能足以与从事历史文献转写的专业人类工作者相提并论。此次测试的文档涵盖了 18 至 19 世纪的多种手写风格,其中不乏字迹潦草、拼写错误和语法不一致的复杂样本,进一步凸显了该模型的强大能力。
 
该模型最令人意外的表现,是其超越了简单的文字转写,展现出复杂的推理能力。在处理一份 18 世纪商人的日记时,原文中有一条关于购买糖的记录,仅标记了数字“145”,并未注明计量单位。
 
谷歌的 AI 模型并未直接转写为“145”,而是输出了“14 磅 5 盎司”。研究人员发现,AI 是通过反向计算账本中记录的总价,并结合当时英国的货币(磅、先令、便士)与重量单位关系,才成功推断出这一结果。
 
 
 
尽管初步结果令人振奋,但 Humphries 也强调了当前评估的局限性。由于该模型通过 A/B 测试形式零星出现,系统性地进行大规模测试存在困难,目前仅评估了基准数据集中约 10% 的样本。
 

车圈原创更多>>

别克至境世家插混奢享版:五恒座舱+四驱,适合全家人的新能源MPV 全能型MPV推荐!别克至境世家,空气悬架+C级空间,续航1320km 硬件堆料难救市场表现,魏牌V9X月销始终难破两千台 增程月销量暴跌25%,小米澎程此刻入局算晚吗? 比亚迪海狮08预计将于8月上市 终于有人把这道题做完整了!东风奕派M8体验记 东风奕派M8:华为乾崑全系标配,这台六座SUV在照顾全家人的里子 国内首个湿热车辆出口定型检测基地投用,补齐汽车出海验证短板 宝马高管明确产品定位,全新一代X5不再侧重强化越野能力 启境GX7轴距3070mm,一键成床大五座SUV空间实用性解析 2026款凯迪拉克CT5测试翻车,IIHS四项核心项目获评最差评级 莲花跑车2026下半年产品矩阵首曝光,三大动力路线同步落地 小米澎程N90/N70申报,5/7座增程SUV亮相 华境S,累计销量破万,主打家庭多场景出行需求 享界V8登陆工信部申报目录,纯电增程双动力完善产品矩阵 弱化大屏视觉核心,奥迪下一代座舱重启实体操作部件 切入大空间SUV赛道,小米澎程扩充品牌产品矩阵 7系阵营集体失眠!启境GX7猜想图流出,“湾区大卡宴”未发就赢了 FREELANDER神行者8 首发限定版全球首秀 23.99万起,全尺寸+闪充+智驾:大唐EV的旗舰体验,一步到位 最早“举”起芯片的零跑,给“芯片自研”做减法 千年文明,万里闪充—— 重走马可波罗新丝绸之路 汇聚顶级气场、硬核实力、旗舰体验,大唐EV上市,售价23.99万元起 23.99万起掀翻旗舰桌子!比亚迪大唐EV上市,全尺寸纯电SUV开始“卷”真格了? 李想回击“唱衰增程”:纯电增程满足不同需求,不要搞能源鄙视链 欣旺达动力王勇:2030年国内HEV市占率可达15%-16% 是MPV也是SUV!魏牌高山 7 SUV版上市限时权益价27.08万 6.28万起开上大满配,高颜值、大空间极狐贝塔T1焕新上市 颜值舒享智能全进阶,哈弗H6经典版2026款限8.19万元起 7.89万起,第5代帝豪 i-HEV智擎混动上市,2L级油耗+强动力