用 16.6 万神经元果蝇大脑读 PDF,字符识别准确率 87%
llama_index · x · 2026-09-14
LlamaIndex 创始人 Jerry Liu 发布开源项目 FlyOCR:用完整的雄性果蝇连接组(MaleCNS v1.0,约 16.6 万神经元、2500 万突触边)来识别 PDF 中的印刷字符。
工作流程:
- 将 PDF 图像拆成单个字形,像素映射为复眼感受器激活
- 在连接组电路上跑简化电流动力学模拟
- 对下游脉冲用一个紧凑的 readout 模型,拼接成解析输出
实测:读取微软 10-K 文件时,资产负债表标题识别约 86%,数值基本读对;在 1700+ 采样字形上准确率 87%,作者称继续训练可能逼近后期 MNIST 模型水平。项目完全开源(代码+研究报告),可在 Mac 本地运行,并能可视化每个预测背后的字符扫描、眼部采样与神经活动。
「Fun」频道最新
- Beff Jezos 炮轰 AI Safety 阵营:称本周是操控舆论与监管俘获 — beffjezos · 2026-09-14
- Astra 演示走出《辐射3》避难所,完整视频即将放出 — imjustnewatai · 2026-09-14
- 开发者吐槽:一句命令误拉超长上下文,OpenRouter 余额瞬间耗光 — haydendevs · 2026-09-14
- 开发者吐槽:用 astra 9 秒烧掉 30 美元 — haydendevs · 2026-09-14
- 传闻 Astra 解决千禧年难题后,AI 能否当 NeurIPS 审稿人引吐槽 — LucaAmb · 2026-09-14
- 微软员工自嘲:作为微软人,我也庆幸没人喜欢 Teams — 0xkarasy · 2026-09-14