首页
学习
活动
专区
圈层
工具
发布
社区首页 >专栏 >从 3.94 亿页书里捞出 2262 万个视觉元素

从 3.94 亿页书里捞出 2262 万个视觉元素

作者头像
用户8729876
发布2026-08-27 16:12:24
发布2026-08-27 16:12:24
610
举报
概述
💡 一句话总结:这篇报告把书籍视觉元素当作一等数据对象,用轻量检测、分类、去重和可选 caption 组成可审计管线,在 Harvard Library 数亿页扫描上释放 22,622,060 个视觉 crop。
文章被收录于专栏:智能文档处理智能文档处理

原创声明:本文系作者授权腾讯云开发者社区发表,未经许可,不得转载。

如有侵权,请联系 cloudcommunity@tencent.com 删除。

问题归档专栏文章快讯文章归档关键词归档开发者手册归档开发者手册 Section 归档