视觉拾遗
ARCHIVE 0722026.07.23
下载 Markdown

SCREEN FRAGMENTS / MACHINE READING

视觉
拾遗

把散落在相册里的屏幕片段,重新变成可查找、可阅读、可带走的文字档案。 每张图保留原貌,并附上一句提炼与完整 OCR。

开始翻阅 识别:阿里云 qwen3-vl-plus
NO. 001—072
瑞幸咖啡官方账号发布视频,回应其门店隔壁一家烧饼店此前走红网络的现象,并亲自拍摄探店内容。
01

瑞幸咖啡官方账号发布视频,回应其门店隔壁一家烧饼店此前走红网络的现象,并亲自拍摄探店内容。

图片72全部成功识别
OCR 文字28,750个字符可搜索
并行耗时124.6s并发 5
重复项1161 张独立画面

02 / INDEX

图像索引

搜索会同时检索文件名、一句话摘要与 OCR 全文。 点击任一画面,可在原图旁阅读完整文字。

72

03 / METHOD

图像没有被压成结论。

一句话摘要负责快速扫读,OCR 全文负责保留细节,原图负责最终核对。 三者放在一起,才是一份可以放心分享的视觉笔记。

  • 01 图片经网页优化,原文件不改动
  • 02 72 张分五路并行送入视觉模型
  • 03 每张独立保存,汇总前再做完整性校验