Skip to content

OCR 移出 macdoc:文字辨識一律委派 bestOCR,macdoc 不自帶 OCR 能力 #145

Description

@kiki830621

Problem

Original text(owner,2026-08-07):
「ocr的部分我想要從macdoc裡面移出來」
「bestOCR 的readme似乎也是想錯了,反而是macdoc需要文字辨識的時候直接轉給bestOCR」

現行架構(bestOCR README 的關係圖)是 ocr-swift 作為 shared capability layer,macdoc 與 bestOCR 是平行消費者,且 README 明寫:

moving measureOCR out of macdoc changed zero build dependencies. macdoc's PDF tools keep their OCR capability untouched.

Owner 的裁定把方向反過來:OCR 的所有權歸 bestOCR 一家。macdoc 是文件工具(pdf-to-latex 等),需要文字辨識時委派給 bestOCR,不自帶 OCR 能力。

Type

refactor

Expected

  • macdoc 不再提供 macdoc ocr 子命令(或降為呼叫 bestOCR 的薄轉接)
  • macdoc 對 ocr-swift 的依賴只剩非 OCR 用途(若有),OCR 路徑一律經 bestOCR
  • 引擎選擇、版本紀錄、evidence 慣例全部由 bestOCR 單點負責

Actual

  • macdoc ocr 自帶完整 OCR 路徑(ollama/mlx backend 選項、--pages、--max-tokens)
  • 同一台機器上兩套入口各自演進,引擎與版本紀錄慣例只在 bestOCR 側有

佐證:下游已經先走了

下游題庫專案(educator_item_bank,private)2026-08-07 已把「掃描 PDF → macdoc ocr」的作業指引整段刪除、改為一律走 bestOCR。macdoc 這頭不動的話,macdoc ocr 會變成一條沒有文件、沒人維護 evidence 慣例的殘留路徑——正是最容易產出「不知道哪個引擎、什麼版本辨識的文字」的地方。

Strategy(初步,待 diagnose)

  • 盤點 macdoc ocr 的呼叫面(CLI 使用者、skill、文件)
  • 決定移除 vs 薄轉接(macdoc ocr 印 deprecation 指向 bestOCR,一版之後移除)
  • macdoc README/skill 文件更新
  • 與 bestOCR 側 README 修正(tracking issue 見下)同步 land

Related

  • Tracking:PsychQuant/bestOCR(README 關係圖與「keep their OCR capability untouched」段落的方向修正)

Activity

Sign up for free to join this conversation on GitHub. Already have an account? Sign in to comment

Metadata

Metadata

Assignees

No one assigned

    Labels

    enhancementNew feature or request

    Type

    No type

    Projects

    No projects

      Milestone

      No milestone

      Relationships

      None yet

      Development

      No branches or pull requests

      Issue actions