手冊首頁 / Release Notes / Guidant AI v1.3.0 Release Note

Guidant AI v1.3.0 Release Note

項目 內容
版本 1.3.0(功能版號 bump)
發布日期 2026-05-29
上一版本 1.2.1(2026-05-28)
涵蓋區間 2026-05-28 ~ 2026-05-29
規模 主功能 1(FR-030.2 圖片/PDF 證據分類)+ 數筆零星修補 / 文件 tweak
適用部署 dev → staging(evidence-classify 仍屬實驗階段,正式環境不建議啟用)

1. 概述

v1.3.0 的主軸是把 AI 證據自動分類(FR-030)的辨識能力從「只看文字」擴展到「看得懂圖片與 PDF」。v1.2.1 已把整條觸發 → 分類 → 審閱 → 預覽鏈路推到 dev demo-ready,但分類器只讀文字檔(docx/csv/txt…),截圖與 PDF 證據一律被當 [Unsupported file type] 跳過。本版用 Claude Vision(多模態)讓這兩類常見證據也能進入分類管道。

仍屬實驗階段(同 v1.2.1):未 DB 化、僅支援 cmmc-l1、實驗階段不設成本上限。


2. 重點功能

2.1 FR-030.2 — 證據分類支援圖片 / PDF 內容辨識(Claude Vision)

為什麼:合規證據裡截圖(設定畫面、console 輸出、後台 dashboard、MFA 設定頁)與 PDF 報告非常常見,畫面狀態本身就是證據。原分類器收不到畫面資料,這類證據完全分不了類,要人工歸檔。

做了什麼:把分類 container 的管道從「字串進」改成「Anthropic content blocks 進」:

檔型 處理方式
docx/csv/txt/log/md 本地抽純文字 → text block(行為不變
png/jpg/jpeg/gif/webp bytes → base64 → image block → Claude Vision
pdf bytes → base64 → document block → Claude 原生讀全頁(文字層 + 圖)
超限(圖 >5MB / PDF >32MB 或 >100 頁)/ 不支援格式(.heic/.tiff/.zip…) skip → 既有「未處理」清單

選 Vision 而非 OCR:分類要的是語意理解(「MFA 設定頁且已啟用」),OCR 先把版面 / UI 狀態壓成散落文字反而更差,且 Claude API 本來就在用、是現成能力。

關鍵紅線:原流程不變_state.json 結構、Drive 歸檔(建 AO 資料夾 + files.copy)、review UI 完全沿用 —— 圖片 / PDF 只是多一條進得了分類器的路,出分類器後與文字檔走同一條歸檔路。文字檔分類結果與改版前語意等價,無 regression。

端對端:已用真實 Drive + Claude 跨一張截圖 + 一份 PDF 實測,確認被分到 AO。

連帶list_jobs 回傳 evidence_folder_id 供 FE 顯示 Drive 連結。


3. 其它修補 / 調整(自 v1.2.1 後)

以下為落在本 release 區間、v1.2.1 release note 未涵蓋的零星項目。

  • tweak(docs):導入 docs/features/ FR 編號規範(FR-<序號>-<YYMM>-<功能名>)並全域更新交叉引用(commit 070ac2c2,changelog 2026-05-29-tweak-feature-folder-fr-numbering.md
  • tweak(evidence-classify):sync api-spec / spec / release-note 與近期變更對齊(commit 55c27218,changelog 2026-05-29-tweak-evidence-classify-docs-sync.md
  • fix(docx-import):mf-default confirm 時刪除已不存在的 components/LA/inventory(commit 738f0119
  • fix(excel-import):template MF 無 SSP 時 update flow 不再回 412(commit b323ca52
  • fix(template-copy):title param cast varchar 避免 psycopg3 AmbiguousParameter(commit 28848ec4

4. Breaking Changes

無。FR-030.2 為純新增能力,既有文字檔分類行為與 API / _state.json 結構不變。

5. DB Migration

無。

6. 相依套件版本

  • 新增 container 依賴 pypdf>=4(僅 scripts/evidence/classify/docker/;主專案不受影響)
  • 既有 anthropic>=0.77(已支援 image + PDF document block),無需 bump
  • jedi-* 無異動

7. 部署順序

  1. 重新 build classifier image(雙 tag:版本 tag 留追溯 + latest 給 BE 跑;BE classifier_container_runner.py 寫死用 :latest):
    docker build \
      -t cmmc-classifier:1.3.0 \
      -t cmmc-classifier:latest \
      -f scripts/evidence/classify/docker/Dockerfile \
      scripts/evidence/classify/docker
    requirements.txt 改了會自動讓 pip 層 cache 失效裝入 pypdf;要全乾淨重來加 --no-cache
  2. 主專案 BE 重啟(list_jobs 回傳新欄位 evidence_folder_id
  3. evidence-classify 仍屬實驗功能,正式環境不建議啟用

8. 已知 follow-up

  • .xlsx / .pptx 尚未支援:兩者常見於合規證據(Excel 清單 / 簡報),Claude API 無原生 block,需走本地抽文字(openpyxl / python-pptx)。本版未納入,已記為 follow-up(討論到設計即暫停,見對話紀錄)。
  • 成本控管 / quota:實驗階段刻意不設上限,正式版再議。
  • 部分區間內的 fix commit(docx-import / excel-import / template-copy)可能缺獨立 changelog,屬 v1.2.1 收尾遺留,待補。

9. 完整 changelog 索引

  • docs/changelog/2026-05-29-feat-evidence-classify-image-vision.md(本版主功能)
  • docs/changelog/2026-05-29-tweak-feature-folder-fr-numbering.md
  • docs/changelog/2026-05-29-tweak-evidence-classify-docs-sync.md

10. 相關文件索引

文件 路徑
FR-030.2 spec docs/features/FR-030.2-2605-evidence-classify-image-vision/design.md
FR-030.2 plan docs/features/FR-030.2-2605-evidence-classify-image-vision/implementation-plan.md
FR-030.2 執行交接 docs/features/FR-030.2-2605-evidence-classify-image-vision/handoff/2026-05-29-execution-handoff.md
FR-030 母功能 spec docs/features/FR-030-2605-auto-evidence-classification/design.md
evidence-classify API spec docs/api/evidence-classification/api-spec.md