把申報材料變成 可核對的證據表。
幾十頁到幾百頁的申報材料,幾秒鐘讀完。每個值都帶頁碼、原文和雙引擎交叉;初審員只需確認或改判。
- 文件✓
- 頁碼✓
- 坐標✓
- 原文✓
- 抽取方法✓
- 引擎交叉✓
- 置信度✓
不替人審, 只讓人審得快、審得住。
不給沒法追溯的風險分數
結論只有四種,每一種都說人話
沒有概率分數。每個結果都寫明依據。
一個材料包進來,系統做五件事
- 01
進料
PDF 文本層帶坐標直讀,掃描頁走本地 OCR,Word 與 Excel 一併處理。內容去重,並按必備件清單分類。
- 02
核驗
確定性校驗(信用代碼校驗位、預算求和、日期邏輯)、自有庫硬匹配(重複申報)、數據共享接口。每條規則都掛著指南原文出處。
- 03
對比
與同專題歷年項目比中位數與四分位。明確標注「參考,不作為退回依據」。
- 04
報告
字段證據表可並排核對;初審意見書出 Word 與 Markdown 兩份,退回理由只列企業能整改的項。
- 05
治理
專題配置按年度凍結成快照,材料包釘住收包當時那一版,指南改版不會翻舊賬。
整批審,不再一份一份點開
一批項目當成一個整體來審。人只處理系統沒把握的那些格子。
- 顯示進度與預計完成時間,按實測速度計算
- 總覽矩陣:項目 × 規則,按問題多少排序
- 整批所有「需人工」項排成一條覆核隊列,支援鍵盤快捷鍵
- 批量出具:通過,以及自動帶上理由的退回補正;整批意見書打包為 zip
- 批次完成時自動跑跨項目重複材料檢查
- 批次匯總表導出 Excel
每個數字背後的四條規矩
先定位,再抽取
按章節樹把字段映射到具體頁面,模型只看該看的那幾頁,不是把整本材料塞給模型碰運氣。
程序管數字,模型管語義
金額、日期、份數、比例一律由程序讀取和計算;模型只在表格直取、正則、計數全都沒命中時才出手,且必須給出原文。
無原文,不成值
模型給的值若在原文裡找不到,當場作廢並留痕。
四值結果,絕不默認通過
通過 / 不通過 / 需人工 / 未核驗。數據源接不上就明寫「未核驗」,不會因查不到就放行。
每個值附帶七項元數據
每個抽出的值都帶自己的出處。初審員可逐條點開,與原頁並排核對。
- 01文件
- 02頁碼
- 03坐標
- 04原文
- 05抽取方法
- 06引擎交叉
- 07置信度
直接看材料本身的檢查
印章
逐頁檢測紅色印章:幾枚、甚麼形狀、是否壓在頁邊(騎縫章)。手寫簽名交由人工判斷。
裝訂 PDF 按內容切分
一個文件裡裝訂了總結報告、審計報告、承諾書,逐頁認出每一段是甚麼材料。
同一項目、同一單位
比對合同、驗收書、審計報告上的項目名稱與承擔單位是否一致。
合同指標對照完成值
從合同讀取考核指標;完成值只從合同以外的材料裡找。
跨項目重複材料
同一張發票號碼、同一份文件或同一頁材料,出現在兩個以上項目裡。
指南審查要點
「加蓋公章」「簽名並註明日期」「報告須涵蓋合同技術指標」這類要求,逐條附頁面證據核驗。
由指南到規則集,不用寫代碼
導入申報指南或驗收要求,系統起草必備件、字段、規則與審查要點。未經人採納,一律不生效。
多專項、多年度,從一開始就做進去
專項組
這份指南是哪來的。一份指南一個盤子,只做分組與出處。
專題
按甚麼標準審。各自一套必備件、字段字典、規則集、對比池。
專題族
跨年度是否同一件事。查重、同類對比、初審員授權都沿它走。
年度版本
材料包按哪套規則審。克隆上一年度再改,發佈即凍結成配置快照。
申報批次
現在能否收包。申報窗口關了就不再收包。
企業預檢
企業提交前可自查,只返回自己能整改的項。
數據不出內網
政務網環境按離線設計:本地識別、模型可換、角色分權、全程留痕。
- 01OCR 跑在本機 CPU,不上雲。✓
- 02走 OpenAI 兼容接口,換成政務網內自建的模型只改一行地址;不配模型,那幾項改走「需人工補錄」。✓
- 03四類角色:管理員、初審員、審計、企業。審計與企業視角自動脫敏,頁面圖帶水印。✓
- 04每次改判、每次模型調用都進日誌,可回放。✓
四類角色,各看各該看的
設定專項並維持系統運作。
- 專項組、專題與年度版本
- 指南導入與規則採納
- 賬號與分派
- 備份與治理
在獲授權的專題族內,確認或改判系統抽出的值。
- 認領材料包、處理整批審查
- 字段證據表,與原頁並排核對
- 「需人工」覆核隊列
- 出具初審意見
只讀監督,個人資料自動脫敏。
- 全量審計日誌
- 誰在何時改判了哪個字段
- 模型調用與引用回驗記錄
按信用代碼只看到自己的材料包。
- 提交前自查
- 只看到自己能整改的項
- 提交補件
- 提出申訴
ZHISHEN 的全部功能
以下每一項,都已在 zhishen.agecms.com 運行中的系統裡。
進料
- PDF 文本層帶坐標直讀
- 掃描頁本地 OCR
- 表格識別
- 支援 Word、Excel、圖片及 PowerPoint
- 內容雜湊去重
- 分類到必備件清單
- 裝訂 PDF 按材料類型切分
- 大材料包分片上傳
- 一堆文件按資料夾或文件名分成各個項目
抽取
- 每個專題一套字段字典
- 先表格直取、正則、計數,再考慮模型
- 模型給的值回原頁核對
- 每個值帶七項元數據
- 中文大寫金額及單位歸一
核驗
- 信用代碼校驗位
- 預算求和與日期邏輯
- 必備件齊全
- 重複申報、歷史履約及限項
- 數據共享接口,接不上即「未核驗」
- 紅章檢測,含騎縫章
- 各材料間項目與單位一致
- 合同指標對照完成值
- 跨項目重複發票、文件及頁面
對比與報告
- 與同專題歷年項目比中位數及四分位
- 明確標註僅供參考
- 字段證據表,與原頁並排核對
- 初審意見書出 Word 與 Markdown
- 專家評審摘要(Word 或 Markdown)
- 批次匯總表(Excel)
批量智審
- 審查批次,附進度與預計時間
- 項目 × 規則總覽矩陣
- 「需人工」項統一隊列
- 批量通過及退回並附理由
- 整批意見書打包 zip
流程
- 分配與認領
- 審核時限及超期巡檢
- 站內通知
- 補件自動升版本並可看差異
- 企業申訴
- 企業提交前預檢
- 時限與分派按專題、專項組或系統預設
安全與賬號
- 四類角色:管理員、初審員、審計、企業
- 初審員按專題族、企業按信用代碼看數據
- 審計與企業視角自動脫敏
- 頁面圖及導出件帶水印
- 密碼至少 10 位、含三類字符,連錯 5 次鎖定
- 全量審計日誌
治理與運維
- 專題配置按年度凍結成快照
- 按存檔配置回放
- 回歸測試與擾動測試
- 人機差異日誌及規則準確率看板
- 在線熱備,保留 14 份
- OpenAI 兼容模型接口;不配模型也能跑
關於 ZHISHEN,你可能想問的。
ZHISHEN 會批准或駁回申報嗎?
不會。它產出可核對的證據與初審意見;最終審批決定以人工審核為準。
現在可以註冊嗎?
暫不可以。當前階段僅對內部賬號開放,尚未對外受理註冊。
能處理掃描件嗎?
可以。掃描頁走本地 OCR,PDF 文本層、表格、Word 與 Excel 一併處理。
數據源接不上時會怎樣?
該項明寫「未核驗」,絕不默認通過。
需要雲端 AI 模型嗎?
不需要。任何 OpenAI 兼容模型都可用,包括政務網內自建的模型;不配模型也能跑。
一個幾百頁、裝訂了多份材料的 PDF 能處理嗎?
可以。系統逐頁讀取標題區,把文件切成各份材料,裝訂在內的總結報告、審計報告不會被誤報為缺件。
會檢查印章和簽名嗎?
會逐頁檢測紅色印章,包括壓在頁邊的騎縫章,並附頁碼如實報告。手寫簽名無法按顏色識別,交由人工判斷。
可以同時審很多個項目嗎?
可以。審查批次會顯示進度、項目 × 規則矩陣,以及一條需要人處理的統一隊列,意見書可以整批出具。
科技申報 相關的 AI 新觀察。
中小企抄哪步
拆解香港BUD申請易15萬港元、30億算力補貼與餘杭AI+OPC政策,講清現金型與資源型資助的門檻差異,幫中小企找到能對上時間點的申報路徑。
大模型動態 · 2026 年 9 月 26 日Opus 5.5 降四成、GPT-6 砍一半,出海企業 AI 賬單為何沒降
大模型API集體降價四到五成,出海企業的AI賬單卻沒同步下降。拆解降價背後的定價邏輯變化,指出真正吃預算的是內容外包與工具切換成本,並給出把模型能力裝進日常工序的落地思路。
AI 早報 · 2026 年 9 月 26 日Anthropic 的七年 116 億美元算力長約,簽給了 Akamai
Anthropic 與 Akamai 簽下七年 116 億美元 CPU 算力長約,揭示 AI 成本正從訓練轉向推理。文章拆解這筆交易對 API 定價、中小企業與出海團隊的真實影響。