AI 能力檢測怎麼測、怎麼計分
AI-CAT · AI 能力自我評測工具
AI-CAT 不是選擇題題庫、也不核發正式證書——它是一個生成式 AI 能力自我評測工具: 免安裝、免跑考場,線上就能測,用真實職場情境的動態沙盒對話,量化你「駕馭 AI」的實作能力, 而不是「認不認識 AI 名詞」。以下把測驗流程與計分規則完整攤開,不含任何真實題目內容。
怎麼測
- 免登入即可先試用一場,不用安裝任何東西,瀏覽器打開就能測。
- 系統隨機抽一個真實職場情境,附任務說明與限制條件;你先自評對這個領域有多熟,讓評分更公平。
- 在雙欄沙盒裡跟平台的生成式 AI 助手對話、追問、修正——最多 10 輪,單則輸入上限 1000 字。
- 過程中系統有機率悄悄埋入一則錯誤資訊,測試你是否照單全收。
- 提交後由高階 AI 裁判模型盲審完整對話歷程,不知道你是誰,輸出五維度結構化評分。
- 免登入試用最多 6 輪對話、結果不保存;登入後每日 3 場免費、生涯累計上限 21 場。
怎麼計分:五個維度
五個維度各自 0–100 分,依固定權重加權平均成一個總分;同一套權重不因題目或情境分類而異:
- 提示詞結構(25%):角色、脈絡與輸出格式限制是否明確
- 問題拆解力(20%):是否分階段引導、逐步確認,而非一次全丟
- 對話效率(15%):最終成品品質 ÷ 有效輪次
- 批判思考(25%):是否識別並糾正 AI 給出的錯誤資訊
- 任務達成率(15%):對話中實際產出的成品是否滿足所有限制條件
分級對照
加權總分依下列門檻對應到 L1–L5:
- L1 AI NOVICE:低於 40 分
- L2 AI USER:40–54 分
- L3 AI PRACTITIONER:55–69 分
- L4 AI COLLABORATOR:70–84 分
- L5 AI ORCHESTRATOR:85 分以上
另有一條規則上限:陷阱資訊確實出現在對話裡、但你沒有質疑或查證就照單全收, 不論加權分數多高,那場分級最高只到 L3。
涵蓋哪些情境類型
題庫依職場情境分成 11 個分類,每次隨機抽一題:
- 創意行銷
- 金融投資
- 醫療保健
- 傳播藝術
- 資訊軟體
- 學術教育
- 生產製造
- 客戶服務
- 商業營運
- 生活與人際
- 個人理財
常見問題
AI-CAT 免費嗎?
免登入可先試用一場(最多 6 輪對話)。登入後每日 3 場免費、隔日重置,免費帳號生涯累計上限 21 場,目前沒有付費方案。
跟坊間選擇題型的 AI 能力認證有什麼不同?
AI-CAT 不是選擇題題庫,也不核發正式證書——它是一個自我評測工具:你要在真實職場情境的沙盒裡實際跟 AI 助手對話、產出成品,由高階 AI 裁判模型盲審整段對話,量化你「駕馭 AI」的實作能力,而不是「認不認識 AI 名詞」。
分數是怎麼算出來的?
五個維度(提示詞結構、問題拆解力、對話效率、批判思考、任務達成率)各自 0–100 分,依固定權重加權平均成一個總分,再對應到 L1–L5 分級。同一套權重不因題目或情境分類而異。
陷阱題會怎麼影響分級?
每場對話系統有機率悄悄埋入一則錯誤資訊。如果它確實出現在對話裡、但你沒有質疑或查證就照單全收,不論加權分數多高,那場分級最高只到 L3。
多久可以測一次?
單場約 5–10 分鐘、最多 10 輪對話。登入帳號每日可開始 3 場(隔日重置),做越多場,跨情境的綜合分級估得越準。
我的對話內容會被看到嗎?
對話內容會送交 AI 模型評分並保存為逐字稿,僅用於顯示你的結果與改進評分模型。公開分享連結只會顯示雷達圖、分級、分數與一句總評,不含題目內容或逐字稿,詳見隱私政策。
準備好了嗎? 回到首頁開始檢測 →