一分鐘重點:把教材整理乾淨貼給 AI,講清楚考試對象、範圍與難度,指定選擇、是非、問答、情境各出幾題,並要求每題都附標準答案、逐項詳解與「這題出自教材哪一段」的命題依據。拿到題目後別急著用,逐題人工複核四件事——答案是不是唯一且正確、選項會不會洩題、有沒有超綱、是不是送分題,有問題就砍掉或改寫。最後小範圍試測,把太多人全對或全錯的題目調一調鑑別度。AI 幫你把「量產題目」這段苦工自動化,但最終能不能考、公不公平,還是要出題的人自己扛。
出過考卷的人都知道,出題比改考卷還累。一份好的考卷不是把知識點抄成問句就好,它要涵蓋範圍、要有難易梯度、選項要設計得刁鑽但公平、答案要禁得起學生來爭。以前一份段考卷或一場內訓認證考,光出題就要耗掉一個晚上。AI 的出現確實把這件苦差事變快了,但也帶來一個危險的錯覺——它產出的題目「看起來」太專業,讓人忘了逐題檢查。這篇就用台灣老師、企業訓練承辦、自學考生的實際情境,帶你把 AI 當成命題助教,量產又不出包。
先想清楚:AI 出題到底在幫你省什麼
先破除一個迷思:AI 不是幫你「決定要考什麼」,那是你的專業。它幫你省的是把腦中的考點「轉成一題一題成形題目」的體力活——寫題幹、設計誘答選項、擬參考答案、排版。這個定位很重要,因為它決定了你該怎麼用它、又該防它什麼。
當你把出題主導權交出去,讓 AI 自己決定考什麼,它就會挑「教材裡最好出成題目的句子」來考,而不是「最該考的重點」。結果常常是一堆枝微末節的名詞背誦,真正的核心觀念反而漏掉。所以正確的順序永遠是:你先決定考點與範圍,再讓 AI 幫你把這些考點鋪成題目。主導權在你,AI 只是加速器。
第一步:整理教材並界定範圍,別讓它超綱
Garbage in, garbage out。你餵的教材越乾淨、範圍講得越清楚,題目就越不會歪。
實際做法是把要考的範圍整理成一段乾淨文字:講義、課本某幾章、內訓簡報的文字稿都可以,去掉頁碼、版權聲明這類雜訊。接著一定要交代三件事,這是防超綱的關鍵。第一,考試對象是誰——高一學生的段考、到職三個月新人的認證考、還是準備國考的成人自學,對象決定深度。第二,範圍到哪裡——明確說「只考第三章到第五章」,並補一句「不要出這個範圍以外的題目」,AI 才不會自作聰明拉進課外知識。第三,這是什麼性質的考試——是要篩選淘汰的鑑別考,還是確認人人都學會的達標考,兩者的難度設計完全不同。
超綱是 AI 出題最常見也最隱蔽的毛病。它腦中有整個網路的知識,很容易在「行政法」的題目裡塞進一個講義根本沒教的學說,學生答不出來會覺得被陰。所以「只准用我給的教材出題」這句話一定要寫進去,並在複核時特別盯有沒有教材裡找不到的概念。
第二步:指定題型、題數與能力層次
不要只丟一句「幫我出十題」。你給的規格越細,回來的東西越能用。
題型與配比要講明白,例如「選擇題 6 題、是非題 4 題、問答題 2 題、情境應用題 1 題」。不同題型考的能力不一樣:選擇與是非適合考記憶與辨識,問答適合考理解與表達,情境題適合考應用與判斷。一份好考卷會混搭,不會全部塞選擇題。
更進階的做法是指定「能力層次」,這是控制難度最有效的手段。你可以用大家熟悉的分類:記憶(記得定義)、理解(能解釋)、應用(會用在新情境)、分析(能比較判斷)。直接告訴 AI「記憶與理解層次各佔一半,另外出兩題應用層次」,它產出的難度梯度會比你只說「難一點」穩定得多。因為「難一點」對 AI 來說沒有錨點,它可能只是把題幹寫得更繞、更長,而不是真的更需要思考——這種假難度反而傷鑑別度。
第三步:一定要附標準答案、詳解與命題依據
這是 AI 出題和人出題最不一樣、也最能幫你的地方——你可以要求它把「為什麼」全部攤開,方便你複核,也方便日後講解。
三樣東西缺一不可。第一是標準答案,選擇是非要標正解,問答情境要給參考答案與給分點。第二是逐項詳解:選擇題不只講為什麼對,還要講每個錯誤選項「錯在哪」,這一步能逼 AI 自我檢查,也能讓你一眼看出它是不是在硬拗。第三是命題依據——要求它標註「這題考的觀念出自教材第幾段/哪一句」。這一招極度好用,因為只要它標不出依據,或標的段落根本沒這回事,就代表這題超綱或是它自己編的,當場抓包。
命題依據還有個好處:日後學生來爭答案,你手上有出處,不用臨時翻書。內訓場合更需要這個,受訓者質疑「這題公司從沒教過」時,你能直接指到教材位置。
第四步:用這個 Prompt 一次到位
下面這個 Prompt 把上面的規格都包進去了,直接複製、填入你的資訊即可。它會強制 AI 附上答案、詳解、命題依據,並自我檢查有沒有洩題與超綱。
你是一位資深的命題老師,擅長設計公平、有鑑別度的試題。我要根據下面的教材出一份測驗,請嚴格遵守以下規則。
【考試設定】
- 考試對象:(例:高一學生段考/到職三個月新人認證考/準備普考的自學者)
- 出題範圍:只能用我提供的教材,禁止使用教材以外的知識,不得超綱。
- 難度定位:(例:達標型,多數人應能通過/鑑別型,要拉出程度差距)
【題型與題數】
- 選擇題(單選,4 選項):__ 題
- 是非題:__ 題
- 問答題(簡答):__ 題
- 情境應用題:__ 題
【每題都要附上】
1. 標準答案;問答與情境題要列出「給分點」(答到哪些要點各得幾分)。
2. 詳解:選擇題要逐一說明每個選項為什麼對/為什麼錯,錯誤選項要是「有道理但錯」的誘答項,不能亂湊。
3. 命題依據:標明這題考的觀念出自教材哪一段或哪一句;若標不出依據,代表可能超綱,請刪掉此題重出。
【品質要求,出完請自我檢查】
- 選擇題四個選項長度相近、語氣一致,不要讓正解特別長或特別完整而洩題。
- 避免「以上皆是/皆非」當保底答案,避免「一定、絕對、所有」這類過度絕對的字眼。
- 每題答案必須唯一且正確,不能有兩個都對或都說得通的情況。
- 依【題型與題數】的能力層次分配難度(記憶/理解/應用/分析)。
- 最後附一段「自我檢查報告」,說明你認為哪幾題最可能有爭議或需要人工複核。
【教材內容】
(把你的講義/課本章節/簡報文字稿貼在這裡)
那段「自我檢查報告」很值得留著,AI 常會老實招認「第 3 題的兩個選項可能都對」「第 7 題的情境我不確定是否符合台灣現況」,等於幫你標出高風險題,複核時先看這幾題。
台灣命題實戰:三個真實情境
高中公民老師——新北的林老師。 期中考要出公民與社會的段考卷,林老師以前一份卷要磨兩三個晚上。他把課本三個章節的內文貼給 AI,用上面的 Prompt 一次產出 20 題選擇加 3 題問答,附詳解與命題依據。他說最省事的是「詳解直接可以拿去當考後檢討的講義」。但他也強調一定要自己看過:「有一題問人民權利救濟,AI 給的標準答案把訴願和行政訴訟的順序寫反了,我沒看就印下去,全班都會被誤導。」他現在固定會遮住題目只看四個選項自己猜一遍,抓洩題。
企業教育訓練承辦——科技業的 Nina。 公司新人到職要考一份資安認證,Nina 要根據內部規範文件出題。她把規範文件丟給 AI,指定「達標型、以理解與應用層次為主」,出了一份 30 題的線上測驗。她踩過的雷是情境題:「AI 設計的一個情境是引用歐盟 GDPR 的處理流程,可是我們公司走的是台灣個資法,情境根本套不上。」她的心得是情境題一定要確認「這個情境在我們公司、在台灣成立嗎」,不能只看答案對不對。她現在都要求 AI 標命題依據,標不到公司規範原文的題目一律砍。
準備國營招考的自學者——高雄的阿凱。 阿凱沒有考古題資源,就用 AI 根據自己整理的重點自己出模擬題自測。他的用法很聰明:出完先不看答案,自己作答完再對 AI 的詳解,把答錯的觀念回頭翻書。他發現的問題是難度不穩:「同一批題目裡有的送分、有的難到超綱,我後來每題都叫它標能力層次,把標成分析層次但其實只是背名詞的題目挑掉。」他提醒同樣自學的人:AI 出的模擬題只能練手感,別把它產出的「參考答案」當成官方標準,冷門法規它常講錯。
這三個人的共同點是:AI 幫他們把「把考點鋪成題目」這段最花時間的工作自動化,但答案正不正確、情境合不合台灣、難度公不公平,每個人都自己扛最後一關。
常見錯誤與瑕疵清單
出題這件事,AI 的錯誤有固定的幾種面孔,認得它們就能快速抓包。
標準答案根本是錯的。 這是最致命的。AI 會很有自信地給一個錯答案配上頭頭是道的詳解,尤其在需要精確記憶的地方——法條順序、公式、年份、專有名詞定義。任何封閉答案都要對照教材核對,不能因為詳解寫得漂亮就信。
答案不唯一,兩個選項都對。 AI 設計誘答項時,有時會不小心讓某個「錯誤選項」其實也說得通,變成一題兩解。學生一爭議你就難收場。複核時每個選項都要問自己「這個真的錯嗎」。
選項洩題。 正確選項寫得又長又完整、錯誤選項出現「一定、絕對、所有」這種太滿的字、或是文法時態只有正解接得上題幹。防這個最快的方法是遮住題幹只看四個選項猜答案,猜得中就是洩題。
超綱。 題目考到教材裡根本沒有的知識。靠「命題依據」欄位抓——標不出出處的題目就是嫌疑犯。
送分題與無鑑別度題。 選項爛到隨便猜都對、或是問得太淺人人會,這種題白佔一格。它不會害人但浪費考卷長度,該換成有區辨力的題目。
情境不符台灣現況。 情境題最容易踩,AI 常引用國外制度、法規或流程。確認「這個情境在台灣、在你的場域成立嗎」。
是非題敘述模稜兩可。 一個句子裡塞兩個判斷,一半對一半錯,就無法回答對或錯。要求每個是非題只判斷一件事。
AI 幫不了你的部分
講在最後,也講最誠實:有些事 AI 做不到,你不能指望它。
它不知道你這場考試真正的重點是什麼。它只看得到你貼的教材,看不到你課堂上特別強調的、考古題常出的、業界實務最看重的。決定「該考什麼」永遠是命題者的專業判斷,AI 只能在你圈定的範圍裡幫你鋪題。
它不保證答案正確。AI 是在模仿「題目與答案應該長什麼樣子」,不是真的在驗證事實。它可以把一個錯答案包裝得非常專業。所以封閉題目要核對、開放題目的參考答案要逐點檢查,這關省不掉,也不該省。
它抓不準難度與鑑別度。Prompt 能給大方向,但一題到底是難是易、能不能區分程度,最終只有真人考過才知道。全對全錯的題目要靠試測數據回頭調,這是 Prompt 做不到的。
它不懂在地脈絡與時效。台灣的法規、產業慣例、最新修法,AI 的知識可能過期或根本錯。情境題尤其要人工確認符不符合現況。
說白了,AI 是一個能日夜量產題目初稿的命題助教,但它沒有教學經驗、不認識你的學生、不為考試的公平性負責。這份責任只能是你的。把它當加速器,讓它扛量、你把關質,這份考卷才既省時又站得住腳。
現在就試:出一份你手上正要用的測驗
不用等到「準備好」,挑你最近正要出的一個小範圍,今天就試一次。流程很短:整理一段乾淨教材、講清楚對象與範圍、指定題型與能力層次、用本文 Prompt 產出附詳解與命題依據的題目、逐題複核四件事(答案唯一正確、不洩題、不超綱、不送分),最後小範圍試測調鑑別度。跑過一輪你就會知道,AI 能幫你把出題從一整晚縮到半小時,但真正讓考卷能用的,是你把關的那半小時。
本文由 AgentAI 智庫(agentai.tw) 整理,台灣最大的繁體中文 AI 應用知識站。內容僅供命題方法參考,AI 產出的題目與答案仍可能有誤,正式考試前務必逐題人工複核,答案與範圍以官方教材為準。
常見問題 FAQ
AI 出的題目可以直接拿去考試嗎?
怎麼讓 AI 出的題目難度穩定,不會忽難忽易?
什麼是鑑別度?為什麼出題要在意它?
選擇題的「選項洩題」是什麼意思,怎麼避免?
AI 出問答題和情境題,會不會比選擇題更容易出錯?
免費版的 AI 夠用來出題嗎?還是要付費?
延伸閱讀
每週把這類實戰教學寄給你
訂閱 AgentAI 智庫情報週報,新的 Prompt、AI Skills、工作流與教學第一時間收到。
免費 · 隨時取消