IELTS口說可以用AI應用程式準備嗎?推算級分的可信度與使用區分
先說結論。Part 2、Part 3的形式反覆練習、確保每日發話量、發音的聲學診斷,這些都可以透過AI應用程式來準備。甚至有服務可以免費使用完整模擬測驗及推算級分顯示功能,費用門檻幾乎已不存在。線上英語會話的自由對話往往無法呈現如Part 3般的抽象討論,若每次模擬考口說總是卡在6.5分,面對這種停滯,AI能大幅增加「反覆練習的量」。
不過,AI顯示的推算級分,並非經過考試機構校準的評分。提供方本身也並未保證與實際分數完全一致,甚至有服務公開承認,部分評分標準單靠AI評估的精確度並不足夠。因此,正式應考前的實力判定與對策方針的制定,仍需借助理解評分標準的真人進行模擬面試。
本文根據2026年8月時點對各家官方資料的調查結果,從IELTS口說準備的角度,說明如何靈活運用各AI應用程式,以及「該如何看待推算級分」。關於AI英語會話應用程式整體的選擇方式(技術方式、費用、與平價線上英語會話的比較),請參閱總論文章。
AI英語會話應用程式推薦比較【中級者適用】
IELTS口說的評分標準與AI的守備範圍
IELTS口說是與經過訓練的認證考官進行面對面訪談(11~14分鐘),並依流暢度與連貫性(Fluency and Coherence)、詞彙運用(Lexical Resource)、文法廣度與準確性(Grammatical Range and Accuracy)、發音(Pronunciation)四項標準進行綜合評分的考試。Part 2在1分鐘準備後進行1~2分鐘的演講,Part 3則就相關主題與考官進行抽象討論。
將這四項標準與AI應用程式的能力對照,可以清楚看出各自的守備範圍。
評分標準 | 考官所觀察的重點 | AI應用程式的守備範圍 |
|---|---|---|
流暢度與連貫性 | 不僅是說話速度,還包括重述、停頓、邏輯脈絡、話語標記 | 速度與停頓可測量。但也有提供方自行承認,連貫性與互動性單靠AI評估精確度不足的案例 |
詞彙運用 | 除廣度外,還包括對語境的恰當性、搭配詞、換句話說的能力 | 擅長生成替代表達方式候選。但難以判斷該表達是否為「自己在正式考試中能自然運用的詞彙」 |
文法廣度與準確性 | 複雜句構的運用能力,以及無錯誤句子出現的頻率 | 擅長糾錯。但語音辨識有時會將冠詞或字尾-s的錯誤自動修正為「正確形式」,導致無法被檢測出來 |
發音 | 除個別音素外,還包括重音、節奏、語調、整體發話的易懂程度 | 部分應用程式支援音素、重音的聲學評估。但對於長篇發話整體易懂程度的綜合判斷,則無法保證 |
換言之,AI能確實貢獻的是「確保練習量」與「可測量要素的改善」,而橫跨四項標準、綜合判斷得出單一級分,目前仍超出AI的守備範圍。基於此前提,以下依角色分類介紹各應用程式。
可用於IELTS準備的AI應用程式比較(2026年8月時點)
角色 | 應用程式 | 免費額度 | 費用參考(2026年8月時點) | 適合IELTS的功能 |
|---|---|---|---|---|
正式形式反覆練習 | 完整模擬測驗、級分推算皆可免費使用 | 付費方案請以官方網站為準 | Part 1~3模擬測驗、有時間限制的Part 2演講、推算級分顯示。僅限瀏覽器使用 | |
發音、演講的事後分析 | 7天試用 | 依促銷活動不同,月費約2,100日圓左右浮動 | 從音素到語調的聲學評估,長篇發話的分解分析 | |
確保每日發話量 | 7天試用 | 進階方案 月費3,800日圓/年費19,800日圓 | 未知主題的自由對話、追問練習、換句話說練習 | |
Part 3型抽象討論 | 每日通話3分鐘 | 付費方案依地區定價(請以官方網站為準) | 辯論、時事討論、自訂提示、嚴格的文法糾正 | |
低價題目來源 | 基本練習免費 | App Store月費約700~1,500日圓左右 | 有時間限制的cue card練習、AI考官模擬面試 |
※費用會因促銷活動或購買管道而變動。簽約前請務必在官方付款頁面確認。
若要練習正式形式,推薦SmallTalk2Me

在IELTS考試形式的還原度方面,SmallTalk2Me格外突出。Part 1~3的完整模擬測驗、與正式考試相同、有時間限制的Part 2演講(1~2分鐘),以及1~9級分的推算分數顯示,皆可免費使用,且僅需瀏覽器即可運作,無需安裝。作為累積「按正式考試流程堅持說完」經驗的工具,值得優先嘗試。
不過如後文所述,顯示的級分僅為推算值。此外,該系統是否能根據回答內容進行動態深入追問(如真實考官在Part 3中的表現),從公開規格上無法確認。
若要從「聲音」層面矯正發音,推薦ELSA Speak

ELSA Speak是少數在官方資料中確認能從個別音素到重音、語調、節奏進行聲學評估的應用程式之一。其Speech Analyzer功能會將Part 2中2分鐘的錄音,分解為發音、流暢度、文法、詞彙等要素進行分析,能將「總覺得不太順暢」轉化為「究竟是哪個音、哪個要素出了問題」。若發音是導致級分卡在6.5分的原因,這款應用程式是首選。
若要練習發話量與Part 3型討論,推薦Speak、Langua
Part 3表現失常的典型原因,是遇到不熟悉的主題時臨場反應不足。Speak的自由對話與AI導師功能,容易累積未知主題的對話量,發音也會進行音素層級的分析。Langua適合辯論、時事討論,以及透過自訂提示進行抽象討論,並可從5個等級中選擇糾正的嚴格程度,不會留下「被輕輕帶過」的感覺。這兩款應用程式的作用並非還原考試形式,而是鍛鍊作為Part 3基礎的「邊思考邊說話的能力」。
若要以低成本累積更多題目,推薦Stimuler
Stimuler每月僅需數百至千餘日圓,即可使用有時間限制的cue card練習與AI考官模擬面試等完整功能。作為SmallTalk2Me之外的另一個題目來源併用,具有一定價值,但其發音評估的技術資訊公開程度不及ELSA或Speak,推算分數的驗證狀況也未公開。
AI推算級分的可信度到什麼程度
使用AI應用程式進行考試準備時,最容易被誤解的就是推算級分的處理方式。先說結論:推算級分作為「進步趨勢的指標」相當有用,但作為「正式考試會拿到這個分數」的預測,則並不適用。理由有三。
第一,各家公司公布的精確度數字,並非考試機構的獨立驗證結果,而是提供方自行驗證的數值。例如ELSA公布的「與真人評分者在±1個CEFR級分內一致的比例為93.88%」,即為該公司自行驗證的數值;SmallTalk2Me雖說明其以包含認證考官評分資料在內的大量數據訓練而成,但同樣未保證與實際分數完全一致。
第二,SmallTalk2Me在自家評估方法的說明中,官方承認連貫性(Coherence)與互動性(Interaction)目前單靠AI作為評分標準,精確度仍不足夠。這種誠實的揭露值得肯定,但反過來說,也應假設其他未揭露類似限制、卻宣稱「AI可提供綜合分數」的服務,同樣存在相同的侷限。
第三,即便是引領自動口說評估研究的Cambridge,為確保信賴度,也採用了結合真人評分者的混合式評分方式。而正式考試的分數,也會因緊張程度、考官、題目難易度而有所變動。
實務上的運用方式應該是這樣:將推算級分用於每週練習中觀察「是否呈上升趨勢,還是停滯不前」,至於正式考試前的實力判定與應考時機的決定,則透過真人模擬面試來校準。關於官方題庫或真人評分模擬測驗的選項,模擬測驗比較文章中有詳細介紹。
ielts-mock-test-guide
Part 2、Part 3的每週練習菜單
將各項角色分工落實為一週的練習菜單,內容如下。
頻率 | 內容 | 負責方 |
|---|---|---|
每天15~30分鐘 | 未知主題的即興回答、重述、換句話說練習 | AI應用程式(Speak/Langua等) |
每週2~3次 | 有時間限制的Part 2 cue card反覆練習,以及Part 3形式的抽象討論 | AI應用程式(SmallTalk2Me/Stimuler等) |
每週1次、短時間 | Part 2錄音的事後分析與弱點發音的集中練習 | AI應用程式(ELSA Speak) |
每1~2週1次 | 透過模擬面試校準實力,並決定接下來兩週的優先順序 | 專業講師 |
重點有二。首先,Part 2務必以有時間限制的方式反覆練習。在1分鐘內構思架構、並在2分鐘內說完的時間感,唯有透過反覆練習才能培養。其次,Part 3的準備並非「背誦範例答案」,而是要透過就抽象主題邊思考邊說話的即興練習量來累積實力。讓AI詢問理由、反例、未來預測等問題的練習,非常適合這個用途。
關於錄音的檢視方式與自學時的練習設計,也請參考口說練習法的相關文章。
IELTS Speaking 高效練習方法|運用AI自學突破Band 7.0的5個步驟
AI做不到的事:級分7的門檻
從級分6.5跨越到7.0的門檻,並不在於單字或句構的知識量,而在於四項標準的綜合運用能力。
級分7要求做到
「頻繁產出無錯誤的句子」
「即使面對不熟悉的主題,也能靈活運用詞彙」
「能自然維持較長的發話輪次」
這些能力。
這是AI擅長的「指出10個錯誤」「顯示發音分數」等局部測量的累積,無法判定也無法指導的領域。
尤其以下三點,是AI特別難以取代的部分:
- Part 3的真實互動:考官會針對剛才回答的內容,進一步追問「除了這個優點之外呢?」「缺點方面又是如何?」。AI雖然也能生成類似的追加問題,但與經過訓練的考官所具備的一致性難度控制及評分判斷並不相同。
- 詞彙「恰當性」的判斷:比起增加艱澀單字,能精準區分詞義、運用自然的搭配詞,並在必要時換句話說,才是直接影響級分7~8的關鍵。AI建議的高階表達方式,是否真的是「自己在正式考試中能自然運用的詞彙」,只有透過實際對話才能確認。
- 與正式考試相當的人際壓力:正式考試是與認證考官面對面進行11~14分鐘、且全程錄音的對話。而與即使答錯也會耐心等待的AI進行練習,在心理壓力方面,與正式考試的條件並不相同。
級分7的具體要求與評分標準的解讀方式,另有專文詳細說明。
IELTS Speaking Band 7.0 奪分完全攻略|評分標準與對策
正因如此,一邊透過AI確保練習量,一邊每1~2週安排一次由理解評分標準的講師進行模擬面試,藉此校準「目前的級分水準」與「接下來該優先修正的重點」,這樣的分工方式,對於進步遇到瓶頸的中級學習者而言,是相當合理的架構。
用AI累積練習量,用模擬面試進行校準
隨著AI應用程式的出現,IELTS口說所需的「練習量」幾乎已能免費確保。建議您先透過SmallTalk2Me的免費模擬測驗掌握目前的實力狀況,再以本文提供的每週練習菜單為參考,將日常練習逐步轉移至AI應用程式上進行。
在此基礎上,若要縮小推算級分與正式考試之間的落差,並確立跨越級分7門檻的優先順序,則需要借助理解評分標準的專業人士進行診斷。
ELT是一所於1984年在倫敦創立、專為專業人士設計的英語學校。由持有教學資格(CELTA/DELTA)或碩士學位的母語講師採完全專屬導師制授課,在IELTS等考試準備方面,負責透過模擬面試校準實力、規劃學習方針,並擔任本文所提出的AI分工架構中的「診斷角色」。
在體驗課程中,會由熟悉學員背景的顧問與母語講師共同診斷您目前的英語能力,以及達成目標分數所需克服的課題,並為您提供包含與AI應用程式分工運用在內的完整對策方案。
關於IELTS對策的整體規劃,也請一併參考完整指南。





