Categories
語言發展 高等教育

GenAI 在寫作反饋流程中的任務卸載方式與寫作發展

Lai 及其團隊採用準實驗設計,探討在英語作為外語(EFL)寫作的「起草—評估—修訂」流程中,將不同任務卸載給 GenAI 會產生何種影響。研究歷時七週,以 101 名中國大學生為對象,比較三種條件:(1)GenAI 起草、學生評估、學生修訂;(2)學生起草、GenAI 評估、學生修訂;(3)學生起草、學生自評、學生修訂。

研究結果顯示,GenAI 起草組在寫作能力上表現最佳 (M = 18.21, SD = 2.21),顯著高於 GenAI 評估組 (M = 16.30, SD = 1.70) 以及無 GenAI 參與組 (M = 15.15, SD = 1.79)。這顯示將 GenAI 納入反饋流程整體上有助於寫作進步,但將「起草」任務(而非「評估」任務)卸載給 GenAI,所產生的效果最強。

在心理歷程方面,GenAI 起草組展現出顯著較高的認知投入,與 GenAI 評估組相比,他們與 AI 互動時使用了更多的總提示次數 (中位數 20.50 vs. 9.00, U = 195, p < .001) 以及學習導向提示 (中位數 10.50 vs. 8.00, U = 398.50, p < .05)。此外,他們在後設認知方面也優於其他兩組在同儕評閱期間的問題辨識 (M = 4.41)、問題論證 (M = 2.82) 與提供建設性建議上 (M = 4.97)。

在寫作自我效能方面,GenAI 起草組展現了最大的進步 (M = 4.74, SD = .55),顯著高於另外兩組;而 GenAI 評估組 (M = 4.42, SD = .53) 與無 GenAI 組 (M = 4.45, SD = .78) 之間則無顯著差異。訪談結果進一步顯示,這些學生因能批判性地評估並改寫 AI 的初稿,而產生了更強的掌控感與能力感。相較之下,GenAI 評估組的部分學生則擔心自己過度依賴 AI 修改,從而形成某種「虛假的自信」。

整體而言,本研究強調 GenAI 在寫作反饋流程中的教育價值,取決於將「什麼任務」卸載給 AI。將起草任務交給 GenAI,並由學生承擔評估與修訂,更能促進深度認知投入、後設認知理解以及寫作自我效能。作者建議,在將 GenAI 融入寫作教學時,應優先考慮「AI 生成草稿搭配學生判斷與修正」的模式,讓 AI 成為引發批判與反思的對象,而非取代學生的思考。

文獻來源(開放取用):Lai, C., Pan, M., Guo, K., & Cui, Y. (2026). What task to offload to GenAI in the writing feedback process? – Effects of task-offloading approaches on EFL learners’ writing skill development. Computers & Education252, 105675.https://doi.org/10.1016/j.compedu.2026.105675Read the rest

Categories
語言發展 小學教育 中學教育

四至十二年級閱讀困難學生介入的效果

Killingly 及其團隊採用系統性回顧與統合分析方法,整理2011至2023年間針對四至十二年級閱讀困難學生的校本介入研究,評估其整體效果,並進一步檢驗研究特徵、樣本特徵與介入特徵是否會調節介入成效。研究納入104篇文獻、586個效果量,總樣本達97,114人。方法上,作者採用Correlated and Hierarchical Effects模型結合Robust variance estimation,以處理同一研究中多個依變項與多重效果量的依賴問題,並同時評估整體閱讀結果與不同閱讀向度的成效。

研究結果顯示,整體而言,閱讀介入對四至十二年級閱讀困難學生具有小幅但顯著的正向效果,整體效果量為 g = 0.212(95% CI [0.163, 0.261], p < .001),顯示這類介入雖非大幅改善,但確實能穩定提升學生的閱讀表現。若以不同閱讀向度區分,效果最強的是詞彙(g = 0.422),其次為解碼/詞辨識(g = 0.199)與閱讀理解(g = 0.187);流暢性僅呈現很小但顯著的效果(g = 0.080),拼字則未達顯著(g = 0.015),而音韻處理雖表面效果量較大(g = 0.531),但未達顯著,結果並不穩定。整體異質性很高(I² = 89.71%),顯示不同研究之間的設計與樣本條件對介入效果有明顯影響。GRADE 評估亦指出,整體證據品質為中度至高度,其中流暢性證據品質最高,詞彙為中度,音韻處理則降為中低。

在調節效果方面,研究發現介入成效會隨研究與樣本條件而變化。整體而言,發表年份越晚,效果越高(β = 0.015),且期刊論文的效果(g = 0.268)顯著高於研究報告(g = 0.062)。在樣本特徵上,低社經背景與整體效果無顯著關聯,但學習障礙學生比例越高,介入效果略高(β = 0.006);對非英語背景學生而言,整體差異雖不明顯,但在詞彙向度上,其比例越高,效果越強(β = 0.016),顯示詞彙教學對此類學生尤其重要。就介入設計而言,介入焦點、時數與測量工具皆為顯著調節變項。理解介入的整體效果較佳(g = 0.313),多成分介入為 g = 0.178,字詞研究為 g = 0.096,而詞彙介入雖研究較少,但效果最高(g = 0.716)。在時數方面,較短介入反而效果更大,0–5 小時與 6–15 小時的效果量分別為 g = 0.405 與 g = 0.409。此外,研究者自編測量所得效果(g = 0.542)顯著高於標準化測量(g = 0.127)。雖然整體而言由教師或研究者執行介入的差異不顯著,但在詞彙介入中,教師執行的效果(g = 0.733)高於研究者執行(g = 0.249),顯示課堂教師在詞彙支持上可能更具優勢。

整體而言,本研究指出,針對高年級與中學階段閱讀困難學生的閱讀介入確實有效,但效果大小會依閱讀向度與介入設計而有所不同。其中,詞彙與閱讀理解是最具潛力的介入焦點,多成分介入亦有穩定效果,而流暢性、拼字與音韻處理則仍需更多高品質研究支持。研究同時顯示,這類介入在不同年級與不同教學場域中皆可實施,且對學習障礙學生與非英語背景學生尤其有幫助。作者因此主張,學校在設計高年級閱讀支持方案時,不應假定年紀較大的學生已錯過關鍵介入時機,而應根據具體閱讀困難類型,選擇更聚焦的理解、詞彙、字詞研究或多成分介入,並持續累積更高品質的研究證據,以支持中學階段的閱讀補救實踐。

 

文獻來源(開放取用):Killingly, C., Matheson, S., Bentley, L., & Swanson, E. (2025). Interventions for students with reading difficulties in Grades 4-12: A systematic review and meta-analysis. Educational Research Review, 100758.

https://doi.org/10.1016/j.edurev.2025.100758.… Read the rest

Categories
語言發展 小學教育

同音詞推理訓練成效:兩項小學隨機對照試驗之研究發現

近日由 Booton 等人進行的一項研究,主要探究一個簡短的詞彙推理介入方案,是否能夠協助7至8歲兒童習得同音詞,即串法相同而意義各異的詞語(例如 bat、bank、bark)的多重含義。雖然同音詞於日常英語中極為普遍,亦有記錄顯示其對年幼讀者造成理解困難,然而過去的文獻一直未能確立任何有效的針對性介入方案。

研究團隊於英國國立小學進行了兩項獨立的隨機對照試驗(RCT)。於研究一中,來自六間學校共180名兒童被隨機分配至詞彙推理訓練組(n = 60)或空間推理主動控制組(n = 120)。參與者於兩星期內以四人小組形式完成四節各30分鐘的介入課節。於研究二中,76名兒童,包括37名以英語為附加語言(EAL)的學童,以及39名以英語為第一語言(EL1)的學童,透過分層隨機方式被分配至詞彙推理訓練組(n = 40)或以情境化閱讀為主的隱性接觸控制組(n = 36)。研究二採用預先登記方法,並於評估同音詞知識之同時,額外量度學童的後設認知及推理能力。

此詞彙推理介入方案俗稱「文字偵探」(Word Detectives),訓練兒童利用句子中的語境線索,推斷同音詞於特定情況下的含義。兒童於研究人員主持的結構化課節中,學習如何察覺、追問並推斷詞義。控制組則參與時間相同而性質不同的活動:研究一為空間推理任務,研究二為對相同目標詞彙進行閱讀接觸,惟不包含任何明確的推理指導。評估工具方面,研究採用研究者自行開發的同音詞認知任務,分別於介入前後量度學童對已教及未教同音詞的接受性知識;研究二另外採用約克閱讀理解評估(YARC)作為標準化閱讀理解量度工具。

兩項隨機對照試驗的結果一致顯示,接受推理訓練的兒童,於同音詞接受性知識方面的進步,顯著優於控制組。於研究二中,訓練組兒童於推理測試的表現亦有明顯提升。值得注意的是,雖然以英語為附加語言(EAL)的兒童於前測中呈現同音詞接受性知識的特定基線劣勢,然而介入方案對EAL及EL1兒童同樣有效,反映此方案具有廣泛的適用性,適合於多元語言背景的課室環境中推行。此外,同音詞的接受性知識與推理能力,於控制其他詞彙量度之後,各自對閱讀理解分數的獨特方差解釋力均達顯著水平,此發現突顯了掌握同音詞知識對整體閱讀能力的重要意義。

研究亦指出數個值得關注的局限性。學習遷移至未教同音詞的效果有限,雖然錯誤分析顯示學童對推理策略的應用具有初步的概化跡象。介入周期較短(約兩星期),且研究未有收集即時後測以外的跟進數據,因此訓練效果的持久性仍屬未知。研究人員呼籲未來研究採用更長的介入期、延遲後測,以及探究此方案是否可由課室教師代替研究人員主持,從而推廣至更大規模的教學場境。

上述發現對教育實踐具有重要啟示。明確教授詞彙推理作為一項學習技能,而非單靠閱讀活動讓兒童自然習得詞彙,或為一個既高效又具公平性的方式,於小學階段提升學童的詞彙量與閱讀理解能力,尤其適合於多元語言課室中推行,以支援為數眾多的英語語言學習者。

文獻來源(開放取用):Booton, S. A., Birchenough, J. M., Gilligan‐Lee, K., Jelley, F., & Murphy, V. A. (2026). Lexical inference training for homonyms: Two randomized controlled trials for children with English as a first and an additional language. British Journal of Educational Psychology.

https://doi.org/10.1111/bjep.70056Read the rest

Categories
語言發展 幼稚園教育 有效教學法

趣味執筆:將寫作教學融入日常遊戲的策略

本研究旨在探討教育工作者如何透過「引導式遊戲」(guided play),將早期寫作教學融入幼稚園課堂。Sanchez (2025) 指出,在現代幼兒教育中,以遊戲為本的學習與僵化、政策主導的學術課程之間,存在日益加劇的張力。由於嚴格的規範常令幼兒在進行正規寫作任務時感到挫敗,Sanchez (2025) 提出「引導式遊戲」——一種結合兒童主導探索與成人刻意鷹架(intentional scaffolding)的混合模式——作為教學解決方案,既能達成讀寫目標,又能維護幼兒的自主權。

本研究設計為一項為期五個月的參與式行動研究,由Sanchez (2025) 在一所公立幼稚園的班級中進行,對象為 25 名學生。Sanchez (2025) 每天撥出一小時進行引導式遊戲,刻意將針對性的寫作工具、書籍和學習單引入受歡迎的區域,如黏土區、積木區、戲劇扮演區和樂高積木中心。透過仔細觀察並與兒童互動,Sanchez (2025) 將早期寫作提示無縫地融入他們自然的遊戲流程中。

藉由精心策劃教材並進行協作對話,Sanchez (2025) 成功激發學生主動將寫作納入其自發性遊戲中。兒童自然地開始創作真實的文本,包括黏土雪人的「製作指南」、複雜積木迷宮的標籤、戲劇扮演用的餡餅食譜,以及逐步的樂高拼砌說明。這種充滿趣味的方法將寫作從充滿壓力的強制性苦差,轉變為快樂、自主的活動,甚至賦權予最抗拒寫作的學生。

Sanchez (2025) 總結指出,引導式遊戲有效地打破了結構化學術學習與幼兒遊戲之間的虛假二元對立。研究強調,成功的實施需要投入足夠的課堂時間、鼓勵向觀眾講述故事,並在教育工作者之間建立支持性的社群。最終,刻意的鷹架作用讓寫作從孤立的學術技能,演變為一種真實且具意義的溝通工具,並尊重幼兒的能動性。

文獻來源(開放取用):Sanchez, A. (2025). Guided play in the kindergarten classroom: One teacher’s inquiry into scaffolding play-based writing instruction. Early Childhood Education Journal53(6), 2089-2098.

https://doi.org/10.1007/s10643-025-01931-wRead the rest

Categories
語言發展 高等教育

比較 ChatGPT 與自動寫作評估對學生寫作表現及理想第二語言(L2)寫作自我的影響

採用隨機對照實驗設計,Shi 等人(2025)比較了以 ChatGPT 為基礎的回饋與傳統自動寫作評估系統(AWE)對英語作為外語(EFL)學生的寫作表現及其理想第二語言(L2)寫作自我的影響。研究招募了來自中國一所公立大學三個寫作班的150名大學二年級學生,並將其隨機分為 ChatGPT 組、AWE 組和控制組。

經過為期十一週的教學介入後,結果顯示,ChatGPT 組學生在寫作表現上明顯優於控制組與 AWE 組;但與 AWE 組相比,ChatGPT 組學生的理想 L2 寫作自我顯著下降。質性研究結果揭示了可能的原因:儘管參與者充分意識到 ChatGPT 反饋的優勢,但他們同時也擔心過度依賴該工具會導致創造力與自主性的喪失,並對未來是否繼續使用 ChatGPT 持保留態度。

教育者應依學生的 ZPD 細化學習目標,並據此設計提示,讓 ChatGPT 用於支持學習而非代寫,同時教授提示工程技能。對中低至中等程度的學習者,AWE 的系統化、規則式反馈更能提供支架,且較能維持作者性。然而,ChatGPT 可供性更強,易致過度依賴、削弱主體性並降低理想 L2 寫作自我;因此應重訂語言教育目標,將 AI 素養與批判性思維納入,以守護師生主體性與負責地使用。

文獻來源(開放取用):Shi, H., Chai, C. S., Zhou, S., & Aubrey, S. (2025). Comparing the effects of ChatGPT and automated writing evaluation on students’ writing and ideal L2 writing self. Computer Assisted Language Learning, 1-28.

https://doi.org/10.1080/09588221.2025.2454541Read the rest

Categories
語言發展 小學教育 數學及理科學習

幼兒教育與照護 (ECEC) 之過程與結構品質與小學早期學業能力的系統性回顧與統合分析

Rademacher等人新進進行的一項研究依循預先制定之方案,進行系統性回顧與統合分析,檢驗幼兒教育與照護 (ECEC) 品質的各項構成要素如何關聯於兒童在小學前兩年之語文與數學能力。共有 17 篇同儕審查研究符合納入標準,其中 11 篇提供效應值以進行量化合併。本研究聚焦兩個問題:(1) 過程品質與結構品質在多大程度上與一年級與二年級的學業能力呈直接關聯,且在師生關係、互動品質、課堂組織、教學支持與前學術活動等子面向上是否出現差異。(2) 在考量個別研究特徵時,這些關聯是否會因樣本型態、洲別或研究品質而有所不同。

統合分析以合併相關係數為估計方式。ECEC 品質操作化為過程品質與結構品質。過程品質包括以「師生關係量表」(Student–Teacher Relationship Scale) 評估之師生關係,以及以「課室評量觀察系統」(CLASS) 觀察之互動品質,並涵蓋課堂組織、教學支持與針對語文與數學的前學術活動。結構品質包括班級人數、師生比、教師資格與整體環境評量。學業能力以一年級與二年級之標準化測驗或教師評量加以衡量。

結果顯示,師生關係與互動品質與後續學業能力之合併關聯為小幅正向 (k = 8, N = 9,896, Δ = .11, p < .001, 95% CI [.05, .18])。異質性偏高 (Q = 40.91, p < .001; I² = 77.70%)。按洲別、樣本型態與研究品質之次群組對比並未達顯著。前學術活動與支持同樣呈現小幅正向之合併關聯 (k = 4, N = 1,856, Δ = .07, p < .001, 95% CI [.02, .11]),且異質性可忽略 (Q = 1.07, p > .05; I² = .01%)。結構品質之合併關聯未達統計顯著,且高度異質 (k = 3, N = 17,804, Q = 44.96, p < .001; I² = 93.94%)。發表偏誤檢測顯示,過程與前學術模型無小型研究效應之證據;然而結構模型之漏斗圖不對稱且 Egger 檢定達顯著,提示可能存在偏誤。在個別研究層次上,結果並不一致。有研究顯示幼兒園階段的親近關係與後續閱讀表現相關,且具幼兒教育專業證照之教師與一年級較高的閱讀與數學表現相關;但多數關於班級人數與師生比的關聯則為不顯著。

整體證據為促進早期學習歷程提供實務導向。結果強調強化師生關係、提升互動品質,以及有目的地實施支持早期識字與基礎數學之前學術活動的重要性。結構性投入仍是關鍵的支撐條件,但需更清楚且一致的測量,以釐清其對長期學業結果之關聯。研究發現支持聚焦於關係能力、課堂組織與教學支持的專業發展,同時謹慎設計與落實前學術實踐,以促進公平且有效的學習成果。

 

文獻來源(開放取用):Rademacher, A., Bäker, N., von Düring, U., Hiltunen, V., & Goagoses, N. (2025). The effects of early childhood education and care quality on academic competences in early primary school: A systematic review and meta-analysis. European Journal of Psychology of Education40(4), 1-31.

https://doi.org/10.1007/s10212-025-01005-wRead the rest