GPT‑4o提升學生成績,因果推理課程激發創新思維
AI 奇點前沿

GPT‑4o提升學生成績,因果推理課程激發創新思維

AI News Bot
2026-08-31
預計閱讀 1 分鐘原文來源

GPT‑4o提升學生成績,因果推理課程激發創新思維

核心發現:在義大利波科尼大學(Bocconi University)進行的隨機實驗顯示,使用 GPT‑4o 的學生在商業案例作業上,平均比未使用者高出近一分(滿分 5 分)。同時,短期的因果推理課程雖未提升傳統分數,卻促使學生提出更具多樣性與深度的解決方案。

背景與實驗設計

2025 年 11 月,研究團隊將 1,053 名大一新生的 13 個管理學入門課程分組,形成四種處置:

  1. 對照組(純粹寫作)

  2. 因果推理課程(教授因果邏輯、可證偽性、行動結果的推演)

  3. GPT‑4o 介面(允許學生在寫作過程中查詢或生成內容)

  4. 兩者結合

作業要求在 180 字以內,為校園商品店提出行銷建議。評分標準以 1‑5 分衡量答案的結構、完整性與說服力,並由三位領域專家提供參考答案。

主要結果

  • GPT‑4o 介面:使用者平均多出約兩個構思,論點更具邏輯連貫性,且與專家參考答案的相似度提升。即使在控制了「論證品質、構思數量、構思多樣性」等變項後,仍保有顯著的分數優勢,說明提升主要來自內容品質而非學生事前知識的差異。
  • 因果推理課程:傳統分數略低,但學生更常說明「為何此行動能奏效」以及「在何種條件下可能失敗」。他們的答案呈現更高的構思多樣性,與同儕的想法差異較大。
  • 課程+GPT‑4o:在傳統分數上未見額外提升,然而在因果推理指標上兩者互補,課程帶來的多樣性仍保持。

統計上,「構思數量」與「論點連貫」與高分呈正相關;相反地,「可證偽性」與過度詳盡的執行說明、以及與他人想法的高度差異,則與低分相關。這表明現行評分體系仍偏好結構完整、符合預期解答範圍的作品,而非純粹的創新或原創。

影響與未來展望

  1. AI 作為寫作輔助:GPT‑4o 能顯著提升答案的深度與品質,暗示在資訊密集的商業課題中,人工智慧可成為有效的思考助理。

  2. 因果推理的教學價值:即使短期課程未直接提升分數,它卻培養學生檢視假設、思考結果因果的能力,這對長期學習與實務決策至關重要。

  3. 評分標準的再設計:若學術機構希望鼓勵創新與批判性思考,必須在評分規範中明確納入「構思多樣性」與「因果說明」等指標,否則 AI 仍可能被視為「作弊」工具。

  4. 後續學習驗證:本研究缺乏追蹤測驗,未能證明學生在無 AI 輔助下的知識保留程度。未來研究應加入「概念遷移」與「長期記憶」的測驗,以全面評估 AI 與因果推理課程對真實學習的貢獻。

結語:GPT‑4o 的即時生成能力已證實能提升學生作業表現;而因果推理的教學則在培養多元思考上扮演關鍵角色。教育者若能同步調整評分架構,將有機會將這兩股力量結合,打造兼具效率、深度與創新的學習環境。

分享