讀懂言外之意:法律模擬中的行為真實性建模與評估

arXiv - Computers and SocietyDivya Vetticaden, Arya Gupta, Julian Nyarko, Megan Ma

本文開發了 WitnessSim 模擬器,並提出一套區分「行為真實性」與「教學實用性」的評估框架。

AI 幫你先抓重點

AI 重點 1

區分「行為真實性」與「教學實用性」的評估維度

滑鼠懸停看 AI 判斷理由
過去的 AI 評估多聚焦於事實正確性,但對於模擬教學而言,行為是否「像真人」與是否「具備教學價值」是兩個不同的維度,這為模擬教學系統的設計提供了更精細的評估標準。
AI 重點 2

動態行為軌跡在模擬教學中的重要性

滑鼠懸停看 AI 判斷理由
研究強調了行為隨互動而變化的能力,這對於設計高階認知技能(如法律辯論)的學習環境至關重要,能確保學習者在面對非線性、動態的挑戰時獲得真實的訓練。

核心研究發現

  1. 1

    開發出 WitnessSim 模擬器,透過可控的法律人格(legal personas)來驅動證人行為,模擬動態的證詞過程。

  2. 2

    透過對抗性測試與盲測比較,證實 WitnessSim 能維持合理的行為邊界,律師無法系統性地分辨模擬證人與原始證人。

  3. 3

    教學測試顯示,證人行為會隨著提問形式與律師干預產生有意義的變化,且不會導致預設人格崩解。

對教育工作者的啟發

對於設計專業技能模擬(如法律、醫學)的教育者,建議不要僅追求 AI 回答的「正確性」,更應關注 AI 角色在互動過程中的「行為一致性」與「反應動態性」。在設計課程時,應建立多維度的評估指標,分別檢驗模擬環境的真實感(是否像真人)以及其教學成效(是否能引發學習者適當的策略調整),而非僅依賴單一的知識檢驗。

原始文獻資訊

英文標題:
Reading Between The Lines: Modeling and Evaluating Behavioral Realism in Legal Simulation
作者:
Divya Vetticaden, Arya Gupta, Julian Nyarko, Megan Ma
來源:
arXiv - Computers and Society
AI 摘要模型:
/models/gemma-4-26B-A4B-it
閱讀原文

每週精選研究電子報

每週五信箱收到精選 5 篇教育科技重點研究摘要,零時間壓力掌握學術前沿。