" 台師大心測中心昨天發表與交大合作研發的國內首套「中文寫作自動化評分系統」,電腦和教師評分結果 一致性高達九十一點六%。" 真的很搞不懂為啥會有人想開發這樣的系統?最扯的事後面的那一句,讓人一堆 問號,首先要問的是,這個數據得基礎是什麼?是由多少次的測試及何種取樣來的?從新聞的其他資訊中,有提到電腦的 評分基準,其實是模擬老師評分的考量點,"電腦評分則以取材、結構(整體及段落結構)、修辭(排比、譬喻、 口語化程度)為先,下一階段會加入標點符號及錯字等評分,最困難部分在於作文立意的評分,及將手寫作文轉 換至電腦閱卷。" 研究人員也知道電腦批改作文時的難處,電腦要如何才能像真人,除了文字之外,如何去體會作者的 意境,那就不是簡單的從文字組合、段落等能判斷的,開發的團隊說能把修辭當作評分的基礎之一,這點是真的很難相信, 如果屬實,那是不是作文的修辭又進入了“八股“的時代,如果真要用電腦閱卷,那坊間想必又會冒出一些提供作文模擬 閱卷的新事業吧!如果電腦能閱卷,是否也代表著電腦能作文了?只是跟人類有多大得差距? 在可見的未來,我是不相信電腦能作文,也不相信電腦能批改作文,人工智慧要達到人類的同等境界,光是資料庫的建立 就是一項大工程,一個國中生起碼也有15年的生活經驗,這些經驗還包括了許多的感官經驗,這些都不是很容易能輸入 資料庫的。新聞中還提到" 目前美國托福及GRE測驗都以電腦及人工閱卷做為作文評分標準,不過攸關大學入學的 SAT測驗,仍不敢讓電腦決定考生的命運",GRE跟托福基本上是為了外國人所設得,考慮到人力負擔,可能會採用 電腦輔助,但托福跟GRE也絕對不是申請入學的唯一考量,所以影響可能還不大。但若用在國內,先天不良,後天亂搞 的升學考試上,只怕是雪上加霜了! 如果你問,那為啥學校要發展這樣的系統?我只能告訴你,現在的學術界,往往都是搞一些有名無實的東西,說得華麗 無比、無所不能,實際用起來,兩光的居多,反正發表完後,沒人會再去追蹤,跟現在的政府善於遺忘有同工異曲之妙, 搶到補助款,達到主管機關要的表現就好。讓下一代還能多一些人性,別再搞這種無用的東西吧!
創作者介紹
創作者 窺探未來 的頭像
fistbreak

窺探未來

fistbreak 發表在 痞客邦 留言(0) 人氣( 86 )