國慶日是10/1?中研院AI出錯 專家:用對岸資料庫 【記者王良博/台北報導】中央研究院日前推出繁體中文的語言模型CKIP-Llama-2-7b,此語言模型類似Chat-GPT,採用問答方式,可用於文案生成、語言翻譯等。不過,專家抓包此語言模型採用中國資料「簡轉繁」,導致諸多用語、問答內容都以中國文化回答,但資料是AI時代的基礎建設,應建立熟悉台灣在地文化的AI。記者實測也發現,該語言模型回答國慶日是10/1,還稱台灣是中國的一部分。
對此,中研院下午回應,已將系統先行下架,此為個人小型研究,希望將明清人物的生平進行自動化分析,建構自動化的歷史人物、事件等事理圖譜,民眾的提問超出原始研究範疇,導致語言模型產生的內容出乎預期,未來研究及成果釋出會更加謹慎。
閱讀全文