🌐 外来客网

AI模型百家爭鳴 「模型評估」成企業新課題

声明:本文转载自 「中央社」, 或因排版与篇幅原因进行过编辑,内容未经本站独立核实,不代表本站立场、观点或建议。 如涉及版权问题,请联系我们,核实后立即删除。 [ 免责声明 ]

(中央社記者張欣瑜舊金山14日專電)AI模型進入百家爭鳴時代,舊金山灣區企業如今更加重視「模型評估」。業者和學者受訪表示,企業面對更多AI模型選擇,如何找出最符合需求的模型,正成為AI導入的重要環節,相關評估能力也比以往更加重要。

「模型評估」泛指透過一系列測試與指標,衡量AI模型的能力、準確性、可靠性,以及是否符合特定應用需求。

美國許多企業如今面臨模型選擇難題,一方面要衡量AI成本,一方面又得在令人眼花撩亂的眾多AI模型中做出選擇。從醫療科技到企業軟體公司,都已出現將模型評估列入主要工作內容的職缺。

1名熟悉模型評估的業者向記者表示,不僅美國,包括台灣都需要相關單位和人才。

聖荷西州立大學(San Jose State University)工程系教授巴納法(Ahmed Banafa)接受中央社訪問表示,隨著各家AI模型之間的效能差距持續縮小,嚴謹的模型評估將成為企業採用與部署AI時「非常關鍵的一環」。

巴納法說,企業的焦點也正在從單純比較哪一款模型排名最高,逐漸轉向「哪一款模型最適合企業使用情境,同時又能符合成本、安全性與營運需求」。

他認為,企業和組織未來在評估AI模型時,將採用更廣泛的標準,包括推理能力、軟體開發表現、事實準確度、產生幻覺的頻率、回應速度、營運成本、安全性、多語言支援、工具整合能力,以及針對特定產業的實際效果。

AI資料科學家瑪哈瑪提(Nina Marhamati)告訴中央社,目前模型評估仍需要人工確認,專業領域的評估成本也可能相當高。

她進一步闡述,一般對話內容的評估未必需要高度專業知識,但若AI模型要應用於特定領域,例如醫療、化學,就需要具備相關專業知識的「領域專家」(domain experts)參與。

瑪哈瑪提表示,專業人才通常工作繁忙、相關人力不易取得,使模型評估往往耗時,成本也較高。這也凸顯在AI模型選擇日益多元情況下,模型評估的重要性更加受到重視。(編輯:韋樞)1150815

评论 (0)