史丹佛大學年度AI報告:AI考試快滿分了,下個戰場是Agent能否完成任務

過去幾年,AI界的競爭重點,幾乎都鎖定大型語言模型(LLM)本身的能力。從語言理解、數學推理到程式開發,各家模型不斷刷新評測紀錄,也帶動一波又一波模型軍備競賽。