
商傳媒|責任編輯/綜合外電報導AI 新創公司 Prism ML, Inc. 於週四宣布,推出第二代超輕量級多模態生成式人工智慧模型 Bonsai 2 27B。這款模型不僅體積精巧,能夠在個人電腦和部分高階行動裝置上運行,同時仍保持高度智慧,有望推動 AI 技術的普及化。
Bonsai 2 27B 的核心突破在於,它成功地在大幅縮小模型體積的同時,仍能保持高水平的運算效能,這對於在有限硬體資源上運行複雜 AI 功能至關重要。該公司透過一種「三元」(ternary)方法,將模型原始的 Qwen3.8 27B 模型從未壓縮的 16 位元(約 56 GB)大幅縮減至約 5.9 GB,但仍保留約 98.2% 的能力。這種方法將模型中的權重(parameters,即 AI 學習到的知識點)從 16 位元簡化為僅使用 +1、0、-1 三種狀態來儲存資訊,從而大幅減少記憶體佔用。
性能方面,Bonsai 2 27B 在多項基準測試中表現優異。在代理(agentic)和工具調用(tool calling)基準測試中,Bonsai 2 與 Qwen3.8 的得分僅相差不到三點(分別為 77.6 和 79.8)。在程式編碼(coding)相關測試,包含 HumanEval+、LiveCodeBench v6、MBPP+ 和 BigCodeBench 等,Bonsai 2 的總體得分為 81.6,與 Qwen3.8 的 82.2 分相當。知識與推理(knowledge and reasoning)的總體得分更以 82.7 分略優於 Qwen3.8 的 81.3 分。
這款輕量級模型能夠在各種消費級硬體上高效運行。例如,在輝達(Nvidia)GeForce GTX 5090 顯示卡上,Bonsai 2 可以在不需量化處理(quantization)的情況下,達到每秒 143 個 Token 的處理速度。在蘋果公司(Apple Inc.)M5 Max 晶片上,也能達到每秒 46.8 個 Token。此外,Bonsai 2 的能耗也相當低,每處理一個 Token 僅消耗 0.714 兆瓦時,比其他全精度運行、80 億參數的模型節省了 40% 的能源。
超輕量級模型的發展,意味著未來用戶將能把 AI 模型直接運行在本地裝置上,而非依賴雲端運算。這將有效降低延遲、提升個人隱私和資料安全性,避免第三方數據共享,並有助於符合更嚴格的隱私規範。對於翻譯、摘要等簡單任務,AI 將可直接在裝置上完成,而更複雜的任務則可能仍需雲端模型的協助。Bonsai 2 模型已於今日透過 Apache 2.0 許可證開放模型權重(weights)供外界使用,可在支援 CUDA 的輝達 GPU 和支援 MLX 的蘋果裝置上運行。


