Google(GOOGL-US) 周二(7日)正式發表全新人工智慧模型,包含首款採用 Apache 2.0 授權條款的開源原生多模態嵌入模型 EmbeddingGemma 2,以及具備高達 100 萬 Token 輸出限制的旗艦級語言模型 Gemini 4 Argon。
Google 執行長 Sundar Pichai 表示,EmbeddingGemma 2 為 Google 第一個開放原始碼且原生支援多模態的嵌入模型,機能將文字、程式碼、圖像、視訊與音訊統一定位在單一向量空間中,方便開發者於消費級裝置上進行高效搜尋與檢索。
EmbeddingGemma 2:輕量化架構與裝置端運算
EmbeddingGemma 2 採用基於 Gemma 4 的模組化架構,總參數量為 7.4 億(740M)。模型結構由 2.7 億參數的純文字主幹、1.7 億參數的視覺編碼器,以及 3 億參數的音訊編碼器組成。在實際應用中,開發者可依據需求僅載入純文字模態(270M)或結合視覺與音訊模態,彈性調配硬體資源。
在裝置端(On-device)執行效能方面,經量化處理後的 EmbeddingGemma 2 在 Google Pixel 11 Pro 上運作時,純文字模式僅需約 191MB 的活躍記憶體,而完整多模態版本約需 567MB。此外,模型將上下文視窗擴展至 8,000(8K)Token,為前一代產品的 4 倍,單次可在本地端處理長達 5.5 分鐘的音訊、29 張圖像或 58 幀視訊。
為降低本地向量資料庫的記憶體負擔,EmbeddingGemma 2 導入了 Matryoshka 表示學習(MRL) 技術,允許將預設的 768 維輸出向量彈性截取至 512、256 或 128 維,最高可節省 6 倍儲存空間。在基準測試表現上,其於 MTEB Code 程式碼檢索測試中取得 78.68 分,相較前代的 68.76 分進步了 9.92 分,顯著提升了本地程式碼庫索引與檢索的效能。
開源權重三大優勢:自主控制、隱私安全與高效運算
相較於閉源 API 服務,開放模型權重的首要優勢在於避免供應商鎖定與系統崩潰風險。若閉源服務調整策略或將模型下線,開發者存於向量資料庫中的歷史向量皆需重新計算;而開源權重下載至本地硬體後,開發者能享有完全的系統自主控制權。
其次,開放權重支援邊緣裝置(On-device)運作與高隱私防護。機密文件與多模態資料無需上傳至雲端伺服器,即可於本地直接生成嵌入向量,能顯著降低資料傳輸延遲。經量化處理後,在智慧型手機(如 Pixel 11 Pro)上運作時,純文字模式僅需約 191MB 活躍記憶體。
最後,開放權重能無縫整合至社群生態系與開源工具鏈,並支援開發者針對特定領域進行客製化微調。
Gemini 4 Argon:百萬Token 輸出的旗艦模型
在發表 EmbeddingGemma 2 的同時,Google 推出了新一代旗艦模型 Gemini 4 Argon。該模型主打長工作流程(Long-horizon workflows),專為複雜軟體工程、法律文件撰寫、金融研究與網路安全防衛等任務打造。
Gemini 4 Argon 的最大技術特點在於將單次回應的輸出上限大幅提升至 100 萬(1M)Token,遠高於先前機型的 64,000 Token,使其能在單一流程中完成深入推理與長篇程式碼生成。
對於模型效能,Google DeepMind 資深副總裁 Koray Kavukcuoglu 將 Gemini 4 Argon 定位為「前沿智慧新時代」的開端。在 Google 公布的 18 項效能評測中,Gemini 4 Argon 在其中的 12 項測試中超越了 OpenAI 的 GPT-6 Astra 與 Anthropic 的 Claude Opus 5.5。
在發行策略上,Google 目前優先將 Gemini 4 Argon 提供給參與「Fairwind 計畫」的全球 650 多家資安合作夥伴與政府防護機構使用。
定價方面,發表初期的促銷價格為每百萬輸入 Token 2 美元、輸出 Token 10 美元,未來將回升至 4 美元與 20 美元。至於一般 API 與 Google AI Ultra 訂閱者的開放時間,官方表示將會在後續階段陸續推動。
