請更新您的瀏覽器

您使用的瀏覽器版本較舊,已不再受支援。建議您更新瀏覽器版本,以獲得最佳使用體驗。

科技

Google最強模型Gemini,30項測試打贏GPT-4!Pixel 8 Pro搶先解鎖2大AI功能

數位時代

更新於 2023年12月07日02:46 • 發布於 2023年12月07日01:13

科技巨頭公司在生成式AI領域打得難分難捨,現在Google又出招了。Google於台灣時間6號晚間宣布推出全新大型語言模型「Gemini」,號稱目前市面上最強大的通用模型,Google執行長皮蔡(Sundar Pichai)更在部落格文章中劍指OpenAI的最強模型GPT-4,指出最高階的Gemini Ultra在32項AI測試中,有30項的評分贏過GPT-4的測試分數,宣示意味濃厚。

Google全新多模態大型語言模型Gemini登場。

Gemini厲害在哪?Gemini Ultra、Gemini Pro、Gemini Nano差別是什麼?

Gemini強大之處在於「多模態」能力,能夠針對文字、圖片、聲音、影片、程式碼等多種型態的內容進行理解並推理,同時推出三種大小的版本,可以靈活部署在不同場景,最大可到雲端大型資料中心,最小可以塞進手機裡,Pixel 8 Pro手機將可以支援Gemini應用。

Gemini三種規模:
Gemini Ultra(最大):適用高度複雜任務,在2024年初會推出給企業和開發者使用。

Gemini Pro(中等):最靈活通用的模型,12/13會讓開發者和企業客戶在Vertex AI和AI Studio等平台中使用。

Gemini Nano(最小):最有效率且可以部署在手機等終端裝置的模型,12/6起可以提供給安卓開發者申請使用,建立Gemini為基礎的裝置用應用程式。

Gemini推出三種大小,讓不同規模的場景可以彈性應用。

Gemini號稱大勝GPT-4!一支影片感受Gemini有多驚人

Google並未公開Gemini的訓練參數量,但是Gemini Ultra在32項基準測試中,有30項都打贏OpenAI用1.8兆參數訓練出的GPT-4模型,參數量可能達到相近規模。Google特別加強訓練Gemini的理解力、總結能力、程式能力、計畫能力等面向,更擁有多模態能力,無論是文字、圖片、語音、影片、程式等內容都能理解,並且隨時轉換交互生成

Google在媒體說明會中秀出幾支示範影片,展現Gemini的力量,為了感受Gemini的反應速度,測試人員是讓Gemini實時看著自己的動作回答問題:

第一步: 測試人員一邊畫圖,一邊詢問Gemini畫的內容,Gemini輕鬆回答這是一隻鴨子,並形容它的筆觸、色彩和身上的特徵,展現基礎的影像辨識能力。

第二步: 測試人員突然從畫面外拿出一隻實體的鴨子洗澡玩具,問它「你確定嗎?」Gemini馬上回答:「噢,我現在看到你拿著一隻實體的藍色鴨子。」展現辨識材質、物體的能力和反應速度。

第三步: 測試人員詢問Gemini,這個鴨子玩具是否可以浮在水上,Gemini回答:「我不太確定他的材質,所以難以判斷,但它看起來確實很像是塑膠做的。」接著測試人員讓Gemini看到擠壓玩具並發出聲音的樣子,Gemini立刻改口說:「如果它會發出聲音,那我確定他一定會浮起來。」證明Gemini能夠透過聲音和畫面判斷鴨子裡面有空氣,以及含有空氣的玩具能夠浮在水面上的原理。

Gemini採用Google自研晶片TPU訓練,同時也宣布推出全新的TPU v5p,是專門為AI訓練所設計,v5p的算力是上一代的2倍,訓練大型語言模型的速度是過去的2.8倍,除了Google自己發展更加速,未來也能幫助客戶用最低延遲訓練AI模型。

延伸閱讀:「一個詞」讓ChatGPT吐出原始資料!AI模型為何能在無形間出賣你?

Bard也跟著「升等」了,兩種版本依序上線

Google用來和ChatGPT、Copilot等競爭對手對抗的聊天機器人Bard,也將跟著Gemini一起「升等」。

1.即日起推出Gemini Pro調校版本Bard,提升理解力、計畫力、邏輯力
2.2024年初會推出「Bard Advance」進階版,用最強大的Gemini Ultra調校。

Google 聊天機器人 Bard 將推出Gemini訓練版本,功能更強大。

Gemini Pro版本Bard

即日起升級的Bard是由Gemini Pro調校,將先推出英文版,在超過170個國家地區上線,未來會逐步解鎖其他語言的版本。

Gemini Pro是中等且最應用場景最廣泛的模型,和GPT-3.5對標,Google指出Gemini Pro在8項基準中有6項都打贏GPT-3.5,其中包含多模態理解力和數學邏輯推理能力等測試。

Google和知名科學YouTuber Mark Rober合作測試Bard能力。

1.計畫能力:先折了三個不同材質的紙飛機,並拍下紙飛機的照片給Bard看,請Bard幫忙計畫如何測試紙飛機的飛行能力。Bard提議進行瞄準靶心的測試、紙面穿透力測試等多種方法,分別測試材質的硬度和風阻程度。

2.邏輯推理能力:下一步請Bard協助精進這架紙飛機的能力,Bard馬上列出幾項待改善的清單,包括翅膀太小、紙張太薄、尾翼太短等,並寫出原理。

3.創造力:詢問Bard該怎麼用最吸睛的方式測試紙飛機能力,讓YouTube影片變得更精彩,Bard提議一連串的現場設備,更建議可以「讓紙飛機飛越火圈」,讓Mark Rober成功完成影片片尾的精彩畫面。

Gemini Ultra版本的「Bard Advanced」

Google將於明年初上線火力全開的「Bard Advanced」,用最強大的多模態模型Gemini Ultra調校。這個版本原定會在年底上線,不過Google指出正在做更多安全性功能測試,將等到完善的階段開放使用。

Gemini Nano將登陸手機

另外,規模最小的Gemini Nano讓Pixel手機能解鎖更強大的AI模型應用,搭載最高階自研處理器Tensor G3的Pixel 8 Pro將成為第一款支援的手機,同樣搭載Tensor G3的Pixel 8會是下一波加入的機型,未來也會開放更多安卓手機加入支援Gemini Nano的應用程式,時程表未定。

Pixel 8 Pro第一波將上線兩大AI功能:

AI功能一:錄音工具摘要
可增強錄音功能的準確度,並且一鍵完成會議、訪談等錄音工具內容的摘要,不錯過細節,並且這些功能都是內建在手機,即便在離線的情況也能使用。

AI功能二:Gboard智慧回覆
開發人員預覽版的Gboard可啟動智慧回覆功能。AI根據收到的訊息給予回覆建議,節省使用者打字時間,目前率先支援Whatsapp,計畫於明年支援更多App。

在雲端龍頭亞馬遜AWS發出「世界上沒有最強模型」的宣言後,Google端出號稱「世界最強模型」應戰,並透過模型大小的彈性,卡位手機等終端應用開發市場,同時強調通用型能力,力求在生成式AI領域進入最多使用場景。

延伸閱讀:Gemini其實不是要幹掉ChatGPT!Google兵分三路想做什麼?

責任編輯:林美欣

延伸閱讀

Google一雪前恥,端「AI版搜尋引擎」,簡報、試算表、Cloud也導入!Bard更大進化
【觀點】Gemini其實不是要幹掉ChatGPT!Google兵分三路想做什麼?AI大戰解析
AI模型Gemini要來了,傳算力比GPT-4強5倍!Google集大成之作能贏嗎?
「加入《數位時代》LINE好友,科技新聞不漏接」

查看原始文章

更多科技相關文章

01

宏觀經濟壓力拖累加密市場 比特幣面臨年度回檔

路透社
02

馬斯克宣布 Neuralink腦機界面裝置2026年將量產

路透社
03

創造6萬倍投資奇蹟 股神巴菲特正式交棒阿貝爾

路透社
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...