1 / 1
◎早安現場:專訪3C部落客林小旭,細探接連兩天OpenAI與Google分別推出的語音互動服務新產品,語音產品的誕生,補足了文字、圖像、影片和語音全方位的AI拼圖。
繼今年2月「Sora」AI影片平台問世之後,OpenAI再推出「GPT-4o」語音問答。使用者透過語音方式進行互動時,4o回應的語氣與能力不僅相當自然,回應的時間更是快速。
4o同時可以翻譯多國語言,或是透過攝影裝置,及時捕捉使用者的表情和聲音情緒,用相對應的情緒回答提問;對學生來說,甚至可以依照程度不同,提供深入淺出的教學解答。不難想像未來說床邊故事哄小孩睡覺的溫柔機器人,就是才剛剛發表的4o!
(繼ChatGPT之後,OpenAI 推出GPT-4o語音服務機器人,在文字、圖像、影片之後,補足語音服務,四塊拼圖終於全部到位、(攝自Open AI官網))
15日凌晨1點,Google舉辦今年的Google I/O 發表會,公佈全新的Google AI 應用,最新的Gemini 1.5 Pro語音助理正式登場。
新的語音助理除了像「ChatGPT」一樣直接給你答案以外,還能針對搜尋結果先做重點整理、辨識圖片、辨識物體、掃描故障代碼或故障現象,立刻提供解決方案;在原先的Google地圖裡,擴增規劃行程、提供餐廳、住宿、景點、充電站等功能;相簿可快速製作回憶或歷年紀念集,Google Meet新增會議摘要、重點整理功能;其他像文字轉圖片、文字轉影片、隱私加密衛星通訊、汽車應用與生態圈互相串聯等等,都會在今年夏天來臨來推出!
(AI科技盛行,Google也發表人工智慧應用Gemini 1.5 Pro語音助理。(攝自發表會))


Rti 中央廣播電臺
Rti 中央廣播電臺