跳到主要內容

發表文章

目前顯示的是有「Meta」標籤的文章

Meta 將 AI 融入 Ray-Ban 眼鏡,重新定義時尚與科技

Meta 在可穿戴技術領域邁出了重大的一步,宣布將 AI 整合到其 Ray-Ban 智慧眼鏡中。此舉象徵著 Meta 從原本專注於元宇宙的策略,轉向更廣泛地強調 AI 在日常設備中的應用。AI 與 Ray-Ban 智慧眼鏡的結合,將提升這些可穿戴設備的功能,提供物體和動物識別、語音翻譯等特色功能。 Ray-Ban 智慧眼鏡中的 AI 整合 Meta 與 Ray-Ban 合作推出了配備攝像頭和麥克風的智慧眼鏡,最初設計用於拍照、錄製影片和播放音樂。隨著 AI 的加入,這款眼鏡現在能夠識別物體和動物,即時翻譯語音,並根據視覺輸入提供資訊。 物體和動物識別 Ray-Ban 智慧眼鏡內建的 AI 可以利用鏡頭識別各種物體和動物。《紐約時報》對此功能進行了測試,發現雖然眼鏡可以正確識別寵物和藝術品,但在識別遠處或籠子後面的動物園動物,以及看到釋迦認不出來的狀況。雖然存在這些挑戰,但 AI 在提供使用者周遭環境的實用資訊方面展現出前景。 語音翻譯 AI 整合的一大亮點是語音翻譯功能。目前,該眼鏡支援英語、西班牙語、義大利語、法語和德語之間的翻譯。這個功能可以讓說不同語言的人之間的無縫對話,有望打破溝通障礙。這功能如果可以沒有延遲的的持續翻譯,真的會是一大福音。 用戶體驗和啟動 使用者可以透過說 "Hey Meta" 並提出問題或指令來啟動智慧助理。AI 會透過內建於眼鏡框架中的喇叭進行回應。這種免持操作針對移動中的使用體驗進行了優化,讓使用者能夠透過語音命令取得資訊和控制功能。這功能類似掛著耳機的 Hey Google 或是 Hey Siri,但是搭配上視覺辨識,可以更加強大。 市場發布日期 Ray-Ban Meta 智慧眼鏡的 AI 功能預計將於下個月向大眾發布,在這之前從去年 12 月就開始了提前體驗。初期,這些功能將透過美國用戶的提前體驗候補名單提供。這款眼鏡的售價為 299.99 美元,可以從 Ray-Ban 官網訂購。看來目前台灣是無法取得了,真的很可惜。 挑戰和限制 雖然 AI 驅動的智慧眼鏡提供了新的功能,但它們並非沒有局限性。《紐約時報》的測試顯示,AI 並不總是能準確識別物體,這表明該技術仍處於早期階段,需要進一步完善。此外,AI 功能在上市時僅支援英語、義大利語和法語,未來計劃逐步擴展語言支援。 寫在後面 Meta 將 AI 引入其 Ra...

Meta 推出 Voicebox:AI 語音生成的集大成

人工智慧語音生成的突破 Meta,Facebook的母公司,宣布在語音生成人工智慧領域取得重大突破。Voicebox,一款最先進的人工智慧模型,它能透過上下文學習來執行它並未特別訓練過的語音生成任務。這個人工智慧模型能夠生成高品質的音訊剪輯,並且可以編輯預先錄製的音訊,例如去除不需要的噪音,同時保留音訊的內容和風格。 Voicebox 的功能 Voicebox 擁有多種功能,包括上下文文字轉語音合成、語音編輯和降噪、跨語言風格轉換,以及多樣化的語音取樣。只需要2秒的音訊樣本,Voicebox就可以匹配音訊風格進行文字到語音的生成。它還可以重建被噪音中斷的語音部分或替換錯誤的單詞,而不必重新錄製整段演講。 Voicebox 的可能應用 Voicebox 的可能應用範圍非常廣泛。它可以賦予虛擬助手和元宇宙中的 NPC 自然的聲音。視障人士也可以使用它來聽取由他們的朋友的聲音朗讀的訊息。在未來,這項技術可能應用於患有聲帶損傷的患者的 AI 聲帶。 寫在後面:Voicebox 的未來 Voicebox 在生成人工智慧研究中代表了一個重大的步驟,但它尚未對公眾開放。因為 Meta 認為到這款人工智慧可能被用於不當用途,並且正在研究一種有效的方法來區分真實語音和由 Voicebox 生成的音訊。Voicebox 感覺跟之前介紹的 AI 配音又更進階了一步,把聲音模擬優化一次集大成,看影片的表現也賦予的不同聲音感情,小編本身很看好未來 MMORPG 的發展,Sword Art Online 感覺快要出現了....😨 Read more AI如何挑戰傳統的配音行業:人工智慧是否將取代配音員的工作? MusicGen:Meta 開發的開源生成式AI 免費玩!   德國首度AI教會講道: 300人見證OpenAI ChatGPT的實驗性活動 霹靂遊俠現世?!賓士整合ChatGPT 進入車內語音控制系統 參考資料 Introducing Voicebox: The Most Versatile AI for Speech Generation | Meta   Meta's Voicebox AI is a Dall-E for text-to-speech | Engadget   Meta's Voicebox Generative AI Makes A...

MusicGen:Meta 開發的開源生成式 AI 免費玩!

MusicLM 與 MusicGen MusicLM 與 MusicGen 是由 Google 和 Meta 開發的兩款生成式 AI 音樂應用程式。 什麼是生成式音樂AI? 生成式音樂 AI 是指使用人工智慧演算法創作新音樂的技術。這項技術可以影響音樂製作過程的每個環節,包括音樂生成、音訊精修和音樂串流。生成式 AI 有兩種類型:基於規則的 AI 和生成式 AI。基於規則的 AI 允許作曲家調整參數,如BPM、節奏、樂器演奏和風格。而生成式 AI 則讓作曲家輸入音樂數據,並應用深度學習根據統計機率根据和模式產出新的音樂作品。 Google MusicLM MusicLM 是 Google 的 AI Test Kitchen 計劃的一部分,是一個文字轉音樂的生成模型。它能夠從自然語言的簡單文字描述創作音樂。MusicLM 以24kHz 的更高採樣率生成音樂,這代表著生成高品質的音訊。MusicLM 是一個實驗性的AI工具,可以根據你的文字輸入建立音樂,但它只限於 20秒,而且目前要排隊才能進去使用,最近 Meta 公布的 MusicGen,反而可以讓大家玩的比較開心。 Meta MusicGen MusicGen 是 Meta 開發的一個開源生成式 AI 模型,它可以根據文字提示生成音樂,甚至可以與現有歌曲保持一致。MusicGen 可以根據文字提示生成短的新音樂作品,這些作品可以選擇性地與現有的旋律保持一致。該模型接受了20,000個小時的音樂訓練,包括完整曲目和單獨的樂器樣本,提供各種音樂風格。MusicGen 使用文字或旋律提示,基於後端生成元素內置的歌曲和樂器樣式樣本創建全新的音樂。 怎麼玩 MusicGen 進入 Hugging Face , 在 Describe your music 地方描述我們的音樂需求,然後在最右邊按下生成。AI 就會開始製作音樂了,完成後可以下載。 聽看看結果,搖滾樂/綠洲合唱團 搖滾樂/超脫合唱團 寫在後面 MusicLM 和 MusicGen 都是生成式 AI 正在改變音樂創作的例子。這些工具有助於比傳統方法更快、更經濟地生成音樂,使它們成為我們這些外行人創作音樂的吸引人選擇。雖然這些工具在激發音樂靈感和節省音樂製作階段的時間方面可能是有幫助的,但音樂這種東西,還是需要人類不斷的激發靈感去產生的,小編認為偉大的音樂創作還是短時間...