新聞
2026-07-30 21:03:46

SpaceXAI推最新語音模型整體評分贏OpenAI

SpaceXAI 推出最新語音模型 Grok Voice Think Fast 2.0,與上一代比較,顯著提升人工智能(AI)語音推理、對話能力和可靠性,該模型是迄今為止最聰明的語音模型。 該公司指出,在準確率方面,對24種不同語言的數以千計的短語進行評估,結果與 Deepgram Nova 3和 ElevenLabs Scribe v2 相比,準確率提高1.5倍至2倍;與 Grok Voice Think Fast 1.0 比較,準確率則提高1.4倍。在嘈雜的環境下,Grok Voice Think Fast 2.0 與專用語音轉文字模型之間的差距會擴大到約10倍。在推理效率方面,可以在說話同時進行查詢推理。這種與語音並行推理方式,令該模型比其他語音到語音模型更智能,且不會影響延遲。 Grok Voice Think Fast 2.0 定價方面,為每分鐘音訊0.08美元(約0.624港元)。 GrokVoiceThinkFast2.0 綜合得分82.9%,較其前代 Grok Voice Think Fast 1.0 的75.7%,及OpenAI 的 GPT-Realtime-2.1、Google(谷歌)的 Gemini3.1 Flash 的79.1%及69.5%為高。 Agentic 表現評分56.5%,前代為52.1%,GPT-Realtime-2.1 及 Gemini3.1Flash 分別為45.7%及37.7%。 (BC) #SpaceXAI #OpenAI #美股

<匯港通訊>