← 所有主題

Voice AI

此主題的繁體中文文章,最新優先。

5 篇文章
繁體中文

2026

4 篇文章

  1. OpenRouter

    把 TTS 接進產品前,先處理音訊位元組與錯誤分類

    OpenRouter 用一個 OpenAI 相容端點統一多家 TTS 模型,但真正的工程量在回應驗證、格式限制與重試分類。

    閱讀文章 ↗

  2. Voice AI

    挑選 AI 語音代理平台:先拆解成本與部署層級,再談功能

    語音代理不再只是「語音辨識 + 規則回應 + 文字轉語音」的拼裝。Firecrawl 的 Ninad Pathak 在 2026 年 9 月 8 日的文章中指出,新一代 AI 語音代理能持續對話、呼叫工具,甚至在通話中完成任務。但市場上外觀相似的平台很多,要選出適合自己的,得先搞懂它們在「怎麼建構、底層跑什麼、怎麼處理電話、以及成本結構」上的差異。

    閱讀文章 ↗

  3. Voice AI

    Nari Labs 把 Qwen3-TTS 壓進 50 毫秒內開口

    Nari Labs 於 8 月 19 日公開 Qwen3-TTS 1.7B 優化成果:單張 H100 上達到每秒 10 次請求、p95 首音延遲低於 50 毫秒,並開源整套服務實作與基準測試。

    閱讀文章 ↗

  4. AI

    Even Realities 躋身獨角獸:無鏡頭智慧眼鏡突圍

    深圳新創 Even Realities 完成一億五千萬美元融資,美團、騰訊領投,估值 10 億美元;其無鏡頭智慧眼鏡已售逾萬副、平均訂單約一千美元並已獲利,走出與 Meta 相反的路線。

    閱讀文章 ↗

2025

1 篇文章

  1. Google

    Google AI Mode 開放語音對話:Search Live 走進搜尋

    2025 年 6 月 18 日,Google 開始在 AI Mode 測試語音對話,美國 Labs 用戶可在 Google App 點 Live 圖示,用說的提問並追問,由客製化 Gemini 生成語音回答。本文整理功能細節、查詢擴散技術與後續規劃。

    閱讀文章 ↗