ChatGPT語音登陸桌面,清聽聲學聚音屏技術賦能AI PC,搶先入局!
日期:2026-07-30 13:42:40 發布者:本站
近日,OpenAI正式將ChatGPT語音功能推進桌面端,在Work與Codex場景中,用戶可直接用語音啟動任務、調度多個AI Agent、隨時打斷并調整方向,用戶只需動嘴,就能指揮AI完成復雜任務。OpenAI官方數據顯示,Codex加ChatGPT Work的周活已突破1000萬。

一個信號已經明確:語音正從"輔助輸入"升級為AI交互的核心入口。
01. 從GUI到AUI,人機交互的第三次躍遷
過去四十年,人機交互經歷了從命令行到圖形界面(GUI)的跨越。如今,隨著大模型理解能力的躍升和語音技術的成熟,交互范式正在發生第三次轉移——AUI(Audio User Interface,語音用戶界面)時代已經來臨。

長期以來,人與AI的交互依賴點擊和鍵盤輸入,想法被拆解成一條條指令逐條輸入。語音輸入打破這種線性限制,用戶可直接開口,把前因后果、顧慮偏好一次性說完,哪怕表達零散,模型也能自行梳理。社區實測:語音吞吐約每分鐘240個詞,打字最多70-80個詞,效率相差三倍有余。
但AUI要真正走進辦公場景,必須先解決一個現實問題:一是環境噪音下,AI能否精準聽懂你的指令;二是AI的語音回復,如何不打擾鄰座、不外泄信息?
02. 語音交互的兩道門檻:AI聽不清/旁人聽得見
語音交互在辦公場景落地,面臨兩道現實門檻。
① AI 聽不清
開放式辦公區鍵盤敲擊、同事交談、電話鈴聲等背景噪音持續存在,語音指令容易被環境音干擾,識別準確率大打折扣。
② 旁人聽得見
AI語音回復通過普通揚聲器外放,鄰座被迫旁聽;會議室里多臺AI終端同時發聲,聲音互相交疊,誰也聽不清自己的那一份。
語音交互要真正走進辦公場景,靠的不是更靜謐的環境、更低的音量,而是讓聲音被精準地收、定向地放。
03. 聚音屏AI PC:釋放全雙工交互價值
清聽聲學聯合聯想打造的全球首款聚音屏AI PC,將第三代定向聲技術與AI 終端深度融合,讓"聽得清"與"聽得私密"同時成立。

輸出端?
聚音屏技術讓屏幕本身成為發聲單元,聲音以15°夾角定向投射至用戶耳畔,形成專屬私密聲場;系統還可通過攝像頭實時感知用戶位置變化,動態調整聲波方向,聲音始終追隨用戶耳際。AI的語音回復只有你能聽見,鄰座同事不受干擾,敏感信息不會外泄。
輸入端?
在定向發聲之外,聚音屏AI PC可進一步集成清聽聲學AI定向拾音,通過高靈敏度麥克風陣列與智能算法,精準鎖定用戶發聲方向,過濾鍵盤敲擊、同事交談等環境噪聲,無需刻意提高音量或俯身湊近,嘈雜的開放式辦公區AI也能清晰"聽見"你的每一句話。

輸出與輸入雙向協同,構成全雙工語音交互,形成“聽-說”交互閉環。在聚音屏AI PC面前,用戶可直接開口向ChatGPT下達復雜指令,AI在后臺執行,定向聲場將反饋私密送達,開放式辦公空間里,你擁有了"只屬于自己的聲音結界"。
不止于此,當一間辦公室同時運行多臺Voice Agent時,聚音屏可以建立一個個相對獨立的聲音區域,提高單位空間內可部署的智能工位數量。
當AUI時代來臨,辦公場景將被重新設計:不必整天端坐敲擊鍵盤,隨口讓AI整理客戶資料/發出一封郵件;可以在開放式辦公區同時調度多個Agent處理不同任務,而鄰座同事渾然不覺;多人協作時,各自與AI對話,聲音互不干擾。

當大模型賦予AI"聽懂人話"的能力,聲學技術則決定了這場對話能否在真實世界里體面地發生。語音交互的下半場,比拼的不只是模型的智商,更是聲音能否被精準地送達與拾取——這正是清聽聲學為AI時代提供的聲學解法。