2026-05-28 · AI 觀察筆記
AI 學會邊聽邊說:全雙工模型照出我們最常犯的溝通盲點
Thinking Machines 推出全雙工 AI,能邊說邊聽、0.4 秒回應,比 OpenAI、Google 都快。但機器努力學的「真正傾聽」,恰恰是大人最常做不到的——從柯維習慣五知彼解己看教育現場。
AI 終於學會一件很多大人做不到的事:邊聽,邊想,邊回
我們跟 Siri、跟語音客服講話,總有一種微妙的卡。你話講完,停半秒,它才開口。或者你只是換口氣,它就急著插話:「抱歉,我沒聽清楚,你說什麼?」
那半秒的尷尬,其實藏著一個技術真相。
現在的語音 AI,是「輪流講話」
它的運作是一條單行道:你講 → 轉成文字 → 運算理解 → 吐出回應。一段一段排隊跑,所以中間一定有縫。
可是真人對話不是這樣。我講話的當下,你已經同時在聽、在想、在準備回應——甚至會在我還沒講完時點頭、皺眉、插一句「等等」。
Thinking Machines 想補上這條縫
這家公司來頭不小:創辦人是 OpenAI 前技術長 Mira Murati,去年融到 20 億美元、估值 120 億,卻一直沒產品。最近他們終於端出第一個研究專案——一個「全雙工(full duplex)」模型。
白話講:它能一邊說話,一邊同時聽你講,反應只要 0.4 秒,比 OpenAI 和 Google 都快。
換句話說,AI 第一次學會了「邊聽邊想」,而不是「等你講完才開始思考」。
但我看到的,是另一件事
AI 拚了命想學會的這個能力——邊聽、邊想、邊調整——恰恰是我們大人最常做不到的。
我帶導師班這幾年最深的體會是:學生話還沒講完,我就已經在心裡準備糾正他了。他說「老師我這次又考不好是因為……」,我腦袋早就跳到「藉口、又是藉口」,根本沒在聽那個「因為」後面是什麼。
那不是傾聽。那也是一條單行道。
拉回教學現場:知彼解己
柯維七習慣裡,習慣五是「知彼解己」——先求理解別人,再求被別人理解。
他說大多數人聽別人講話,不是真的想懂,是在等一個空檔把自己的話塞進去。我們聽的方式,根本就是那台會插話的舊語音 AI。
諷刺的是,機器正在努力學會真正的傾聽,而我們這些有血有肉的人,反而常常退化成「sequential loop」。
我的結論
AI 把「邊聽邊回」做到 0.4 秒,是工程的勝利。但「真正聽懂一個孩子在說什麼」這件事,從來不是速度問題——是你願不願意先把自己的答案放下。
機器在練習傾聽了。今天回家,要不要也試著,把孩子那句話聽完?
資料來源:AI Hustle Podcast〈Thinking Machines 全雙工語音模型〉