它接到答錄機。播的是你的聲音。

語音訊息處理,指的是 AI 電話能辨識出接聽的是答錄機而不是真人,並播放一段你自己錄製的錄音 —— 用你自己的聲音,和你錄下來時一模一樣。這通電話會被標記為語音信箱,所以你分得出哪些是真人接的、哪些不是。

語音信箱通話同樣按每分鐘語音費率計費,而且都很短。錄音可以重複使用,所以功夫只花一次,不必每檔活動重來。

+1 425 ··· ···· 0 分 24 秒
Octo

您好,這裡是港灣牙醫診所,想跟您確認預約⋯⋯

Caller

「嗨,這裡是 Tom。嗶聲後請留言。」[嗶]

Octo

▶ 正在播放你的錄音 —— 11 秒,用你錄下時的那個聲音。

通話結束後

偵測結果
答錄機
採取動作
已播放錄音
訊息檔案
spring-checkup-v2.wav
通話結果
語音信箱

問候語是以固定規則比對的,不是模型的主觀判斷,所以同樣的問候語永遠得到同樣的結果。播出去的是你的檔案,不是合成語音在唸稿。

或者,直接開口問

你的聲音留在答錄機上,用一則訊息就安排好。

錄好、指定它,然後查它落在哪裡。

from:octo voicemail
Octo已留 96 則語音訊息 —— 你的錄音 — 原樣播出,沒有文字轉語音下午 4:20
Octo新錄音已儲存:「autumn-offer」 — 18 秒週二
Octo分布:318 接通 / 96 機器 — 以固定規則歸類,不是用猜的週二

Inbox已留 96 則語音訊息 —— 你的錄音

D上午 9:40

碰到答錄機時,就用 autumn-offer 那段錄音。

OOcto下午 4:20

完成 —— 96 台機器,播的是你錄的那段,和錄下來時一模一樣,中間沒有任何語音合成。這 96 通標記為語音信箱,所以會和那 318 通真實對話分開排序。

Octo線上
它怎麼知道那是機器?下午 4:31 ✓✓
用逐字稿上的固定規則,不是模型判斷 —— 所以同樣的問候語永遠得到同樣的結果。下午 4:31
可以聽它留給 tom whitfield 的那則嗎?下午 4:33 ✓✓
每一次都是同一個 18 秒的檔案。這是檔案,還有它被留在哪一通電話上。下午 4:33
幫十二月錄一段新的下午 4:35 ✓✓
隨時可以 —— 打那個號碼,我會把你錄的存成「december」。下午 4:35
訊息
#omniocto4 位成員
MRMarcus下午 1:12

@Octo 我們有哪些錄音?

OOctoAPP下午 1:12

處理中 🔧(執行list_voicemail_recordings…)

三段:autumn-offer(18 秒)、missed-you(12 秒),還有一段三月的,目前沒有任何地方在用。 (edited)

✅ 1

1 則回覆 · 最後一則於 33 分鐘前

DWDana下午 1:40

三月那段砍掉

訊息 #omniocto

Email octo@agent.omniocto.com · WhatsApp 1-MAN-ASK-OCTO · Slack #omniocto

三個部分

認出機器,播出真人。

多數系統遇到語音信箱不是直接掛斷,就是用合成語音唸一段稿子。這兩種都不是你自己會做的事。

它認得出問候語

答錄機自報身分的方式就那麼幾種,而且相當固定,所以偵測是一組跑在逐字稿上的固定規則,而不是主觀判斷 —— 當問候語靜音或短到讀不出來時,嗶聲本身就算數。

播的是你的錄音

你錄的音檔會原樣播出。不改寫、不重新合成、也不照稿唸 —— 對方聽到的就是你選定的那個聲音。

錄音可以重複使用

錄音會被保存下來,需要時掛到任何一檔活動上,所以你錄一次的訊息,往後每一份名單都用得上。

留下語音訊息是一個真實的結果,不是一通失敗的電話。它會被歸類成一種結果,所以你的成效報表分得出誰是誰。

你會怎麼交辦

錄音、掛上去、看結果。

1

錄下訊息

用它該有的那個聲音。

你、同事,或家人 —— 電話那頭的人該聽到誰,就由誰來錄。那是一個音檔,所以聽起來就是錄的人本人。

「如果轉到語音信箱,就播我錄的那段訊息 —— 不要試著跟答錄機對話。」
2

掛到活動上

然後照常跑名單。

接到真人的電話就進行對話,接到機器的就播錄音。你不需要建兩檔活動。

3

看清楚哪通是哪通

「接通」和「語音信箱」是不同的結果。

每位聯絡人的結果都會標明是真人接的還是機器接的,所以後續要追的名單,就是那些值得再打一次的人。

✓ 318 通接通 · 96 通留言 · 61 通無人接聽

底下實際發生的事

為什麼它聽起來像你,而不像軟體。

偵測靠規則,不靠猜

判斷器用固定規則,在逐字稿上比對標準的機器問候語和單獨的嗶聲。同樣的問候語永遠得到同樣的判斷 —— 當另一種可能是對著答錄機講一分鐘還被計費時,這一點很重要。

固定規則 · 可重現 · 純嗶聲備援

真人錄音,原樣播出

播出的就是你錄的那個檔案。你的聲音和聽到它的人之間,沒有經過任何文字轉語音的步驟 —— 這正是要用錄音而不是用稿子的全部理由。

你的音檔 · 原樣播出

也可以讓留言本身就是整件事

語音訊息投遞是一種獨立的活動類型,適用於「把錄音送到」本身就是目標、而不是備案的情境 —— 名單建立、排程和成效報表都和其他活動一樣。

語音訊息投遞活動類型

語音信箱是一等公民的結果

它是十三種通話結果之一,和「無人接聽」與「忙線」都不同。你的重撥策略可以區別對待 —— 大多數人不會回撥一個已經收到訊息的人。

獨立結果 · 重撥策略可識別

對話部分仍然適用揭露

在真人接聽的通話上,AI 揭露預設開啟,措辭由你掌控,而且每通電話都會記錄對方被告知了什麼。

預設開啟 · 可編輯 · 逐通稽核

常見問題

大家真正會問的問題。

它怎麼知道接到的是答錄機?
它會聽答錄機實際會說的那些話 —— 像是「嗶聲後請留言」這類標準句型;當問候語是靜音或太短而無法判斷時,則以嗶聲本身為準。這個判斷是根據逐字稿、用固定規則做出來的,不是請模型去猜,所以同樣的問候語永遠會得到同樣的結果。
播出去的是合成語音在唸我的稿子嗎?
不是。播的就是你錄的那個音檔,原樣播出。這正是這項功能的重點:對方聽到的是你,不是一個近似於你的東西。
可以改由家人或同事來錄嗎?
可以。那就是一個音檔,所以由誰來當這段訊息的聲音,就由誰去錄。以關懷問安來說,錄的人通常是家屬而不是機構。
每檔活動都要重錄嗎?
不用。錄音會放在一個可重複使用的資料庫裡,需要的時候掛到任何一檔活動上。
可以完全不要 AI 對話、只留語音訊息嗎?
可以,那是一種獨立的活動類型:語音訊息投遞。此時把錄音送到對方信箱本身就是目的,而不是對話沒發生時的備案。
對方會知道這是自動撥打的嗎?
在對話那一側,AI 揭露預設是開啟的,措辭由你決定。而在你已經錄好真人聲音的地方,那段錄音會原樣播出 —— 你錄了什麼,對方就聽到什麼。

開始

錄一次,每一份名單都能用。

語音信箱通話同樣按每分鐘語音費率計費,而且都很短。錄音可以重複使用,所以功夫只花一次,不必每檔活動重來。