接通的是答录机。播出去的是你的声音。

语音留言处理,是指 AI 外呼能识别出接电话的是答录机而不是真人,然后播放一段你自己录制的录音——用你自己的声音,和你录下来时一模一样。这通电话会被标记为语音留言,所以你能把它和真人接听的那些区分开。

语音留言电话按同样的语音分钟费率计费,而且时长很短。录音可以反复使用,所以这份功夫只花一次,不用每个营销活动都重来。

+1 425 ··· ···· 0 分 24 秒
Octo

您好,这里是港湾口腔,想跟您确认一下预约……

Caller

“嗨,这里是 Tom。听到提示音后请留言。”[提示音]

Octo

▶ 正在播放你的录音 —— 11 秒,就是你录下时的那个声音。

通话结束后

识别结果
应答机
采取动作
已播放录音
消息文件
spring-checkup-v2.wav
通话结果
语音信箱

问候语是按固定规则匹配的,不是模型的主观判断,所以同样的问候语永远得到同样的结论。播出去的是你的文件,不是合成语音在念稿。

或者,直接开口问

留在答录机上的是你的声音,一句话安排好。

录一段、指过去,然后看它留到了哪些人那里。

from:octo 语音留言
Octo留了 96 条语音——用的是你的录音 — 原样播放,没有用语音合成下午 4:20
Octo新录音已保存:“autumn-offer” — 18 秒周二
Octo拆分:318 通接通 / 96 通答录机 — 按固定规则判定,不是猜的周二

Inbox留了 96 条语音——用的是你的录音

D上午 9:40

碰到答录机就播 autumn-offer 那段录音。

OOcto下午 4:20

完成——96 台答录机,你的录音原样播放,中间没有经过语音合成。这 96 通标记为语音信箱而不是接通,所以它们和那 318 通真实对话是分开排序的。

Octo在线
它怎么知道那是答录机?下午 4:31 ✓✓
是对通话记录套固定规则,不是模型判断——所以同一段问候语每次都会得到同样的结论。下午 4:31
能听一下留给 tom whitfield 的那条吗?下午 4:33 ✓✓
每次都是同一个 18 秒的文件。这就是它,另外附上留言的那通电话。下午 4:33
给十二月再录一段下午 4:35 ✓✓
随时可以——打这个号码,你录什么我就存成“december”。下午 4:35
消息
#omniocto4 位成员
MRMarcus下午 1:12

@Octo 我们现在有哪些录音?

OOctoAPP下午 1:12

处理中 🔧(正在执行list_voicemail_recordings…)

三段:autumn-offer(18 秒)、missed-you(12 秒),还有三月那段现在没人在用。 (edited)

✅ 1

1 条回复 · 最后回复于 33 分钟前

DWDana下午 1:40

三月那段删掉吧

消息 #omniocto

邮件 octo@agent.omniocto.com · WhatsApp 1-MAN-ASK-OCTO · Slack #omniocto

三个部分

认出机器,播出真人。

大多数系统碰到语音信箱,要么直接挂断,要么用合成语音念一段稿子。这两种都不是你自己会做的事。

它能认出问候语

答录机自报家门的说法就那么几种,都很好预料,所以这个识别是对文字记录套一组固定规则,而不是一次主观判断——如果问候语是静音的,或者短到读不出什么,提示音本身也算数。

播放的是你的录音

你录下来的音频原样播出去。不是改写,不是重新合成,也不是照稿朗读——对方听到的就是你选定的那个声音。

录音可以反复用

录音会被保存下来,哪个营销活动需要就挂到哪个上面,所以录一次的留言,能服务后面每一份名单。

语音留言是一个真实的结果,不是一通失败的电话。它会被单独归类,所以你的结果表能告诉你哪通是哪通。

你会怎么把它交出去

录制、挂载、看结果。

1

录下这段留言

用它该有的那个声音。

你、同事,或者家人——电话那头的人该听到谁,就让谁来录。它就是一段录音,所以谁录的就像谁。

“如果转到语音信箱,就放我录好的那段留言——别去跟机器聊天。”
2

挂到营销活动上

然后照常跑名单。

打通到真人的,就进行对话。打到机器的,就播录音。你不用做两个营销活动。

3

看清楚哪通是哪通

接听和语音留言是两种不同的结果。

每个联系人的结果都会写明是真人接的还是机器接的,所以后续要跟进的名单,就是那些值得再打一次的人。

✓ 318 通已接听 · 96 通已留言 · 61 通无人接听

底下实际在发生什么

为什么它听起来像你,而不像软件。

识别靠的是规则,不是猜

分类器针对文字记录,用固定规则去匹配那几种标准的答录机问候语,以及单独出现的提示音。同一段问候语永远得出同一个结论——当另一种可能是对着答录机说上一分钟、还照样收你钱时,这一点就很要紧。

固定规则 · 可复现 · 仅凭提示音也能兜底

真人录音,原样播放

播出去的就是你录的那个文件。从你的声音到对方耳朵之间,没有任何语音合成环节——这正是用录音而不用稿子的全部理由。

你的音频 · 怎么录就怎么放

也可以把语音留言本身当成整件事

语音留言投放是一种独立的营销活动类型,适合把送达录音当作目标、而不是当作退路的情况——名单搭建、排期和结果统计都和其他营销活动一样。

语音留言投放型营销活动

语音留言是一等的结果类型

它是十三种通话结果之一,和无人接听、占线都不一样。你的重拨策略可以区别对待它——大多数人不会再回拨一个已经收到留言的人。

独立结果 · 重拨策略可识别

身份告知在对话里依然适用

在真人接听的通话里,AI 身份告知默认开启,措辞由你控制,而且每通电话都会记录当时告诉对方的内容。

默认开启 · 可编辑 · 逐通留痕

常见问题

大家真正会问的问题。

它怎么知道接的是答录机?
它听的是答录机实际会说的那些话——那几种标准的“听到提示音后请留言”说法;如果问候语是静音的,或者短到无法判断,就靠提示音本身来定。这个判断是根据文字记录、按固定规则做出来的,不是让模型去猜,所以同一段问候语永远得到同一个结论。
这段留言是合成语音在念我的稿子吗?
不是。播出去的就是你录的那个音频文件,怎么录的就怎么放。这正是这个功能的意义所在:对方听到的是你,而不是一个近似的你。
可以让家人或同事来录吗?
可以。它就是一段录音,所以这条留言里该出现谁的声音,就让谁来录。做关怀问候时,往往是家属来录,而不是商家。
每个营销活动都要重新录吗?
不用。录音会存进一个可反复使用的素材库,哪个营销活动需要,就挂到哪个上面。
可以完全不做 AI 对话,只发语音留言吗?
可以,那是一种独立的营销活动类型:语音留言投放——把录音送达本身就是全部任务,而不是对话没谈成时的退路。
别人会知道这是自动的吗?
在对话那一侧,AI 身份告知默认开启,措辞由你来定。凡是你录了真人声音的地方,那段录音会原样播放——你录的是什么,对方听到的就是什么。

开始

录一次,每份名单都能用。

语音留言电话按同样的语音分钟费率计费,而且时长很短。录音可以反复使用,所以这份功夫只花一次,不用每个营销活动都重来。