为正在进行的VOIP呼叫提取和注入音频

Moo*_*oon 7 voip pbx audio-streaming

在VOIP和与VOIP系统的集成方面,我是一个新人.

这是我想要做的:

  1. 呼叫者呼叫并且操作员应答呼叫.
    1.1.开始将呼叫者的音频流式传输到云中的分析服务.
  2. 一旦执行音频分析(通常在几秒钟内),操作员将按下"保持"按钮以执行分析建议的操作.
    2.1.根据分析结果,将特定音频文件播放回呼叫者,让他们知道操作员在保持时正在执行"x","y"或"z".

鉴于我使用VOIP系统的非经验,我正在寻找任何可以指向正确方向的主题,领域,文章和技术的建议/指针.

小智 1

我可以给出一些一般性的观点。我假设基于 SIP 的 VOIP 实际上是无所不在的(IMS、LTE、3GPP 等)。

您在搜索时可能会发现 VOIP 有两个部分:

  • SIP(控制平面)
  • RTP(数据或有效负载平面 = 音频)

一般来说,有两种方法,一种来自点对点世界,其中媒体流的每个变化都会通过 REFER 传达给另一方,以执行出于任何目的的实际呼叫转移。但这通常不是首选的做事方式。第二种方法是隐藏 B 方(被叫方)方面的任何更改。IMS中也使用了这种东西(它是现代 GSM 网络的背后)。诀窍在于 A 方(调用者)实际上到达了 B 方代理。就SIP而言,它是B2BUA又名背对背用户代理。顾名思义,它涵盖了被叫方网络中发生的所有魔力。

魔法实际上隐藏在B2BUA后面,它实际上充当中间的实体,因此可以操纵SIP和RTP。

因此,该实体实际上可以使用MGW (媒体网关)将音频分叉至“真正的”B 方(人类/操作员),并将音频引导至ML / AI /专家系统分析。此过程还包含适当的控制平面事件,例如启动分析过程附加、实际音频分叉 ( RTP ) 以及触发最终 B 方的SIP INVITE 。每当分析结束时,就会通过带外消息发送到SIP 代理(带有 SoftPhone 的计算机/平板电脑)或附加到呼叫中心系统的某个CRM系统上的某个“丰富”客户端。此类消息应告知 B 方分析结果。

所有的魔力要么隐藏在B2BUA内部,要么最终隐藏在SIP 应用服务器内部,SIP 应用服务器是各种服务的通用名称,例如呼叫中心代理的呼叫分配、语音邮件、IVR 等。

如今,语音分析在银行中用于呼叫者验证、情绪分析和许多“智能”音频处理。

在该领域,有一些开源和专有的 SIP 系统。它们往往有些复杂。此外,与请求响应系统(如 HTTP)相比,其逻辑有很大不同。呼叫是一个具有“会话”(呼叫 ~ 呼叫 ID)的有状态系统,一切都与之绑定。

希望这可以帮助您。