AI 通话引擎
不是简单的「自动外呼」,是 8 状态机驱动的实时语音 AI 流水线
从拨通到挂断的每一毫秒都有状态机控制 —— 静音检测、插话打断、合规扫描、情绪识别,全在一条热路径上实时完成。
通话状态机
8 个状态,全程自动流转
IDLE空闲等待呼入 / 呼出触发
GREETING开场白播放 TTS 合成的开场问候
LISTENING聆听VAD 语音活动检测,采集债务人语音
THINKING思考ASR → LLM 推理 → 生成回复文本
SPEAKING播报TTS 合成语音 → AudioSocket 推流
INTERRUPTED被打断检测到插话 → 暂停播放 → 切换到聆听
CLOSING收尾播放结束语,排空 TTS 缓冲
DONE结束挂断 → 触发通话后分析流水线
技术实现参考:runtime/pipeline.py — RealtimePipeline + PipelineState
实时热路径
AudioSocket → VAD → ASR → LLM → TTS,一条异步管线打到底
热路径不经过数据库、Redis、事件总线 —— 全在内存中完成,毫秒级延迟
实时合规扫描
Aho-Corasick 多模式匹配,通话中毫秒级检测
威胁恐吓
threat包含威胁性、恐吓性语言
冒充身份
impersonate冒充公检法、监管部门等
过度承诺
overpromise承诺无法兑现的减免方案
辱骂骚扰
abuse使用侮辱性、攻击性语言
程序违规
procedure未进行身份核验、未告知录音
三层防御体系
双引擎架构
FreeSWITCH + Asterisk 22 互备,运营商级可靠性
FreeSWITCH (主)
- · ESL 事件套接字,实时呼叫控制
- · WebRTC 软电话支持
- · SIP Trunk 配置化管理
Asterisk 22 (备)
- · AMI + ARI + AudioSocket 协议
- · FastAGI 拨号方案脚本
- · 自动故障切换
语音模板引擎
支持两种模板类型:对话模板(多轮 AI 协商,含开场白 × 对话目标 × 最大轮次 × 禁止动作 × 身份核验 × DNC 规则 × 转接规则 × 通话后动作) 和 通知模板(单次 TTS 播报)。 模板变量从案件数据自动填充(债务人姓名、欠款金额等)。
对你的团队意味着什么
调解员
告别手工拨号。一键发起 AI 通话,实时看文字转录,通话结束后自动出摘要和下一步建议。
合规官
不再抽样听录音。每一通电话实时扫描 5 类违禁词,违规瞬间告警,全量录音可回溯。
IT 管理员
双引擎高可用架构,一个挂了自动切另一个。SIP Trunk 配置化管理,无需改代码。