定价概览
本平台将源码交付拆成两大业务系统:
- 系统一:AI 语音通话底座:负责 FreeSWITCH 通话控制、流式 ASR、TTS、运营管理后台,以及呼入/双向通话的基础语音交互。提供成熟稳定的呼叫编排引擎。
- 系统二:智能外呼与协同系统:不是“系统一 + 两个外呼页面”,而是在系统一通话底座上深度融合外呼调度、流程脚本、原生内嵌 AI 决策中台(AI 策略中心 + Playground)、坐席协同、实时盯屏、会议转人工与多模态情绪分析闭环的呼叫中心级外呼经营系统。
每个系统均提供云语音与本地私有化两类规格。
重要说明:“云语音”仅指 ASR/TTS 语音能力通过网关接入阿里云或 Azure,全部业务系统源码(如呼叫控制、管理后台、外呼系统、AI 策略中台、数据库、FreeSWITCH 等)仍交付并部署在客户自有环境中。
- 🎯 适用:呼入客服、语音 IVR、双向实时交互
- ⚡ 特点:ASR/TTS 走阿里/Azure 云网关,轻量易上手
- 📦 核心:ESL 通话编排 + 运营后台 + 云语音网关
- 💡 零本地模型运维成本,低门槛快速上线
- 🎯 适用:纯内网运行、自持模型、高数据隐私要求
- ⚡ 特点:自研纯 Rust 高性能语音引擎,无云端调用费
- 📦 核心:底座核心 + FunASR + Sherpa + 前置 VAD
- 💡 毫秒级开嗓打断,自持模型安全可控
- 🎯 适用:批量自动外呼、通知触达、坐席协同与盯屏
- ⚡ 特点:原生内嵌 AI 决策中台(AI 策略中心 + Playground)
- 📦 核心:系统一全部源码 + 外呼调度中台 + 流程脚本编排
- 💡 多 FS 池化分片调度,标准 OpenAI 兼容推理
- 🎯 适用:呼叫中心级全业务闭环、本地高密部署与质检
- ⚡ 特点:纯 Rust 本地语音 + 智能外呼 + 多模态情绪质检
- 📦 核心:包含两套系统全部源码及全部本地 Rust 服务
- 💡 转人工会议 + 办公室拟真底噪 + 情绪质检全链路闭环
💡 组件清单对照:各套餐对应的详细代码目录与微服务分工,请参见下方核心源码组件对照表。
🛠️ 配套实施服务:FreeSWITCH 源码编译安装、mod_audio_fork编译与端到端呼叫联调打通(¥500 / 次),可随套餐按需选购。
业务系统定位与解决问题
系统一:AI 语音通话底座(呼入/双向基础交互)
系统一专注于语音通话中的“听、说、控、管”,是所有语音交互业务的基础底座。主要用于呼入客服、语音 IVR、自助导航、双向基础对话等场景。
- 听(ASR):支持本地纯 Rust 流式
FunASR(2-pass 双流与 SenseVoice/Paraformer 离线识别)与sherpa-onnx识别服务,或云端语音网关,实时将通话音频转化为文字。可选stream-vad-proxy前置 VAD 流式代理,毫秒级开嗓即断(亦可直驱科大讯飞私有云 IAT)。 - 说(TTS):纯 Rust
sherpa-tts-server,支持普通 wav 与流式 TTS 播放链路,内置 LRU 缓存降低首包等待时间。 - 控(FreeSWITCH / ESL):基于
apps/callflow-esl呼叫编排服务,负责接听、播放、录音、挂断、转接、会议背景音(办公室拟真底噪)注入与打断保护,支持毫秒级 barge-in 打断。 - 管(运营后台):
callflow-server/callflow-webpage提供可视化路由配置、TTS/ASR 测试与运行看板,支持浏览器软电话接入与鉴权。
系统二:智能外呼与协同系统(外呼/人机协同)
系统二在系统一的通话底座上增加外呼业务闭环,专注解决外呼场景中的“呼、编、想、协、转、析”。它的价值来自“外呼调度 + 流程脚本 + 原生 AI 决策中台 + 坐席协同 + 实时盯屏 + 转人工 + 质检闭环”的完整组合。主要用于批量外呼、营销回访、通知触达、问卷调查、坐席协同等场景。
- 呼(智能外呼与调度):
callout-server/callout-webpage负责外呼活动、名单导入、批次调度、并发策略、多 FreeSWITCH cell 池化分片与 Redis 租约协调。 - 编(流程脚本):可视化编排话术、变量、节点(start, send, collect, router, var_router, chat, transfer, end)、NLU 决策与字段抽取规则;由
callflow-esl的callout-flow-business读取运行时 JSON 并逐节点精准执行。 - 想(原生 AI 策略中台):原生内置于
callout-server,并在前端提供独立一级入口「AI 策略中心」与 Playground。全面支持标准 OpenAI 兼容推理后端(Ollama、vLLM、GPUStack、DeepSeek、Qwen 等),提供 NLU 语义决策、多轮流式 Chat 对话、话术生成与模型用量大盘,彻底消除独立微服务的网络开销与端口割裂。 - 协(坐席协同与实时盯屏):提供坐席工作台与浏览器软电话,通话实时盯屏支持客户/AI/坐席/主管(Supervisor)多角色实时转写气泡推演、意向关键词告警、主管耳语与强插介入就地切换。
- 转(转人工与会议):支持按客户意图、流程节点或实时介入信号动态转接人工坐席,支持同 cell 转接、16k 会议拟真底噪防抖注入、转人工双阶段看门狗超时防护与坐席离会自退机制。
- 析(多模态情绪分析):全能私有化版配备纯 Rust
emotion-analysis-server,通话后自动完成文本 + 音频融合多模态情绪分析,用于质检、风险识别和外呼结果画像。 - 丰(核心业务套件):全平台业务扩充至 25 项(11 项核心生产业务 + 14 项测试/演示业务),新增
insurance-chat-business(1010,太平洋车险大模型电销对话,内置防复述护栏与改号纠错)。
核心源码组件对照表
如果您需要了解系统内包含的具体源码模块及分工,可对照下表:
| 对应代码目录 | 模块名称 | 作用说明 | 系统一 | 系统二 |
|---|---|---|---|---|
apps/callflow-esl |
ESL 业务编排服务 | 通话控制、媒体调度、识别事件处理、会议背景音与打断机制。 | 有 | 有 |
apps/callflow-server +apps/callflow-webpage |
运营管理后台 | 路由配置、TTS/ASR 测试、号码与运行时配置、浏览器软电话。 | 有 | 有 |
apps/callout-server +apps/callout-webpage |
智能外呼与 AI 策略系统 | 活动/名单调度、流程脚本、坐席工作台、实时盯屏,原生内嵌 AI 决策中台与「AI 策略中心」/ Playground。 | - | 有 |
onnx-platform/funasr-asr-server |
FunASR 识别服务 (Rust) | 统一流式 2-pass 双流与离线识别,高准确率与低延迟。 | 仅限本地私有化版 | 仅限全能私有化版 |
onnx-platform/sherpa-asr-server |
Sherpa ASR 识别服务 (Rust) | 统一流式与离线识别服务,纯内网自持模型。 | 仅限本地私有化版 | 仅限全能私有化版 |
onnx-platform/sherpa-tts-server |
本地 TTS 语音合成 (Rust) | 本地 HTTP 语音合成、LRU 缓存管理、流式播放支持。 | 仅限本地私有化版 | 仅限全能私有化版 |
onnx-platform/stream-vad-proxy |
前置 VAD 流式代理 (Rust) | 毫秒级开嗓即断 (speech-start),可直驱科大讯飞私有云 IAT。 |
包含于私有化套餐 | 包含于私有化套餐 |
onnx-platform/emotion-analysis-server |
本地情绪分析服务 (Rust) | 通话后文本 + 音频融合情绪质检与外呼结果分析。 | - | 仅限全能私有化版 |
speech-gateway/aliyun-speech-gateway |
阿里云语音网关 | 兼容 ASR WebSocket + TTS HTTP 的云端代理。 | 仅限云语音接入版 | 仅限云语音外呼版 |
speech-gateway/azure-speech-gateway |
Azure 语音网关 | 兼容 ASR WebSocket + TTS HTTP 的云端代理。 | 仅限云语音接入版 | 仅限云语音外呼版 |
部署前置条件(客户侧准备)
源码部署于客户自有环境,以下资源由客户自行准备,不包含在源码/服务费用中:
- 服务器与环境:Linux 系统服务器。纯 Rust 本地语音服务默认为 CPU/ONNX Runtime 路线,若需 GPU 加速可配置对应 CUDA 环境。
- 基础运行时:Bun 1.x(所有 TypeScript 服务)、PostgreSQL 15 数据库;Redis 7.x(多实例分片池化、调度分布式锁与实时盯屏的核心依赖);构建本地私有化语音底层需 Rust 编译工具链(随包可提供已编译可执行文件)。
- FreeSWITCH:FreeSWITCH 1.10.x / 1.11.x,并启用
mod_audio_fork;仓库提供容器化部署包deploy/freeswitch/与五篇专题部署文档;需要准备 SIP 中继线路,或测试用 SIP 分机及软电话。 - 云端版本依赖:若采购云语音接入版 / 云语音外呼版,需客户自行向阿里云 NLS 或 Azure Speech 申请账号、凭据并承担后续接口调用费用。
- 本地语音模型:若采购系统一本地私有化版 / 系统二全能私有化版,随包提供配套开源权重文件与下载指引。
- 系统二外呼依赖:若采购系统二,需准备外呼线路、坐席账号、外呼名单、业务流程脚本。
- 大模型与推理服务:若采购系统二,需准备标准 OpenAI 兼容接口的大模型推理环境(如 Ollama、vLLM、GPUStack、DeepSeek、Qwen 等),推理资源由客户侧服务器或外部 API 承担。
- 情绪分析模型:仅采购系统二全能私有化版时需要准备文本/音频情绪分析模型、通话录音存储和质检结果留存策略。
交付物与服务边界
交付内容
- 源码交付包:所购系统套餐对应的完整、可编译运行的源码(非片段、无混淆)。
- 开发文档:包含各服务
README.md、业务开发指南、接口契约及典型场景说明。 - 本地模型与库:购买本地私有化版时,随包提供配套的本地开源模型权重文件及第三方运行库(其授权以各开源 LICENSE 为准)。
授权与商业边界
- 授权说明:源码提供一次授权、永久使用。上述价格为当前优惠源码授权价,不包含第三方云服务调用费、服务器费用、SIP 线路费用、实施、定制流程、模型调优、运维及第三方开源组件授权责任。
- 实施服务边界(¥500):包含在客户服务器上编译安装 FreeSWITCH、编译
mod_audio_fork模块、配置基础 dialplan,并与购买的系统套餐进行端到端联调,确保测试通话(呼入/呼出)全链路打通。 - 线下增值服务(面议):如需定制业务流程、大规模性能压测、私有化打包交付、团队培训或定制化验收等,可另行沟通。
自研成本与采购对比
采用本平台系统,可为您和您的团队省去大量在底层通信协议与流式 AI 算法上的“踩坑”时间:
- 🛑 自研难点:ESL 协议异步封装、复杂会话状态机、低延迟媒体流控制、会议背景音与毫秒级打断
- 🚀 现成方案:系统一(云语音版 / 本地私有化版)
- 💡 交付价值:直接提供成熟稳定的工业级呼叫编排底座
- 🛑 自研难点:纯 Rust 架构、FunASR(2-pass)与 Sherpa 深度集成、前置 VAD 毫秒级开嗓即断、LRU 缓存
- 🚀 现成方案:私有化版本(系统一 / 系统二)
- 💡 交付价值:纯内网运行自持模型,零云端调用费,高隐私保障
- 🛑 自研难点:多 FS 分片池化、批次调度锁、实时盯屏推演、坐席工作台、动态转人工会议
- 🚀 现成方案:系统二(云语音外呼版 / 全能私有化版)
- 💡 交付价值:呼叫中心级完整套件,可视化流程编排与调度闭环
- 🛑 自研难点:原生内嵌 AI 决策中台、Playground 调试大盘、防复述电销护栏、多模态情绪质检
- 🚀 现成方案:系统二(AI 策略中心 + 情绪质检)
- 💡 交付价值:消除微服务网络开销与端口割裂,开箱即用兼容各主流大模型
⏱️ 综合研发周期对比:搭建一套类似的工业级 AI 语音系统通常需要 2 至 4 个月的跨技术栈团队协作(通信协议 + 语音算法 + 调度后台 + AI 决策)。采购本平台成熟源码,仅需数日联调即可快速进入业务开发,研发成本通常不足自研一周的人力投入。