首页 / 关于我们

关于这套服务端

我们做的事情很具体:把「语音识别 → 大模型 → 语音合成」这条链路做成一个能自己部署、 自己掌控数据的服务端,而不是又一个必须联网、数据留在别人服务器上的语音助手。

数据留在自己手里

对话、记忆、设备信息全部存在你自己的数据库,不经过任何中间服务器。

模型选择权在你

不绑定任何厂商。识别、生成、合成三类能力分开配置,随时更换对比。

软硬一体但可选

没有硬件也能用网页端完整体验;有设备时,同一套配置直接复用。

技术实现

没有黑盒,全部是常见且可维护的技术

刻意选择成熟、通用、运维成本低的技术栈,方便你自己接手维护或迁移。

层次技术选型说明
运行环境PHP 8.2自建轻量 MVC 框架,无重型依赖,虚拟主机也能跑
数据存储MySQL 5.7 / 8.0结构清晰,自带安装向导与增量升级脚本
Web 服务Nginx + HTTPS静态资源直出,长连接反代到独立语音服务
实时通信WebSocket(WSS)每个连接独立进程,互不阻塞
音频协议16kHz / 16bit / 单声道 PCM按 60ms 一帧传输,兼顾实时性与网络抖动
第三方依赖无前端框架、无 CDN页面与脚本全部自托管,不对外发起多余请求
安全实践

这些不是宣传话术,是代码里逐条落实的约束

  • 密码使用强哈希存储,绝不明文落库
  • 所有写操作校验 CSRF 令牌,防跨站提交
  • 查询强制带用户维度,控制器二次校验记录归属
  • 越权访问按标准语义返回 403,不返回「空数据」掩盖
  • 设备绑定验证码限时限次,绑定成功即作废
  • 模型密钥脱敏展示,日志中不明文输出
  • 安装向导在安装完成后对非管理员关闭
  • 语音长连接使用一次性令牌认证
质量保障

每次改动都用自动化测试收尾

语音链路的很多问题(打断没真的中断、记忆没真的注入)光看界面是看不出来的, 所以我们用能读到请求体与响应的测试来验收,而不是靠肉眼观察。

语音主动打断

断言上游请求被真实中止、残留音频为 0 字节,实测响应 129ms

智能体长期记忆

直接读取发给模型的请求体,确认记忆确实注入而非仅入库

多用户数据隔离

用两个真实账号交叉访问,19 项断言全部通过

全站页面回归

覆盖控制台全部页面,确认功能改动无副作用

语音链路端到端

模拟上游模型服务,验证「流式生成 → 分句 → 合成音频」全链路

我们的边界

哪些事我们不做,也说清楚

把边界讲明白,比一味堆好话更能建立信任。

我们承诺
  • 不向第三方回传你的对话内容与设备信息
  • 不申请模型服务商的分成,你在哪买都一样
  • 不在页面里偷偷加载外部统计脚本
  • 全局开关交给你:打断、记忆、自助注册都能一键关停
我们不提供
  • 模型能力本身——你需要自备接口与额度
  • 公网托管服务——本服务端是交付到你自己的服务器上
  • 硬件成品——我们只做服务端,设备由你按开源方案组装或采购
  • 对话内容的人工审核——数据不上云,也就没有这一环

看完了,去把它跑起来吧

部署、配置、对话,三步就能听到第一句回答。