实时语音交互
研究识别、理解、生成与播放之间的协同,让对话不被技术流程打断。
关注真实场景中的响应速度、表达方式、隐私边界和长期可维护性。
研究识别、理解、生成与播放之间的协同,让对话不被技术流程打断。
把复杂能力收进简单界面,让每一步都容易理解、容易恢复。
重视数据边界、失败恢复、成本控制与真实设备上的稳定运行。
每个项目都从真实问题开始,经过原型、测试、数据验证和持续修正。技术选择服务于使用体验,而不是为了展示复杂度。
从实际操作和反馈中确认问题,不用想象代替证据。
让关键路径尽早可用,再逐步扩大功能和使用范围。
将有效方法写进产品、测试和运维流程,减少偶然性。
这里是个人技术记录空间,用于整理人工智能、语音交互、前端体验和软件工程实践。
内容持续整理中。所有项目说明以实际公开内容为准。