预发布模拟
在上线前使用场景库或自定义场景运行语音评估,检查代理在不同对话和人物角色中的表现。
Cekura 是面向构建对话式 AI 和语音代理团队的语音测试与可观测性平台。它将预发布模拟与生产环境监控结合起来,帮助团队验证提示词、测试工作流行为,并监控实时通话中会影响质量的问题。
源内容显示,该产品重点关注指令遵循、工具调用、对话流程以及语音特有信号。实际使用中,这意味着团队可以回放棘手对话、针对不同人物角色进行测试、检查实时通话,并利用生成的数据在问题影响用户之前捕获回归。
在上线前使用场景库或自定义场景运行语音评估,检查代理在不同对话和人物角色中的表现。
在通话发生时监控实时通话,并跟踪诸如乱码检测、打断跟踪、延迟、情绪和音高等语音特有信号。
在实验室工作流中基于真实通话录音调优评估提示词,通过编辑、回放和评分通话,直到裁判结果与真实情况一致。
设置阈值,并通过 Slack、电子邮件或 Webhook 接收错误、失败和性能下降的即时通知。
构建自定义图表,并按代理或日期筛选生产指标,以查看时长、情绪、流失和成功率等趋势。
与支持的语音平台集成,并访问用于生产通话模拟、日志记录和工具调用工作流的 API。
在发货前测试提示词变更对取消、改期、后续跟进、退款或其他多步骤工作流等核心流程的影响。
在不同性格的用户之间对通话处理进行压力测试,包括会打断或不耐烦的用户,以确认代理能够平稳恢复。
回放已知有问题的对话以复现失败,并验证修复是否解决了原始问题且没有引入新的问题。
监控生产中的实时通话,关注延迟、打断、情绪和其他语音特有信号,以便团队在问题发生时及时发现质量问题。
使用告警、报告和自定义图表来跟踪趋势、审查失败,并在团队中共享运营数据。
源内容将 Cekura 描述为端到端的语音测试与语音可观测性平台。它用于运行预发布模拟、监控真实生产对话,并查看语音特有的质量信号。
定价页面显示有一个可免费开始的 Developer 方案,以及一个定制定价的 Enterprise 方案。Developer 方案包含 7 天免费试用、300 个 credits,且无需信用卡。
该产品面向从事语音代理和对话式 AI 的团队,包括开发者、AI 自动化团队、医疗团队,以及其他使用生产级语音 AI 的用户。
源内容显示了生产通话告警、可下载报告、API 访问、日志保留和实时监控功能。它还提到了用于测试的场景库以及创建自定义场景的能力。
源内容明确列出了 Developer 方案和 Enterprise 方案。Enterprise 方案提供定制定价、访问控制、合规选项、自托管、自定义集成和专属支持。
blop 是一款 QA agent,可在仓库中将浏览器测试以代码形式编写并运行于 CI,聚合重复失败,还可发起 PR 修复失效测试,适合需要可审查、版本控制浏览器 QA 的团队。
Orca 是面向编码代理的 Agent 开发环境,支持在隔离的 git worktree 中并行运行多个 CLI agent,并提供桌面端与移动端协作流程。
BotLab is a tool for testing video-game bots by running them in simulated game clients, reviewing session logs, and comparing results in the Reactor. It offers a free tier for short sessions and a paid Pro plan for longer online runs.
Firebase Studio 是一款基于浏览器的全栈应用开发工作区,支持 Gemini 辅助编写代码、应用预览、云模拟器、导入仓库、原型开发、协作与从浏览器部署。
EZsite AI 是一款 AI 网站构建器,可将 URL 转为完整的 React 或 Vue.js 应用。支持托管、自定义域名、代码导出及面向团队的后端功能,帮助快速交付可部署结果。
AI Magicx 是一体化 AI 工作区,集聊天、图片、视频、语音、音乐、邮件和开发任务于一处,帮助创作者、团队和开发者集中使用多种模型,无需在多个工具和订阅间切换。