01
一句话定位
一位能在用户开口时发现表达问题、给出行动建议,并通过复练证明效果的实时表达教练。
口语宝是一款离线优先的中英文 AI 表达训练桌面应用。产品同时处理逐字稿与原始音频,提供实时反馈、可解释指标、同题复练和长期成长证据。
一句话定位、目标用户和核心价值。
一位能在用户开口时发现表达问题、给出行动建议,并通过复练证明效果的实时表达教练。
面试与复试考生、职场汇报者、销售与客服、教师与培训师、托福雅思口语学习者。
让用户从“感觉自己表达不好”,走向“知道具体问题、知道下一步动作、看见第二次变化”。
为什么普通转写和一次性 AI 点评不够。
每一步都对应用户可以执行的动作。
默认无需选题即可开口;面试、汇报等训练方向与中英文题库作为可选辅助。
边说边显示字幕和动态统计,及时提示填充、犹豫、笼统表达与语境问题。
离线生成文本和声音两类指标;联网时可追加云端精转与大模型报告。
保留题目和训练重点,比较前后变化,并写入长期成长看板。
桌面采集、本地推理、规则分析与可选云端能力分层解耦。
不把不同概念硬压成一个分数,让用户知道指标从哪里来。
| 指标 | 定义与计算 | 训练意义 | 数据来源 |
|---|---|---|---|
| 每百词问题数 | (填充词 + 犹豫词 + 笼统词) ÷ 总字词数 × 100 | 衡量表达中的干扰性词语密度。 | 逐字稿 + 分层词库 |
| 表达密度 | (总字词数 − 填充词 − 犹豫词) ÷ 总字词数 × 100 | 观察表达是否被口癖与犹豫大量占用。 | 逐字稿 |
| 结构信号 | 统计“首先、因为、因此、最后”等结论、理由、递进和收束提示。 | 判断表达是否存在可跟随的组织线索。 | 逐字稿规则 |
| 证据信号 | 统计案例、经历、数据、百分比等具体支撑。 | 提醒用户把抽象观点落到可验证内容。 | 逐字稿规则 |
| 语速 | 总字词数 ÷ 有效录音时长 × 60 | 发现明显过快或过慢的表达节奏。 | 逐字稿 + 时长 |
| 有效发声占比 | 检测为发声的 20ms 音频帧 ÷ 全部音频帧 × 100 | 观察大量空白是否破坏表达连贯性。 | 原始音频 |
| 长停顿 | 统计首尾有效发声之间超过 0.6 秒的内部静音段。 | 区分有意识停顿与影响理解的长空白。 | 原始音频 |
| 音量稳定性 | 计算有效发声音频帧的分贝标准差。 | 提醒用户保持稳定的麦克风距离和发声强度。 | 原始音频 |
核心训练可离线,云端能力明确、可选、可回退。
主动说明边界,明确当前能力范围与后续规划。