共 2 篇文章
识别错误分两类:声学的在采集那一刻就丢了,语言的还能靠词表与上下文补救。这篇接着上一篇往下写:硬件能补的是采集、按键与链路时延,补不了的是「整理」;以及一个常驻托盘的小工具,为什么准备用 Rust 重写边缘层,而不是重写一切。
语音输入早就不缺识别率,缺的是「识别之后」那一步。这篇拆解一个小工具的三段链路:听清(双引擎与热词表)、整理(场景判断与提示词护栏)、落到光标(不抢焦点、可撤销、可换说法),以及为什么这类工具的成败在边界而不在能力。