Experimental · on-device STT (vosk-browser)

useEar / Vosk

No Web Speech API · No earcon · Continuous · Multi-language

使い方・見どころ
  • 多言語同時: 下の Models で日本語+English を両方ON = 2モデル並列。日本語「こんにちは」も英語「hello」も同時に拾える
  • earcon なし: Start してもOSのピコ音が鳴らない(on-device なので)
  • 連続リッスン: 話している間 Partial が途切れず更新され続ける
  • 負荷/メモリ: Avg/Max frame ms でメインスレッドの詰まりを可視化。 モデルのメモリは Worker 側なので JS heap には出ない(端末の体感で見る)。 iOS Safari など端末差があるため experimental
Idle
Language models (同時ロード)
Models
0
parallel
Model load
Uptime
0s
Avg frame
16.7ms=60fps
Max frame
jank spike
Audio chunks
0
Avg chunk
JS heap
Partial (continuity)
Final
こんにちはjaねえjahelloencomputerenストップjastopen
Detection Log
No detections yet
Models: vosk small ×7 langs via Cloudflare R2 (Apache-2.0) · ← Web Speech API demo