|
|
4 miesięcy temu | |
|---|---|---|
| .. | ||
| client | 4 miesięcy temu | |
| whisper_asr | 4 miesięcy temu | |
| README.md | 4 miesięcy temu | |
| requirements.txt | 4 miesięcy temu | |
| startclient.sh | 4 miesięcy temu | |
| startserver.sh | 4 miesięcy temu | |
Real-time speech recognition client using Qwen3-ASR / Whisper and Qt.
pip install -r requirements.txt
cd whisper-qt-client
source venv/bin/activate
python -m whisper_asr.server --model qwen --port 8765
cd client
mkdir build && cd build
cmake ..
make
./whisper_client # or whisper_client.exe on Windows
| Model | Type | Languages | Memory |
|---|---|---|---|
| Qwen/Qwen3-ASR-1.7B | Qwen | 52+ languages | ~6GB |
| Whisper small | Faster-Whisper | Multilingual | ~2GB |
python -m whisper_asr.server --model qwen --port 8765
python -m whisper_asr.server --model whisper --size small --port 8765
┌──────────────┐ WebSocket ┌──────────────┐
│ Qt Client │ ◄───────────────► │ ASR Server │
│ │ │ │
│ - UI │ │ Qwen3-ASR │
│ - Audio In │ │ or │
└──────────────┘ │ Faster-Whisper│
└──────────────┘
ws://localhost:8765
{
"type": "audio",
"data": "<base64 encoded PCM16 audio>"
}
{
"type": "transcript",
"text": "识别结果文本",
"language": "zh",
"segments": []
}
MIT