Meine Heimautomatisierung beruht auf OpenHAB und Rhasspy. In der Vergangenheit habe ich Spracherkennungs-Satelliten bestehend aus einem Raspberry Pi und Rhasspy verwendet (Einzelheiten hier https://requireiot.com/rhasspy-satellite-with-raspberry-pi/ ). Jetzt wollte ich ein kompakteres Modul bauen, das die Spracherkennung komplett im Modul durchführt, ohne Streamen des Audiosignals zu einem (internen oder externen) Server.
Die Lösung besteht aus einem ESP32-S3 Modul mit einem kleinen Lautsprecher, eigener Software und der von Espressif bereitgestellten Spracherkennungs-Bibliothek.
Low cost: Materialkosten ca. €20, einschließlich Lautsprecher
Cloud-free: lokale Spracherkennung, kein Streaming des Mikrofonsignals zu einem Server
Dynamisch: Liste der Sprachbefehle wird automatisch erstellt, aus den "Items" die in openHAB als relevant markiert sind
Code, Schaltplan und Aufbauanleitung gibt's bei Github https://github.com/requireiot/MyVoiceBox und weitere Erläuterungen in meinem Blog https://requireiot.com/cloud-free-voice-recognition-for-openhab/
