Assist, Je n'en peux plus d'entendre "désolé, je n'ai pas compris"

Bonjour,

Je n’en peux plus d’entendre « désolé, je n’ai pas compris » lorsque je prononce mal, ou que je ne dis pas la bonne phrase.

C’est possible de changer ça en une autre phrase un peu plus personnalisée ou encore mieux, en plusieurs phases qui seraient répondues de façon aléatoire ?


Salut

+1 sur ce coup là ou même juste un beep différent par exemple selon que la commande ait été comprise et exécutée ou pas compris :wink:

Vincèn

Bonjour @christophe30
il faut plutôt soigner la base du problème non !
Tu utilises quel système pour la commande vocale, as-tu de l’IA pour le TTS, STT, si tu donnes plus de contexte on pourra t’aiguiller pour améliorer la détection.

Bob

Bonjour,

Peut être qu’avec un peu plus de détails tu obtiendras une aide plus efficace?

J’en profite, le message est tout frais…

Perso je passe par Alexa, je doute qu’elle soit plus performante… Donc pas plus d’avis sur le sujet. Désolé

Exemple pour moi avec un Respeaker Lite:

[16:24:21.255][D][voice_assistant:663]: Speech recognised as: "Allumer la lumière de la cuisine et la lumière Marine."
[16:24:21.256][D][voice_assistant:624]: Event Type: 5
[16:24:21.256][D][voice_assistant:668]: Intent started
[16:24:28.501][D][voice_assistant:624]: Event Type: 100
[16:24:28.505][D][voice_assistant:672]: Intent progress
[16:24:28.505][D][media_player:084]: 'respeaker-satellite' - Setting
[16:24:28.505][D][media_player:091]:   Media URL: http://192.168.1.32:8123/api/tts_proxy/5I10seh0RS1CqJz_7r4LEg.flac
[16:24:28.505][D][media_player:097]:  Announcement: yes
[16:24:28.507][D][voice_assistant:478]: State changed from AWAITING_RESPONSE to STREAMING_RESPONSE
[16:24:28.507][D][voice_assistant:485]: Desired state set to STREAMING_RESPONSE
[16:24:28.510][D][speaker_media_player:406]: State changed to ANNOUNCING
[16:24:28.510][D][light:091]: 'led_internal' Setting:
[16:24:28.510][D][light:079]:   Brightness: 100%
[16:24:28.513][D][light:115]:   Red: 20%, Green: 100%, Blue: 100%
[16:24:28.513][D][light:165]:   Effect: 'Slow Pulse'
[16:24:31.211][D][voice_assistant:624]: Event Type: 6
[16:24:31.211][D][voice_assistant:624]: Event Type: 7
[16:24:31.211][D][voice_assistant:721]: Response: "Les lumières de la cuisine et Marine sont maintenant allumées."
[16:30:09.269][D][voice_assistant:663]: Speech recognised as: "Quelle heure est-il ?"
[16:30:09.269][D][voice_assistant:624]: Event Type: 5
[16:30:09.270][D][voice_assistant:668]: Intent started
[16:30:09.282][D][voice_assistant:624]: Event Type: 6
[16:30:09.282][D][voice_assistant:624]: Event Type: 7
[16:30:09.282][D][voice_assistant:721]: Response: "Il est 16:30"

L’action est très rapide, la confirmation vocale quelque secondes.
Si tu donnes ta config ce sera plus facile comme le dit @BBE

Bob

C’est bien pour ça que je ne me suis jamais lancé dans ce genre de machin.

Je sais pas si j’ai un accent de bouseux, que je prononce mal ou que ma voix est juste nulle, mais quand il faut parler à une machine elle ne me comprend jamais ! C’est super relou, du coup je déteste ça…

Salut,
Désolé, effectivement je n’ai pas précisé ma config:
C’est avec un HA voice PE en cloud nabu car ça fonctionne bien mieux qu’en local.
Mon HA est sur un NUC