Hi Syrius,
ich denke aber das das ein zu komplexes Thema ist um so etwas privat umzusetzten, ich habe allerdings auch keine Ahnung von dieser Thematik. Trotzdem mal ein paar Gedanken die mir zu dem Thema auf die Schnelle gekommen sind:
Allein wenn ich daran denke wie das mit Android funktioniert, habe ich den Eindruck das es mit großem Rechenaufwand verbunden ist.
Man muss zuerst das Handy trainieren damit es den Aufruf verstehr, beispielsweise mehrmals sein Ok Google sagen damit es das mit deiner Aussprache und Stimme erkennen kann. Mit völlig unbekannten Stimmen/Sprachweisen ist das sicher Schwieriger. Der Rest der Befehle wird dann zuerst an Server gesendet und dort ausgewertet.
Auf der anderen Seite gibt es seit vielen Jahren die Spracherkennungsprogramme, die immer genauer werden.
Vom Prinzip her müsstest du wohl den kompletten Radiotext aufnehmen und jedes Wort (erkennbar an kurzen Sprechlücken) mit mehreren, verschieden schnell und deutlich gesprochenen, abgespeicherten Tonfolge vergleichen, wobei da eine grössere Toleranz als Abweichung erlaubt sein müsste.
Ich vermute einfach mal das du als Reaktion etwas aufnehmen möchtest. Dann wäre das nächste Problem, wo ist das Ende der Aufnahme ? Es sagt ja keiner "Ende"




Zitieren