AIペットロボット(LOOIスタイル寄せ)の研究。
脳、耳、口、手。ここまでの役割まで、出来ましたよ。
いま詰まってるとこ。
家族という状況の場合に
「パパ」「ママ」「子供達」がいる想定で、「この声は誰の声」という部分の声認識のやり方がわからない。ここで、いま、どん詰まり。壁にぶつかっている。

手の役割は、例えば、
パパさん:「今日は仕事で疲れたからなんか優しい曲でも流してくれる?」
ウォーリー(AI):「OK」となって、YouTubeから検索してバッググラウンドから再生。という流れまでクリアしました。

と、ここまで。
つぎの課題は、
情緒表現の実装: 数秒に1回の「まばたき」「キョロキョロ目線移動」のアニメーション、およびローカル相槌(「うんうん」など)のタイマー処理。
やること: ローカル(アプリ内)に「うんうん」「そうだね」「お疲れ様!」といった簡単な相槌リストを用意から。
ついでに、YouTubeの処理も検索リストにまとめて処理したほうがいいのかな?
癒しピアノ、壮大なBGM、シネマティック、EDM、ノリノリな曲、テンポのいい曲、JPOP。
という感じで、人間が「◯◯みたいな曲流して」に対応できるようにするべきか?
ここは、今の既存機能が崩れないように慎重にAIと相談。
と、今、こんな感じ。