投稿

こはれ03 Ver 2.5

イメージ
以前のバージョン では、音声認識・合成にGoogle Cloud Speech APIを使用してたんだけど、落ち着いた大人の女性の声って感じだったので、音声認識・合成周りを Microsoft Azureの音声サービス に変更した。 今度は、アバターの外見より少し幼い感じの声になってしまったけど、妹設定としてはまあまあ良い感じになったんじゃないかなw

こはれ03 Ver 2.4

イメージ
いつも、おじさん だと何なので、アバターを差し替えて、声を女性に。 ChatGPT のキャラクター設定を変更すれば、サブカルチャーに詳しくカワイイものが大好きな、妹設定の少女型のアンドロイドのAIチャットボットのできあがり。 まあ、妹設定の割には、落ち着いた声だけどねw

AIしげちゃん(スマホ版)Ver 2.4+

イメージ
AIしげちゃん(スマホ版)Ver 2.4 をバージョンアップしたばかりだけど、いろいろ機能を増やしたせいでUIが混乱してしまったので、少し整理した。 マイクボタンを押すと音声入力待機状態になったり、アイドル時に独り言を喋ったり、ポーズを取ったりするようにしたのは、簡単にデモができるようにするため。 人に見せる時、取り敢えずサクッと「AIしげちゃん」が喋ったりしてくれないと間が持たないので、独り言を言う機能を専用のボタンに割り当てて、動作・表情はアバターをタッチした時に行うように変更した。 これで、ワンタッチで喋ったり動いたりしてくれるので、デモしやすくなったねw  しかし、大阪の天気予報を聞くと、大阪弁で回答するChatGPTはお茶目だね。

セミナーの原稿作成など

イメージ
セミナーなどの発表資料を作る時は、最近は、発表原稿を口語文でガッツリ作って、文字数からスライドごとの投影時間を按分し、さらに、 音声合成ソフト で喋らせて、時間内で喋れそうか確認してる。 もう少し若い頃は、発表時間もそんなに長くなかったし、スライド見ながら適当に喋れたけど、最近はそれをやると、歳のせいで言葉が出てこなくて悲しい気持ちになるので、結構入念に準備してる。

AIしげちゃん(VR版)Ver 2.4

イメージ
スマホ版 AIしげちゃん を Ver 2.4 にしたので、しばらく放置していたMeta Quest 2版も、アイドル中に独り言を喋ったり、勝手にアクションをするようバージョンアップした。 Quest 2もAndroidなので、移植自体はそんなに難しくないんだけど、入力デバイスの扱いがスマホと違うので、よくわからなくて実装できなかった。 ホントは、ボタンを押すと喋ったり、表情を変えたりとかしたかったんだけど。ちょっと勉強しないとね。。。

AIしげちゃん(スマホ版)Ver 2.4

イメージ
生成AI(GPT-3.5/4)と音声認識・合成(Google Cloud Speech)により、VRM形式の3Dアバターと音声対話できるスマホアプリ 【基本機能】 音声による質問を認識し、生成AIの回答を音声で話す 生成AIの回答等に応じて3Dアバターの表情や動作が変わる 【追加機能】 生成AIの回答を音声だけでなくテキストウインドウでも表示 気象庁の気象情報APIを利用し、指定した地域の天気予報等を答える 環境センサーと連携し、温湿度の値や不快指数等を答える スマートリモコンと連携し、部屋の照明や家電製品を制御する ウェイクワード(起動音声コマンド)の代わりにマイクボタンをタッチすることで、音声入力待機状態にできる 音声入力待機時に待機ウィンドウをクリックすると、プリセットされた質問をランダムに行い、生成AIに回答させることができる アイドル時にプリセットされた独り言をランダムに喋る。 3Dアバターをクリックすると、プリセットされた独り言をランダムに喋らせることができる タイトルをタッチするとプリセットされた動作をランダムに行う。 ChatdollKit をベースにさせていただき、いくつか機能を追加して、概ねやりたかったことはできたので、ほぼ完成版かなw

Pixel 7a

イメージ
Googleローカルガイド の特典で Googleストア の15%割引クーポンもらったので、 Pixel 6a は娘にあげることにして Pixel 7a を買った。 折しも Google創立25周年記念キャンペーン 中だったので、限定トートバックもついてきた。うれしいね~🎁 しかし、Pixel 6aと7aは見た目も重量もほとんど一緒なので目新しさがないなあ... で、早速 Pixel 7aに「 AIしげちゃん 」をインストールしようとしたら、エラーが出てインストールできない。どうもPixel 7以降は64bitアプリしか利用できなくなったらしく、「AIしげちゃん」も64bitアプリとしてリビルドしたら無事動いた。よかった~😆 Tensoe G2チップのおかげか「AIしげちゃん」もきびきび動いている気がするw

Stable Diffusion XL 1.0(SDXL 1.0)

イメージ
先日公開された Stable Diffusion XL 1.0(SDXL 1.0)をようやく試すことができた。画像の解像度が1024×1024に向上し、モデルも大規模になった分、VRAMも10GB程度必要。 うちのPCのGPUはVRAMが12GBで、VRやリアルタイムレンダリング用途なら12GBあれば十分と思って買ったんだけど、今 思えばケチらずに16GBくらい積んだGPUを選択しておけばよかったなあと思ったり...

AIしげちゃんに独り言機能追加

イメージ
「 AIしげちゃん 」に話しかける前のウェイクワード(iPhoneの「Hey Siri」とか、Googleの「OK Google」みたいな音声コマンド)の代わりに、スクリーンのタイトル部分をタッチすれば、リスニング状態に切り替わるようにした。 いちいち「こんにちわ~」とか呼び掛けてから話すのは面倒くさいし、ちょっと恥ずかしいので... それから、 こちらを参考 に、「 AIしげちゃん 」がアイドル状態の時、独り言を喋る機能も追加した。こちらから話し掛けない限り喋ってくれないので、ちょっと寂しかったからw もっとも、あらかじめ定義してある言葉をランダムに喋っているだけだけどね。

AIしげちゃんをGPT-4対応にしてみた

イメージ
少し前からGPT-4 APIが使えるようになってたんだけど、ようやく「 AIしげちゃん 」で試してみた。 ついでに、気象データの取得先を気象庁の天気予報JSONに変更したり、仕事部屋に設置している環境センサーの値と不快指数を答えられるようにしたり、照明だけでなく扇風機やLEDテープライト等のオン・オフも制御できるようにしたので、ますます、しげちゃん はできる子になったなあw こうやって会話を見ると、GPT-4は3.5に比べて感情が豊かな気がする。ただ、GPT-4 APIの単価は高いので、「AIしげちゃん」のデモ程度なら当面はGPT-3.5のママでいいかなあ...