投稿

Fooocus

イメージ
Stable Diffusion XL専用の新しいWeb UI「 Fooocus 」を試してみました。導入はダウンロードした7-Zipファイルを適当なフォルダに解凍するだけ。必要なファイルは起動時に自動でダウンロードされます。 高機能だけど設定が難しくなってしまった既存のWeb UIと違って、プロンプトを入力して「Generate」ボタンを押すだけのシンプル操作なのに、高精度なAI画像を簡単に生成することができます。 また、プリセットのスタイルが多数用意されているので、スタイルを選択・変更するだけで、動画のように、同じプロンプトでも全く異なるスタイルのAI画像を出力できます。じわじわと画像が生成されていく過程が見えるのも面白いですね。

ガラスの仮面

イメージ
妻が、図書館で「ガラスの仮面」を借りてきた。大学生の時、コインランドリーとか銭湯に置いてあった「花とゆめ」をよく読んでいたなあ。懐かしい。。。 18巻と19巻は、北島マヤが芸能界を追われ、一ツ星学園の学園祭で始めた一人芝居、「女海賊ビアンカ」と「通り雨」の回。どちらもだんだん観客が引き込まれていく様子が面白い。 個人的には、「ふたりの王女」のオーディションで、北島マヤが行った即興演技も迫力があって好だったので、今度は23巻を借りてきてもらおうかな。。。

ハイブリッドプレゼンター(PR7-HY)

イメージ
対面でのプレゼンテーションが増えてきたので、赤色レーザーポインターとソフトウエアポインター両用の ハイブリッドプレゼンター PR7-HY を買った。 最近は、レーザーポインターが使えない大型液晶TVでプレゼンすることも多く、エアーマウスで画面上をポイントできるものが欲しかったので。 PCとの接続も、本体に収納されたUSBレシーバーを使えば2.4GHzワイヤレス接続だし、USBレシーバーを挿さなくてもBluetoothでPCとつながるすぐれもの。 これで、緑色レーザーだったら言うことないんだけどなあ。。。

BIM利用技術者(2級)合格

イメージ
BIM利用技術者(2級) に合格しました。これで今日から僕も、(一社)コンピュータ教育振興協会認定のBIM利用技術者。 残念ながら、100点満点とはいかなかったけど、カラアゲニスト検定に合格した時よりは、ちょっとだけうれしいかなw

こはれ03 Ver 2.5

イメージ
以前のバージョン では、音声認識・合成にGoogle Cloud Speech APIを使用してたんだけど、落ち着いた大人の女性の声って感じだったので、音声認識・合成周りを Microsoft Azureの音声サービス に変更した。 今度は、アバターの外見より少し幼い感じの声になってしまったけど、妹設定としてはまあまあ良い感じになったんじゃないかなw

こはれ03 Ver 2.4

イメージ
いつも、おじさん だと何なので、アバターを差し替えて、声を女性に。 ChatGPT のキャラクター設定を変更すれば、サブカルチャーに詳しくカワイイものが大好きな、妹設定の少女型のアンドロイドのAIチャットボットのできあがり。 まあ、妹設定の割には、落ち着いた声だけどねw

AIしげちゃん(スマホ版)Ver 2.4+

イメージ
AIしげちゃん(スマホ版)Ver 2.4 をバージョンアップしたばかりだけど、いろいろ機能を増やしたせいでUIが混乱してしまったので、少し整理した。 マイクボタンを押すと音声入力待機状態になったり、アイドル時に独り言を喋ったり、ポーズを取ったりするようにしたのは、簡単にデモができるようにするため。 人に見せる時、取り敢えずサクッと「AIしげちゃん」が喋ったりしてくれないと間が持たないので、独り言を言う機能を専用のボタンに割り当てて、動作・表情はアバターをタッチした時に行うように変更した。 これで、ワンタッチで喋ったり動いたりしてくれるので、デモしやすくなったねw  しかし、大阪の天気予報を聞くと、大阪弁で回答するChatGPTはお茶目だね。

セミナーの原稿作成など

イメージ
セミナーなどの発表資料を作る時は、最近は、発表原稿を口語文でガッツリ作って、文字数からスライドごとの投影時間を按分し、さらに、 音声合成ソフト で喋らせて、時間内で喋れそうか確認してる。 もう少し若い頃は、発表時間もそんなに長くなかったし、スライド見ながら適当に喋れたけど、最近はそれをやると、歳のせいで言葉が出てこなくて悲しい気持ちになるので、結構入念に準備してる。

AIしげちゃん(VR版)Ver 2.4

イメージ
スマホ版 AIしげちゃん を Ver 2.4 にしたので、しばらく放置していたMeta Quest 2版も、アイドル中に独り言を喋ったり、勝手にアクションをするようバージョンアップした。 Quest 2もAndroidなので、移植自体はそんなに難しくないんだけど、入力デバイスの扱いがスマホと違うので、よくわからなくて実装できなかった。 ホントは、ボタンを押すと喋ったり、表情を変えたりとかしたかったんだけど。ちょっと勉強しないとね。。。

AIしげちゃん(スマホ版)Ver 2.4

イメージ
生成AI(GPT-3.5/4)と音声認識・合成(Google Cloud Speech)により、VRM形式の3Dアバターと音声対話できるスマホアプリ 【基本機能】 音声による質問を認識し、生成AIの回答を音声で話す 生成AIの回答等に応じて3Dアバターの表情や動作が変わる 【追加機能】 生成AIの回答を音声だけでなくテキストウインドウでも表示 気象庁の気象情報APIを利用し、指定した地域の天気予報等を答える 環境センサーと連携し、温湿度の値や不快指数等を答える スマートリモコンと連携し、部屋の照明や家電製品を制御する ウェイクワード(起動音声コマンド)の代わりにマイクボタンをタッチすることで、音声入力待機状態にできる 音声入力待機時に待機ウィンドウをクリックすると、プリセットされた質問をランダムに行い、生成AIに回答させることができる アイドル時にプリセットされた独り言をランダムに喋る。 3Dアバターをクリックすると、プリセットされた独り言をランダムに喋らせることができる タイトルをタッチするとプリセットされた動作をランダムに行う。 ChatdollKit をベースにさせていただき、いくつか機能を追加して、概ねやりたかったことはできたので、ほぼ完成版かなw