← 動画アーカイブに戻る
本編Cloudflare Workers AI8分01秒

第15本:【マルチモーダル編】Cloudflare Workers AIで画像生成・音声認識まで全部無料!AI機能満載アプリを作る方法なのだ!

ずんだもん × 四国めたんの対話解説 | 44シーン | 収録時間 8分01秒

この回について

画像生成FLUX、音声認識Whisper、テキスト生成、Embeddingを1つのアカウントで。Workers AIのマルチモーダル実践編として、サムネ自動生成や議事録アプリの作り方を解説します。

動画は準備中です

完成し次第、ここで視聴できるようになります。

この回のポイント

  • FLUXによる画像生成の実践
  • Whisperでの音声文字起こし
  • マルチモーダルのNeurons配分設計
  • 1アカウントで完結する管理の楽さ

チャプター

  1. 00:00オープニング:文章だけじゃ物足りない!画像も音声もAIでやりたい!
  2. 01:30第1章:Workers AIで使えるモデルたち — 約80種類のオールラウンダー
  3. 04:00第2章:画像生成FLUXと音声認識Whisperの実践
  4. 06:30おじさん豆知識:マルチモーダルって何なのだ?
  5. 07:00第3章:Neurons消費の現実と、無料枠を超えない設計
  6. 08:45エンディング:まとめと次回予告

関連ツール