BASECORD  LOCAL  AI  LAB

総合トップローカル生成AIラボ ― 動画・画像・音声

自宅の GALLERIA 2台(RTX 3080 Ti 12GB ×2)で動かしている生成AIの入口ページです。外部サービスに一切送らず、手元の機械だけで BASECORD の宣伝素材(映像・画像・ナレーション)を作れるかを確かめています。動画のことは「動画ポータル」、画像・音声はそれぞれの比較ページへ、ここから入ってください。

本 完成作品 本 動画の検証 枚 画像の検証 本 音声の検証 8モデル 稼働中

ここは 生成AIラボ トップです。下の3枚がそれぞれの入口で、各ページの上に出るバーからも行き来できます。

動画 動画作品の例 動画 ― BASECORD 動画ポータル 動画に関するものは、まずここ。完成作品・制作中・モデル比較・生成ログ・つくる場所の5つに分けた入口です。
  • 作品は全部同じ形のページ(完成動画/台本/カットごとの指示文/制作メモ)
  • 本番モデルは MiniMax H3(映像とを同時に生成)/ 高画質は HunyuanVideo
  • テスト・ボツも含む生成ファイルは動画ライブラリーに全部あります
完成作品 本 / 生成ログ 動画ポータルを開く
画像 画像生成AIの出力例 画像 ― 生成AI 3モデル比較 写真調・アニメ調・既存画像の一部差し替えを、お題ごとに3本で描き比べ。
  • FLUX.1 dev … 写真調と英字ロゴが得意(1枚 約50秒)
  • Qwen-Image … アニメ調と日本の街並みに強い
  • FLUX.1 Kontext dev … 元の絵を保ったまま背景・時間帯だけ差し替え
画像 画像の比較ページを開く
音声 音声 ― 合成AI 3モデル比較 短い録音から声を真似る/文章で声そのものを設計する。宣伝動画のナレーション用。
  • Qwen3-TTS 1.7B … 稼働中。文章で声を設計(低い・明るい・通販調など)
  • GPT-SoVITS v4 … 日本語の再現度が高い。現在は環境修復中
  • CosyVoice 3 … 多言語+感情指定。導入継続中
音声 音声の比較ページを開く

この3つをどう組み合わせるか

宣伝動画を1本作る流れは、3つを順につなぐ形になります。

① 画像生成AI で狙いどおりの1枚を作り込む → ② 動画生成AI(H3) でその絵を動かす → ③ 音声合成AI でナレーションを載せる。

H3 は「最初と最後の絵から動画を作る」型なので、①で絵を固めておくと「指示どおりの構図にならない」問題が大きく減ります。

使っている機材

GALLERIA1(gpc001)GALLERIA2(gpc002)
GPURTX 3080 Ti / VRAM 12GBRTX 3080 Ti / VRAM 12GB
動画MiniMax H3 / HunyuanVideoMiniMax H3
画像FLUX.1 dev / FLUX.1 Kontext devQwen-Image
音声GPT-SoVITS v4Qwen3-TTS / CosyVoice 3
兼務宅内への入口 / Qwen3(Ollama) の実体大容量SSD 1.9TB(動画の正本置き場)

2台は普段スリープしていて、頼まれた時だけ自動で起きます(検証中は起こしたままにしています)。

関連ページの全体図

上の共通バーの「全ページ ▾」からも、同じ一覧をどのページからでも開けます。

動画を見る

動画をつくる

モデル比較(このラボの本体)

資料・機材

この相互リンクの仕組み

各ページの上に出るバーは 正本1本/share/ai-lab/assets/ai-nav.js)から描いています。ページを増やす・名前を変える時はそのファイルだけ直せば全ページに反映されます(公式ヘッダーと同じ考え方で、コピーを増やしません)。左端の「生成AIラボ」がこのトップ、隣の「動画ポータル」が動画専用の入口です。

ローカル生成AIラボ ― BASECORD / 自宅 GALLERIA 2台での検証記録。各ページの件数は自動で更新されます。
Powered by BASECORD