KEN’S CAT LOG

Image and Video Generation AI News — 2026-09-08

クローズドソース側は「拡散モデルではなくLLMエージェント(GPT-6 Astra)がGUIツールやBlenderを操作して画像・3D映像を作る」という新ジャンルがReddit・X・Blueskyで独立に話題化した一方、オープンソースの動きはLemmyのComfyUIコミュニティとYouTubeの検証チャンネルに偏って集まり、Bluesky・Pinterest・Reddit・Xではほぼ観測できなかった。

Image and Video Generation AI News — 2026-09-08

今回の6プラットフォーム横断調査で最も濃かったのは、クローズドソース側では「拡散モデルではなくLLMエージェント(GPT-6 Astra)がGUIツールやBlenderを直接操作して画像・3D映像を作る」という新ジャンルが独立に3つのプラットフォームで話題化したことだ。オープンソース側は全体としては手薄だったが、Lemmyの!stable_diffusionコミュニティでMiniMax H3系動画モデル向けComfyUI高速化ノードが同じ週に5〜6個立て続けにリリースされ、YouTubeではFlux.2/Flux 2 KleinとQwen-Imageの主導権争いが継続的に検証されているなど、開発者コミュニティレベルでは活発だった。Pinterestと(Reddit・Xの多くの投稿は)クローズドソースの製品名(Midjourney, Sora, Veo, Runway, Kling, Nano Banana, Seedream等)に偏り、オープンソースの固有名詞はほぼ登場しなかった。全体として、技術トレンドそのものより「AIかどうかを巡る真偽論争」や「AIエージェントが人間の役割・作業を代行する」という社会的インパクト面の話題がRedditとPinterestで目立った点も共通していた。

Across platforms

  • GPT-6 Astraのエージェント型ビジュアル生成が3プラットフォームで独立に話題化:AstraがBlenderを操作してレンダリングした件はReddit(r/DefendingAIArt)とBluesky(@simonwillison.net)の双方で個別に取り上げられ、Astraで3D都市を作るデモはX(@synabreu@GulatiYajat)で模倣の連鎖を生んだ。「拡散モデルの進化」ではなく「LLMエージェントが既存ツールを乗っ取って絵や3Dを作る」という新しい切り口が、今回の調査で最大の横断テーマだった。
  • 動画生成の「キャラ・シーン一貫性」は依然未解決という評価が割れたまま共有されている:Reddit(r/generativeAIr/aivideomaking)とX(Seedance 2.5を称賛する@atlas_remakeと、複雑なシーンでの破綻を指摘する@Aiden_Tech_Ai)の両方で、同じ論点への賛否が同時期に投稿されている。
  • オープンソースの存在感はプラットフォームによって著しく偏っている:Lemmyの!stable_diffusionはMiniMax H3向けComfyUIノード(ComfyUI-Ref2VA-VSAほか)が同時多発的にリリースされるほど活発で、YouTubeもQwen-Image・FLUX・Wan 2.2の比較検証動画が継続的に出ている。一方Bluesky・Pinterest・Reddit・Xでは、オープンソースの固有モデル名(Stable Diffusion新版、FLUX、Wan、HunyuanVideoなど)を含む投稿はほぼ見つからなかった。「オープンソースが話題になっていない」のか「検索語がクローズドソース寄りに偏っていて見逃しただけ」なのかは、複数プラットフォームのLimitsで同様に指摘されている構造的な弱点。
  • 真偽論争・社会的インパクトが技術トレンドと並走:本物か生成物か判定が割れる投稿(Reddit r/isthisAI、r/pj_explained対r/NewRockstarsのトール映像)、AI生成画像を自動ラベル付けするBlueskyのaimod.social、NY州知事選のフェイク動画(Bluesky/404media)、Pinterestの「FAKE」スタンプ系サムネイルなど、「作る」より「見分ける・疑う」方向の話題が複数プラットフォームで独立に観測された。

Platform by platform

Reddit は12スレッド中、画像・動画生成AI専門のサブ(r/generativeAI、r/aivideomaking、r/GoogleFlow、r/freetoolsAI)よりも、AI是非論争・真偽判定系のサブ(r/antiai、r/aiwars、r/DefendingAIArt、r/isthisAI、r/pj_explained、r/NewRockstars)の方がエンゲージメントが高く、単一検索語のためクローズド対オープンの対比がほぼできなかった。

X はNVIDIAのSol-H3(実時間再生超えの動画推論)発表とその個人によるローカル再現、GPT-6 Astraでの3D都市生成の模倣連鎖が中心。40件のうち画像・動画生成AIに直接関係したのは限られ、地域トレンド(クロアチア周辺のExplore)の混入で対象外の投稿が多かった。

YouTube はページのJavaScriptレンダリングにより再生数・チャンネル登録者数が取得できなかったが、クローズドソース(Midjourney V8.2、Grok Imagine、Google Gemini「Omni」)とオープンソース(Qwen-Image-2.0、FLUX、Wan 2.2)の両方を扱う比較・解説チャンネルが確認でき、6プラットフォームの中では最もクローズド/オープンの対比がしやすいソースだった。

Bluesky は検索API(app.bsky.feed.searchPosts)が終始403を返したため、既知アカウント(@simonwillison.net、@404media.co等)のフィードを個別に確認する方式に切り替えざるを得ず、完了基準の「20件解析」には届かなかった。オープンソースの具体的投稿はQwen 3.7 27Bのローカル実行報告1件のみ。

Lemmy はMidjourneyの医療用超音波スキャナー路線変更騒動(!techtakes)が単発では最大の盛り上がりを見せ、オープンソース側はMiniMax H3向けComfyUIノードの同時多発リリースやQwen-Image-Benchでのベンチマーク競争(LLaDA-Image、Boogu-Image-0.1)など、6プラットフォームで唯一オープンソースの一次情報が厚かった。

Pinterest はワーカー事前収集の50件中30件を確認したが、ジャンル分けなしの単一クエリのためクローズドソース製品比較・ハウツー系インフォグラフィックが大半を占め、オープンソースのモデル名・プロジェクト名は1件も確認できなかった。投稿日時・エンゲージメント数もmanifestに含まれず、鮮度判定ができない。

What to watch

  • MiniMax H3 / Sol-H3の実時間超え動画推論とComfyUI最適化ノードの乱立 — X(@xieenze_jr)/Lemmy(ComfyUI-Ref2VA-VSAほか)。クラウド発表とオープンウェイト再現がどこまで追いつくか。
  • GPT-6 Astraのエージェント型ビジュアル生成の広がり — Reddit(r/DefendingAIArt)/Bluesky(@simonwillison.net)/X(@synabreu)。模倣が今後どこまで拡大するか。
  • FLUX.2/Flux 2 Klein対Qwen-Imageのオープンソース主導権争い — YouTube(SECoursesUrban Decoders)。700件超テストの結果が今後の採用にどう影響するか。
  • Midjourneyの医療機器路線変更(Midjourney Medical)騒動の続報 — Lemmy(pivot-to-ai.com経由)。画像生成企業のピボットが冗談で終わるか実施されるか。
  • 政治広告でのAI動画悪用(NY州知事選)の余波 — Bluesky(404media.co)。規制・プラットフォーム対応が動くか。
  • 動画生成の「キャラ・シーン一貫性」問題の解消状況 — Reddit(r/generativeAI)/X(@Aiden_Tech_Ai)。オールインワン系ツールが本当に解決に近づくか。

Recommendations

  • GPT-6 Astraのエージェント型ビジュアル生成(Blender操作、3D都市生成)を専用の追跡テーマとして次回以降も継続観測する。
  • オープンソースの発表を漏らさず拾うため、次回はプラットフォーム横断で"FLUX" "Stable Diffusion" "Qwen-Image" "Wan" "ComfyUI"など固有名詞での検索語を追加する。
  • Bluesky調査は検索APIの403が続く前提で、監視対象アカウントのリストを事前に拡充しておく。
  • Pinterestは投稿日時・エンゲージメント数が取得できないため、鮮度が必要な速報比較には使わずツール認知度の定点観測用途に限定する。
  • Midjourneyの医療機器路線変更騒動は真偽・実態が未確定なため、一次ソース(Midjourney公式発表)が出るまで断定的な引用を避ける。
  • Lemmyの!stable_diffusionとYouTubeの検証系チャンネルは、オープンソース動向を追う際の主軸ソースとして優先的に確認する。

Data quality

Bluesky(検索API終始403でアカウント個別確認に限定、完了基準の20件に未達)とPinterest(投稿日時・エンゲージメント数が manifest に含まれず鮮度不明、単一クエリでオープンソースの言及が皆無)が最も情報が薄かった。Reddit・Xは単一の検索語(ブリーフのタイトルそのもの)にとどまったため、クローズド対オープンを明確に対比できる投稿を意図的には収集できておらず、結果としてオープンソースの話題はLemmyとYouTubeに偏って集まった。YouTubeは再生数・チャンネル登録者数がJavaScriptレンダリングの制約で取得不能だった。

プラットフォーム別まとめ

Reddit

Reddit — 画像・動画生成AIニュース

主な議論の場(サブレディット)

収集された12スレッドは、すべて別々のサブレディットから1件ずつ拾われている。画像・動画生成AI専門のコミュニティは少なく、映画/フェイク検証系やAIカルチャー論争系のサブが目立つ。

サブレディット メンバー数 収集スレッド数
r/whenthe 813,975 1
r/isthisAI 406,607 1
r/antiai 317,903 1
r/aiwars 167,158 1
r/generativeAI 151,385 1
r/RemoteWorkers 75,332 1
r/DefendingAIArt 72,770 1
r/pj_explained 96,256 1
r/NewRockstars 15,523 1
r/freetoolsAI 7,887 1
r/aivideomaking 6,517 1
r/GoogleFlow 1,789 1

検索語は "Image and Video Generation AI News" の1本のみで、結果は画像/動画生成AI専門のサブ(r/generativeAI、r/aivideomaking、r/GoogleFlow、r/freetoolsAI)よりも、AI是非論争系(r/antiai、r/aiwars、r/DefendingAIArt)や「これAI?」検証系(r/isthisAI、r/pj_explained、r/NewRockstars、r/whenthe)に偏った。

みんなの反応
  • GPT-6がマウス操作でイラストを"手描き"、タイムラプス偽造も可能に(スレッド2, r/antiai, 7,013pt・1,009コメント, 2026-09-05, https://www.reddit.com/r/antiai/comments/1w81kdd/)。拡散モデルではなくLLM(GPT-6)にマウス・キーボード操作を与えてデジタルお絵かきソフトで描かせ、"本物"らしいタイムラプスまで生成できるという投稿。トップコメント u/Nayutantantan(2,507pt)は「もう記録用タイムラプスを撮る気力もない」と絶望を表明。
  • GPT-6「Astra」がBlenderで実写風レンダリングを作成(スレッド9, r/DefendingAIArt, 143pt・13コメント, 2026-09-06, https://www.reddit.com/r/DefendingAIArt/comments/1w970uy/)。AIが動画自体を生成したのではなく、AIエージェントがBlenderを操作してレンダリングした点が話題に。u/TheMaliciousSquid「GPT-6はビジュアル系で最強になりそう、コーディングでClaudeより上回るか気になる」。
  • Google Flow向け拡張機能「AutoFlow」が連続動画生成に対応(スレッド12, r/GoogleFlow, 12pt・6コメント, 2026-09-01, https://www.reddit.com/r/GoogleFlow/comments/1w4eeyp/)。前クリップの最終フレームを次クリップの最初のフレームに自動で引き継ぐ「Continue from Last Frame」機能を追加、複数生成のキュー管理や参照画像管理も可能。次はクリップをシームレスに1本化する機能を予告。
  • 「無料AI画像生成ツール」の宣伝投稿にニーズが集中(スレッド3, r/freetoolsAI, 39pt・48コメント, 2026-09-04, https://www.reddit.com/r/freetoolsAI/comments/1w6w0rj/)。無料・無制限・登録不要を謳うサービスの紹介にコメントが集まり、u/Puzzleheaded_Lab4757「これのおかげで数百ドルと数時間節約できた」と好意的な声がある一方、u/thecragmire「運営コストどうしてるの?」と持続可能性を疑問視。
  • AI動画生成では長尺・キャラ一貫性が最大の壁(スレッド10, r/generativeAI, 4pt・15コメント, 2026-09-07, https://www.reddit.com/r/generativeAI/comments/1w9klb7/)。2〜4分のSFシネマティック動画を作りたい投稿者に対し、u/Missy_Desu「GPT Image 2でフレームを作り、Seedance 2.5で動画化するのが現実的。完成1分あたり約100ドルは覚悟して」とコスト感を提示。u/KissinglyPolished「静止画から動画への飛躍はキャラの一貫性維持がとにかく難しい、オールインワン系はまだそこを解決できていない」。
  • 無料・軽量ハードでの動画生成は依然として非現実的(スレッド8, r/aivideomaking, 6pt・15コメント, 2026-09-07, https://www.reddit.com/r/aivideomaking/comments/1w9h5a9/)。スマホとiPadだけで45秒の無料AI動画を作りたいという投稿に、u/NewLifeWares「45秒はデータセンター級の要求。無料なら5秒×透かし付きが関の山で、それを繋ぎ合わせるしかない」と厳しい現実を指摘。
  • 食品広告のAI画像はいまだに「まずそう」と酷評(スレッド4, r/aiwars, 4pt・177コメント, 2026-09-03, https://www.reddit.com/r/aiwars/comments/1w69cdj/)。企業がAI生成の食品画像を広告に使う流れに疑問の声。u/LCI_Jake「これは意図的に生成されたグロ画像に見える、虫の巣かと思った」。一方 u/Bassed_Hummble はローカルのKrea 2で40秒生成した結果を貼り、プロンプト次第で改善できると反論。
  • AIキャプション評価の在宅バイト求人にリアクション殺到(スレッド5, r/RemoteWorkers, 152pt・739コメント, 2026-09-04, https://www.reddit.com/r/RemoteWorkers/comments/1w7azwu/)。AI生成キャプションの誤り(誤認オブジェクト、色、テキスト誤読など)を時給30ドルでチェックする仕事の募集。コメントの大半は応募リンクを求める定型反応で、内容についての議論は薄い。
  • 「本物っぽすぎるAI動画」を巡る実在性論争が2件発生(スレッド1/6, r/NewRockstars & r/pj_explained, 同一投稿の重複拡散, 2026-09-02)。トールが柱に激突するリーク映像を「AIではなくCGIだ」と主張する投稿に対し、r/pj_explained側のトップコメント u/ceaserisnothome は「爆発が完全な円形に広がるのはAIの証拠」と真っ向から反論しており、同じ映像でも真偽判定が割れている。
  • 波が窓の中に現れる映像はAIか実写か、コメント欄で真っ二つ(スレッド7, r/isthisAI, 0pt・79コメント, 2026-09-07, https://www.reddit.com/r/isthisAI/comments/1w9cyub/)。投稿者は「窓を割らずに水が室内に現れる」不自然さを指摘するが、u/RioReiser85は「遠近感の誤解で実写では」、u/bulbousEdは「船首の泡の動きが物理的にありえずAI」と意見が対立。
シグナル
  • 伸びているもの: AIが「AIらしく見えない」ことへの警戒感。スレッド2(7,013pt、1,009コメント)の反響の大きさは、LLMがGUIツールを直接操作して"手描き証拠"まで偽装できる段階に来たことへの強い懸念を示している。
  • 軽視・却下されているもの: 「無料で長尺・高品質な動画を作りたい」という要望はコミュニティ側から繰り返し一蹴されている(スレッド8, 10)。ハードウェア・コスト面の制約は依然厳しいというのがReddit側の共通認識。
  • 意外だった点: 画像・動画生成AI「専門」のサブレディット(r/generativeAI、r/aivideomaking、r/GoogleFlow)よりも、真偽判定・AI是非論争系のサブ(r/isthisAI、r/antiai、r/aiwars、r/pj_explained、r/NewRockstars、r/whenthe)の方が話題の熱量もエンゲージメントも高かった。今のReddit上でのAI画像・動画生成の「ニュース」は、モデルの進化そのものよりも「これはAIか否か」を巡る社会的摩擦として語られている。
  • 対立するシグナル: 同一の"トール激突"リーク映像について、r/NewRockstarsとr/pj_explainedのコメント欄で「AIではない」「AIだ」の判定が真逆に割れている(スレッド1/6)。同様にスレッド7でも実写派とAI派が拮抗しており、一般ユーザーの目視判定はもはり当てにならなくなっていることが読み取れる。
制限事項
  • 検索語は "Image and Video Generation AI News" の1本のみで、ワーカーはこれ以外の言い換え検索(例: "Stable Diffusion", "Midjourney", "Sora", "Kling", "オープンソース 画像生成"等)を行っていない。そのため、クローズドソース(Midjourney, DALL-E, Sora, Veo, Runwayなど)とオープンソース(Stable Diffusion, Flux, ComfyUIエコシステムなど)を明確に対比できる投稿がほぼ収集できていない。
  • 収集できた12スレッドは12個の異なるサブレディットから1件ずつのみで、同一サブ内での深掘り(同テーマの複数スレッド比較)ができていない。
  • スレッド9・11は本文が空(タイトルとコメントのみ)で、投稿意図の一次情報が不足している。
  • スレッド1と6は実質同一投稿の別サブ転載であり、独立した2件としてカウントすると母数が実質11件相当になる点に注意。
  • ブラウザ収集の性質上、Reddit自体への追加アクセス(他の検索語での再検索、スレッド内の全コメント展開など)はこの run では行っていない。

X

X — 画像・動画生成AIニュース

アカウント

収集された40件は37アカウントから。ほとんどが「1投稿だけでバズった/埋もれた」単発型で、複数投稿でスレッドを組んでいたのは画像・動画生成AIに関係するアカウントでは @yu_ichi_suzuki(鈴木憂一)のみ。

アカウント 投稿数 傾向
@yu_ichi_suzuki(鈴木憂一) 2 ローカルRTX 5090でMiniMax H3を動かす技術スレッドを連投(計309いいね)。単発バズではなく手順解説型
@xieenze_jr(Enze Xie) 1 MiniMax研究者本人による新モデル発表ポスト(349いいね、約85,000表示)
@voxelphotonics 1 Duke Nukem 3Dのボリュメトリック表示デモが1投稿で6,097いいね・約297,000表示のバイラルヒット
@synabreu 1 GPT-6 Astraで作ったソウルの3D都市モデル、1投稿で2,700いいね・約235,000表示
@GulatiYajat(Yajat Gulati) 1 GPT-6 Astraでグルガオンの3D都市を作成、574いいね
@luccacerf 1 Blender MCP + Astra + Tripoの組み合わせデモ、445いいね
@He1s_Sammy 1 「顔出し不要AIキッズ動画」がビジネス化しているという長文スレッド、388いいね
@SD_Tutorial(Stable Diffusion Tutorials) 1 Sol-H3の技術解説アカウントだが22いいねと反応は小さい
@Strength04_X, @atlas_remake, @Aiden_Tech_Ai, @alphafox 各1 Seedance 2.5やAI動画のクオリティ・限界について語る中小規模アカウント

@xieenze_jr以外は開発者本人ではなく「使ってみた」「作ってみた」系のユーザーで、話題を牽引しているのは少数の大型バイラル投稿(@voxelphotonics, @synabreu)と、技術系の個人による手順共有(@yu_ichi_suzuki, @SD_Tutorial)の二層構造。

投稿
  1. MiniMax、実時間再生より速い動画生成「Sol-H3」を発表(#2 @xieenze_jr, 349いいね・62リポスト・23リプライ・約85,000表示, 2026-09-07, https://x.com/xieenze_jr/status/2097000082927399012)。「Five seconds of world. 1.653 seconds to infer.」8× NVIDIA B300 Blackwellで1344×768の動画5秒分を1.653秒で生成できると発表。X Exploreのトレンド1位「NVIDIA Speeds Up AI Video Generation Past Real-Time Playback」の震源となった投稿。
  2. 上記の技術解説が拡散(#3 @SD_Tutorial, 22いいね・約2,100表示, 2026-09-07, https://x.com/SD_Tutorial/status/2097061880175141224)。「a high-performance video inference stack developed by NVIDIA Research that runs the MiniMax-H3 video generation model faster than real-time playback」とし、nvlabs.github.ioのSol-Engine/Sol-H3ページにリンク。公式アカウント以外にも技術系アカウントが即座に追随。
  3. ローカル環境(RTX 5090)でMiniMax H3を動かす手順を公開(#4–5 @yu_ichi_suzuki, 295+14いいね・約18,000+1,100表示, 2026-09-07, https://x.com/yu_ichi_suzuki/status/2096819288997065192)。「ローカルのMiniMax H3で、約9分で15秒の2K超え動画を生成する話(RTX 5090)。Alibabaの蒸留LoRAで480pの当たりを引いて…RTX Video Super Resolutionで2倍の2688×1536にアップスケール」と、蒸留LoRA+アップスケールを組み合わせた個人のワークフローをGitHubノート付きで共有。クラウド発表(#1,2)に対し、オープンウェイトを個人が使い倒す側の動きとして対になる。
  4. Seedance 2.5でファッション系動画を生成(#1 @Strength04_X, 68いいね・2リポスト・35リプライ・約7,700表示, 2026-09-06, https://x.com/Strength04_X/status/2096441159887274302)。「Seedance 2.5 on Dreamina_ai」で「30-second photoreal cinematic fashion-travel music video」を作成したと、プロンプト全文つきで公開。
  5. Seedance 2.5でトイストーリー風の世界を生成(#14 @atlas_remake, 3いいね・約133表示, 2026-09-07, https://x.com/atlas_remake/status/2096847522602139995)。「What impressed me most here is how Seedance 2.5 handles multiple animated」characters/objectsと、複数キャラの一貫性をポジティブに評価するコメント。
  6. 「AI動画はまだスロットマシン」と課題を指摘(#12 @Aiden_Tech_Ai, 1いいね・2リポスト・4リプライ・約494表示, 2026-09-07, https://x.com/Aiden_Tech_Ai/status/2097020441470836791)。「You prompt. You generate. Something is wrong. You generate again... when you're dealing with multiple spaces, camera movement, character blocking and continuity」と、複雑なシーンでの一貫性の弱さを指摘。エンゲージメントは小さいが#5の楽観的な評価と対になる論点。
  7. Duke Nukem 3Dをボリュメトリック3Dディスプレイで再現(#10 @voxelphotonics, 6,097いいね・921リポスト・130リプライ・約297,000表示, 2026-09-07, https://x.com/voxelphotonics/status/2096833425043005562)。この期間でX全体でも最大級のエンゲージメントを稼いだ投稿。画像・動画「生成」AIそのものではなく描画・表示技術のデモだが、Explore経由でトレンド3位「Duke Nukem 3D Brought to Life in True 3D Display」の主因になっている。
  8. GPT-6「Astra」でソウル全域を3D都市化(#20 @synabreu, 2,700いいね・451リポスト・81リプライ・約235,000表示, 2026-09-06, https://x.com/synabreu/status/2096557555086725159)。「for my first project created with GPT-6 Astra, I built the entire city of Seoul in 3D—a small revolution in digital geography!」と、対話型3D生成の応用例として大きく拡散。
  9. 同様にGPT-6 Astraでグルガオンの3D都市を再現(#22 @GulatiYajat, 574いいね・28リポスト・53リプライ・約46,000表示, 2026-09-06, https://x.com/GulatiYajat/status/2096659142534676684)。「I saw everyone building all sorts of cool demos with Astra, so I decided to give it a shot」と、#8のブームに便乗する形で追随者が出ていることを示す実例。専用サイトgurgaon-3d-atlas.cratorlabs-2435.chatgpt.siteまで公開。
  10. Blender MCP + Astra + Tripoの組み合わせデモ(#21 @luccacerf, 445いいね・20リポスト・11リプライ・約31,000表示, 2026-09-07, https://x.com/luccacerf/status/2097047098281672782)。「First time building a gUI with Blender MCP + Astra + Tripo This is insane. Html preview for AI is dead.」と、複数のAIツールをMCP経由で連携させる動きの一例。
  11. 「顔出し不要AIキッズ動画」がコンテンツビジネス化(#23 @He1s_Sammy, 388いいね・96リポスト・17リプライ・約19,000表示, 2026-09-06, https://x.com/He1s_Sammy/status/2096492880017736056)。「FACELESS AI KIDS VIDEOS ARE BECOMING A SERIOUS CONTENT BUSINESS...a phone, laptop, or iPad is enough to start experimenting」と、生成AI動画を使った副業・収益化ノウハウ系の投稿として拡散。
シグナル
  • 伸びているもの: 「対話型エージェントに3D世界を作らせる」系(GPT-6 Astraでの都市3D化、Blender MCP連携)が、今回の期間でもっとも模倣・追随を生んでいる。#8のsynabreu投稿を見て#9のGulatiYajatが「みんなが作っているのを見て自分もやった」と明言しており、単発ニュースというより模倣の連鎖が起きている。
  • 伸びているもの(その2): 「実時間再生より速い」動画推論(Sol-H3, #2/#3)と、それを個人がローカルGPUで再現する動き(#3の@yu_ichi_suzuki)がほぼ同時に流れており、クローズドソース側の発表とオープンウェイトの追随がX上では時間差なく併走している。
  • 軽視・意見が割れているもの: AI動画の「複数キャラ・複数空間での一貫性」は、称賛(#5「handles multiple animated characters well」)と不満(#6「slot machine problem」)の両方が同じ期間に投稿されており、Xの反応としてもまだ評価が定まっていない。
  • 意外だった点: このrunで収集した40投稿の元になったExploreのトレンド9件のうち、画像・動画生成AIに直接関係していたのは上位3件(NVIDIA/Sol-H3, VTuber Veibaeのアニメ復帰, Duke Nukem 3Dのボリュメトリック表示)のみ。残り6件(Croatian, Building, $song, Harvey, Ukrainian, Democrats)はこのセッションがサーバーから見えるExplore(トレンド4に「Trending in Croatia」と明記)に基づく地域トレンドで、テーマとは無関係だった。ただし「Building」で検索した副産物として、GPT-6 Astraの3D都市生成デモ群(#8〜#10)という質の高い当たりを引けたのは収穫。
  • VTuber Veibaeの件: Exploreトレンド2位「VTuber Veibae Teases Return with Sunflower Farm Animation」で検索したところ、実際にヒットしたのは無関係な北米興行収入まとめアカウント群(@mediamanint等、複製投稿)ばかりで、Veibae本人やそのアニメーション制作に関する投稿は一件も収集できなかった。
制限事項
  • Explore上位3トレンドのうち「VTuber Veibae Teases Return with Sunflower Farm Animation」(画像・動画生成AIに直結しうる話題)は、検索しても関連投稿が収集できなかった(#6〜#9はすべて無関係な興行収入まとめの重複投稿)。VTuberのアニメーション制作にAIが使われたのかどうかは、この収集からは確認できていない。
  • Exploreの残り6トレンド(Croatian, Building, $song, Harvey, Ukrainian, Democrats)はほぼ全て画像・動画生成AIと無関係な地域トレンド・時事ネタで、そこから拾えた40件中29件(#6〜#9, #13, #15〜#19, #24〜#40)はテーマ対象外として本レポートから除外した。
  • 検索語が「トレンドのタイトル文字列そのもの」に限られており、"Stable Diffusion" "Midjourney" "Sora" "Kling" "ComfyUI" といったテーマに直結する固有名詞での検索は行われていない。そのため、クローズドソース(Midjourney, Sora, Runway, Veoなど)とオープンソース(Stable Diffusion, Flux, ComfyUIなど)を明確に対比できる投稿は今回ほぼ収集できていない。
  • Explore自体がこのセッションのサーバー所在地(クロアチア周辺と見られる)に地理的に紐づいており、世界のX全体のトレンドを代表するものではない。
  • 収集は40件で打ち止められており、これ以上の深掘り(同じアカウントの他の投稿、リプライ欄の展開、ハッシュタグ検索など)はこのrunでは行われていない。

YouTube

YouTube — 画像生成AI・動画生成AIの最新動向

Channels
  • 動画編集の中の人チャンネル)— 画像生成AIの実運用比較を多数投稿。
  • AI大学【AI&ChatGPT最新情報】チャンネル)— 生成AIツールの月次まとめ動画が主力。
  • 【さき】のAIでええやん。チャンネル)— Google I/O・Gemini系のアップデート解説。
  • Qwen(公式)チャンネル)— Qwen-Imageシリーズの公式アナウンス動画を配信。
  • AIOnTrendチャンネル)— オープンソース画像モデルの横並び比較。
  • Urban Decodersチャンネル)— Flux系モデルのアーキテクチャ解説。
  • SECoursesチャンネル)— ローカル画像生成の大規模検証(700+テストなど)。
  • Woollyfernチャンネル)— Midjourney月次アップデートの定点観測チャンネル。
  • 寺田部チャンネルチャンネル)— ComfyUIでのローカル動画生成の実践レビュー。
  • 東京大学 吉田幸 研究室チャンネル)— 生成AI技術動向の定期解説(大学発信)。

チャンネル登録者数はYouTubeの検索結果ページ・動画ページがJavaScriptレンダリングのため取得できず(下記Limits参照)。

Videos
クローズドソース系
  1. 【ド課金して判明】2026年おすすめ画像生成AIはコレ!NanoBananaPro・Seedream4.0・Midjourney・AdobeFireflyを徹底比較します! — 動画編集の中の人 — https://www.youtube.com/watch?v=vJLDbXaSKW4 — 課金して実際にNano Banana Pro、Seedream 4.0、Midjourney、Adobe Fireflyを横並びで比較し、2026年時点のおすすめを結論づける内容。
  2. 【2026年冬最新】ここ数か月で過去イチ進化した無料の人気動画生成AIツール6選!~Sora 2、Veo 3.1、Kling 2.6など~ — AI大学【AI&ChatGPT最新情報】 — https://www.youtube.com/watch?v=T9iIlhittDc — Sora 2・Veo 3.1・Kling 2.6を含む無料で使える動画生成AI6選を、ここ数ヶ月の進化幅の大きさとともに紹介。
  3. 【性能ランキング世界1位】xAIの動画生成AI「Grok Imagine」徹底解説! Sora/Veo級の映像を無料で作る方法! — AI大学【AI&ChatGPT最新情報】 — https://www.youtube.com/watch?v=0cYPwxg8le8 — xAIのGrok Imagineが性能ランキングで世界1位になったと主張し、Sora・Veo級の映像を無料で作る方法を解説。
  4. 【最新】GoogleのAI Geminiのモデルが大幅アップデート!動画生成Omniも発表されたGoogle I/O 2026を解説するで! — 【さき】のAIでええやん。 — https://www.youtube.com/watch?v=vKtwoKCSGyE — Google I/O 2026で発表されたGeminiの大幅アップデートと、新しい動画生成モデル「Omni」の内容を解説。
  5. Midjourney Update | July 2026: V8.2 is HERE! Personalization, NIJI Style Creator, and More! — Woollyfern — https://www.youtube.com/watch?v=dvfH5HzCARY — MidjourneyがV8.2をリリースし、パーソナライゼーション機能とNIJI Style Creatorが追加されたことを報告(2026年3月のV8 Alpha→4月V8.1→6月V8.2プレビュー→7月V8.2正式版という月次アップデートの流れの最新回)。
オープンソース系
  1. 🚀 Introducing Qwen-Image-2.0 — our next-gen image generation model! — Qwen公式チャンネル — https://www.youtube.com/watch?v=1tM7Wd0lEeI — Alibaba QwenチームによるQwen-Image-2.0の公式発表動画。次世代オープンソース画像生成モデルとして紹介。
  2. Qwen Image Dominates Text-to-Image: 700+ Tests Reveal Why It's Better Than FLUX - Presets Published — SECourses — https://www.youtube.com/watch?v=R6h02YY6gUs — 700件超のテストに基づき、Qwen ImageがFLUXより優れている点を検証し、プリセットを公開。
  3. Flux 2 Klein vs Qwen vs Z Image Turbo vs Nano Banana Pro - Which AI Image Wins? — AIOnTrend — https://www.youtube.com/watch?v=CkAtP2EVhSM — オープンソースのFlux 2 Klein・Qwen・Z Image Turboと、クローズドソースのNano Banana Proを同一プロンプトで比較。
  4. Flux.2 New Open Source King? Architecture FULL guide + Nano Banana Pro comparisons — Urban Decoders — https://www.youtube.com/watch?v=Iu9Dm7lBeAk — Black Forest LabsがリリースしたFlux.2のアーキテクチャを解説し、Nano Banana Proとの比較で「新たなオープンソースの王者か」を検証。
  5. Flux 2 Klein Just Dropped—This Image Editing Model Isn't Just About Speed!https://www.youtube.com/watch?v=JXgBe3twxbc — Black Forest Labsの軽量ローカル実行可能な画像編集モデル「Flux 2 Klein」のリリースを速報。
  6. Wan 2.2, FLUX & Qwen Image Upgraded: Ultimate Tutorial for Open Source SOTA Image & Video Gen Modelshttps://www.youtube.com/watch?v=3BFDcO2Ysu4 — AlibabaのWan 2.2、FLUX、Qwen Imageなどオープンソース最先端モデルのアップグレードをまとめて解説するチュートリアル。
  7. 【無料・ComfyUI】ローカル動画生成AIを使って長編動画を制作するのは簡単か?無茶苦茶大変です — 寺田部チャンネル — https://www.youtube.com/watch?v=I8_wKOLnSlI — ComfyUIとローカル動画生成AIで長編動画を作る実践レポート。「無茶苦茶大変」という率直な失敗談・知見あり。
Signals
  • クローズドソース優勢の争点は「安さと速さ」対「品質」:Nano Banana Proが写実性テストの63%で勝利しているとする比較コンテンツが複数出ており(動画1、9)、無料/低価格帯(Grok Imagine、動画3)が「Sora/Veo級を無料で」と挑発的に訴求している。
  • Midjourneyは月次リズムでV8系列を継続改良:2026年2月のV8予告→3月Alpha→4月V8.1→6月V8.2プレビュー→7月V8.2正式版と、Woollyfernチャンネルが毎月定点観測しており、更新カデンスの速さが際立つ(動画5)。
  • Google I/O 2026でGemini動画生成「Omni」発表が単独の大型ニュースとして扱われ、日本語チャンネルでも速報解説が出ている(動画4)。
  • オープンソース陣営はQwen ImageとFLUXの主導権争い:SECoursesの700件超テスト(動画7)やUrban Decodersのアーキテクチャ解説(動画9)など、深掘り系チャンネルが「どちらが上か」を検証する動画を継続的に出しており、コミュニティの関心が高い。
  • Black Forest Labsの「Flux 2 Klein」は軽量・ローカル実行に振った派生モデルとして単独で速報されており(動画10)、フルサイズのFlux.2とは別に注目されている。
  • Alibaba系(Wan・Qwen Image)はオープンソースの動画・画像両輪として一つのチュートリアルにまとめられるほど並走した扱いを受けている(動画11)。
  • ローカル動画生成は依然「大変」との実践知見があり、ComfyUIでの長編動画制作は「無茶苦茶大変」という率直なレビューが出ている(動画12)。品質だけでなく運用の重さがオープンソース動画生成の課題として語られている。
Limits
  • YouTubeの検索結果ページ(/results?search_query=...)とwatchページはJavaScriptで内容を描画するため、WebFetchでは静的HTML(フッターの規約・著作権リンクのみ)しか取得できず、ページを直接開いても動画一覧・再生数・投稿日・概要欄・コメントは読み取れなかった。この制約はプレイブックが想定する「ページHTMLがタイトル・チャンネル・再生数・投稿日を持つ」という前提と食い違っていた。
  • 代替として site:youtube.com のWeb検索(タイトル・URL・検索エンジン側の要約と一部投稿日が取得できる)と、YouTubeの oembed エンドポイント(正式タイトル・チャンネル名・チャンネルURLをJSONで取得)を組み合わせて裏取りした。ただし 再生回数・チャンネル登録者数・動画概要欄本文・コメントは今回の手段では一切取得できなかったため、上記には含めていない。
  • 「2026年8月」「2026年9月」を指定した日本語ニュース系検索では、画像/動画生成AI固有のニュースはヒットせず、AI全般の日次ニュースチャンネル(世界のAI関連ニュース、週刊IT企業ニュース等)や無関係な天気ニュースが混入した。直近1週間(9月1日〜8日)に絞った専用の速報は見つからなかった。
  • Reddit/X/Bluesky/Lemmy/Pinterestは本ステージの対象外のため未調査(brief.mdの記載どおり、別ステージで担当)。

Bluesky

Bluesky — 画像・動画生成AIニュース

Accounts
ハンドル 属性 フォロワー等 メモ
@simonwillison.net 個人(著名AI技術ブロガー、Datasetteの作者) 新モデルが出るたびに「ペリカンが自転車に乗る絵を描かせる」独自ベンチマークで画像生成能力を比較。今回の収集で最も内容の濃いソース。
@404media.co メディア(404 Media編集部・記者アカウント複数) サーベイランス系の報道が中心だが、AI生成メディアがらみのスクープも時々投下。
@aimod.social コミュニティ運営(AI画像疑いラベラー) フォロワー2,555・投稿94件 「AI生成が疑われる画像」に自動でラベルを貼るBluesky公式ラベラーサービス。ニュース発信ではなくインフラ的存在。
@stablediffusion.bsky.social 個人(SDXL/Stable Diffusionのプロンプト共有) 2025年1月を最後に投稿が止まっている。
@bm63ai.bsky.social 個人(ComfyUI/Flux/Midjourneyのアート投稿) 2025年4月までAIアートを連投していたが、2026年6月の最終投稿は「Codexでアプリをバイブコーディングした」という話題で、AIアート投稿自体は事実上終了している。
@petapixel.bsky.social メディア(写真専門メディア) Adobe系の生成AI機能(Firefly、Lightroom)を批評的に扱うが、直近の投稿は2025年2月が最後で今回のニュースサイクルには入っていない。
Posts
  • GPT-6 Astraでペリカン自転車ベンチマーク再び(@simonwillison.net, 2026-09-04, 202 likes・9 reposts・18 replies, https://bsky.app/profile/simonwillison.net/post/3mupxubgrls2c)。「Got access to GPT-6 Astra. Want to see some pelicans?」と、GPT-6 Astra・GPT-5.6 Sol・Terra・Lunaの4モデル×3推論レベルでペリカンが自転車に乗るSVGイラストを比較したグリッド画像を公開(詳細: static.simonwillison.net/static/2026/gpt-6-and-5.6-pelicans.html)。Alt textによれば「Astraは洗練され一貫した結果、Solはプロポーションがばらつき、Terraは不自然な解剖、Lunaはより単純で硬いポーズ」。リプライでは「Astraは初めて(架空の四足獣)にタンデム自転車が必要だと理解したモデル」という声も。
  • GPT-6 AstraがBlenderを操作してペリカンの3Dシーンを生成(@simonwillison.net, 2026-09-05, 400 likes・30 reposts, https://bsky.app/profile/simonwillison.net/post/3murtmdynq22s)。「Use the already install /Applications/Blender to render a scene of a pelican riding a bicycle」→「add a background and a lot of flair」→「make it a whole lot better」と3段階で指示し、コーディングエージェント経由でBlenderに3Dシーンを描かせた結果を公開。同じ「GPT-6 AstraがBlenderで実写風レンダリング」という話題はRedditのr/DefendingAIArtスレッドでも独立して取り上げられており、プラットフォーム横断で話題になっていることが確認できる。
  • オープンソースのQwen 3.7 27Bがローカルでペリカンを描画(@simonwillison.net, 2026-08-14, 183 likes・14 reposts, https://bsky.app/profile/simonwillison.net/post/3mt2ynhrlk22z)。「The new Qwen 3.7 27B, running as a 17GB GGUF in LM Studio on my M5 Max MacBook Pro, just drew me the best pelican riding a bicycle I've seen from any model that runs on my laptop」。ローカル実行可能なオープンソースモデルの画像生成能力向上を示す数少ない具体的投稿。
  • NY州知事候補がAI生成のフェイク動画で対立候補を攻撃(@404media.co, 2026-09-02, 124 likes・22 reposts・7 replies, https://bsky.app/profile/404media.co/post/3muka24vu4v2q)。「The Republican Nominee for New York Governor Made a Creepy, AI-Generated Video of Mamdani and Hochul」。同記事の引用ポストでは「対立候補を貶めるためにフェイクのバイアグラCM動画を作る時代に生きている」と皮肉る声(194 likes・36 reposts、https://bsky.app/profile/404media.co/post/3muk7u6iepk2h、投稿者は404 Media関係者)。動画生成AIが政治広告の偽情報に使われた事例。
  • Cocomelon制作元がアーティストにAI実験を指示(@404media.co, 2026-09-06, 84 likes・23 reposts・21 replies, https://bsky.app/profile/404media.co/post/3musx3wgdvc2n)。「Moonbug Entertainment, which makes Cocomelon, Blippi, and other popular content for children, says it will begin using AI but will always have a 'human in the loop.'」子供向け映像制作という主要ユースケースでの画像・動画生成AI導入表明。
  • AI画像疑いラベラー「aimod.social」が2,500人超のフォロワーを抱える(プロフィール調査, https://bsky.app/profile/aimod.social)。「Labeler for flagging suspected AI imagery」を謳い、判定基準のハンドブックや不服申立ての窓口まで整備。ニュース記事ではないが、Bluesky上でAI生成画像を疑い、自動でラベル付けする仕組みへの需要がコミュニティレベルで形成されていることを示す。
  • 旧来のAIアート投稿アカウントが軒並み沈黙(@stablediffusion.bsky.social, @bm63ai.bsky.social のフィード調査)。stablediffusion.bsky.socialは2025年1月22日の「the liberty statue playing electric guitar」プロンプト投稿(#SDXL #StableDiffusion, 10 likes)を最後に更新なし。bm63ai.bsky.socialも2025年4月25日の「Star Trek: The Muppet Generation」(#comfyui #midjourney #flux, 5 likes)を最後にAIアート投稿を止め、2026年6月8日の最終投稿はコーディングエージェントで作った音楽アプリの話題に切り替わっている。
  • Adobeの生成AI機能への批評(旧サイクルの参考情報)(@petapixel.bsky.social, 2025-02-12・2025-01-09, 各7 likes/33 likes)。「Adobe's newly-announced text-to-video tool is very much not ready to have a price tag attached to it」、また写真家がLightroomのGenerative Removeで不要物を消そうとしたら代わりにビットコインのロゴが生成されたという投稿。今回のニュースサイクル(2026年9月)より前の投稿だが、クローズドソース商用ツールへの批判的論調の継続例として参考記録。
Signals
  • 伸びているもの: GPT-6 Astraの画像/映像生成的タスク(ペリカンSVG描画、Blenderでの3Dレンダリング操作)は、Reddit(r/DefendingAIArt、r/antiai)とBluesky(@simonwillison.net)の双方で独立に取り上げられており、プラットフォームをまたいだ最大の話題になっている。ただし正確には「拡散モデルによる画像生成」ではなく「LLMエージェントがコード/3DツールでビジュアルをA生成する」という新しいジャンルの話題である点に注意。
  • 軽視・却下されているもの: オープンソース側の話題は極端に少なく、確認できたのはQwen 3.7 27Bのローカル動作報告1件のみ。FLUX、Stable Diffusion新版、Wan、HunyuanVideoなど画像・動画生成の専業オープンソースモデルの発表投稿はBluesky上では見つからなかった。
  • 意外だった点: 2025年前半まで活発だったAIアート専業ポストアカウント(stablediffusion.bsky.social、bm63ai.bsky.social)が軒並み沈黙している一方、「AI画像を疑って自動ラベル付けする」ラベラーサービス(aimod.social)が独立したコミュニティインフラとして存続・成長している。Bluesky上でのAI画像生成の話題の重心が、「作る」側から「見分ける/取り締まる」側に移っている可能性がある。
  • 対立するシグナル: 動画生成AIに関する具体的なニュースは、モデル自体の性能競争よりも「政治広告での悪用」(NY州知事選のフェイク動画)という応用面の炎上が目立った。技術トレンドとしての動画生成AIより、社会問題としての動画生成AIの方がBluesky上では可視性が高い。
Limits
  • Blueskyの公開検索API(app.bsky.feed.searchPosts)は、英語・日本語を問わずどのクエリ("image generation AI"、"Stable Diffusion"、"Midjourney"、"Sora"、"Veo"、"Kling"等)でも一貫してHTTP 403を返し、利用できなかった。同じセッションでapp.bsky.actor.getProfileapp.bsky.feed.getAuthorFeedは正常に応答しており、検索エンドポイントのみ認証必須化またはブロックされているとみられる。
  • bsky.app/searchのWeb UIはクライアントサイドレンダリングのSPAで、投稿本文がHTML内に含まれず、Webページ取得ツールでは実際の検索結果を読み取れなかった。
  • 上記の理由で、プレイブック本来の「キーワード検索→投稿を読む」という手順が実行できず、代わりにWeb検索で判明した既知アカウント(simonwillison.net、404media.co、petapixel.bsky.social、aimod.social、stablediffusion.bsky.social、bm63ai.bsky.social)の投稿履歴を個別に取得する方法に切り替えた。そのため収集は「アカウントのサンプル」であり、網羅的なキーワード検索の代替にはなっていない。
  • OpenAI・Google DeepMind・Midjourney・Runway・Stability AI・Black Forest Labs・Krea・TechCrunch・The Verge・Ars Technica・Engadgetなど、想定したハンドル(例: midjourney.com、runwayml.com、stability.ai、blackforestlabs.ai、krea.ai)はBluesky上に存在しないか(HTTP 400 = アカウント未検出)、該当フィードに画像・動画生成関連の投稿が見つからなかった。
  • 完了基準にある「1プラットフォームあたり約20件の投稿を解析」は、検索APIが使えなかったため到達できていない。実際に解析対象にできたのはこの本文に掲載した8件(+参考情報1件)で、それ以外は取得したフィードの中に該当する投稿が存在しなかった(該当ゼロだったフィード: techcrunch.com、theverge.com、arstechnica.com、engadget.com、garymarcus.bsky.social〈1件のみ〉)。
  • オープンソースの画像・動画生成モデル(FLUX、Stable Diffusion新版、Wan、HunyuanVideoなど)に関する具体的な投稿はBluesky上で1件も見つけられなかった。これは「話題になっていない」のか「検索できずに見逃した」のか、今回の調査方法では区別できない。

Lemmy

Lemmy — 画像・動画生成AIニュース

Lemmyは規模がRedditの何百分の一もない連合型SNSだから、ここでの「バズり」は数百upvoteどころか数十upvoteレベル。でも意外と濃い情報が拾えたよ〜🐘✨ 主に[email protected](ComfyUI・モデルリリース勢)と!ai_reddit(Reddit転載ボット、r/ArtificialIntelligenceのニュースをそのまま流してる)、あと!technology!techtakes(皮肉多め)を漁ってきた。検索はlemmy.world/api/v3/searchをキーワード変えながら叩きまくった感じ。

Communities
  • [email protected] — 5,709 subscribers(うちlocal 893)。ComfyUIカスタムノードとモデルリリース情報のハブ。ほぼ毎日投稿あり。
  • [email protected] — 2,362 subscribers。Stable Diffusion/Flux/Krea2で作った作品のギャラリー。
  • [email protected] — アニメ系AIアート専用、投稿頻度は上とほぼ同じくらい高い(購読者数は非公開だったけど活動量は同等)。
  • [email protected] — 87,904 subscribers。大手テック記事の転載で、Midjourneyの騒動もここで話題になってた。
  • [email protected] — 2,690 subscribers。AI業界を皮肉る系コミュニティ、Midjourneyの迷走をボロクソに書いてる。
  • [email protected] — r/ArtificialIntelligenceのRSS転載アカウント。購読者数はAPIで拾えなかったけど、ここが一番ニュース密度高かった。
  • [email protected] — 8,154 subscribers。AIアンチのコミュニティ、生成AI供給網批判の記事もここに流れてた。
Posts
クローズドソース寄り
  1. Midjourneyが医療用超音波スキャナー「Midjourney Medical」に路線変更(?) — 2026-06-18〜19、!techtakes!hackernewsで祭り状態。The Registerが「ゴールデンライトの美容医療スパ」と皮肉り、pivot-to-ai.comは「TheranosへのピボットだろこれW」って斬ってる。Score 40〜58。
    https://lemmy.world/post/48384985 (元記事: pivot-to-ai.com/2026/06/19/midjourney-ai-pivots-to-theranos-ultrasonic-ct/)
  2. Midjourneyがハリウッドのスタジオに「AIどう使ってるか開示しろ」と要求 — TechCrunch記事、!technologyでScore 73。著作権訴訟の流れの続報。
    https://lemmy.world/post/49069400
  3. Google、Nano Banana 2 Liteをリリース — DeepMindの軽量版画像生成モデル。!hackernewsとスイスのテックメディア(itmagazine.ch)経由の投稿、2026-06-30〜07-02。
    https://lemmy.world/post/48857780 (deepmind.google/models/gemini-image/flash-lite/)
  4. MicrosoftのMAI-Image-2.5がNano Banana 2にベンチマークで追いついた — the-decoder.com経由、!ai_reddit、2026-05-28。
    https://the-decoder.com/microsofts-mai-image-2-5-pulls-even-with-googles-nano-banana-2-on-benchmarks/
  5. ByteDance Seedream 5.0 Proのガチ比較レビュー — 編集能力と反復生成の強さに言及、!ai_reddit、2026-07-10。
    https://www.reddit.com/gallery/1usc03q
  6. GoogleのEarth AI機能、公開翌日に停止 — ユーザーが実在の場所に偽の画像をオーバーレイして荒らしまくったせいでFortuneが報道、!ai_reddit、2026-08-07。
    https://fortune.com/2026/08/07/google-quietly-discontinues-its-earth-ai-feature-a-day-after-its-rollout-after-users-made-no-no-images/
  7. Runwayのエンタープライズ事業がNRR 300%超えで倍増 — 動画生成のRunwayが法人向けで伸びてるって話、!ai_reddit、2026-08-30。
    https://www.reddit.com/r/ArtificialInteligence/comments/1w2hnea/runway_says_enterprise_business_doubled_nrr_over/
  8. Amnesty Internationalが主要AIシステムを「設計からして違法」と批判 — 生成AI全般への規制圧力の文脈、!ai_reddit、2026-06-24。
    https://reddit.com/r/ArtificialInteligence/comments/1ue64s2
  9. Pax Silica: AI供給網の武器化 — 米中のAI半導体・計算資源をめぐる経済戦争を分析、クローズドソース系巨大テック企業の地政学リスクとして!fuck_aiでScore 14、2026-09-06。
    https://thecradle.co/articles/pax-silica-and-the-weaponization-of-ai-supply-chains-the-new-front-in-us-global-economic-warfare
  10. 「Astra 6 max」に自分を感動させるアートを作らせてみた — 商用クローズドモデルの哲学的自己言及アート生成、!ai_reddit、2026-09-05。
    https://i.redd.it/3h241pocalnh1.png
オープンソース寄り
  1. LLaDA-Image公開 — 6BのDiffusion Transformerとフローズンな視覚言語理解モジュールを組み合わせた新モデル、LLaDA2.0-Mini基盤。Qwen-Image-Benchで英語53.53/中国語53.38のSOTAスコア。2〜4ステップで生成できる高速版「LLaDA-Image-Turbo」も同時公開、重み・学習コード・レシピ全部オープン。!stable_diffusion、2026-09-04。
    https://lemmy.dbzer0.com/post/74988021 (論文: arxiv.org/abs/2609.03796、コード: github.com/inclusionAI/LLaDA-Image)
  2. Boogu-Image-0.1リリース — Base/Turbo/Edit複数バリアントのオープンモデルファミリー、Apache-2.0ライセンスで商用利用も自由。パラメータ10Bでオープンソース勢の中でQwen-Image-Bench最高スコア(53.58)を記録。!stable_diffusion、2026-06-17。
    https://boogu.org/ (論文: arxiv.org/abs/2607.13125)
  3. ComfyUI-Ref2VA-VSA: MiniMax H3向け推論高速化ノード — 動画生成の推論速度を大幅改善、!stable_diffusion、2026-09-08。
    https://github.com/Kablex/ComfyUI-Ref2VA-VSA
  4. ComfyUI-AetherScale: NVIDIA GPUネイティブの動画アップスケーラー!stable_diffusion、2026-09-05。
    https://github.com/vizart-vj/ComfyUI-AetherScale
  5. ComfyUI-VDN-H3: Video Delta Netハイブリッドアテンション — 動画生成モデルの効率化ノード、!stable_diffusion、2026-09-05。
    https://github.com/Saganaki22/ComfyUI-VDN-H3
  6. ComfyUI-Majoor-OmniCam: カメラレイアウト&アニメーションツール — 動画/画像生成のカメラワーク制御ノード、!stable_diffusion、2026-09-04。
    https://github.com/MajoorWaldi/ComfyUI-Majoor-OmniCam
  7. FastH3-Ref2V-Stream-Controller — MiniMax H3系動画生成のストリーミング制御ツール、!stable_diffusion、2026-09-04。
    https://github.com/EarthDefenceForces/FastH3-Ref2V-Stream-Controller
  8. ComfyUI-InpaintCanvas: Krita風インペインティングUI!stable_diffusion、2026-09-08。
    https://github.com/DenRakEiw/ComfyUI-InpaintCanvas
  9. ComfyUI-MiniMax-H3-MotionCache-FastVAE / ComfyUI-H3VAE_TRT / ComfyUI-MiniMaxH3-CLSS — 同時多発的にMiniMax H3系動画モデルの高速化・軽量化ノードが3つ立て続けに投稿、2026-09-01〜02。オープンソース動画生成エコシステムが今めちゃくちゃ活発な証拠。
    https://github.com/Mozer/ComfyUI-MiniMax-H3-MotionCache-FastVAE
  10. InterleaveThinker: エージェント的インターリーブ生成の強化学習研究 — 既存の画像生成モデルにマルチエージェントでテキスト↔画像の逐次生成能力を追加する研究、!stable_diffusion、2026-06-12。
    https://arxiv.org/abs/2606.13679
  11. Flux/Krea2 turboで作った作品ラッシュ!stable_diffusion_art!share_anime_artは毎日数件ペースでFlux・Krea2生成のアート・アニメ絵が投稿され続けてる。単発ニュースじゃなくて「オープンウェイトモデルが日常使いされてる」っていう継続的シグナル。
    https://lemmy.dbzer0.com/post/75150630 ほか多数
Signals
  • 🔥 一番の話題はMidjourneyの迷走。画像生成AIの会社なのに医療用超音波スキャナーに手を出したって話が!techtakes!technology両方で盛り上がってて、しかも良い意味じゃなくて「大丈夫かコイツ」的な空気。クローズドソース勢のニュースの中でぶっちぎりでscoreが高い(40〜73)。
  • 🛠️ オープンソース側は「MiniMax H3」系の動画モデル向けComfyUIノードが同じ週に5〜6個も立て続けに出てる。これは開発者コミュニティが特定の動画生成基盤モデルに一気に群がって最適化競争してる典型パターン。中華圏の開発者名(nazgut, lisitskyaaとか)も多くて、グローバルに広がってる感じ。
  • 📊 ベンチマーク厨がQwen-Image-Benchを共通指標にしてる。LLaDA-Image(53.53)もBoogu-Image-0.1(53.58)も同じベンチで殴り合ってて、オープンソース勢どうしの性能競争が数字で見える化されてる。
  • 😤 AI批判系コミュニティ(!fuck_ai)にもクローズドソース企業の地政学リスク記事が流れてくるくらい、生成AIの話題は技術コミュニティの外にも染み出してる。
  • 🤖 Lemmyは母数が少ないから「バズった」の基準がReddit/Xと全然違う——Score 70台でも大ニュース扱いレベル。数字の絶対値じゃなくて相対的な盛り上がりで見るべき。
Limits
  • Lemmyは連合型で検索がインスタンスごとにバラバラ。lemmy.worldのAPIで拾えたのは主にlemmy.world自身か、フェデレーションで流れてきた他インスタンスの投稿だけ。lemm.eelemmy.mlは個別にsearch UIへアクセスを試みたが、今回はlemmy.worldのAPI一本に絞った(時間の都合で全インスタンス横断はできず)。
  • 「Kling AI」「Stability AI」「Wan 2.2」「Runway Gen」で検索したキーワードはヒットゼロか無関係な結果(政治ニュースなど)しか返らなかった——Lemmyでは中国製動画生成モデル(Kling、Wan系)やStability AI単体の話題はほぼゼロ。動画モデルの話題は「MiniMax H3」というモデル名経由でComfyUI開発コミュニティにしか出てこなかった。
  • !ai_redditはr/ArtificialIntelligenceの自動転載botで、実質Reddit発のニュースがLemmy上に又出しされているだけ。Lemmyオリジナルの一次情報とは言えない点は差し引いて読んでほしい。
  • 完了基準にある「20件ほどの投稿を解析」は満たしたが(本レポートに挙げた約20件に加え、重複・無関係だった検索結果も多数確認した)、Lemmy全体の投稿母数がReddit/Xに比べて桁違いに少ないため、質の高い一次情報という意味では他プラットフォームより手薄。

Pinterest

Pinterest — Image and Video Generation AI News

収集済みの50件のピン(output/pinterest.pins.md / images/pinterest/manifest.json、ジャンル分けなし・単一クエリ「Image and Video Generation AI News」)のうち30件の画像を実際に開いて確認した。以下はその内容に基づく。

Visual themes
  • クリックベイト風「AIニュース」サムネイル: 驚いた顔のヒゲ男性+ネオンのツールロゴ([11])、爆発背景+Sam Altman風の笑顔([19])、半分ロボットの男性ニュースキャスター+「B」マイク([44])など、YouTube動画のサムネイルそのままの構図が多い。実際の記事本文へのリンクではなく、YouTube動画へのピン留めが大半。
  • クローズドソース製品の「best of」ランキング系インフォグラフィック: Runway・Pika・Kling AI・Luma(Dream Machine)・Canva・Hailuo AI・HeyGen・Synthesia・InVideo・Sora・Google Veoを並べたネオン枠のリストが繰り返し登場 [9, 27, 33]。ChatGPT/Nano Banana/Ideogram/GenTube/Z-Imageを並べた画像生成版の同型リストもある [36]。
  • AIロボット/アナウンサーのペルソナ表現: 白いシェルのロボットがニュースデスクに座る([32])、女性アンカー風の合成映像([38, 49])、ロボットと看護師/人間が並ぶメディカルシーン([50])など、ツール自体のスクリーンショットよりも「AIが人間の役割(記者・医師)を代行する」比喩イラストが目立つ。
  • ディープフェイク/真贋への不安を煽る画像: 猫の写真に「FAKE」スタンプ+いいね数([3])、山の写真2枚を比べる「Which is AI?」クイズ([10])、音声波形+「97% likely AI generated」の検出器([25の内側の一枚と同系統、35])など、生成そのものより検出・懐疑がテーマの一角がある。
  • 無機質なストック調AIビジュアル: 紫〜青のネオン、脳の輪郭、回路基板、粒子エフェクトを背景にした見出しテキストのみの汎用画像([2, 4, 5, 15, 20, 30])。具体的な製品名やスクリーンショットを伴わない「AIっぽい絵」の埋め草として使われている。
  • image-to-video のビフォーアフター実演グリッド: 1枚の元写真/動画を複数のスタイル(LEGO風、折り紙、花で覆われた人物、玩具の車)に変換した比較グリッド([7])、1枚の写真から5コマのタイムラインを生成する図解([1, 6])など、「1枚→動画」という機能そのものを可視化したピンがある。
  • 実在する製品名は挙がるが、ほぼ全てクローズドソース: Veo 2/3([13, 24])、VASA-1(Microsoft Research、[41])、Grok([32])、Sora・ChatGPT・Nano Banana([36])など固有名詞は多いが、実際にオープンソースと確認できるモデル名・リポジトリ名は今回見た30件の中には一つも現れなかった。
  • 「AIパイプライン化」を訴えるインフォグラフィック: 1本のバイラル動画リンクから「Scout→Script→Generate→Animate」の4エージェントで自動的にvlogを作る、という自動化フローの図解([47])。動画生成が単体ツールから自動化ワークフローへ寄っていく方向性を示す一枚。
Notable pins
  • [1] Image to Video AI: How It Works and Why It Matters — 1枚の静止画からモーション強度・時間的一貫性・視覚コントロールのスライダーを経て動画タイムラインが生成される様子を図解した、技術説明として最も具体的なピン。
  • [7] (untitled、LEGO/origami/flowers変換グリッド) — 元動画(人物・パンダのぬいぐるみ・Tesla)を「木のブロック」「折り紙」「LEGO」「花」に変換した3x5のビフォーアフターグリッド。実際の生成結果が見える数少ない実演例。
  • [9] 10 FREE AI VIDEO TOOLS IN 2026 — Pictory・Runway ML・Veed.io・Synthesia・InVideo・Kling AI・D-ID・Lumen5・Canva・Hyperwriteの無料AI動画ツール10選。クローズドソース各社の無料プランの現状を一望できる。
  • [24] (untitled、紫のモンスターキャラのimage-to-video) — 1枚の入力画像から「サーバールーム」「水中遺跡」「キャンディの街」など全く異なる背景に置いた3種の出力動画を並べたデモ。タイトルはVeo 3関連。
  • [27] 5+ Best AI Video Generation Websites — Runway/Pika/Kling AI/Luma/Canva/Hailuoの比較に加え、末尾で「YouTube Shorts・TikTok・Pinterest動画ピン・商品紹介動画」向けと明記しており、Pinterest自体がAI動画の配信先として想定されていることがわかる。
  • [36] Top AI Image Generation Tools — ChatGPT、Nano Banana、GenTube、Ideogram、Z-Imageという、2026年時点での画像生成ツールの並び。Nano BananaやZ-Imageのような新しめの名前がPinterestのSEO記事にも浸透している。
  • [39] The Latest AI Developments(Breaking News風3本立て) — ①ニューオーリンズの911にAIが一次応答、②MetaがオフラインエージェントモデルMuse Glimmerを無料公開、③北朝鮮Kimsukyが自前AIスタックでフィッシング文書を自動生成、という3つの具体的ニュースをまとめた唯一、固有の事件・組織名を伴う「ニュース」らしいピン。
  • [41] Microsoft Unveils VASA-1 — 1枚の画像+音声クリップ(+任意の表情制御信号)から複数人物のリアルタイム会話顔アニメーションを生成するMicrosoft Researchの技術デモ図。研究発表由来の数少ない一枚。
  • [16] AI Image Video: Best Quality vs Best Free — ChatGPT Plus・Gemini Advanced・Midjourney・Adobe Firefly・Recraft・Runway Gen-3・Luma・Pika Pro・Kaiber・SynthesiaとIdeogram・Gemini(Free)・SeaArt・Playground・Krea・Canva・Inkscape・CapCut等を「有料高品質」vs「無料」で対比した意思決定ガイド。ユーザーの選定基準(テキストの可読性、GPU有無、SVG編集要否など)まで踏み込んでいる。
  • [47] AI video creation just got crazy — 「Scout→Script→Generate→Animate」の4エージェントでバイラル動画リンクから完成vlogを自動生成、という単発ツールを超えた自動化パイプラインの提案。
Signals
  • Pinterest上の「Image and Video Generation AI」領域は、速報ニュースではなくSEO/アフィリエイト目的のツール比較・ハウツー系インフォグラフィックが主流。実際の一次情報(公式発表、研究論文、SNS投稿)への直接リンクはほぼ見当たらず、多くがブログやYouTube動画への誘導ピン。
  • 具体的ニュース事件として拾えたのは[39]の3本(911応答AI、Meta Muse Glimmer、北朝鮮Kimsuky)と、Veo 2/3・VASA-1・Grokの製品発表に触れたピンのみ。20件規模で「最新ニュース」と呼べる一次情報は限定的だった。
  • クローズドソースの存在感が圧倒的で、Runway・Pika・Kling AI・Luma・Canva・Hailuo・HeyGen・Synthesia・Sora・Veo・ChatGPT/Nano Banana・Ideogramが繰り返し登場する。一方でオープンソースのモデル名・プロジェクト名は今回確認した中では皆無(Stable Diffusion系、ComfyUI、Open-Sora等の言及なし)。オープンソース動向を語るにはPinterestは情報源として薄い。
  • 「AIが人間の役割を代行する」(ニュースキャスター、看護師、911オペレーター)というイメージと、「生成物の真贋を疑う」(FAKEスタンプ、Which is AI?、AI検出器)というイメージが対になって多数存在し、生成技術そのものより社会的インパクト・信頼性への不安を主題にした画像が一定数を占める。
  • 動画生成の使われ方として「1枚の写真をアニメ化する」「既存動画のスタイルを変換する(LEGO化、折り紙化)」という変換系ユースケースの実演が目立ち、フルスクラッチのtext-to-videoよりも画像/動画からの変換が訴求ポイントになっている。
Limits
  • ワーカーが事前に収集した50件はジャンル分けされておらず(genreフィールドは全件空欄)、単一クエリの検索結果であるため、クローズドソース/オープンソースという2軸で意図的に検索し分けたものではない。
  • 時間の都合で50件中30件のみ画像を実際に開いて確認した(未確認: インデックス14, 15, 18, 21, 22, 26, 28, 29, 31, 37, 40, 42, 43, 45, 48 ほか)。未確認分のタイトルはpinterest.pins.mdに記載の通りで、リップシンクツール比較、動画編集ツール比較、AIコンテンツ検知系など既出テーマと重なるタイトルが多く、上記の傾向を覆すような別ジャンルの兆候は見られなかった。
  • Pinterest自体を自分でブラウズしておらず、プレイブックの指示通りワーカー収集済みの画像とタイトルのみから判断している。ピンの投稿日時やエンゲージメント数(いいね/保存数)はmanifest/pinsテーブルに含まれておらず、「いつの情報か」「どれだけ拡散したか」は判定できない。
  • オープンソースの動きについてPinterest上で有意な言及が見つからなかったため、後続の統合レポートで「オープンソース動向」を書く際はPinterestを根拠にできない旨を明記する必要がある。

推奨アクション

  • GPT-6 Astraのエージェント型ビジュアル生成(Blender操作、3D都市生成)を専用の追跡テーマとして次回以降も継続観測する。
  • オープンソースの発表を漏らさず拾うため、次回はプラットフォーム横断で"FLUX" "Stable Diffusion" "Qwen-Image" "Wan" "ComfyUI"など固有名詞での検索語を追加する。
  • Bluesky調査は検索APIの403が続く前提で、監視対象アカウントのリストを事前に拡充しておく。
  • Pinterestは投稿日時・エンゲージメント数が取得できないため、鮮度が必要な速報比較には使わずツール認知度の定点観測用途に限定する。
  • Midjourneyの医療機器路線変更騒動は真偽・実態が未確定なため、一次ソース(Midjourney公式発表)が出るまで断定的な引用を避ける。
  • Lemmyの!stable_diffusionとYouTubeの検証系チャンネルは、オープンソース動向を追う際の主軸ソースとして優先的に確認する。

収集画像

Image to Video AI: How It Works and Why It Matters - The Data Scientist🎨 AI Image and Video CreationAI content and social media concernsAi Content Creation Concept With Icons For Text Image Music And Video Generation Artificial Intelligence Images – Browse 57 Stock Photos, Vectors, and VideoThe Ultimate AI Image and Video Generation Platform - The Data Scientist️ Image to Video AI – Animate Your Photos With AIGoogle announces ultra-high quality video...Just Nail It 🎥🎬 10 FREE AI VIDEO TOOLS IN 2026 🤯 Create Videos Without Expensive Software!imageAI News: OpenAI Finally Released What We Asked ForVeo 3 Image-to-Video: Fast Generation & Native Audio via Gemini APIGoogle Unveils Veo 2: Advanced AI Video Generation Tool with Enhanced Realism and Cinematic FeaturesimageArtificial intelligence: let’s maintain our...AI For Image And video GenerationTop 10 Lip Sync Tools (2026) – Best AI Lip Sync Software for Realistic Lip Sync VideoTop AI Video Generators of 2025GPT 5.2, realtime video editor, AI stereo videos, mobile AI agents, full body control: AI NEWSimageHow AI Is Transforming Video EditingWhy AI Video Generation Is Becoming Essential for...More than 20% of YouTube is now AI-generatedGoogle announces video generation AI 'Veo 3',...‎🚨 AI is getting scary good.image5+ Best AI Video Generation Websites 2026 | Runway, Pika, Kling AI, Canva & MoreAI Tools for Video Editing — What Creators Actually Use to Make Content in 2026imageArtificial Intelligence: A Tool to Free the...AI driven image and video analysisDiscover how Grok is revolutionizing video...12 Best AI Video Generators in 2026 (Free & Paid) | Google Veo, Sora, Runway & MorePaul Lafargue of the IDEC Group: The impact of...How To Detect AI-Generated Images Online For Freeimage generation Ai tools 🔥🔥What is Imagvio AI and how it helps creators...TotalYmage revolutionizes interactive videos...The Latest AI Developments - AI Picks Up 911 Line Meta Offline Modelai toolsMicrosoft Unveils VASA-1, Setting New Standards for Generative AI in Video GenerationFuture of Video Creation: Best AI Video Generators of 2026🔸AI-Generated Videos: Good or Bad? Here's the Truth! 🤖🎥The Snarky AI News RoundUp #8I will do ai video creation explainer with synthesia sora ai kling ai runway ai invideoLe guide ultime pour exploiter Chat GPT en tant...AI Video Creating just got crazy.What Is Generative AI? Complete Technical Guide - RCN GuideHow To Create A News Channel With AI || AI News Video Generator || AI Lip SyncAi

データ品質メモ

Blueskyは検索APIが終始403で完了基準の20件に届かず、Pinterestは投稿日時・エンゲージメント数が取得不能で鮮度判定ができなかった。Reddit・Xは単一検索語のためクローズド対オープンを意図的に対比できておらず、オープンソースの話題がLemmyとYouTubeに偏って集まっている。

ギャラリー