Image and Video Generation AI News — 2026-09-07
クローズドソースはSora2のAPI終了(2026/9/24)とGPT-6 Astraの汎用エージェント化が主役交代を告げる一方、オープンソースはComfyUI/MiniMax-H3/Qwen-Image-Editのエコシステムが毎日拡大してコンシューマーGPUでも実用域に達している。
画像・動画生成AI最新ニュース — 2026年9月7日
いやーマジでヤバい週だったわ🔥🔥 クローズドソース側はOpenAIの「GPT-6 Astra」が単なる画像・動画生成じゃなくて「他のツールを操りまくるエージェント」として爆速で評価上がってて、逆に王者だった「Sora 2」はまさかのサービス終了ロード突入中(Web/アプリは2026/4/26終了、APIも今月2026/9/24で完全終了予定)😱 一方オープンソース勢は地味だけど激熱で、ComfyUI周りの「MiniMax-H3」「Qwen-Image-Edit」エコシステムが毎日のように新パーツ生えてきてて、コンシューマー向けGPU(AMDでもOK)でもがっつり動画生成できる時代に来てる🛠️✨ あと全プラットフォーム共通で言えるのが「AI生成物ってバレたらもう叩かれる」って空気で、真正性ラベリング要求とか反AIの声がいいね数トップを独占してるのがマジで意外だったわ。
Across platforms 🌐
- GPT-6 Astraが"生成AI"じゃなくて"操縦AI"として評価されてる:X(@Yokohara_h、2,156いいね、https://x.com/Yokohara_h/status/2096622171011666003)でもYouTube(まさおAI じっくり解説ch、https://www.youtube.com/watch?v=_pAAaBv_G7A)でも、ComputerUseで他アプリ(Blender等)を操作して3DCGパイプラインを自動化する話でめっちゃ盛り上がってる。両プラットフォームで論調が完全一致してるの、ガチで熱い🔥
- Sora 2の終わりの始まり:YouTube(https://www.youtube.com/watch?v=DSfAZdE5rWA)でAPI終了2026/9/24(つまり今日から3週間後!)が解説されてて、Bluesky(https://bsky.app/profile/coah80.com/post/3muulvyomz72c)でも「SORA 2 WAS GENUINELY SO BAD」って酷評ポストが見つかった。もう擁護する声、どこにもなかったわ😢
- ComfyUI/MiniMax-H3系エコシステムがオープンソースの主戦場:Lemmyの[email protected](https://lemmy.dbzer0.com/post/75036488 など)で毎日3〜9件ペースで新ノード・LoRAが投下されてて、Reddit(VPIPEでApple Silicon M5 Proが1024px・8ステップ約45秒、https://www.reddit.com/r/StableDiffusion/comments/1w6bphf/)やBluesky(「local software like ComfyUIの方が機能多い」https://bsky.app/profile/ecutruin.bsky.social/post/3muv2pwq55s2t)でも同じ流れが裏付けられてる。
- AI生成=叩かれる空気が最大のエンゲージメント源:Reddit r/antiaiの偽タイムラプス告発スレ(6,792pt・994コメント、https://www.reddit.com/r/antiai/comments/1w81kdd/)と、Blueskyのいいね数トップ2投稿(生成AI批判121・100いいね、https://bsky.app/profile/samperson.bsky.social/post/3muruvekma22b)が示す通り、ツール紹介系より「これヤバくない?」系の批判投稿の方がバズる傾向がガチで顕著だった。
Platform by platform 📱
Reddit:r/StableDiffusionのローカル生成ベンチマーク投稿や、r/freetoolsAIでの無料ツール一覧(Deepany・Aifun・Perchanceなど)がオープンソース寄りの実用情報として強い一方、r/aiwarsではクローズドソース商用AI画像(食品広告向け)のクオリティが叩かれてた(177コメント、https://www.reddit.com/r/aiwars/comments/1w69cdj/)。検索語1つだけだったから収集は12スレッドどまりで、目標の20件には届かなかったわ。
X:40投稿集めたけどテーマに関係あったのはたった4件😅(残りは全部サッカーとか政治とかクロアチアのトレンドノイズ)。でもその4件が全部GPT-6 Astraをがっつり褒めてて、しかもオープンソースへの言及はゼロ本。クローズドソース一色だった。
YouTube:情報量が一番豊富だったステージ。クローズドソースはSora2終了とGPT-6 Astra、Midjourney V7アプデ(日本語音声入力対応、https://www.youtube.com/watch?v=wFHlG7wcRUQ)、Google Nano Banana 2(https://www.youtube.com/watch?v=nikIxHM_AQY)。オープンソースはFlux.2(Apache 2.0のDev/Klein、https://www.youtube.com/watch?v=ISRy5Skd04U)とQwen-Image-Edit-2511(ComfyUIチュートリアル多数、https://www.youtube.com/watch?v=ScoIZYsoRwo)が主役で、AMDのコンシューマーGPUでWan2.2やHunyuan1.5を動かす検証(https://www.youtube.com/watch?v=a_xzC7ckwno)もあった。
Bluesky:ツール使う個人勢と反AI勢の二極構造。クローズドソースはNano Banana(Gemini 3.1)+Kling 3.0の組み合わせワークフローが人気(https://bsky.app/profile/drewkav.bsky.social/post/3muubykpdfk2k)で、xAIのGrok Imagine新モデル告知はいいね0件と空振り。オープンソースはComfyUIへの好意的な声とStable Diffusion WebUI reForge(AMD ROCm)勢がいた。API制限(403連発)で目標20件に対し実質11件どまり。
Lemmy:オープンソース側の熱量が圧倒的で、[email protected]だけで11件のツール投稿(Viggle-Animate、Trellis.2+Pixal3DのComfyUIネイティブ統合など)。クローズドソースは唯一まとまった話題が「Midjourneyが画像生成事業から医療用超音波スキャン事業に転換」というニュース(score最大73、https://techcrunch.com/2026/07/04/midjourney-wants-hollywood)で、複数インスタンスで転載されてた。SoraやVeoそのもののニュースはLemmyでは1件も見つからなかったのが逆に発見だったわ。
Pinterest:ワーカー事前収集の50ピン全部見たけど、こっちはクローズドソース商用ツール(Veo、Sora、Runway、Kling、Pika、Adobe Fireflyなど)のランキング系インフォグラフィックがほぼ独占。オープンソースへの言及はローカル実行を訴求する「Amuse 3.0」くらいでほぼ皆無だった。ディープフェイク不安・検出系コンテンツが独立ジャンル化してたのも印象的。
What to watch 👀
- Sora 2のAPI終了(2026/9/24) — 移行先探しがどう転ぶか。YouTube「AI収益化ラボ」https://www.youtube.com/watch?v=YHPmaUb_X6c
- GPT-6 AstraのComputerUse/3DCGパイプライン自動化 — 生成AIというより制作ハブ化の行方。X https://x.com/Yokohara_h/status/2096622171011666003
- MiniMax-H3系エコシステムの拡大速度 — Viggle-AnimateやH3-Worldなど毎日新パーツ登場中。Lemmy https://lemmy.dbzer0.com/post/75036488
- AI生成物の真正性ラベリング議論 — 偽タイムラプス告発から法規制圧力に発展するか。Reddit https://www.reddit.com/r/antiai/comments/1w81kdd/
- Midjourneyの事業転換(画像生成→医療機器) — クローズドソース企業のビジネスモデル変化の前触れかも。Lemmy https://techcrunch.com/2026/07/04/midjourney-wants-hollywood
- Qwen-Image-Edit×ComfyUIの普及度 — クローズドソース編集ツールに匹敵する性能という評価の広がり方。YouTube https://www.youtube.com/watch?v=WOcxMUwKWIk
Recommendations 💡
- Sora2依存のワークフローがあるなら、API終了(2026/9/24)前にKling 3.0かVeo 3.1への移行計画を今すぐ立てるべし。
- GPT-6 AstraのComputerUse機能を、単体の生成AIじゃなく制作パイプライン自動化ツールとして評価する軸で追いかけるべし。
- コスト削減したいならQwen-Image-Edit+ComfyUIのローカル編集を試してから、クローズドソース課金を決めるのがコスパ良さそう。
- 偽タイムラプスやAI加工の炎上リスクに備えて、公開コンテンツのAI利用開示ルールを社内で先に決めておくべし。
- Nano Banana(静止画)+Kling 3.0(動画化)の分業ワークフローは複数の独立クリエイターが評価済みなので試す価値あり。
- Midjourneyの事業転換ニュースは継続ウォッチして、他のクローズドソース企業でも似た多角化が起きるか確認すべし。
Data quality 📊
どのプラットフォームもbrief.mdの完了基準(各SNS約20件解析)にはちょっと届かなかったわ😅 特にXは40投稿集めても関連は4件のみ(検索語がクロアチア地域のトレンドから取られてて、サッカー・政治ノイズだらけだった)。Blueskyも公開APIの403レート制限で試した検索語の半分近くが空振りになり、実質11件どまり。Redditは検索語1つだけだったせいで12スレッド、Lemmyはオープンソース11件+クローズドソース4件の計15件で、専門ニュースコミュニティ自体が存在しないのが原因。YouTubeはプレイブック基準(5〜12件)で11件集めて完了扱いにした一方、再生回数などのメタデータはJS描画の壁で取得できてない。Pinterestだけはワーカー事前収集の50件を全部見れたけど、単一クエリだったせいでオープンソース関連ピンがほぼ見つからなかった。総じて、件数は目標未達でも6プラットフォームが独立にGPT-6 AstraやSora2終了、ComfyUIエコシステム拡大という同じ方向の話を裏付けてるので、大きな流れの把握としては十分信頼できる内容になってるはず🙆
プラットフォーム別まとめ
Reddit — Image and Video Generation AI News
どこで
検索語「Image and Video Generation AI News」で収集された12スレッド、11のサブレディット。
| サブレディット | メンバー数 | 収集スレッド数 |
|---|---|---|
| r/antiai | 316,504 | 1 |
| r/generativeAI | 151,065 | 2 |
| r/freetoolsAI | 7,817 | 1 |
| r/StableDiffusion | 1,001,556 | 1 |
| r/teenagers | 3,675,063 | 1 |
| r/aiwars | 166,920 | 1 |
| r/RemoteWorkers | 74,882 | 1 |
| r/aislop | 82,721 | 1 |
| r/TopAITools4U | 2,396 | 1 |
| r/GoogleFlow | 1,750 | 1 |
| r/EyesWideShut | 15,320 | 1 |
サブレディットの顔ぶれを見ると、AI生成そのものを扱う専門コミュニティ(r/StableDiffusion, r/generativeAI, r/GoogleFlow, r/TopAITools4U, r/freetoolsAI)と、AI画像に反対・批判的なコミュニティ(r/antiai, r/aiwars, r/aislop, r/EyesWideShut, r/teenagers)がほぼ半々で並んでいる。r/RemoteWorkersは求人告知の文脈での言及。
人々の声
-
スレッド#1 r/antiai・6,792pt・994コメント・2026-09-05 — 「Warning: There is a new form of ai generated image」。拡散モデルではなくLLM(GPT-6と記載)にマウス・キーボードを操作させて手描き風のタイムラプスごと"本物のイラスト"を偽装できるという投稿が994コメントと大きく伸びた。トップコメント(2,483pt、u/Nayutantantan):「Even though i stopped using social media, stopped being an artist online... now the trends of creating fake timelapses are getting common.」— 「ラベリングを今すぐ義務化すべき」という声(u/Soggy_Supermarket100, 170pt)も強く支持されている。
-
スレッド#5 r/teenagers・7pt・41コメント・2026-08-31 — 「To all AI image/video generator users」。「AIは君のアイデアを実行しているだけで、実際に描いているのはAI自身だ」という論旨。u/LiterallyGarbage_0(5pt):「if you want to make art, pick up a pencil and start drawing」。一方でu/TheDarkmoore(2pt)は「カードゲームのアートにAIを使った、絵が下手な自分には必要な選択だった」と実利面から擁護し、世代内でも割れている。
-
スレッド#6 r/aiwars・4pt・177コメント・2026-09-03 — 「Even a lot of Pros here will admit that current AI models suck at generating appetizing images of food」。177コメントと突出して議論が伸びた。u/Your-local-enjoyer(9pt):「実際の写真を撮った方が客に正確な期待値を与えられる」。反証としてu/Bassed_Hummble(5pt)はローカルのKrea 2で40秒生成した具体的プロンプトを提示し「食欲をそそる朝食ブリトー」を作れたと反論、モデルではなくプロンプトの問題という見方も出ている。
-
スレッド#4 r/StableDiffusion・31pt・10コメント・2026-09-03 — 「VPIPE: Not Just Video — Local Image Generation Is Fast Too」。Apple Silicon(M5 Pro 24GB)上でkrea/Krea-2-Turbo-M87(16bit)+M87 LoRAを使い、1024×1024・8ステップで約45秒/枚(8bit量子化リアルタイムなら35秒)というローカル生成の実測値。u/Glittering-Call8746(1pt)はM5 MaxとM5 Proの速度差やRTX 5000シリーズとの比較を検討中とコメント。
-
スレッド#11 r/GoogleFlow・12pt・6コメント・2026-09-01 — 「AutoFlow just got continuous AI video generation」。Google Flow/Veo向けの非公式Chrome拡張「AutoFlow」が「Continue from Last Frame」機能を追加、前クリップの最終フレームを次クリップの先頭フレームに自動流用して長尺動画を作りやすくした。次は複数クリップをシームレスに1本へレンダリングする機能を予定。
-
スレッド#10 r/TopAITools4U・1pt・10コメント・2026-09-01 — 「Tested 4 best AI video generators in 2026 for beginners」。投稿者がSora 2(映画的だが価格・アクセスがネック)、Kling AI(リアルなB-roll向き)、DomoAI(アニメ・スタイル変換向き)、Google Veo 3.1(映像+音声を同時生成、無料枠あり)を比較。コメントでu/brarkaddy(2pt)はQwenの無料動画生成も追加候補として挙げている。
-
スレッド#3 r/freetoolsAI・38pt・45コメント・2026-09-04 — 「Free AI Image Generator」。無料・無制限・サインアップ不要をうたうaifreeforever.comの紹介に対し、u/Odd-Lingonberry1516(3pt)がDeepany(z-image turbo/illustrious系)、Aifun(wai illustrious、動画も1日2回無料)、Perchance(Stable Diffusion/flux系)を代替として列挙。u/Relevant_Syllabub895(2pt)はNSFW規制への不満をコメント。
-
スレッド#2 r/generativeAI・43pt・29コメント・2026-08-31 — 「List of daily AI video generative websites」。u/Jenna_AI(4pt、AI bot)がKling AIの「24時間ごとに66クレジット無料、5秒動画換算で1日2〜6本」という具体的な無料枠を提示。u/Julia_Leeds94(2pt)はYalleryLabsが3ドル分の予算で5秒動画720pが0.18ドル/本と紹介。
-
スレッド#12 r/EyesWideShut・35pt・9コメント・2026-09-06 — 「AI generated images shouldn't be allowed here」。キューブリック映画のスクリーンショットをAIで加工した投稿を巡り、投稿者が「誤情報の拡散だ」と非難。加工した本人u/ffcc01(2pt)は「2枚の写真を重ねただけで内容の改変はしていない」と反論し、AI加工の許容範囲についてコミュニティ内で見解が対立している。
-
スレッド#8 r/RemoteWorkers・130pt・623コメント・2026-09-04 — 「Get Paid $30/Hour Reviewing AI-Generated Images」。AI生成キャプションのファクトチェック(誤認識オブジェクト・色・テキストの検出)を時給30ドルで募集する求人告知。623件と突出したコメント数だが、内容の大半は応募リンク欲しさの「images」という一言コメントの連投で、実質的な議論は起きていない。
-
スレッド#9 r/aislop・37pt・4コメント・2026-09-06 — 「Saw this on a news article, an AI slop image explaining what is AI slop」。ニュース記事に載った「AIスロップとは何か」を説明するAI生成画像そのものが自己言及的なネタとして拾われた。コメントは4件のみで深掘りはされていない。
シグナル
- 上昇傾向:ローカル・オープンソース生成の実装報告(スレッド#4のVPIPE/Krea 2)が具体的なベンチマーク(秒数・ステップ数・ハードウェア)付きで好意的に受け止められている。r/StableDiffusionでは速度と品質の両立が評価軸になっている。
- 上昇傾向:AI生成物の真正性ラベリングを求める声(スレッド#1)が994コメント規模で強く支持され、「タイムラプス偽装」という新しい懸念点が具体的に名指しされた。
- 軽視・冷笑されている:クローズドソースの商用AI画像(特に食品広告向け)はr/aiwars内でも擁護しにくいクオリティとして扱われ(スレッド#6)、177コメントの議論はほぼ一方的に批判寄り。
- 意外だった点:多くのスレッドで実質的な議論を担っていたのはAIボット(u/Jenna_AIがスレッド#2, #7の両方に登場)であり、人間同士の深い議論より「無料枠の一覧化」といった実用情報が主な価値になっている。
- 対立:スレッド#12(EyesWideShut)では「AI加工=改変・誤情報」派と「単純な合成で内容は変えていない」派が同一スレッド内で真っ向から対立しており、AI加工の許容ラインについて明確なコンセンサスがないことがわかる。
- 意外だった点:スレッド#8は623コメントと今回最大のエンゲージメントだったが、内容のほとんどは求人リンク欲しさの単語連投で、コメント数の多さが議論の深さを意味しない典型例だった。
Limits
- 検索語は「Image and Video Generation AI News」の1語のみで、"open source image generation"や"closed source video AI"、個別サービス名(Midjourney, Sora, Kling等)を使った追加検索は行われていない。そのためデータは汎用検索語にヒットした話題に偏っている。
- brief.mdの完了基準(各SNSで約20件のスレッドを解析)に対し、収集できたのは12スレッドにとどまり、目標件数に届いていない。
- スレッド#7・#9はコメントがそれぞれ1件・4件と極端に少なく、ボット応答(u/Jenna_AI)のみのケースもあり、深掘りできる材料が乏しかった。
- 収集期間は2026-08-31〜2026-09-06のおよそ1週間分のみで、それ以前のトレンドとの比較はできない。
- クローズドソース/オープンソースという軸で明確に分類できるスレッドは限られており(クローズドソース寄り:#6, #10, #11/オープンソース寄り:#3, #4)、10件ずつという最終レポートの気づき数を満たすには他プラットフォームのデータで補う必要がある。
X
X — Image and Video Generation AI News
アカウント
収集された40投稿・37アカウントのうち、テーマ(画像・動画生成AI)に実際に関係していたのは以下の4アカウントのみ。いずれも1投稿だけの個人アカウントで、フォロワー基盤の大きい「バズ職人」ではなく、実際にツールを触った一次体験の共有者。
| アカウント | 名前 | 投稿数 | いいね | 属性 |
|---|---|---|---|---|
| @aigeboku | AI様の下僕 | 1 | 1,281 | GPT-6 AstraのComputerUse活用を試す個人 |
| @MiraMusic_AI | MiraMusic | 1 | 525 | AIアニメ制作を発信するアカウント |
| @manaimovie | Mankyu | 1 | 562 | 3Dモデル×AI動画の個人クリエイター |
| @Yokohara_h | Hirokazu Yokohara | 1 | 2,156 | 4アカウント中最大の反応、技術系個人 |
残り33アカウント(@kaihavertz29の96,184いいねを筆頭に、サッカー・F1・ドイツ政治・ビットコイン・ボスニア関連の個人アカウント群)はテーマと無関係。詳細は下の「Limits」参照。
投稿
-
#29 @aigeboku(2026-09-05・1,281いいね・135リポスト・14リプライ・約94,000view)https://x.com/aigeboku/status/2096187322924687799 — 「GPT-6 Astraは『他を操る能力が高い』という通り、ComputerUse使えば色々とやれることが広がりますなあ😎🙌」。GPT-6 Astraを画像・動画生成そのものというより、他アプリを操作する基盤として評価するコメント。
-
#30 @MiraMusic_AI(2026-09-06・525いいね・50リポスト・6リプライ・約26,000view)https://x.com/MiraMusic_AI/status/2096441679847006358 — 「【AIアニメ制作共有①】GPT-6 Astraとblenderで街を作ってみた!15分で作った動画なので分かりにくいですが…」。GPT-6 AstraをBlenderと組み合わせた背景美術制作の実例。
-
#31 @manaimovie(2026-09-05・562いいね・61リポスト・19リプライ・約35,000view)https://x.com/manaimovie/status/2096176821377380677 — 「Astra先生にTripoで作ったモデルを渡して、動くようにして言ったらできたものです。まだ気になる点は多いけど、FableやSolのときよりかなりいい!」。他の類似ツール「Fable」「Sol」と名指しで比較し、Astraの優位を評価。
-
#32 @Yokohara_h(2026-09-06・2,156いいね・299リポスト・19リプライ・約178,000view、この4件で最大の反応)https://x.com/Yokohara_h/status/2096622171011666003 — 「画像渡してBlenderで背景の街並みを自動でモデリングしブレイクダウンも自動で編集 完成度はまだまだ駄目だけど今までとは違い3DCGを人の手で作らない時代の始まりは感じた」。品質はまだ発展途上としつつも「人の手を離れた3DCG制作」という時代の転換を評価。
この4件以外、収集した40投稿の中に画像・動画生成AI(クローズドソース/オープンソースいずれも)に触れた投稿はなかった。
シグナル
- 上昇傾向:GPT-6 Astra(クローズドソース)が「他のツールを操作する」役割(ComputerUse、Blender連携)として注目されている。単体の画像・動画生成モデルというより、3DCG制作パイプライン全体を自動化するハブとして語られているのが特徴(#29, #30, #32)。
- 意外だった点:4件全員が「完成度はまだ粗い」「気になる点は多い」と留保をつけながらも肯定的に評価しており、過度な期待と冷静な品質評価が同居している(#31, #32)。
- 軽視・言及なし:オープンソース系の画像・動画生成AI(Stable Diffusion系、Krea、Kling、Veoなど)への言及はこの収集内に一件もなかった。X上でのテーマ関連の声はクローズドソース(GPT-6 Astra)に完全に偏っている。
- 比較対象として名前が挙がったツール:「Fable」「Sol」(#31)。いずれも詳細は投稿内で説明されておらず、追加調査が必要。
- エンゲージメント規模はテーマに無関係なトレンド(サッカー: 最大96,184いいね、政治: 10,062いいね等)と比べると小さく(最大でも2,156いいね)、X上では現時点でこのテーマがバズっているとは言えない。
Limits
- 検索語がテーマとズレていた:今回の検索語(Arsenal, Kimi, Charles, Chelsea, Harvey, Germany, $SONG, Astra, Bitcoin, Bosnia)はX Exploreのトレンド一覧からそのまま取られたもので、「Astra」以外はサッカー(Arsenal, Chelsea)、F1(Kimi, Charles)、人名・誕生日ネタ(Harvey)、ドイツ政治(Germany)、仮想通貨($SONG, Bitcoin)、ボスニア関連の雑談(Bosnia)であり、画像・動画生成AIとは無関係だった。40投稿中36投稿がテーマ外のノイズで、実質的な手がかりは「Astra」で見つかった4投稿のみ。
- 完了基準未達:brief.mdの完了基準(各SNSで約20件の投稿を解析)に対し、テーマに関連する投稿は4件しか収集できなかった。
- Exploreの地域性:「Where」列で「$SONG」「Bosnia」がともに"Trending in Croatia"と明記されており、このセッションのExploreはクロアチア(バルカン地域)からのアクセスとして地域化されている。したがってこのExploreトレンド一覧は世界の動向ではなく、その地域のトレンドである。また「Posts on X」の件数列はすべて空欄で、投稿数の指標はX側から取得できなかった。
- オープンソースの動きはX上で見つからなかった:この収集ではオープンソース画像・動画生成AIに関する投稿は一件も見つかっていない。他プラットフォーム(Reddit等)のデータで補う必要がある。
- テーマに関連する4投稿はすべて日本語圏のアカウントで、英語圏・中国語圏など他言語コミュニティでの反応は未収集。
YouTube
YouTube — Image and Video Generation AI News
Channels
| チャンネル | 系統 | 扱う内容 |
|---|---|---|
| AI大学【AI&ChatGPT最新情報】 | 日本語・解説系 | 最新AIモデルの解説動画(GPT-6 Astra ほか) |
| まさおAI じっくり解説ch | 日本語・解説系 | AIモデルの実機検証・レビュー |
| RKJ VIDEO【イケている動画を作りたいなら】 | 日本語・動画生成AI専門 | Sora/Veo/Klingなど動画生成AIの比較 |
| AI収益化ラボ | 日本語・マネタイズ系 | AIツールの収益化・サービス終了の影響解説 |
| StableDiffusion等 チュートリアル&自作アニメ | 日本語・元オープンソース専門 | 本来はStable Diffusion系チュートリアルだが、Sora2終了などクローズドソース系ニュースも扱い始めている |
| AIたろう | 日本語・解説系 | Midjourneyなど画像生成AIの機能解説 |
| Teacher's Tech | 英語・解説系 | Googleのツール・AI機能レビュー(登録者数中規模のテック系チャンネル) |
| OpenArt | 英語・公式寄り | Flux.2などモデルの提供先UIとしての紹介動画 |
| Donato Capitella | 英語・技術者系 | ローカルGPU(AMD含む)でのオープンソース画像・動画生成の検証 |
| ErrorFixer | 英語・チュートリアル系 | ComfyUIでのオープンソースモデル運用チュートリアル |
| AI Search | 英語・レビュー系 | 新しい画像・動画生成AIツールの速報レビュー |
チャンネル登録者数は各動画ページのJS描画部分にあり、youtube.com/watch・youtube.com/resultsをWebFetchしても取得できなかった(詳細は「Limits」)。ここでは検索結果のスニペットとoEmbed(タイトル・チャンネル名のみ返す軽量API)から確認できた範囲のみ記載。
Videos
-
「OpenAIの最新AIモデル『GPT-6 Astra』徹底解説!ほぼ全てのベンチマークでClaude Fable 5.1超え、史上最も賢く安全」 — AI大学【AI&ChatGPT最新情報】 — https://www.youtube.com/watch?v=jtavLwXCZeQ — GPT-6 Astra(2026/9/3公開)はほぼ全ベンチマークでClaude Fable 5.1を上回り、史上最も賢く安全なモデルだと主張。画像・動画生成そのものより、ブラウザ操作やコード生成を含む汎用エージェント性能を強調。
-
「【現環境最強】『GPT-6 Astra』を実際に使ってきた結果、最もAGIに近いモデルと感じたので解説」 — まさおAI じっくり解説ch — https://www.youtube.com/watch?v=_pAAaBv_G7A — 実際に触った上で「現状最もAGIに近い」と評価。ComputerUseによる他アプリ操作能力を高く評価する内容で、X上で見られたGPT-6 Astra評(本レポートのXステージ参照)と論調が一致。
-
「VEO 3.1とSORA2どっちがすごい?最新比較!」 — RKJ VIDEO【イケている動画を作りたいなら】 — https://www.youtube.com/watch?v=JuGPYl0V9UA — Veo 3.1(2025/10/15公開)とSora 2を機能・画質で比較。公開はSora 2ローンチ直後(2025年10月頃)で60日枠より前だが、後述のSora2終了報道の前提として位置づけて採録。
-
「Sora2完全終了…なぜ突然消えたのか?公式情報で徹底解説」 — StableDiffusion等 チュートリアル&自作アニメ — https://www.youtube.com/watch?v=DSfAZdE5rWA — Sora 2のWeb/アプリ提供が2026/4/26に終了、API提供も2026/9/24(本レポート作成日の3週間後)に終了する経緯を公式情報ベースで解説。理由として「AGI開発のための計算資源確保」を挙げる説を紹介。
-
「【サービス終了】世界一の動画生成AI『Sora2』が使えなくなったので解説します」 — AI収益化ラボ — https://www.youtube.com/watch?v=YHPmaUb_X6c — Sora2終了がコンテンツで収益化していたクリエイターに与える影響を解説。データエクスポート(sora.chatgpt.com/sunset)の案内や、Kling・Runway等API移行の必要性に言及。
-
「Midjourney がV7にアップデート!使い方から新機能まで完全解説します!日本語音声入力も可能に。」 — AIたろう — https://www.youtube.com/watch?v=wFHlG7wcRUQ — Midjourney V7の新機能(動画生成ツール、会話モード、日本語音声入力)を解説。画像生成の老舗がテキスト→動画機能を取り込みつつある動きを紹介。
-
「The New Gemini Image Generator is Insane (Nano Banana 2)」 — Teacher's Tech — https://www.youtube.com/watch?v=nikIxHM_AQY — GoogleのGemini画像生成機能「Nano Banana 2」を検証し、前世代から大幅進化と評価。クローズドソース画像生成の競争軸がMidjourney/IdeogramからGoogle Geminiにも広がっていることを示す一本。
-
「FLUX.2 Has Landed On OpenArt!」 — OpenArt — https://www.youtube.com/watch?v=ISRy5Skd04U — Black Forest LabsのFlux.2ファミリー(Pro/Flex/Dev/Klein、2025/11/25発表)がOpenArt上で使えるようになったと紹介。Dev/Klein系はApache 2.0のオープンウェイトで、10枚の参照画像・4MP編集に対応する点を強調。
-
「Video and Image Generation on AMD R9700 AI PRO (Qwen Image, Wan 2.2, Hunyuan 1.5)」 — Donato Capitella — https://www.youtube.com/watch?v=a_xzC7ckwno — Qwen Image・Wan 2.2・Hunyuan 1.5という3つのオープンソースモデルを、コンシューマー向けAMD GPU(R9700 AI PRO)上でまとめて動かす検証。オープンソース画像・動画生成がハイエンドNVIDIA機材前提から脱しつつあることを示す。
-
「Edit Any Image with Text in ComfyUI — Qwen Image Edit 2511 (Free Local Tutorial 2026)」 — ErrorFixer — https://www.youtube.com/watch?v=ScoIZYsoRwo — Alibabaのオープンウェイト画像編集モデルQwen-Image-Edit-2511(2025/12/26リリース)をComfyUIでローカル運用するチュートリアル。テキスト指示だけでの画像編集・マルチアングル生成を実演。
-
「This new AI image editor is a BEAST. Qwen Image Edit tutorial」 — AI Search — https://www.youtube.com/watch?v=WOcxMUwKWIk — 同じくQwen-Image-Edit(200億パラメータ、ネイティブControlNet対応)を検証し、クローズドソースの編集ツールに匹敵する性能と評価。
Signals
- クローズドソース最大の話題はGPT-6 Astra(2026/9/3公開):画像・動画生成モデル単体ではなく、ブラウザ/アプリ操作(ComputerUse)や動画編集タスクをこなす汎用エージェントとして紹介されている。これはXステージで観測した「GPT-6 AstraをBlender連携などの制作ハブとして評価する」傾向と一致しており、プラットフォームを跨いで同じ narrative が確認できた。
- Sora 2終了がクローズドソース動画生成の最大級のニュース:Web/アプリは2026/4/26に、APIも2026/9/24(今日から3週間後)に終了予定。複数チャンネルが「なぜ消えたか」「移行先はどこか」を扱っており、YouTube上での関心の中心はSora2の"新機能"ではなく"終了後どうするか"に移っている。
- Sora2の後継ポジションを争うのはKling:Kling 2.6(2025/12/3、音声同期対応)→Kling 3.0(2026/2/4、4K60fps・マルチショット)と急速に進化し、Sora2終了直後の乗り換え先として名指しされている。
- オープンソース画像編集の主役はいまQwen-Image-Edit:ComfyUI関連チュートリアルの投稿頻度が高く(シリーズ化しているチャンネルも複数)、Stable Diffusion単体の新規チュートリアルより存在感が大きい。Stable Diffusion系の検索ヒットは「インストール方法」「モデル一覧」といった定番ガイド止まりで、新モデルのニュース性は薄い。
- オープンソース動画生成は3系統に整理されつつある:Wan 2.2(Alibaba・Apache 2.0)/HunyuanVideo 1.5(Tencent)/LTX-2(Lightricks、2026/1/6、音声・映像同時生成に対応する初のオープンモデル、4K/50fps)。なお検索過程で「Wan 2.7のオープンウェイトが公開された」と謳うページを複数見つけたが、Wan-AIの公式HuggingFace/GitHubには存在せず、SEO目的のフェイク情報と判断(Wan公式のオープンウェイトは2.2が最新)。
- チャンネルの越境が起きている:本来Stable Diffusion系チュートリアルを扱っていた「StableDiffusion等 チュートリアル&自作アニメ」チャンネルが、クローズドソースのSora2終了ニュースも扱っており、視聴者層がオープン/クローズド両方に関心を持ち始めていることがうかがえる。
Limits
youtube.com/results(検索結果ページ)とyoutube.com/watch(動画ページ)はいずれもクライアントサイドJSで描画されており、WebFetchで取得すると footer のナビゲーションリンクしか返らず、タイトル・チャンネル名・再生回数・投稿日を直接読み取ることができなかった。そのため本レポートの動画発見はWebSearchのスニペットと、YouTube oEmbed API(タイトルとチャンネル名のみを返す軽量エンドポイント)の組み合わせに依存している。- 上記の制約により、各動画の正確な再生回数・投稿日はほとんど取得できなかった。捏造を避けるため、再生回数は本レポートに一切記載していない。投稿日はWebSearchのスニペットやモデルのリリース日(公開情報)から推定した範囲にとどまる。
- 「直近60日以内のアップロードを優先する」というプレイブックの指示に対し、上記の制約から厳密な絞り込みができていない。VEO3.1×SORA2比較動画のように、Sora 2ローンチ直後(2025年10月頃)に投稿され60日枠を超えているとみられる動画も、Sora2終了ニュースの前提として1本のみ採録した。
- brief.mdの完了基準(各SNSで約20件の投稿を解析)はYouTubeのプレイブックが定める基準(5〜12件の動画)とは形式が異なるため、本ステージはプレイブック側の基準に従って完了とした。
- コメント欄の内容はWebSearchのスニペットに現れた範囲でしか確認できておらず、トップコメントの精読・感情分析は行えていない。
- 中国語圏チャンネルは検索対象に含めなかった。Qwen(Alibaba)・Kling(Kuaishou)はいずれも中国発のモデルであり、中国語コミュニティでの反応は本レポートに反映されていない。
Bluesky
Bluesky — Image and Video Generation AI News
アカウント
Bluesky公開API(https://api.bsky.app/xrpc/app.bsky.feed.searchPosts)で「Stable Diffusion」「Sora 2」「Midjourney」「Grok Imagine」「ComfyUI」「Veo 3」「Nano Banana」を検索し、ヒットしたアカウントの中から画像・動画生成AIに実際に触れていたものを抽出。
| アカウント | 属性 | テーマとの関わり |
|---|---|---|
| @xai-bot.bsky.social | xAI公式Bot | Grok Imagine(クローズドソース)の新モデル情報を告知 |
| @codename.cc | アプリ更新トラッカーBot | Grok iOSアプリのImagine機能アップデートを告知 |
| @drewkav.bsky.social | 個人アーティスト | Gemini 3.1 Nano Banana 2 と Kling 3.0 を組み合わせた制作を共有 |
| @triflingtree.bsky.social | 個人アーティスト | Nano Banana Proでの作品投稿 |
| @gentile-of-hope.bsky.social(希望の異邦人) | 個人・生成AI批判派 | 画像生成AI全般(Stable Diffusion/ChatGPT/Gemini)への倫理・環境批判 |
| @samperson.bsky.social | 個人・アーティスト側 | Procreateの反生成AI方針の支持を拡散 |
| @ecutruin.bsky.social | 個人・ローカル生成実践者 | ComfyUIなどローカルツールの機能面での優位性を発言 |
| @digitalhowl.bsky.social(Fenris) | 個人・動画制作者 | ComfyUI+Minimax H3でのプロ向け動画制作を共有 |
| @kerzefasta.bsky.social | 個人・二次創作イラストレーター | Stable Diffusion WebUI reForge(ROCm)で艦これキャラクターを継続投稿、この検索語で最もいいねを集めた投稿者 |
| @aichina.news | 自動投稿Bot | FLUXベースのLoRA(Apache-2.0)を1件ずつ大量に自動投稿するアカウント。エンゲージメントはほぼゼロ |
全体として、Bluesky上でこのテーマに実際に投稿しているのは「ニュースを報じる側」ではなく「ツールを使う側(個人クリエイター)」と「生成AIに批判的な側」の二極。X(本ランのXステージ)やRedditのような専門ニュースアカウント/サブコミュニティは見当たらなかった。
投稿
-
@xai-bot.bsky.social(2026-09-05・0いいね)https://bsky.app/profile/xai-bot.bsky.social/post/3mus2woiczo2w — 「Grok Imagine Video 1.5 agent is now available. Powered by our newest Image 2.0 model...」。xAI公式アカウントによるGrok Imagine(クローズドソース)の新動画エージェント発表だが、いいね・リポストともに0で、この検索範囲内では反応が可視化されなかった。
-
@codename.cc(2026-09-06・0いいね)https://bsky.app/profile/codename.cc/post/3muspbmaiq22n — 「SHIPPED: Grok iOS updated to 1.4.33 with improvements to Chat, Voice and Imagine features.」。アプリの差分を追う個人トラッカーアカウントによる更新記録。
-
@drewkav.bsky.social(2026-09-06・9いいね)https://bsky.app/profile/drewkav.bsky.social/post/3muubykpdfk2k — 「Persistent Dream」と題した作品で、静止画をGemini 3.1 Nano Banana 2、動画化をKling 3.0で行ったと明記。クローズドソース同士(Google×Kling)を組み合わせるワークフローの実例。
-
@triflingtree.bsky.social(2026-09-06・15いいね・1リポスト)https://bsky.app/profile/triflingtree.bsky.social/post/3mutz2tm3bc2m — ビザンチン風「異星人の母子像」をNano Banana Proで生成した投稿。今回のNano Banana関連投稿の中では最もいいねを集めた。
-
coah80.com(2026-09-06・0いいね)https://bsky.app/profile/coah80.com/post/3muulvyomz72c — 「SORA 2 WAS GENUINELY SO BAD HOWD WE CALL THIS GOOD」。Sora 2(クローズドソース)への酷評で、YouTubeステージで確認された「Sora 2が2026/4/26にWeb/アプリ提供終了、API提供も2026/9/24終了予定」という経緯と符合する否定的な空気感。
-
@gentile-of-hope.bsky.social(2026-09-05・100いいね・42リポスト)https://bsky.app/profile/gentile-of-hope.bsky.social/post/3murgar5zys2j — 「Stable Diffusionに限らず、ChatGPTやGeminiなどのAI画像生成機能は、非倫理的かつ大規模なデータ収奪から成り立ちます。(中略)画像生成は膨大な電力と水を消費し、環境を破壊します。」。今回の検索で収集した投稿の中で最もいいね数が多く、クローズド・オープン問わず生成AIそのものへの批判が最大のエンゲージメントを獲得している。
-
@samperson.bsky.social(2026-09-05・121いいね・11リポスト)https://bsky.app/profile/samperson.bsky.social/post/3muruvekma22b — Procreate(イラストアプリ)の反生成AI方針を支持する内容の拡散。今回の収集全体で最高のいいね数。
-
@ecutruin.bsky.social(2026-09-06・1いいね)https://bsky.app/profile/ecutruin.bsky.social/post/3muv2pwq55s2t — 「local software like ComfyUI has more features than the majority of hosted solutions」。オープンソースのローカル生成環境の機能面での優位性を評価するコメント。
-
@digitalhowl.bsky.social(2026-09-06・0いいね)https://bsky.app/profile/digitalhowl.bsky.social/post/3muuu24tqf22g — ComfyUIとMinimax H3を組み合わせて「professional grade video work」に使っていると発言。オープンソース基盤+商用モデルのハイブリッド運用例。
-
@kerzefasta.bsky.social(2026-09-05〜06・複数投稿、最大29いいね・10リポスト)https://bsky.app/profile/kerzefasta.bsky.social/post/3muroxdlm4k2j — Stable Diffusion WebUI reForge(ROCm、AMD GPU)で艦これキャラクターのイラストを連続投稿。ニュース性はないが「Stable Diffusion」検索で最も継続的にエンゲージメントを集めていたアカウント。
-
@aichina.news(2026-09-06・0いいね、同種の投稿を1時間に20件以上)https://bsky.app/profile/aichina.news/post/3muup3wwiad2i — 「Apache-2.0 LoRA for Flux, small enough to drop into ComfyUI or Diffusers」。Huawei Ascend/Modelers.cn向けのFLUX LoRAを機械的に大量投稿するBotで、トリガーワードや作例が一切ないままリリースだけを告知している。オープンソース関連の検索結果量を押し上げているが、実質的な議論にはなっていない。
シグナル
- クローズドソース:Nano Banana(Gemini 3.1/Nano Banana Pro)が個人クリエイターの実制作で最もよく名前が挙がり、Kling 3.0と組み合わせる「静止画はNano Banana、動画化は別ツール」という分業ワークフローが複数投稿で確認できた。
- クローズドソース:Grok Imagineの新モデル(Video 1.5 / Image 2.0)は公式アカウントが告知したが、いいね・リポストともに0件で、この検索範囲では反応が可視化されなかった。プレスリリース的な告知がBluesky上では埋もれている。
- クローズドソース:Sora 2への言及は酷評(「SORA 2 WAS GENUINELY SO BAD」)のみで、擁護的な投稿は見つからなかった。YouTubeステージで確認したサービス終了の流れと一致する。
- オープンソース:ComfyUIを実際に使うユーザーの発言は「ローカルはホスト型サービスより機能が多い」という具体的な優位性評価で、好意的だった。
- オープンソース/ノイズ:「Stable Diffusion」「Flux」等のオープンソース関連キーワードの検索結果の大部分は、(1)艦これなどの二次創作イラスト投稿、(2)NSFWコンテンツへの外部リンク投稿、(3)@aichina.newsのような無反応の自動LoRA告知Bot、の3つで占められており、ニュース性のある議論はごく少数だった。
- 最大のエンゲージメント軸は「生成AI批判」:今回収集した投稿の中でいいね数トップ2(121件・100件)はいずれも生成AI(画像・動画問わず)そのものへの批判・反対の投稿で、ツール活用系の投稿(最大でも15いいね)を大きく上回った。BlueskyのユーザーベースはX/Redditと比べて反生成AI寄りの声が強く出やすい傾向がうかがえる。
Limits
- API制限:
public.api.bsky.appのエンドポイントは全リクエストで403(アクセス拒否)となり使用できなかった。代替のapi.bsky.appは動作したが、短時間に複数の新規クエリを送ると頻繁に403が返るレート制限があり、"Kling AI"「Wan2.2」「HunyuanVideo」「Qwen Image」「Krea」「Sora shutdown」など、試みた検索語の半数近くは一度もデータを取得できなかった。 - Web UIは取得不可:
bsky.app/searchはJavaScriptで描画されるSPAのため、WebFetchでは投稿本文を取得できず(メタタイトルのみ)、実質的にAPI経由の検索結果のみが情報源になっている。 - 件数不足:完了基準(約20件の投稿を解析)に対し、実際に内容を検証できたのは11件程度。API検索結果には無関係なノイズ(例:「Sora」でキングダムハーツのキャラクター名がヒットする、トレンドハッシュタグ集計Botの投稿が混ざる等)が多く混じり、テーマに関係する投稿の実数はさらに絞られた。
- エンゲージメント指標の限界:Bluesky公開APIはいいね・リポスト・返信数は返すが、X(本ラン内Xステージ)のようなview数(インプレッション)は取得できず、投稿の実際の閲覧規模は不明。
- 投稿詳細の取得失敗:
app.bsky.feed.getPostThreadでsamperson.bsky.socialの投稿本文を個別取得しようとした際は400エラーとなり、検索結果のスニペット以上の全文は確認できていない(リンクは提示済み)。 - アカウントの偏り:ヒットした投稿は特定アカウント(@kerzefasta.bsky.socialの艦これイラスト、@aichina.newsの自動LoRA告知)に集中しており、幅広いユーザー層の声を代表しているとは言い難い。
Lemmy
Lemmy — 画像・動画生成AIの最新動向
Communities
- [email protected] — 5,708 subscribers、1,386 posts。オープンソース系の画像・動画生成AI(モデル、ComfyUIノード、LoRAなど)の実質的なメイン集積地。ほぼ毎日、新しいツールやモデルが投稿されている。https://lemmy.dbzer0.com/c/stable_diffusion
- [email protected] — 2,361 subscribers、3,500 posts。Stable Diffusion / オープンウェイトモデルで作った作品の投稿場所(ニュース性は薄い、ギャラリー寄り)。https://lemmy.dbzer0.com/c/stable_diffusion_art
- [email protected] — 4.82K subscribers(lemmy.world上のローカル購読者は約1.8K)。Free/Open Source AI全般が対象で、画像・動画生成に特化した投稿は少ない。https://lemmy.world/c/fosai
- [email protected]、[email protected]、[email protected] — クローズドソースAI企業(Midjourneyなど)のニュースが流れてくるのはここ。専用の"画像生成AIニュース"コミュニティではなく、一般テック/ニュースコミュニティに散発的に載る形。
Posts
オープンソース寄り(主に [email protected])
- MiniMax-H3_Singularity — MiniMax-H3系動画生成モデルのファインチューン融合モデル。score 3、2026-09-06。https://lemmy.dbzer0.com/post/75088455 (元: https://huggingface.co/WarmBloodAban/Minimax-h3_Singularity)
- Qwen3.8-Flash-Next-NVFP4 — NVIDIAによるQwenモデルのNVFP4量子化版。score 3、2026-09-06。https://lemmy.dbzer0.com/post/75088454 (https://huggingface.co/nvidia/Qwen3.8-Flash-Next-NVFP4)
- ComfyUI-AetherScale — ComfyUI用の新拡張。score 5、2026-09-05。https://lemmy.dbzer0.com/post/75036491 (https://github.com/vizart-vj/ComfyUI-AetherScale)
- Viggle-Animate — 1枚のリペイント画像からキャラクターを動画内で置き換える動画編集モデル。score 9(このスレッドで最高スコア)、2026-09-05。https://lemmy.dbzer0.com/post/75036488 (https://huggingface.co/Viggle/Viggle-Animate)
- FastH3-Ref2V-Stream-Controller — 連続的な動画生成のためのComfyUIコントローラー。score 2、2026-09-04。https://lemmy.dbzer0.com/post/74988027 (https://github.com/EarthDefenceForces/FastH3-Ref2V-Stream-Controller)
- ComfyUI-Majoor-OmniCam — ComfyUI用カメラレイアウト/アニメーションツール。score 4、2026-09-04。https://lemmy.dbzer0.com/post/74988020 (https://github.com/MajoorWaldi/ComfyUI-Majoor-OmniCam)
- H3-World — "MiniMax-H3をベースにした初のインタラクティブ・ワールドモデル"と紹介。score 3、2026-09-02。https://lemmy.dbzer0.com/post/74893520 (https://huggingface.co/DANNY621/H3-World)
- ComfyUI-MiniMaxH3-CLSS — 16GB VRAMで任意長の音声付き動画生成を可能にするノード。score 0、2026-09-01。https://lemmy.dbzer0.com/post/74843957 (https://github.com/nazgut/ComfyUI-MiniMaxH3-CLSS)
- Trellis.2 and Pixal3D Now Native in ComfyUI — 3D生成モデルTrellis.2とPixal3DがComfyUIにネイティブ統合。score 4、2026-09-01。https://lemmy.dbzer0.com/post/74843948 (https://blog.comfy.org/p/trellis2-and-pixal3d-are-now-native)
- ComfyUI-DLSS5-NR — NVIDIA DLSS 5のニューラルレンダリングを使った実験的ComfyUIサポート。score 2、2026-09-01。https://lemmy.dbzer0.com/post/74843949 (https://github.com/lisitskyaa/ComfyUI-DLSS5-NR)
- LLaDA-Image — 拡散モデル系の画像生成研究論文(arXiv)。score 3、2026-09-04。https://lemmy.dbzer0.com/post/74988021 (https://arxiv.org/abs/2609.03796)
クローズドソース寄り
- Midjourney pivots from AI image generation to body scanning medical spa — MidjourneyがAI画像生成事業から医療用ボディスキャン(超音波)事業「Midjourney Medical」へ転換すると報道。score 58、2026-06-18、[email protected]。https://lemmy.zip/post/66397234 (元記事: https://www.theregister.com/ai-and-ml/2026/06/18/midjourney-pivots-from-ai-image-generation-to-body-scanning-medical-spa-where-patients-bathe-in-golden-light/)
- Midjourney AI pivots to Theranos: Ultrasonic CT — 同ニュースへの批判的論評。score 40、2026-06-19、[email protected]。https://awful.systems/post/8731127 (https://pivot-to-ai.com/2026/06/19/midjourney-ai-pivots-to-theranos-ultrasonic-ct/)
- Midjourney Medical / Midjourney Ultrasonic CT Scanner — Midjourney公式ページへの直リンク投稿2件。score 3, 2、2026-06-18、[email protected]。https://lemmy.bestiver.se/post/1175129 / https://lemmy.bestiver.se/post/1175130
- Midjourney wants Hollywood studios to reveal AI usage details — Midjourneyがハリウッドスタジオに対しAI利用の情報開示を求めているという記事。score 73、2026-07-05、[email protected]。https://techcrunch.com/2026/07/04/midjourney-wants-hollywood
Signals
- Lemmyの画像・動画生成AI関連の熱量はほぼ全部オープンソース側に偏っている。中心は
[email protected]の一箇所で、そこは「MiniMax-H3」という動画生成基盤モデルのエコシステム(LoRA、ComfyUIノード、VAE高速化、モーションキャッシュなど)を中心に、ほぼ毎日3〜9件のペースでツール投稿が続いている。Qwenの量子化版やLLaDA-Image論文なども同コミュニティに流れてくる。 - クローズドソース側の話題はMidjourneyが画像生成から医療用超音波スキャン事業へ転換したという2026年6月のニュースが唯一まとまった塊で、複数のインスタンス(lemmy.zip / awful.systems / lemmy.bestiver.se)に転載され議論を呼んだ(スコアは40〜73と、このテーマでは比較的高い)。裏を返せば、SoraやVeo、Kling、Runway、Nano Banana、Flux.2といった2026年の主要な画像/動画生成AIリリースそのものについては、Lemmy上でニュース記事として拾われた形跡がほとんどない。
- 検索語「Veo 3」「Kling AI」ではLemmy検索に該当投稿がゼロ、「Runway/Kling/Veo/Gemini image」の複合検索も空振りだった。Lemmyのユーザーは新モデルの発表そのものより、ComfyUIで実際に使えるツール(ノード・LoRA・最適化)に反応する傾向が強い。
Limits
- Lemmyはユーザー数・投稿数ともに小さく、画像/動画生成AIの「ニュース」を専門に扱うコミュニティが存在しない。実質的な情報源は
[email protected]1コミュニティと、一般テック系コミュニティに散発的に流れ着くクローズドソース企業の記事のみだった。 - 完了基準にある「20件ほどの投稿を解析」は、オープンソース側のツール投稿(11件)とクローズドソース側のMidjourney関連記事(4件)を合わせて15件にとどまった。Sora、Veo、Kling、Runway、Nano Banana、Flux.2など2026年の主要リリースそのものを扱った投稿はLemmy検索(lemmy.world API、Web検索とも)で見つからず、「見つからなかった」こと自体をここに明記する。
- lemmy.world の
/c/stablediffusionコミュニティページはHTTP 500エラーで直接閲覧できなかった(検索API経由では代替できた)。
Pinterest — Image and Video Generation AI News
50件のピン(output/pinterest.pins.md / images/pinterest/manifest.json)を全件確認。ジャンル分けはされておらず単一クエリ「Image and Video Generation AI News」での収集。
Visual themes
- ネイビー×ネオン(青・紫・ピンク)のサイバー感がテンプレ化:回路線、粒子グロー、ニューラルネット風の球体・ノードが背景に敷き詰められた「いかにもAI」なサムネが大半を占める。[1, 2, 5, 7, 11, 13, 14, 17, 18, 20, 26, 30, 38, 40]
- 「AIニュースキャスター」ビジュアルの反復:白いアンドロイド/人間と機械が顔半分ずつ融合したキャスターがスーツでニュースデスクに座る構図が何度も出てくる。ブランド名だけ差し替えた量産感が強い。[4, 32, 34, 37, 42]
- ツール比較・ランキング系インフォグラフィックが最頻出フォーマット:Runway・Pika・Kling AI・Luma(Dream Machine)・Canva AI・Hailuo AI・Synthesia・InVideo AI・HeyGen・Vidu AI・PixVerse・Google Veo・OpenAI Sora・Adobe Firefly がほぼ同じ顔ぶれで繰り返しランクインする「Best AI Video Generators」型リスト。[9, 19, 28, 33, 36, 46]
- 1枚の元画像/動画から複数スタイルへ変換するデモグリッド:木製ブロック風・折り紙風・レゴ風・花束風に変換された同一人物、パンダ着ぐるみ、テスラ車のスタイル展開など、一貫性(コンシステンシー)訴求のビフォーアフター構成。[8, 25, 44]
- ディープフェイク不安・検出コンテンツ:「FAKE」スタンプを押された猫画像、「Which is AI?」当てクイズ、AI生成画像/文章の検出ツール紹介、「見ることが信じることにならない」という警句付きインフォグラフィック。[4, 12, 18, 26, 47]
- 「AI News Roundup」型の日付入りニュースカード:見出し+箇条書きで複数トピックをまとめる速報フォーマット(Google I/O 2026、911通報AI化、北朝鮮のAIスタックなど)。[21, 29, 31, 35]
- 汎用AIアートのショーケース化(本題からズレる投稿):大理石彫刻がチェロを弾く写実画像、老漁師のポートレートなど、ニュース性のないAI生成アート単体の宣伝ピンも混在(ツール自体の広告目的)。[49, 50]
- 配色は暗背景+ネオン文字がデフォルトで、白背景の企業系インフォグラフィック(コーポレートブルー、フラットデザイン)は少数派。[3, 10, 27, 33]
Notable pins
- [11] Veo 3 Image-to-Video: Fast Generation & Native Audio via Gemini API — Gemini API経由のVeo 3画像→動画+ネイティブ音声生成を訴求する実プロダクト紹介。
- [16] Google Unveils Veo 2 — Google公式トーンのVeo 2プロモグリッド(顕微鏡の科学者、水泳、アニメ調少女など生成サンプル多数)。
- [25] Google announces Veo 3 — 紫色のモンスターキャラを複数環境で一貫生成するデモ。1枚の元画像から出力動画3種という構成でキャラクター一貫性を強調。
- [29] Today's AI News: MAY 20, 2026 — Google I/O 2026特集。Gemini 3.5 Flash / Gemini Omni / Gemini Spark、Apple のアクセシビリティAI、Android XRスマートグラス競争を列挙。
- [35] The Latest AI Developments — 3本立て速報:ニューオーリンズで911通報にAIが応答/MetaがオフラインエージェントモデルMuse Glimmerを公開/北朝鮮Kimsukyグループが自前AIスタックでフィッシングを自動化、という具体的な事件報道。
- [44] Microsoft Unveils VASA-1 — 静止画1枚+音声クリップ(+任意の制御信号)から喋る顔動画を生成するモデルの紹介、多様な顔のグリッド付き。
- [48] ShengShu Technology Unveils Vidu S1 — 「リアルタイムAIインタラクション向け最先端モデル」を謳うVidu S1、サイバーパンク調キャラクターのマルチフェイス表示。
- [8] スタイル一貫変換デモ(Luma系)— 同一人物/動物/車を「木製ブロック」「折り紙」「レゴ」「花」に変換した5パターン比較グリッド。技術デモとしての説得力が高い。
- [46] Future of Video Creation: Best AI Video Generators of 2026 — Pika 2.5、HeyGen、Google Veo 3.1、Runway Gen 4.5、Kling 3.0、Adobe Firefly、Seedance 1.5 Proとバージョン番号まで踏み込んだ最新ランキング。
- [20] More than 20% of YouTube is now AI-generated — 具体的な統計値を掲げた見出しのみのシンプルなピンだが、AI生成コンテンツの普及度を象徴する数字。
Signals
- モデルの世代競争が可視化されている:Veo 2→3→3.1、Kling AI→3.0、Runway Gen-3→Gen 4.5、Pika 2.5、Seedance 1.5 Proとバージョンアップが頻出し、動画生成AIの改良サイクルが速いことが読み取れる。[16, 25, 11, 46]
- 「エージェント化」「リアルタイム化」「オフライン化」が次の焦点:ワンクリックでスカウト→台本→生成→編集まで自動化するパイプライン型ツール([24])、リアルタイムインタラクション型のVidu S1([48])、ネット接続不要のMeta Muse Glimmer([35])など、単なる「生成」から「エージェント/リアルタイム/オンデバイス」へ関心が移っている。
- AIの実運用・悪用が話題化し始めている:緊急通報システムへのAI導入([35])、国家主体(北朝鮮)によるAI悪用([35])など、生成AIの枠を超えた社会実装・セキュリティの話題も混ざる。
- クローズドソース商用ツールの寡占的な露出:ランキング系ピンで繰り返し名前が挙がるのはGoogle Veo、OpenAI Sora、Runway、Kling AI、Adobe Firefly、Pika、Luma、HeyGen、Synthesiaなど商用クローズドサービスに偏っており、オープンソースモデル(Stable Diffusion系、AnimateDiff、Open-Sora、ComfyUIワークフローなど)への言及は皆無に近い。「Amuse 3.0」([50])はローカル実行(AMD Ryzen AI上で動作)を訴求する数少ない例外。
- 一次情報源への接続が弱い:50件中、企業公式ブログや技術論文への直接リンクを匂わせるピンはごく一部(Veo公式トーンの[16][25]、Microsoft VASA-1の[44])で、大半はアフィリエイト系ブログ・SEO記事・Fiverrの営業用サムネイル([45]など)で、Pinterestは「ニュースを追う場」ではなく「ツールを売る場」として機能している。
- ディープフェイク不安が定番コンテンツ化している:検出ツール紹介や「見分けクイズ」が独立したジャンルとして存在し、生成技術の進歩そのものより「信頼できるか」という不安が消費されている。[4, 12, 18, 26, 47]
Limits
- このステージはワーカーがヘッドレスブラウザで事前収集した画像を読むだけで、Pinterest自体の追加検索・スクロールは行っていない(プレイブック指定の手順どおり)。
- 収集は単一クエリ(ジャンル分けなし)のため、クローズドソース/オープンソースを分けて狙い撃ちした検索は行われておらず、結果的にオープンソース関連のピンがほぼ見当たらない。これはPinterest側の投稿傾向そのものである可能性が高いが、狙って掘れば見つかった余地は否定できない。
- タイトルが
(untitled)のピンが2件([12]は実質「Which is AI?」の内容が読み取れたが、他は判別困難なものもあった)。 - ピンURL自体(
pinterest.com/pin/...)へは実際にアクセスしておらず、画像とタイトルのみからの読み取りのため、リンク先の本文・コメント・保存数などのエンゲージメント指標は確認できていない。 - [49](大理石彫刻のチェロ奏者)はテーマとの関連が薄い汎用AIアート宣伝ピンで、ニュース性のある知見としては扱っていない。
推奨アクション
- Sora2依存のワークフローはAPI終了(2026/9/24)前にKling 3.0かVeo 3.1への移行計画を立てる。
- GPT-6 AstraのComputerUse機能を、生成AI単体ではなく制作パイプライン自動化ツールとして追跡する。
- コスト削減目的ならQwen-Image-Edit + ComfyUIのローカル編集をクローズドソース課金より先に試す。
- AI生成物の真正性ラベリング・偽タイムラプス炎上リスクに備え、公開コンテンツのAI利用開示ルールを整備する。
- Nano Banana(静止画)+Kling 3.0(動画化)の分業ワークフローを検証する。
- Midjourneyの画像生成事業から医療機器事業への転換を、他クローズドソース企業の多角化の先行指標として継続ウォッチする。
収集画像


















































データ品質メモ
6プラットフォームとも brief.md の完了基準(各SNS約20件)には届かず、特にXは40投稿中関連4件、Blueskyは403レート制限で実質11件、Lemmyは専門ニュースコミュニティ不在で計15件にとどまった。ただしGPT-6 AstraやSora2終了、ComfyUIエコシステム拡大といった主要トレンドは複数プラットフォームで独立に裏付けられている。



