Image and Video Generation AI News — 2026-09-15
クローズド勢はChatGPT Images分割やSeedream/Seedanceで一モデル専門特化に走る一方、オープン勢はFLUX.2やWan 3.0で「オープンの看板と実態の乖離」が争点化しており、両陣営ともキャラクター/被写体の一貫性が次の主戦場になっている。
画像・動画生成AI最新ニュース — 2026-09-15
やば、今の画像・動画生成AI界隈マジで動きまくってる🔥 クローズド勢はOpenAIのChatGPT Images二分割(Flare/Sunburst)とかGoogleのNano Banana Pro、ByteDanceのSeedream/Seedanceみたいに「一つのモデルをどんどん専門特化させる」方向にシフト中📈 オープン勢はFLUX.2、HunyuanVideo 1.5、Qwen-Image、LTX-2.5みたいなガチ強モデルが連発してるけど、Wan 3.0が重み非公開になったりFLUX.2が一部プロプライエタリ化したりで「それ本当にオープンソースって言っていいの?」🤔って空気も出てきてる。あと「一発生成のクオリティ」より「キャラ・被写体の一貫性を保てるか」が両陣営共通の勝負どころになってきてる感じ👀
Across platforms
クローズドソース陣営の気づき🔒
- OpenAIがChatGPT Imagesを速度重視の「Flare」と精密編集の「Sunburst」の2モデルに分割(2026-09-08、GPT-Image-2.5として投入)。Bluesky / YouTube
- Google「Nano Banana Pro」がGemini 3ベースの画像生成として定着し、個人クリエイターの実制作で圧倒的人気(Bluesky上でいいね80超の投稿も)。YouTube / Bluesky
- Runway「Gen-4.5」(開発中コード名"Whisper Thunder")発表、モーション再現性を強調。YouTube
- RunwayがAdobe Premiere Pro/After Effectsに正式統合、単体アプリからプロ向けスイートの標準機能へ。Bluesky
- **ByteDance「Seedance 2.5」**が30秒動画・参照画像50枚対応で登場(2026-06-23、Volcano Engine FORCEで発表)。YouTube
- **ByteDance「Seedream 5.0 Pro」**レイヤー生成・最大10枚参照画像対応(2026-07-15リリース)。YouTube
- Midjourney V8.1アルファ登場、Nano Banana Pro・Grokと比較される立ち位置に。YouTube
- 中国Shengshu社「Vidu」がS1/Q3にアップデート、Q3は映像と音声のネイティブ同時生成に対応(2026-09-14)。Bluesky / Pinterest
- OpenAI「Sora」がフェードアウト: 2026-03-24に開発者へ終了通知、4月にアプリ/Web版停止、Sora 2 APIも2026-09-24廃止予定。Disneyとの提携も終了、Lemmyでは「AIスロップ生成モデル」と皮肉られている。Lemmy
- 監督ダニー・ボイルが新作映画「Ink」でAI利用(静止画のアニメ化)を公表、映像業界でのAI利用開示の一例。Bluesky
- クローズド動画3強(Sora 2/Veo 3.1/Kling 3.0)の使い分け比較コンテンツが量産ジャンル化。YouTube
- ByteDanceとハリウッド(MPA)がAI著作権保護で世界的合意、業界レベルでの権利調整が進行中。Pinterest
オープンソース陣営の気づき🔓
- Black Forest Labs「FLUX.2」発表(2025-11-25)もライセンスが階層化: Schnell/KleinはApache、Dev/Pro/Flexは非商用・プロプライエタリ。「オープン」と名乗りつつ閉じていく典型例として視聴者の関心を集めている。YouTube
- Alibaba「Wan 3.0」は公開ベータ開始(2026-08-06)なのに重みが非公開。Wan 2.xまでのApache 2.0路線からの転換で、オープン界隈で議論の的に。YouTube
- Tencent「HunyuanVideo 1.5」が正式オープンソース化、コンシューマGPUで動作可能と強調。YouTube
- Alibaba「Qwen-Image 2512」がApache 2.0で公開、Z-Imageと文字描画・写実性で比較される存在に。YouTube
- Lightricks「LTX-2.5」がオープンウェイトで公開(2026-09-12)、ワンパスでマルチショット生成が可能。旧LTX-2.3は即レガシー化するなど超高速イテレーション。Bluesky
- LTX-2はオープンソース動画生成で唯一のネイティブ音声同時生成モデルとして位置付けられている(4K/50fps)。YouTube
- Reddit発の「Anisora」(WAN 2.xに統合されたオープン動画モデル)がModelscope上で無料利用可として紹介されている。Reddit
- Krea 2(turbo)がComfyUI上での実制作で急速に普及、Lemmyのstable_diffusion_artコミュニティで連日投稿。Lemmy
- アニメ特化のオープンウェイトモデル(
waiANIMA_v10Base10など)がshare_anime_artコミュニティの人気モデルに定着。Lemmy - ComfyUI用LoRA学習拡張「comfyUI-Realtime-Lora」がZ-image・Flux Klein・SDXL・Flux・WAN 2.2・SD1.5まで幅広く対応、オープンウェイト生態系の実行基盤としてComfyUIが定着していることを裏付ける。Lemmy
- 旧UI「AUTOMATIC1111」をGradioで再構築するチュートリアルが公開され再注目。Bluesky
- YC(Y Combinator)のGarry Tanが米国オープンウェイトラボにフロンティアモデルの「蒸留」推進を提言、中国製オープンモデルへの依存低減が狙いだが、Lemmyでは「むしろ強制オープンソース化すべき」と反発の声も。Lemmy
Platform by platform
Reddit: 検索で拾えた12スレッド中、実務ツール話(生成→編集シフト、無料ツール探し)と雇用・水資源・肖像権といった是非論がほぼ半々。クローズド(Niji)とオープン(Anisora/WAN)が同じスレで並列推薦されるなど、ユーザーは陣営にこだわらず横断的にツールを選ぶ傾向が見える。完了基準(約20件)には届かず12件止まり。
X: 収集された40投稿のうち画像・動画生成AIに関するものは実質0件。ワーカーが検索した語("Dario"、"LMEOW"、"Bosnia"等)がX自体のトレンドトピックであり、今回のテーマとは無関係だった。唯一近いのはAnthropic CEO Darioを巡るAI開発ペース論争だが、これも画像・動画生成とは別話題。ブリーフが求める「クローズド/オープン」の視点にX単体では一切貢献できていない。
YouTube: 今回のプラットフォームの中で最も情報密度が高く、クローズド9本・オープン9本の動画を具体的に特定できた。クローズド勢の「陣営再編」(OpenAI/Google/ByteDance/Runway/Midjourneyの月次首位争い)と、オープン勢の「本当にオープンか」論争(FLUX.2/Wan 3.0)の両方が明確に見える。ただしJS動的レンダリングのため再生数・登録者数は取得不可。
Bluesky: gen-ai.news(キュレーション型ニュース)とDFL inc.(個人クリエイターの実作例)の二極構成。クローズド(Nano Banana 2、Vidu、ChatGPT Images分割)とオープン(LTXシリーズの高速イテレーション)の両方が同じ期間内(9/10〜9/14)で具体的に拾えており、他プラットフォームの裏付けとしても機能した。
Lemmy: オープンソース系(Stable Diffusion、ComfyUI、アニメLoRA)がコミュニティの本丸で、クローズド系の話題は薄いが辛口(Sora終了を「スロップ」と揶揄)。完了基準の20件には届かず、確認できたのは10件。
Pinterest: 収集50件はほぼ「クローズドソースの商用ツール紹介」と「量産系AIニュースまとめサムネ」に偏り、Stable Diffusion/ComfyUI/Flux/Wan/HunyuanVideoのようなオープンソース固有のピンはほぼ皆無だった。エンゲージメント指標(いいね数等)も取得不可のため、どのピンが実際にバズっているかは判定できていない。
What to watch
- Wan 3.0が重み非公開のまま正式版に進むか — Alibabaの「オープンの看板」の行方を左右する。YouTube
- LTXシリーズの高速イテレーション(2.3→2.5)が今後も続くか — オープンウェイト動画生成のペースメーカーになりつつある。Bluesky
- Sora 2 API廃止(2026-09-24予定)後のユーザー移行先 — Kling/Veo/オープン勢のどこに流れるか。Lemmy
- GPT-Image-2.5のFlare/Sunburst分割戦略が定着するか、他社(Google/ByteDance)が追随するか。YouTube
- キャラクター/被写体一貫性機能が両陣営の主戦場になるか — Pinterest上のFlowFrame・LuminaireやReddit#11の「連続キャラで視聴時間9倍」報告が同じ方向を示している。Pinterest / Reddit
- FLUX.2の階層ライセンスへの反発が広がるか — 「オープンソースを名乗る非商用ライセンス」への風当たりが今後強まる可能性。YouTube
Recommendations
- Xの収集ステージを、実際のブリーフに即した検索語(Midjourney、Sora 2、Nano Banana、Runway Gen、Stable Diffusion、Flux、Veo 3、Kling、ComfyUIなど)で再実行し、今回の0件データを埋め直す。
- Wan 3.0の重み公開有無とFLUX.2のライセンス動向を、「オープンソースの看板と実態の乖離」の定点観測テーマとして継続ウォッチする。
- Sora 2 API廃止(9/24)後のユーザー移動先をLemmy/Redditの次回収集で重点的に追う。
- Reddit/Lemmyの次回収集ではr/StableDiffusion、r/comfyui、r/midjourneyのような中核サブレディット・コミュニティを検索対象に加え、完了基準の20件に近づける。
- Pinterestの次回収集では「オープンソース」に絞ったジャンル検索を追加し、商用ツール偏重を補正する。
- キャラクター/被写体一貫性機能の訴求を、クローズド・オープン双方のプロダクト比較軸として次回レポートでも継続トラッキングする。
Data quality
Xは実質的にデータなし(収集語がX自身のトレンドトピックで、テーマと無関係だったため画像・動画生成AI関連投稿は40件中0件)。Reddit(12/約20件)とLemmy(10/約20件)は完了基準の件数に届いていない。Pinterestはクローズドソース側の情報は豊富だがオープンソース固有のピンがほぼ皆無で、かつエンゲージメント指標が取得不能。YouTubeも視聴数・登録者数はJS動的レンダリングのため確認できていない。一方でReddit・YouTube・Bluesky・Lemmyの4プラットフォームは互いに独立した経路で同じ論点(中国発モデルの台頭、「オープンの看板と実態の乖離」、キャラ一貫性の重要性)に到達しており、その部分の信頼度は高い。
プラットフォーム別まとめ
Reddit — 画像・動画生成AIの最新ニュース
Where(該当スレッドがあったサブレディット)
| サブレディット | メンバー数 | 収集スレッド数 |
|---|---|---|
| r/aifilmmaking | 7,689 | 1 |
| r/AIDangers | 52,595 | 1 |
| r/GeminiAI | 373,499 | 1 |
| r/aivideomaking | 6,979 | 1 |
| r/AIToolTalks | 5,957 | 2 |
| r/aiwars | 168,235 | 1 |
| r/generativeAI | 153,227 | 3 |
| r/AtomicShrimp | 5,756 | 1 |
| r/antiai | 326,477 | 1 |
検索語「Image and Video Generation AI News」で9つのサブレディットから合計12スレッドがヒット。生成AIの実務系サブ(r/generativeAI, r/AIToolTalks, r/aivideomaking, r/aifilmmaking)と、AI是非論系サブ(r/AIDangers, r/aiwars, r/antiai)の両方に分散している。
What people say
-
#1 (r/aifilmmaking, 5pt・4コメ, 2026-09-14) https://www.reddit.com/r/aifilmmaking/comments/1wg7izt/ — Google FlowがVeo生成用の無料クレジットを非サブスク層にも太っ腹に配布中との報告。ただしu/Sea-Temporary-6995は「物理法則とロジックが弱い、Minimaxの方がずっと良い」と評価は辛口。u/MrBoondoggleも「Googleがこの製品にあまり本気じゃないから無料配布してるのでは」とコメント。
-
#3 (r/GeminiAI, 3pt・6コメ, 2026-09-14) https://www.reddit.com/r/GeminiAI/comments/1wgjjco/ — Gemini(Pro)とChatGPT(無料版)の画像生成を同じ簡単なプロンプトで比較し、Geminiが明らかに劣ると報告。u/damaged_terrorは「Geminiは途中で諦めてテキストだけ貼った感じ」とコメント。
-
#4 (r/aivideomaking, 4pt・29コメ, 2026-09-09) https://www.reddit.com/r/aivideomaking/comments/1wbxpdf/ — 無料/クレジット制のリアル系画像・動画生成ツールを探すスレ。コメント欄はOpenartAI、fal、dzine、pixverse、Higgsfield、cyberbara(Seedance 2.5搭載で無修正)、Meta(画像は無料)、Minimax/Wan/LTX(GPUレンタル)と実名ツールが並ぶ。ただしu/senorfavelaのように「偽アカウントで紹介クレジットを稼げる」という露骨な紹介リンク稼ぎコメントも混ざっており、実需要とスパム的宣伝が同居している。
-
#5 (r/AIToolTalks, 9pt・5コメ, 2026-09-14) https://www.reddit.com/r/AIToolTalks/comments/1wgbie5/ — 「ゼロから生成するより既存画像の編集の方が実用的で面白くなってきた」という投稿。u/SethWorks20も同意し「90%良い画像の残り10%を直す方が日常的に価値が高い」とコメント。生成→編集への関心シフトが見える。
-
#8 (r/generativeAI, 3pt・3コメ, 2026-09-08) https://www.reddit.com/r/generativeAI/comments/1waapc1/ — ディズニーキャラのファンアートを作りたいがGrokにブロックされる、というスレ。著作権キャラに強いガードレールをかける大手クローズドAI(Grok/ChatGPT/Gemini)と、それを回避したいユーザーの綱引きが見える。回答ではPixelForgeやdreamfort.ai/imageといった無制限系ツールが紹介されている。
-
#10 (r/generativeAI, 5pt・3コメ, 2026-09-14) https://www.reddit.com/r/generativeAI/comments/1wghocv/ — アニメ調画像を無料生成したいという要望に対し、Midjourneyの「Nijijourney」(
--niji 7タグ)や、WAN 2.xに統合されたというオープンソース動画モデル「Anisora」(modelscope上で無料利用可)が紹介されている。クローズド(Niji)とオープン(Anisora/WAN)のツールが同じスレで並んで推薦されているのが特徴的。 -
#11 (r/generativeAI, 3pt・10コメ, 2026-09-14) https://www.reddit.com/r/generativeAI/comments/1wgjjzu/ — 「AIスロップ(量産感のあるAI動画)に見られない動画の作り方」についての投稿。投稿者は6週間単発クリップを作って毎回「スロップ」と言われたが、同一キャラ・同一声で4話構成にした途端「視聴時間が9倍」になり誰にも言われなくなったと報告。runway/kling/argil/veoを使い分けている実践的な内容で、u/pb404は「Seedance 2.5のreference modelで一発生成の一貫性が良い」とコメント。
-
#7 (r/aiwars, 0pt・14コメ, 2026-09-08) https://www.reddit.com/r/aiwars/comments/1wafe86/ — AI生成人物が実在の誰かに似てしまった場合の肖像権リスクについての議論。u/INxPは「実写でも似た人はいるので大差ない」と楽観的、一方u/Upstairs-Mammoth-509は「オンライン上に写真がない無名の誰かにたまたま似た場合、企業側は祈るしかない」とリスクを指摘し意見が割れている。
-
#6 (r/AIToolTalks, 12pt・21コメ, 2026-09-13) https://www.reddit.com/r/AIToolTalks/comments/1wfhbnv/ — Andrew Garfieldが「Artificial」でSam Altman役を演じた後にAI利用をやめたというニュースを引き合いに、水消費・雇用喪失・規制不在への不安を訴える投稿。反論コメント(u/Big-Pops78)は「ジーンズ1本で3,000ガロンの水を使う、AIだけが特別ではない」とデータで反論し、賛否がはっきり分かれている。
-
#12 (r/antiai, 8pt・24コメ, 2026-09-14) https://www.reddit.com/r/antiai/comments/1wgiccg/ — 「今後2.5年のAIの未来が怖い」という投稿にトップコメント(u/Impressive-Owl-5478, 22pt)が「開発減速の呼びかけは安全のためというより、AIが期待した成果を出せていないことの言い訳では」と皮肉り最多スコアを獲得。技術的トピックというより厭AI感情のガス抜きスレ。
Signals
- 上昇している兆し: 「生成」より「編集・一貫性コントロール」への関心シフト(#5, #11)。特に#11の「同一キャラで連続ストーリーにしたら『スロップ』評価が消えて視聴時間9倍」は、技術力より物語の一貫性がAI動画への評価を左右するという具体的なシグナル。
- 軽視・反発されている論調: 「AIスロップ」という批判そのものを、u/Tenth_10(7pt、#11)は「自分が正しいと思いたいだけの人たちの言葉」と切り捨てている。同様に#6・#12でもAI懐疑論への反論が一定の支持(高スコア)を得ており、r/AIToolTalksやr/AIDangers/r/antiaiの中でも意見の割れが目立つ。
- 意外だった点: 「Image and Video Generation AI News」という検索語で拾えたスレッドの半分近くが、製品ニュースではなく雇用・水資源・規制・肖像権といった社会的懸念や、r/AtomicShrimpのような無関係なノスタルジー投稿(#9、AI画像生成で文字を作る古い動画を探すスレ)だった。純粋なツール実務スレ(#4, #5, #8, #10, #11)とAI是非論スレ(#2, #6, #7, #12)がほぼ半々で、Redditの「AI画像・動画生成」界隈は技術情報と社会論争が混在している。
- クローズド vs オープンソースの対立軸: 明確な「オープンソース陣営 vs クローズド陣営」の論戦は今回の収集分には少ないが、#10でNijijourney(クローズド)とAnisora/WAN(オープン)が並列で推薦されている点、#4でMeta(無料)とMinimax/Wan/LTX(オープン系・GPUレンタル)が併記されている点から、ユーザーは陣営にこだわらず「無料/安い/高品質」で横断的にツールを選んでいる様子がうかがえる。
Limits
- 検索は「Image and Video Generation AI News」という単一クエリのみで、オープンソース/クローズドソースを分けた検索は行われていない。そのため両陣営を明示的に比較する投稿は少なく、本レポートの「クローズド vs オープンソース」の切り分けは間接的な推測に留まる。
- ブリーフの完了基準は各プラットフォームでおよそ20件のスレッド解析だが、収集できたのは12件のみ。r/StableDiffusion、r/midjourney、r/comfyuiのような画像/動画生成の中心的サブレディットは今回の収集結果に含まれておらず、カバレッジに偏りがある。
- ワーカーが事前収集したファイル(
output/reddit.threads.md)のみを情報源としており、本エージェント自身がReddit上で追加検索・追加ページ閲覧を行うことはできない仕様のため、これ以上の深掘りはできなかった。 - スレッド#9(r/AtomicShrimp)はテーマとの関連が薄い(古いAI画像生成ミーム動画を探すノスタルジー投稿)ため、ニュース性という点では参考程度の情報。
X
X — Image and Video Generation AI News
Accounts
The collection (output/x.posts.md) covers 40 posts from 37 accounts, gathered by
searching the terms "Dario", "LMEOW", "England", "Bosnia", "Vladimir Putin",
"Lando", "Solbiscuit", "Donald", "company os", "Slack". These are X's own
Explore-page trending topics for this session (see the table at the top of
x.posts.md), not search terms related to image/video generation AI. As a
result almost none of the accounts collected are relevant to this brief:
- @ctgptlb (AGIラボ, 1 post, 1,357 likes, ~691,000 views) — a Japanese AI-news
account; its one post here is about general AI development pace (Anthropic/
OpenAI/xAI), not image or video generation specifically. - @BenjaminPDixon (Pastor Ben, 1 post, 846 likes) and @beffjezos (Beff
(e/acc), 1 post, 1,344 likes) also posted about the same "Dario" news cycle
(AI regulation/pace), again general-AI-policy rather than image/video-gen.
@beffjezos is a well-known e/acc voice, so his framing is adversarial to the
"slow down" narrative rather than a genre-specific take.
All other high-engagement accounts (@NFL with 50,463 likes, @AnaKasparian
with 15,836 likes, @NFLHateMemes, @SVCarbaholic, @Daicaramel_, etc.) are
posting about sports, geopolitics, or unrelated meme coins ($LMEOW,
Solbiscuit) — no relation to image/video generation AI at all. - @joinmatrixos (Matrix OS, 1 post, 0 likes, ~39 views) is the only account
touching AI product territory, and even that is about an "AI Chief of
Staff" agent product, not image/video generation.
Posts
None of the 40 collected posts are about image or video generation AI
(no mentions of Midjourney, Stable Diffusion, Sora, Runway, Veo, Flux, Nano
Banana, ComfyUI, or similar). The closest the collection gets is general
AI-industry-pace chatter, surfaced only because "Dario" (Anthropic CEO Dario
Amodei) happened to be trending in Croatia this session:
-
@ctgptlb (#3) — 1,357 likes · 384 reposts · 21 replies · ~691,000 views
· 2026-09-12 · https://x.com/ctgptlb/status/2098917214741254175【速報】Sam、Elon、Darioが「AI開発のペースを落とす」方向で異例の一致。Anthropic CEO
Darioの提言にSamが賛同し、第三者評価の受け入れを約束。
An unusual-alignment story: Sam Altman, Elon Musk and Dario Amodei reportedly
agreeing AI development should slow down, with third-party evaluation. This
is about frontier-model pace/safety policy, not image/video generation. -
@BenjaminPDixon (#1) — 846 likes · 157 reposts · 44 replies · ~13,000
views · 2026-09-12 · https://x.com/BenjaminPDixon/status/2098901766351778076You all wanted Ai stopped so badly that they got Elon, Sam, Dario and all
of Washington DC ready to regulate it.
Same news cycle, skeptical/political framing of AI regulation — again
general AI policy, not generation tooling. -
@beffjezos (#4) — 1,344 likes · 82 reposts · 74 replies · ~100,000
views · 2026-09-13 · https://x.com/beffjezos/status/2099256177683222768Dario really really wants to be nationalized by the Dems.
The e/acc counter-reaction to the same Dario story — accelerationist
pushback against slowdown/regulation framing. -
@joinmatrixos (#34) — 0 likes · 0 reposts · 1 reply · ~39 views ·
2026-09-14 · https://x.com/joinmatrixos/status/2099519796710666359Your company has 20 tools, 6 AI agents, 14 dashboards... here's how to
build an AI Chief of Staff inside Matrix
Low-engagement product pitch for an AI agent orchestration tool — adjacent
to "AI news" only in the loosest sense; no image/video generation content.
No other post in the 40 touches AI at all — the rest is NFL injury news,
Premier League/Arsenal chatter, UK devolution funding debate, Bosnia/Herzegovina
culture-war posts, Putin/BRICS commentary, F1 (Lando Norris) fandom, meme
coins ($LMEOW, $Solbiscuit), Trump-family gossip, and a Boston-media jury
story — none relevant to this brief.
Signals
- Nothing rose or was dismissed on the theme, because nothing on the
theme was collected. The only AI-adjacent thread visible in this data is a
same-day split reaction to a "Dario/Sam/Elon agree to slow AI down" story —
interesting for AI policy, but off-topic for image/video generation. - What surprised me is the mismatch itself: the search terms fed into this
collection ("Dario", "LMEOW", "England", "Bosnia", "Vladimir Putin", "Lando",
"Solbiscuit", "Donald", "company os", "Slack") are exactly X's Explore
"trending in Croatia / Politics / Motorsport" list fromx.posts.md, not
image/video-generation search terms (e.g. "Midjourney", "Sora", "Nano
Banana", "Runway", "Stable Diffusion", "Flux", "Veo"). The worker appears to
have searched X's trending topics rather than the research theme.
Limits
- The collected data does not cover this brief's theme. Of the 40 posts
gathered underoutput/x.posts.md, effectively zero are about image or
video generation AI (closed- or open-source). The completion criterion
("analyze ~20 posts per network") cannot be met from this file for this
theme — there are 0 on-theme posts to analyze, only 3–4 tangential
AI-policy posts. - The search terms used by the collector were X's own Explore trending topics
for this session ("Dario", "LMEOW", "England", "Bosnia", "Vladimir Putin",
"Lando", "Solbiscuit", "Donald", "company os", "Slack"), geolocated mostly to
Croatia per X's own labeling — not terms related to image/video generation
AI. This looks like a collection-stage mismatch rather than X having "no
posts" on the theme. - I did not run my own searches — per the playbook, the worker's collection is
the only source for this stage, and I could not browse X myself in this
session. - Recommendation: re-run the X collection stage with search terms drawn
from the actual brief (e.g. "Midjourney", "Sora 2", "Nano Banana", "Runway
Gen", "Stable Diffusion", "Flux", "Veo 3", "Kling", "ComfyUI", "open source
image model", "video generation AI") before this platform's findings can
meaningfully feed the closed-source/open-source synthesis report.
YouTube
YouTube — 画像・動画生成AIの最新ニュース
Channels
正確な登録者数はYouTube検索結果ページがJavaScriptレンダリングのため取得できなかった(Limits参照)。動画タイトル・説明から確認できた発信元は以下の通り。
- Runway(公式チャンネル) — Gen-4.5系の公式発表動画を連発。企業公式チャンネル。
- fal Academy — オープンソースモデル(LTX-2など)の解説・チュートリアル特化チャンネル。
- Dreamina / CapCut系チャンネル — ByteDanceのSeedream/Seedance関連のハウツー動画。
- ComfyUI系チュートリアルチャンネル(複数、仏語・英語) — Z-Image、Qwen-Image、Wanなどローカル実行の解説が中心。
- 比較・レビュー系個人チャンネル(複数) — "Best AI Video Generator 2026"のような比較動画を量産しており、視聴数を稼ぐジャンルになっている。
Videos
クローズドソース
- "Introducing Gen-4.5" / "Cinematic Worlds with Gen-4.5" — Runway公式 — 2025-12-01, 2026-01-22 — https://www.youtube.com/watch?v=ei2PsDpPbB4 / https://www.youtube.com/watch?v=IKGRhqk7Ql0 — RunwayがGen-4.5(開発中コード名"Whisper Thunder")を発表、モーション再現性を強調。
- "The New Gemini Image Generator is Insane (Nano Banana 2)" — 2026年前半 — https://www.youtube.com/watch?v=nikIxHM_AQY — GoogleのGemini画像生成(Nano Banana系列)の後継版が話題に。
- "Ultimate Nano Banana Pro Guide 2026: How to Use Gemini 3 Image AI" — https://www.youtube.com/watch?v=ZCw325FiS78 — Nano Banana ProがGemini 3ベースの画像生成として定着したことを解説。
- "Midjourney 8.1 - BIG Alpha TEST!" — 2026-04-15 — https://www.youtube.com/watch?v=u9xuHoLFtF0 — Midjourney V8.1アルファをNano Banana Pro・Grokと比較。
- "ByteDance Seedance 2.5: 30-Second AI Video Generation with 50 Reference Inputs" — https://www.youtube.com/watch?v=O2KNqKLANtQ — ByteDanceが2026-06-23のVolcano Engine FORCEで発表したSeedance 2.5を紹介、参照画像50枚対応。
- "Seedream 5.0 Tested & Seedance 2.5 Leaks Are Unreal!" — https://www.youtube.com/watch?v=pn-YwWn3kkM — Seedream 5.0 Pro(レイヤー生成・最大10枚参照画像対応、2026-07-15リリース)のテスト。
- "The New ChatGPT Images 2.5 vs Gemini 3.1: We Have a Clear Winner" — 検索時点で「4日前」投稿(brief日付2026-09-15付近) — https://www.youtube.com/watch?v=EnwL5-RC2_E — OpenAIのGPT-Image-2.5(2026-09-08にChatGPT/API投入、Flare・Sunburstの2モデル体制)とGemini比較。
- "State of AI Video in 2026: Sora 2, Veo 3.1, Kling 3.0 & Cinematic Prompting Workflows" — 2026-03-20 — https://www.youtube.com/watch?v=vtJzDgmWVWc — クローズドソース動画3強(Sora 2 / Veo 3.1 / Kling 3.0)の使い分けとプロンプト設計を整理。
- "Kling 3.0 vs Seedance 2.0 vs Veo 3.1 vs Sora 2: The Ultimate AI Video Comparison" — https://www.youtube.com/watch?v=-MluR9dqt5w — クローズドソース系の4モデル横並び比較、Klingが物理演算で高評価。
オープンソース
- "FLUX.2 Just Beat Every AI Image Model — Black Forest Labs' Most Powerful Release Yet" — 2025-11-27 — https://www.youtube.com/watch?v=VMBSUBKON_U — FLUX.2発表(2025-11-25)。Schnell/KleinはApacheライセンスで公開、Dev/Pro/Flexは非商用・プロプライエタリと階層化されたライセンス構成が特徴。
- "Flux.2 New Open Source King? Architecture FULL guide" — 2025-11-25 — https://www.youtube.com/watch?v=D0_QGrdtvEg — FLUX.2のアーキテクチャ(Mistralベースの視覚言語モデル採用)を解説。
- "Tencent HunyuanVideo 1.5 has been officially open-sourced!" — 2025-11-21 — https://www.youtube.com/watch?v=MJShdc8tkkA — TencentがHunyuanVideo 1.5を正式オープンソース化、コンシューマGPUで動作可能と強調。
- "HunyuanVideo 1.5 vs Wan 2.7 Comparison: Which is The Best Free Local Video AI Generation Model?" — 2026-06-25 — https://www.youtube.com/watch?v=4GNT4-QYekg — VRAM要件・モーション品質・人物再現度でHunyuanVideo 1.5とWan 2.7を比較。
- "How to Create EPIC AI Films With WAN Animate & WAN 2.5 (Open Source and Uncensored)" — 2025-11-04 — https://www.youtube.com/watch?v=vQKvaJ0DSAk — Wan 2.2 Animate / Wan 2.5をオープンソース・無検閲として紹介。
- "New Qwen Image 2512: Better Than Z-Image? (Open Source & Free)" — 2026-01-05 — https://www.youtube.com/watch?v=uAGH_yRZ2Gw — AlibabaのQwen-Image 2512(Apache 2.0)とZ-Imageを比較、文字描画・写実性を検証。
- "Is Flux 2.0 DEAD? Qwen image 2512 & Z-Image vs. The King (15 Stress Tests)" — 2026-01-04 — https://www.youtube.com/watch?v=54zvSiAWz2Y — オープンソース画像生成の王座争いをストレステストで検証。
- "LTX-2 by Lightricks: Open-Source 4K Video Generation With Audio (50 FPS)" — 2026-01-10 — https://www.youtube.com/watch?v=t5X5JR_CAv4 — LTX-2の目玉機能「音声・映像同時生成(4K/50fps)」を解説。オープンソース動画生成で唯一のネイティブ音声対応モデルと位置付け。
- "FREE Wan 3.0: what actually shipped (there are no weights) and How to use it for FREE" — https://www.youtube.com/watch?v=gbI8XV4Szrk — 2026-08-06にパブリックベータ開始したWan 3.0について、重みは公開されていない(Wan 2.xまでのApache 2.0路線から転換)ことを指摘。オープンソース界隈で議論の的に。
Signals
- クローズドソースは「陣営再編」の年。OpenAI(GPT-Image-2.5、2026-09-08投入、Flare/Sunburstの二段構成)、Google(Nano Banana Pro / Gemini 3 Pro Image)、ByteDance(Seedream 5.0 Pro/Seedance 2.5)、Runway(Gen-4.5)、Midjourney(V8.1→V8.2)、中国勢のKling 3.0・Sora 2・Veo 3.1が数ヶ月おきに首位を奪い合う比較動画が量産されている。
- 中国発モデルの存在感が急速に拡大:ByteDance(Seedream/Seedance)、Alibaba(Qwen-Image、Wan)、Tencent(HunyuanVideo)が画像・動画の両方でオープン/クローズド双方に食い込んでいる。
- オープンソース陣営で「本当にオープンか」が争点化:Black Forest LabsのFLUX.2はSchnell/Klein(Apache)とDev/Pro/Flex(非商用・プロプライエタリ)でライセンスを階層化。Alibabaも Wan 2.xまでApache 2.0で重み公開していたが、Wan 3.0では重み非公開に転換したと指摘する動画が出ている——「オープンソースを謳うブランドが実は閉じていく」流れが視聴者の関心を集めている。
- 音声統合がオープンソース動画生成の新戦場:LTX-2/2.3/2.5(Lightricks)が「単一の拡散プロセスで映像と音声を同時生成」を売りにしており、これはクローズドソース勢にまだない特徴として比較動画で頻繁に言及される。
- ComfyUIエコシステムがオープンソース画像・動画生成の実行基盤として定着。Z-Image、Qwen-Image、Wan、HunyuanVideoいずれもComfyUI向けチュートリアルが大量に作られている。
- ローカル実行のハードル低下がオープンソース側の推しポイント:HunyuanVideo 1.5は「コンシューマGPUで動く」、Wan 2.2は「8GB VRAMのGGUF量子化版で動く」ことが繰り返し強調されている。
- 比較・格付け系動画("Best AI Image/Video Generator 2026"のような)が独立したジャンルとして成立しており、月次で最新モデルを追加更新する運用が主流。
Limits
- YouTubeの検索結果ページ(
youtube.com/results)および個別動画ページ(youtube.com/watch)はJavaScriptで動的にレンダリングされており、WebFetchでは静的HTML(フッターのみ)しか取得できなかった。そのため正確な再生数・登録者数・アップロード日時の多くは確認できず、Web検索のスニペットから読み取れた範囲の情報(タイトル、概要、検索結果に付随する日付)のみで構成している。 - 上記の制約により、コメント欄の内容は一切確認できていない。
- 日本語圏のYouTubeチャンネル(日本語コメント・日本語レビュー動画)は今回の検索クエリでは主要にヒットしなかった。英語・フランス語・スペイン語・ロシア語のチャンネルが中心。
- Wan 3.0の「重み非公開」情報は動画タイトルからの示唆であり、当該動画本文を直接開いて検証することはできなかった(上記のレンダリング制約のため)。
Bluesky
Bluesky — 画像・動画生成AIニュース
Accounts
- gen-ai.news(@gen-ai.news)— 週2回、画像・動画生成の新モデル・研究・製品リリースを2分で読めるようにまとめる専門ニュースアカウント。フォロワー33人だが投稿は166件と密度が高く、2026年9月の直近投稿だけで20件取得できた。クローズド/オープン両方をカバー。
- DFL inc.(@dfl.bsky.social)— 「Design & Web creation」を名乗るクリエイター。Nano Banana 2で生成した写実系画像をほぼ毎日投稿し、フォロワー237人ながら1投稿あたり10〜89いいねと反応が良い。
- ardelbufai.bsky.social(@ardelbufai.bsky.social)— キャラクターLoRA学習など個人のAI画像制作ログを投稿するアカウント。Krea 2やMinimax H3を使ったワークフローに言及。
- ostris.com(@ostris.com)— オープンソースLoRA学習ツール「AI-Toolkit」の開発者。Flex.1-alpha/HiDream/Wan2.1のファインチューニング情報を発信する重要アカウントだが、取得できた投稿は2025年4〜1月のものが最新で、今回のブリーフが求める「最新ニュース」としては古すぎたため参考情報にとどめた。
Posts
- LTX-2.5がオープンウェイトで公開 — 2026-09-12、gen-ai.news「Lightricks released LTX-2.5, an open-weight video model that generates multi-shot scenes in one pass.」いいね1。リンク
- 旧LTX-2.3はレガシー化 — 2026-09-12、同アカウント「Lightricks moved LTX-2.3 to legacy status. LTX-2.5 is now the recommended model.」LTX系オープンモデルの急速なイテレーションを示す。リンク
- AUTOMATIC1111をGradioで再構築するチュートリアル公開 — 2026-09-13「Hugging Face published a walkthrough showing how AUTOMATIC1111's core interface can be rebuilt using Gradio.」リポスト1。リンク
- Vidu S1/Q3が音声同期に対応(クローズド) — 2026-09-14「Shengshu quietly updated its Vidu model to S1, with better video quality and motion coherence.」及び同日「Vidu Q3 now generates audio natively alongside video.」リンク
- ChatGPT Imagesが2モデルに分割(クローズド) — 2026-09-11「OpenAI is splitting ChatGPT image generation into two models: Flare for speed, Sunburst for precise editing.」リンク
- RunwayがAdobe Premiere Pro/After Effectsに統合 — 2026-09-10「Runway is now built into Adobe Premiere Pro and After Effects. Generate media, restyle footage.」プロ向けツールへの生成AI組み込みが加速。リンク
- ダニー・ボイル監督が新作でAI使用を公表 — 2026-09-13「Danny Boyle publicly disclosed using generative AI to animate still photos in his new film Ink.」映像業界でのAI利用開示の一例。リンク
- Nano Banana 2作例が最もバズった投稿(クローズド) — 2026-09-04、DFL inc.「AI image generation #Nano Banana 2 #masterpiece #realistic photo #landscape...」いいね89・リポスト7と個人アカウントの投稿として突出。リンク
- Nano Banana 2作例が継続的に高反応 — 2026-09-07、同アカウント、いいね52・リポスト3。ほぼ毎日投稿され、Nano Banana 2への個人クリエイターの支持が継続していることを示す。リンク
- Krea 2キャラクターLoRA学習、データセットはMinimax H3で生成 — 2026-08-25、ardelbufai.bsky.social「This is Garrett Simms, a Krea 2 character LORA I'm working on... All of the pics in my dataset were created by using Minimax H3 with a single headshot portrait as a reference.」オープンのLoRA学習にクローズドモデルの出力を使う実例。リンク
Signals
- クローズド側の目立った動き: Google「Nano Banana 2」が個人クリエイターの実制作で圧倒的な人気(DFL inc.の投稿がBluesky上で見た中で最もエンゲージメント高)。OpenAIはChatGPT Imagesを速度重視の「Flare」と精密編集の「Sunburst」に分割するなど、単一モデルからの多様化が進む。動画系は音声同期がデフォルト化(Vidu Q3など)。
- オープンソース側の目立った動き: LightricksのLTXシリーズが「LTXV → LTX-2 → LTX-2.3(レガシー化)→ LTX-2.5(オープンウェイト)」と短期間で世代交代し、オープンウェイト公開を明示的にアピール。旧世代UI「AUTOMATIC1111」もGradioでの再構築という形で再注目されている。
- プロツールへの統合が加速: Runway→Adobe Premiere/After Effects、DaVinci Resolve 21.1のAIアシスタント、Apple iOS 27のClean Upなど、生成AIが単体アプリからクリエイティブスイートの標準機能へ移行する流れが複数アカウントで報告されている。
- オープン/クローズドの境界が曖昧な実例: 個人のLoRA学習ワークフローで、クローズドモデル(Minimax H3)の出力をオープンモデル(Krea 2)の学習データに使う事例が見られ、両陣営が実制作レベルで混ざり合っている。
- Bluesky上のAI生成AI言説は、キュレーション型ニュースアカウント(gen-ai.news)と個人クリエイターの実作例投稿(dfl.bsky.social等)の二極で構成されており、後者の方がいいね数などの反応は大きい。
Limits
- Bluesky公開API
app.bsky.feed.searchPosts(キーワード全文検索)は、クエリ内容によらず一貫して403 Forbiddenを返し、利用できなかった。そのため自由なキーワード横断検索ではなく、Web検索で発見した既知アカウントのgetAuthorFeed(タイムライン取得)で代替した。結果として、Web検索に出てこないアカウントの投稿は今回のサンプルに含まれていない可能性がある。 bsky.appのWebページはクライアントサイドレンダリングのSPAで、投稿本文やいいね数がHTML/メタタグに含まれず、WebFetchで直接読み取ることができなかった(web-cdn.bsky.appでも同様)。- ComfyUIワークフロー投稿で知られる
tenofas.bsky.socialはプロフィール取得が400 Bad Requestとなり、データを取得できなかった。 - オープンソースLoRA学習ツール「AI-Toolkit」開発者
ostris.comは重要アカウントだが、取得できた最新投稿が2025年4月までで、今回求められる「最新ニュース」の期間外だったため参考情報のみに留めた。 - 完了基準にある「約20件の投稿の解析」は、gen-ai.news(20件)とDFL inc.(15件)で計35件のフィード投稿を確認し、うち関連性の高いものを上記に厳選する形で満たした。
Lemmy
Lemmy — 画像・動画生成AIニュース
Communities
- [email protected](link)— 5.71K購読者(うちローカル1.23K)、投稿数1.41K件。「お気に入りのAIアート生成技術について語る」場、AI Hordeプロジェクトとも関連。
- [email protected](link)— 2,360購読者、投稿数3,520件。Stable Diffusionやオープンウェイトモデルで作った作品を共有するコミュニティ。
- [email protected]("Stable Diffusion Anime")— 1,600購読者、投稿数3,320件、1日43人/週80人がアクティブ。アニメ系AIアート専用、SFW限定。
- [email protected] — 汎用テック系コミュニティ。クローズドソースのAI企業ニュース(Sora終了、YCの発言など)はここに流れてくる。画像/動画生成AI専用の大規模コミュニティは見当たらなかった。
Posts
- "OpenAI: decides to shut down their AI slop video generating model Sora. Everyone else:" — technology, lemmy.world/post/44721138。日付・スコア非公開(サーバーエラーでページ本文は取得不可、Web検索のタイトルのみ確認)。文脈:OpenAIは2026年3月24日に開発者へSora終了を通知、2026年4月26日にSoraアプリ/Web版を停止、Sora 2 APIも2026年9月24日に廃止予定(NPR、techxplore)。Disneyとの10億ドル提携(Sora内でのキャラクター利用)も終了。Lemmyの反応はタイトル通り皮肉混じりで「AIスロップ生成モデル」と揶揄。
- "Y Combinator's Garry Tan wants US open-weight AI labs to 'distill' frontier models, too" — technology, lemmy.world/post/51925475、投稿2時間前(2026-09-15付近)、スコア17(downvote 1)、コメント2件。YCのGarry Tanが、米国のオープンウェイトAIラボにもフロンティアモデルの蒸留を推進すべきと提言、中国製オープンモデルへの依存低減が狙い。コメントは懐疑的で、「盗んだデータで学習したモデルを企業が所有すべきでない、蒸留どころか強制オープンソース化すべき」との強い意見あり。
- "Watch at the Burning Falls" — stable_diffusion_art, civitai画像リンク、2026-09-15投稿(1時間前)、スコア5、投稿者Even_Adder。使用モデル:Krea2 turbo(ComfyUI)。オープンウェイト系の新モデルKrea2が実際に使われている一例。
- "Path Beneath the Watching Eye" — stable_diffusion_art、2026-09-14投稿、スコア9。こちらもKrea2 turbo(ComfyUI)製作、風景系作品。
- "Cozy Kit" — stable_diffusion_art、2026-09-14投稿(13時間前)、スコア3。モデルはStable Diffusion系、パジャマ姿の人物とキツネのイラスト。
- "DoSolfachord Coolia - Yu☆Gi☆Oh!" — share_anime_art、2026-09-14投稿、スコア22(今回集めた中で最高)。モデルは
waiANIMA_v10Base10、アニメ系オープンウェイトモデルの人気ぶりがうかがえる。 - "Megumin - Kono Subarashii Sekai ni Shukufuku wo!" — share_anime_art、2026-09-14投稿(13時間前)、スコア14、モデルは
anima_baseV10。 - "Ibuki Douji - Fate/Grand Order" — share_anime_art、2026-09-15投稿(1時間前)、スコア2、投稿者Even_Adder、カスタムアニメLoRA + Stable Diffusion。
- "Kirarazaka Marina - Takopii no Genzai" — share_anime_art、2026-09-14投稿(7時間前)、スコア2、モデルは
BASBetterAnimeStyleAnimaBase v10。 - "GitHub: shootthesound/comfyUI-Realtime-Lora v2" — [email protected]、lemmy.world/post/40601816、投稿約9ヶ月前、スコア6(downvote1)、コメント0。ComfyUI内でLoRAの学習・ブロック編集・保存ができる拡張ツールで、Z-image、Flux Klein、SDXL、Flux、WAN 2.2、SD1.5と幅広いオープンウェイトモデルに対応と紹介。
Signals
- オープンソース系はLemmyの本丸:技術寄り・自由ソフトウェア寄りの住人が多いLemmyらしく、投稿のほとんどはStable Diffusion系・アニメLoRA・ComfyUIワークフローなど、オープンウェイトモデルの実作品共有とツール紹介。CivitAIへの画像リンクが標準フォーマット。
- Krea2 turboとWAN 2.2/Z-image/Flux Kleinがローカル生成の最新トレンドとして言及されている(ComfyUI拡張のサポート対象リストにも並ぶ)。
- クローズドソース系の話題は薄いが辛口:Sora終了のニュースは「AIスロップ」と揶揄され、OpenAIへの否定的な論調が強い。YC Garry Tanの「蒸留」提言スレッドでも、企業のクローズドモデル所有そのものへの反発(学習データの出所問題)が目立つ。
- スコアは全体的に低め(数〜20台)で、Redditのような数千スコアの巨大バズ投稿はLemmyには存在しない。話題の絶対量よりも「濃いオープンソース実践コミュニティ」という性格が強い。
Limits
- Lemmyは画像・動画生成AI専用の大規模ハブが乏しく、20件のポストを厳密に集めることはできなかった(実際に内容を確認・要約できたのは10件、うち1件はページ取得エラーのためタイトルと外部報道のみで裏付け)。
lemmy.world/post/44721138(Sora終了スレッド)は本文取得時に一貫してHTTP 500/403エラーとなり、投稿日時・スコア・コメント本文を直接確認できなかった。タイトルと文脈は検索結果と外部報道で補完。- Midjourney v7、Nano Banana(Google)、Grok Imagine、Runway、Klingといった主要クローズドソースサービス固有のLemmy投稿は検索で見つからなかった。Lemmyコミュニティではこれらの話題が実質的に不在。
lemmy.mlやlemm.ee単体での目立った関連投稿も見つからず、話題は主にlemmy.world(一般テック系)とlemmy.dbzer0.com(AIアート専門コミュニティ、lemmy.world経由で閲覧)に集中していた。
Pinterest — 画像・動画生成AIの最新ニュース
検索語「Image and Video Generation AI News」でワーカーが収集した50件のピンをすべて画像として確認した(ジャンル分けなし、単一クエリの結果)。
Visual themes
- 「ロボット/サイボーグの顔」が量産ニュースサムネの定番モチーフ: 白いヒューマノイドロボットのニュースキャスター([6]の男性、[26]のスーツ姿でBREAKING NEWSの席に座るロボット)、半分機械化された横顔([1], [23], [42])など、AIニュースまとめ系ピンの大半がこの「ロボット顔+ネオンブルーの背景」で統一されている。実際のサービス画面より抽象的なAIアイコンとしてロボットが多用されている。
- YouTubeサムネ風「驚いた顔の男性+カラフルなロゴアイコン」: [4], [19], [43]は同じ構図(ヒゲの白人男性のリアクション顔+OpenAI/Google/Meta/Microsoft/Notionなどのロゴを円形ネオンで並べる)。[41]も驚愕顔+サイバー加工の顔という同系統。週次/日次「AI NEWS」動画の定番フォーマットとして繰り返し出現している。
- ネイビー×ネオン(シアン/マゼンタ/パープル)のインフォグラフィック: [8]「6+ Best AI Video Generation Websites」、[29]「5+ Best AI Video Generation Websites」(ほぼ同一構成でRunway/Pika/Kling/Luma/Canva/Hailuoを毎回同じ並びで紹介)、[40]「AI Video Creation Tools」(Veo3/Gemini Video/Kling/Runway/Pika/Luma/Hailuo/Descript/ElevenLabsなど20ツールを機能別に整理)。配色と情報設計がテンプレ化しており、量産系AIブログ・アフィリエイト記事のフォーマットであることが分かる[8, 29, 40, 12]。
- 「クローズド大手モデル」のプロダクト公式ビジュアル: Google Veo 2の公式風スクリーンショット([2], [10]、フラミンゴやアニメ調少女、犬など同じ素材の使い回し)、Gemini API([15])、Vidu S1([38], 中国ShengShu Technology)、VASA-1([34], Microsoft Researchの1枚画像+音声からのトーキングヘッド生成)など、企業公式のプロモ画像がそのままピン化されている。
- 写実的な人物ポートレート+ワイヤーフレーム/デジタル顔の重ね合わせ: [18]の女性の顔にAI生成音声の波形とワイヤーフレームの頭部を重ねた合成画像は、リップシンク・音声クローン系ツール([25]「Top 10 Lip Sync Tools」)の訴求に典型的な意匠。
- AI生成コンテンツへの懐疑・警告を扱う画像: ロボット+スマホ+「FAKE」の赤いスタンプ+猫の顔([3])、ディープフェイク猫ミーム([46]、いわゆる「スプリングフィールドのペット食害デマ」の合成画像を模した政治的AI生成画像の実例)、AI生成動画の「良いか悪いか」を天秤にかけるインフォグラフィック([30])など、技術礼賛一辺倒ではなく信頼性への懸念を扱うピンも一定数ある。
- 画風変換・スタイル一貫性のデモ画像: [7]は同じ人物・同じ車を「木のブロック」「折り紙」「レゴ」「花」に変換した比較グリッド(Luminaireというツールのブランドが写っている)。[13]はキャラクター一貫性(Character Consistency)を売りにするFlowFrameというツールのUI。生成AIの「同一キャラを保ったまま様式変換する」需要がビジュアルとして目立つ。
Notable pins
- [7] 画風変換デモ画像(Luminaire) — 人物・犬・車を木材/折り紙/レゴ/花に変換する比較グリッド。テキストプロンプトだけで一貫した被写体を様々な素材に変換する「スタイル一貫性」トレンドを象徴する一枚。
- [10] / [2] Google Veo 2 公式ビジュアル — 「state-of-the-art video generation model」と明記されたVideoFX誘導のプロモ画像。クローズドソース大手の代表例。
- [34] Microsoft VASA-1 — 1枚の静止画+音声クリップ(+任意の感情コントロール信号)からリアルなトーキングフェイス動画を生成する研究発表のビジュアル。技術的にはかなり具体的な「入力→出力」の図解になっている。
- [38] Vidu S1 (ShengShu Technology) — 「The World's Most Advanced Model for Real-Time AI Interaction」を謳う中国発モデルの公式画像。米系(OpenAI/Google)以外のクローズドプレイヤーの存在感を示す。
- [31] DeepFloyd IF風アーキテクチャ図(AIM/Analytics India Magazine制作) — "Frozen T5 XXL" → "IF-I-M(400M)" → "Stable x4" という处理パイプラインを図解したコラージュ。テキストから画像への内部構造を扱う、やや技術寄りの解説ピン。
- [46] ディープフェイク政治ミームの実例(Springfield/Ohio) — 「fake news won't tell you what's really happening in Springfield」というAI生成画像付き投稿のキャプチャと、猫を政治家風に合成した画像。AI生成コンテンツが誤情報・扇動に使われた実例として唯一の生々しいスクリーンショット。
- [8] / [29] 「Best AI Video Generation Websites」系まとめ画像(2種) — Runway/Pika/Kling AI/Luma AI/Canva/Hailuoを毎回同じ並びで紹介するテンプレ。Pinterest上でのAI動画ツール比較コンテンツの「型」を示す。
- [40] 「AI Tools for Video Editing」20選インフォグラフィック — Text-to-Video(Veo3, Gemini Video, Kling, Runway, Pika)、Image-to-Video、編集(Descript, Topaz, Clipsai, Submagic)、音声(ElevenLabs, PlayHT)まで網羅した最も情報量の多い1枚。
- [13] FlowFrame UI画面 — 「Character Consistency」を前面に押し出したAI動画生成ソフトのスクリーンショット。同一キャラクターを複数シーンで保つニーズの高さを示す具体例。
- [47] ByteDanceとハリウッドのAI著作権合意ニュース記事 — 「ByteDance and Hollywood reach global deal on AI copyright」という見出し付きニュース記事のスクリーンショット。MPA(Motion Picture Association)との著作権保護強化合意という、具体的な業界動向を伝える数少ない記事系ピン。
Signals
- いま強い: (1) Runway・Pika・Kling AI・Luma AI・Canva・Hailuoの6社が「ベスト動画生成ツール」まとめの常連として繰り返し登場しており([8][29][40])、この顔ぶりが現時点のPinterest上でのデファクトの比較対象になっている。(2) 「キャラクター/被写体の一貫性」([7][13])と「リップシンク・音声クローン」([18][25])が、単純なテキスト→画像/動画よりも訴求ポイントとして目立つ。(3) AI生成コンテンツの真贋・信頼性への警戒([3][30][46])が、礼賛系コンテンツと並存している。
- 薄い/ほぼ無い: Stable Diffusion、ComfyUI、Flux、Wan、HunyuanVideoなど典型的なオープンソース画像/動画生成モデル名を冠したピンは50件中ほぼ見当たらない(唯一[31]がDeepFloyd IF的な技術図解に近いが、モデル名の明記はない)。Pinterestの収集結果は「クローズドソースの商用ツール紹介」と「量産系AIニュースまとめ」に大きく偏っており、オープンソース陣営の動きはこのプラットフォームからはほとんど拾えなかった。
- やや意外だった点: 具体的な一次ニュース(製品発表・提携)を伝えるピンが少なく、大半は「まとめ記事」「YouTube動画のサムネ」「ストック画像/インフォグラフィック」で、Pinterestは速報性のあるニュースソースというより、ツール紹介・ハウツー・ビジュアル訴求のプラットフォームとして機能していることが分かる。
Limits
- ピンのテーブルにジャンル分け(
## <genre> (n))がなく、単一クエリ「Image and Video Generation AI News」の結果50件のみを対象にした。オープンソース/クローズドソースを分けた個別検索は行われていないため、オープンソース動向の薄さは検索クエリの偏りによる可能性がある。 - タイトルが「(untitled)」のピンが5件([2][13][18][33][47の一部])あり、画像本体から判断した内容であって元の投稿文脈(誰が・いつ投稿したか)は不明。
- 各ピンの投稿日時・いいね数・保存数などのエンゲージメント指標はmanifest.json/pins.mdに含まれておらず、どのピンが実際に「バズっている」かは判定できなかった。
- プレイブックの指示通りワーカー収集済みの画像のみを対象とし、Pinterest上での追加検索・追加ページ閲覧は行っていない。
推奨アクション
- Xの収集ステージを、実際のブリーフに即した検索語(Midjourney、Sora 2、Nano Banana、Runway Gen、Stable Diffusion、Flux、Veo 3、Kling、ComfyUIなど)で再実行する。
- Wan 3.0の重み公開有無とFLUX.2のライセンス動向を、オープンソースの看板と実態の乖離というテーマで継続ウォッチする。
- Sora 2 API廃止(2026-09-24予定)後のユーザー移動先をLemmy/Redditの次回収集で重点的に追う。
- Reddit/Lemmyの次回収集ではr/StableDiffusion、r/comfyui、r/midjourneyなど中核コミュニティを対象に加え完了基準の件数に近づける。
- Pinterestの次回収集ではオープンソースに絞ったジャンル検索を追加し、商用ツール偏重を補正する。
収集画像


















































データ品質メモ
Xは収集語がX自身のトレンドトピックでテーマと無関係だったため画像・動画生成AI関連投稿が実質0件だった。Reddit(12/約20件)とLemmy(10/約20件)は完了基準の件数に届かず、Pinterestはオープンソース固有のピンがほぼ皆無でエンゲージメント指標も取得不能。



