KEN’S CAT LOG

Image and Video Generation AI News — 2026-09-21

クローズド勢はSora 2/Kling 3.0/Seedance 2.0が音声同期と物理精度で競り合い、Klingが30億ドル調達で勢いを増す一方、オープン勢はAlibaba(Wan/Qwen)・Tencent(HunyuanVideo)・Black Forest Labs(Flux)が「無料でも大差ない」という空気を広げているが、Xステージは検索語の事故で画像・動画生成AIの手がかりを一つも拾えなかった。

画像・動画生成AIニュースまとめ — 2026-09-21

よっしゃ、今週の画像・動画生成AI界隈、マジで動きまくってるから一気にまとめるぜ🔥 クローズド側はSora 2・Kling 3.0・Seedance 2.0あたりが「音声同期×物理精度」でガチンコバトル中で、Kling作ってるKuaishouは30億ドルも調達してめちゃ勢い出してる💰一方オープンソース側はAlibaba(Wan/Qwen)・Tencent(HunyuanVideo)・Black Forest Labs(Flux)が「無料でローカルで動くやつ」を武器にクローズド勢を追い上げ中📈 ただしSNSごとに拾える話題の濃さはバラバラで、Xだけは今回検索語がバグって画像・動画生成AIの話が1件も拾えなかったのがマジで痛いポイント😭

Across platforms

  • クローズド vs オープンの「もう対して変わんなくね?」論争がどこでも起きてる。Reddit(#2)では「GPT Image 2.5 Flareすごい」って声と「ComfyUI+KREA2でも同じ結果出るじゃん」って声が同じスレでぶつかってたし、YouTubeでもQwen-Image系動画が軒並み「Nano Banana Proの代替になるか」ってタイトル付けてるし、Pinterestの道具まとめピン(#31)もVeo・Kling・RunwayとStable Video Diffusionを同じチートシートに並べてる。もうガチで「無料でいいじゃん」って空気が広がってきてる感じ🤔
  • 中国勢がクローズドもオープンも両方強い。Alibaba(Wan/Qwen)、Tencent(HunyuanVideo)、ByteDance(Seedance/Seedream)、Kuaishou(Kling)って感じで、Lemmyの記事(#7)は「中国の2026年オープンソース転換は地政学戦略」って分析までしてる。アメリカ勢(OpenAI/Google)が閉じたAPIで囲い込む一方、中国勢はオープンウェイトもガンガン出してくる二正面作戦って感じ🐉
  • 「本当に無料の動画生成AIなんて存在しない」って諦めムード。Redditの複数スレ(#1, #3, #6)で「無料枠は数秒だけ、電気代とハード代は絶対かかる」って結論がほぼ総意になってた⚡
  • Sora(OpenAI)の失速がBlueskyとLemmyで同時に話題。コンシューマーアプリは4月に終了済み、APIも2026年9月24日に終了予定で、Blueskyでは「歓迎ムード」、Lemmyでは「動画生成AIは企業向けじゃないと儲からない」って冷静な分析が出てた📉
  • AIっぽさへの不信感がプラットフォーム横断で強い。Reddit(#4)は凝ったプロンプト技巧の投稿に「まだAIってバレバレじゃん」と総攻撃、Pinterestは「本物か判定するアイコン」系のピンが定番ジャンル、Blueskyでは「Midjourneyの学習データにCSAM混入」告発がいいね79件で今回最大バズってた😨

Platform by platform

Redditは8サブレディット・12スレッドを解析。r/generativeAIやr/perchanceで「無料枠を探す」系の議論が中心で、Wan・Minimax・GPT Image 2.5 Flare・Seedance・KREA2・Perchanceといったツール固有名詞がしっかり拾えた✨ ただしr/StableDiffusionのようなオープンソース専門コミュニティは収集対象に入っておらず、オープンソース側の情報がやや薄め。ブリーフの「各SNS約20件」基準には届いていない(12件どまり)。

Xは今回ガチで事故った😱 収集ワーカーがテーマ語(Sora、Midjourney等)じゃなく、たまたまその時のExploreトレンド(グリーンランド、ロシア、アーセナルなど)をそのまま検索しちゃって、40投稿集めたのに画像・動画生成AI関連は0件。Redditで拾えたような固有名詞がXでは1つも出てこなかった。これは媒体の限界じゃなくて検索語選定ミスによるもの。

YouTubeはチャンネル登録者数・再生数こそ取得できなかったけど、内容面ではかなり充実📺 クローズド側はSora 2・Nano Banana Pro/2・Kling 3.0・Seedance 2.0・Midjourney月次アプデ、オープン側はWan2.2〜2.7・Qwen-Image・HunyuanVideo・Flux.2/Klein とバランスよく拾えてる。「クローズド発の新機能を追いかけてオープン側が代替を出す」流れがタイトルからも見て取れる。

Blueskyは検索APIが403で全滅💀 既知アカウント頼りの迂回収集になったけど、Replicate公式アカウント経由でGPT Image 2・Seedance 2.0・Runway Gen-4.5・Kling 3.0・Vidu Q3のリリース事実は拾えた。オープンソース勢の一次投稿はほぼ皆無で、Wan 3.0はまさかの「オープンウェイト明言なし」な非公式サードパーティ宣伝アカウントのみ。あと反AI感情強めのコミュニティ性もはっきり出てた。

Lemmyは12クエリで横断検索、実質12件のニュースに絞り込み📰 Sora API終了とKling急成長の対比記事、Midjourneyの「水中エコー医療スキャナー」ピボット炎上(score 41〜73でLemmy最大バズ)、Qwen-Image-2.1・HunyuanVideo-I2Vといったオープン系リリースが拾えた。全体的にクローズド系の話題(7〜8件)がオープン系(4〜5件)よりやや優勢だった。

Pinterestは50ピンのうち25件を深掘り🖼️ クローズド勢(Veo, Gemini, Kling, Runway, Pika, GPT-6 Astra, Grok)がブランドとして目立つ一方、オープンソースは「Open Models / open weights」って見出しレベルの言及どまりで、Flux・ComfyUI・LTX-Video・Wan・SDXLといった具体名は1つも出てこなかった。フォーマット的にも「反応系サムネ」「ネオン風インフォグラフィック」「Before/After比較」がジャンルの主役で、技術的な深掘りは苦手な媒体っぽい。

What to watch

Recommendations

  • Xステージは検索語をSora・Midjourney・Nano Banana・Wan・Klingなどテーマ固有名詞に差し替えて再実行すべき。
  • Redditの次回収集にはr/StableDiffusionやr/comfyuiなどオープンソース専門コミュニティを加えてバランスを取るべき。
  • Sora API終了(9/24)後の企業向け動画AI市場(Synthesia, HeyGen, Kling, Argil)の動きを次回追跡すべき。
  • Wan 3.0が公式にオープンウェイトを維持するかどうか、Alibaba公式発表で確認すべき。
  • BlueskyはキーワードAPIが403で使えないため、既知アカウントリストを拡充する形で監視を継続すべき。
  • Midjourneyの医療スキャナー事業とハリウッド著作権訴訟の展開を次回チェックすべき。

Data quality

Xステージは検索語がテーマと無関係なExploreトレンド(グリーンランド、ロシア、アーセナル等)に引っ張られ、画像・動画生成AI関連の投稿を1件も拾えなかった。実質「収集失敗」であり、Xについての気づきはゼロ件。Reddit(12スレッド)とLemmy(実質12件)はブリーフの「各SNS約20件」という完了基準には届いていない。BlueskyはキーワードAPIが常時403エラーで使えず、既知アカウント頼りの迂回収集にとどまった。YouTubeは視聴回数・チャンネル登録者数がJavaScriptレンダリングの制約で取得できなかった。Pinterestは50ピン中25件を深掘りし、6媒体の中では最も完了基準に近い収集ができた。

プラットフォーム別まとめ

Reddit

Reddit — Image and Video Generation AI News

Where
  • r/generativeAI — 155,458人 — 3スレッド (#1, #3, #6)
  • r/ImagineAiArt — 19,379人 — 1スレッド (#2)
  • r/aivideos — 123,300人 — 1スレッド (#4)
  • r/aivideomaking — 7,342人 — 2スレッド (#5, #8)
  • r/SideProject — 847,262人 — 1スレッド (#7)
  • r/perchance — 30,870人 — 2スレッド (#9, #10)
  • r/aitubers — 28,841人 — 1スレッド (#11)
  • r/NoStupidQuestions — 7,506,846人 — 1スレッド (#12)
What people say
  • #1 (19点・65コメント・2026-09-16) 「Which AI video generator can still be used for free?」— 有料化が進む中、ローカル実行できるオープンソース系のWanやMinimaxが逃げ道として挙げられてる。u/RioMetal「If you can go local you have plenty of them, like Wan or Minimax」。 https://www.reddit.com/r/generativeAI/comments/1whtesl/
  • #2 (89点・60コメント・2026-09-16) 「GPT Image 2.5 Flare — is this actually the best AI image generating model right now?」— クローズドソースのGPT Image 2.5 Flareを試した投稿だけど評価は割れてる。u/oldboi777「its really good, its an incredible upgrade I think」に対し、u/Dependent_Quit_3730は「É um modelo perfeito pra quem quer usar de forma fácil, mas eu ainda fico com o KREA 2」(簡単に使うにはいいけど自分はまだKREA2を使う)、u/SeaworthinessFreshi16は「The result in Comfyui with Krea2 looks the same」とオープンソース系ツールでも同じ結果が出ると指摘。 https://www.reddit.com/r/ImagineAiArt/comments/1wi79wi/
  • #3 (2点・18コメント・2026-09-19) 「Free AI video generator」— 無料枠を探すスレでMinimax H3、Hailuo、Pixverse、Klingなど複数モデルが名指しで比較される。u/harit0818「Have you tried Hailuo or Pixverse? Kling is another one worth testing if you want more realistic motion.」。 https://www.reddit.com/r/generativeAI/comments/1wkmgdo/
  • #4 (52点・54コメント・2026-09-20) 「I stopped prompting for clean shots and my AI video finally stopped looking like AI」— Seedance 2.5を使った凝ったプロンプト技法の投稿だけど、コメント欄は総攻撃。u/TCristatus「What a load of waffle, and the video is still obviously AI」、u/Ensiferal「So, has bro never watched anything that wasn't ai? Because this looks like ai」。 https://www.reddit.com/r/aivideos/comments/1wl6op9/
  • #6 (7点・26コメント・2026-09-20) 「Looking for a free AI video generator」— 「本当に無料の動画生成AIは存在しない」という結論がほぼ総意。u/SRD-Social「It costs at minimum hardware and electricity. So it will never be truly free.」。 https://www.reddit.com/r/generativeAI/comments/1wlec1u/
  • #7 (2点・0コメント・2026-09-16) 「Dreamfort: an unrestricted AI image and video studio」— プライバシー重視・匿名性を売りにした新しい画像+動画スタジオの自己宣伝投稿だけど、コメント0件で全く反応なし。 https://www.reddit.com/r/SideProject/comments/1wi15w7/
  • #9 (28点・19コメント・2026-09-19) 「Why does Perchance AI only support text-to-image and not image-to-image generation?」— 無料ツールPerchanceがimage-to-imageを実装しない理由は法的リスクという声が最多得票。u/Dack_Blick(30点)「Image to image poses huge legal risks and liability.」、u/DoctaRoboto「Ask yourself why? Because of illegal porn and deepfakes.」。 https://www.reddit.com/r/perchance/comments/1wknh3f/
  • #10 (0点・6コメント・2026-09-17) 「AI Image Generator (free, no sign-up, unlimited)」— Perchanceでネガティブプロンプトが機能しなくなったという細かい不具合報告。u/Slight-Tea-5538「Negative prompting doesn't work anymore.」。 https://www.reddit.com/r/perchance/comments/1win0jr/
  • #11 (0点・47コメント・2026-09-14) 「best apps for generating AI videos」— スクリプトから全自動で動画を作る「AIスロップマシン」への要望に対し猛反発。u/RobJames007「Youtube is trying to reduce AI slop, not allow more of it onto the platform.」、u/-NearlyThere-「And I will be there to report and downvote this type of slop」。 https://www.reddit.com/r/aitubers/comments/1wg3duk/
  • #12 (4点・16コメント・2026-09-15) 「Any good news surrounding technology and AI?」— 動画・画像生成の枠を超えてAI全般のポジティブな話として、コーディング効率化や医療診断への活用が語られた。u/rm-minus-r「I write code for a living and AI has been fantastic for my job. I can do things about 8x faster on average now」。 https://www.reddit.com/r/NoStupidQuestions/comments/1wgmwf2/
Signals
  • 上昇傾向: ローカル実行できるオープンソース系動画モデル(Wan、Minimax H3など)が、有料クローズドサービスへの対抗策として複数スレッド(#1, #3, #6, #8)で繰り返し推薦されている。
  • 見下されているもの: 台本から全自動で動画を作る「AIスロップ」的ツールへの需要は、コミュニティから強い拒否反応を受けている(#11で「downvote/report」宣言、#4でも「still obviously AI」と一蹴)。プロンプト技巧でAIっぽさを消そうとする試み自体が懐疑の対象になっている。
  • 意外だった点: オープンソース寄りの無料ツールPerchanceがimage-to-image機能を実装しない理由として、計算コストよりも先にディープフェイク・児童性的搾取コンテンツへの法的リスクが挙げられていた(#9)。オープンソースツールの機能停滞が技術的制約ではなく法務判断由来であるという構図。
  • 意見の対立: クローズドソースのGPT Image 2.5 Flareの評価は割れており(#2)、「an incredible upgrade」という称賛と、「ComfyUI + KREA2 looks the same」というオープンソース代替で十分という意見が同じスレッド内で対立している。クローズド優位の合意は形成されていない。
  • 経済的な現実: 「本当に無料の動画生成AIは存在しない」という結論は複数スレッド(#1, #3, #6, #8)で一貫しており、無料枠は3〜6秒程度に制限されるのが実態として語られている。
Limits
  • 検索語「Image and Video Generation AI News」1本での収集は12スレッド・8サブレディットにとどまり、ブリーフの完了基準(各SNSで約20件の投稿)には届いていない。追加の検索語はこのステージでは実行されていない。
  • プレイブック通り、このステージではRedditを自分で閲覧することができない(Reddit is WebFetchと検索結果経由のページアクセスを拒否するため)。よって、事前収集されたデータの範囲を超えてサンプルを拡張したり追加検証したりする手段はなかった。
  • 会員750万人超の巨大サブレディットr/NoStupidQuestions(#12)は画像・動画生成に特化しない一般的なAI議論であり、テーマとの関連度が薄くサンプルを希釈している。
  • r/StableDiffusionやr/comfyuiのようなオープンソースモデル専門のサブレディットが収集セットに含まれておらず、オープンソース動向の情報は「無料ツールを探す」系の一般スレッドに偏っている可能性がある。

X

X — 画像・動画生成AIニュース

What X says is happening

x.posts.md の Explore テーブルに載っている10件のトレンドは以下の通り(Explore はセッションの接続元にジオロケーションされる。うち3件は明示的に「Trending in Croatia」と表記されており、残りは場所の指定なく「Politics · Trending」「Sports · Trending」となっている。これは世界のトレンドではなく、このセッションが接続した1拠点のローカルなトレンドリストである)。

# トレンド Where
1 Greenland Politics · Trending
2 Russians Politics · Trending
3 NATO Politics · Trending
4 Arsenal Sports · Trending
5 Saudi Politics · Trending
6 #Cardano Trending in Croatia
7 Islamic Politics · Trending
8 Austria Sports · Trending
9 Shane Trending in Croatia
10 hudson Trending in Croatia

画像・動画生成AIに関するトレンドはこの10件の中に1つも入っていない。

Accounts

収集された39アカウント・40投稿は、すべてこの10個のトレンド語(Greenland / Russians / NATO / Arsenal / Saudi / #Cardano / Islamic / Austria / Shane / hudson)で検索して見つかったもの。つまり収集ワーカーはテーマ(画像・動画生成AI)を検索したのではなく、Xのその時点のExploreトレンド語をそのまま検索クエリとして使ってしまっている。結果、投稿者の内訳もテーマとは無関係:

  • 地政学・戦争系:@SantiagoAuFund、@JesseCohenInv、@nosoupforgeorge、@AnalyticaCamil1、@chrisschmitz、@NepCorres、@May_Roma(グリーンランド、NATO、ロシア関連の政治アカウント。1投稿で大きくバズったのは@May_Roma、9,749いいね)
  • サッカー実況・ミーム系:@icunga_、@Pats_Aura、@jethan69、@troll__foot(Arsenal対Brighton戦の実況・煽り。@troll__footが5,041いいねで最大)
  • 中東情勢系:@Nostre_damus、@Rusia_HD、@saudi_1ive、@visegrad24、@iribnews_irib、@pvtjokerus(サウジ・フーシ派関連の速報アカウント)
  • 仮想通貨系:@QuantumSnek、@mau_pm、@skymonNFT、@LapuhAndrej(#Cardano関連、いずれも小規模でいいね数十以下)
  • 芸能・VTuber・スポーツ雑談系:@literatigirl_、@Ziphora_ttv、@hudconation、@666Lottie、@FireMemeNews、@Shane00、@LaraUnnieO、@amorehud、@Namya_Hudville、@purehroines(Shane/hudsonという語で拾われた、無関係な個人アカウントの雑談・ファン投稿)

いずれのアカウントも画像・動画生成AI(クローズドソース/オープンソース問わず)を専門に発信しているアカウントではない。

Posts

画像・動画生成AIに関する投稿は40件中0件。 「クローズドソースの動向」「オープンソースの動向」いずれについても、Xから拾えた実質的な気づきはゼロだった。捏造を避けるため、無理に10件ずつの気づきを作ることはしない。

参考までに、収集内容がどれだけテーマとずれているかを示す例を3つ挙げる:

  1. @DrClownPhD(1,645いいね・215リポスト・~45,000閲覧・2026-09-20) — 「First gameplay trailer for Greenland Builder. One island. One hammer.」(ゲームトレーラーのネタ投稿。AIには触れていない)https://x.com/DrClownPhD/status/2101763576805601618
  2. @abdulrahmanway(192いいね・~12,000閲覧・2026-09-19) — 「AI Guide for Legitimate Researchers... Linking the Comprehensive Library and Heritage Books with Claude and Artificial Intelligence」。この投稿には「AI」「Claude」という語が出てくる唯一の例だが、内容はイスラム文献のテキスト検索支援ツールの話で、画像・動画生成とは無関係。https://x.com/abdulrahmanway/status/2101422325308801202
  3. @QuantumSnek(19いいね・~432閲覧・2026-09-18) — 「I luv a good dip」(#Cardanoの値下がりに対する一言。仮想通貨の話で画像・動画生成AIとは無関係)https://x.com/QuantumSnek/status/2100897670931902487
Signals
  • 今回のXステージで実際に観測できた唯一の「シグナル」は内容面ではなく収集プロセスの不具合:検索語が「Greenland」「Russians」「NATO」「Arsenal」「Saudi」「#Cardano」「Islamic」「Austria」「Shane」「hudson」となっており、これはこの回のExploreトレンドの見出し語とそのまま一致する。つまりテーマ語(画像生成AI、動画生成AI、Sora、Midjourney、Stable Diffusionなど)では一切検索されていない。
  • Reddit側のステージ(output/reddit.md)ではWan、Minimax、GPT Image 2.5 Flare、Seedance、KREA2、Perchanceといったテーマに沿った固有名詞が拾えていたのに対し、Xステージでは同種の固有名詞が1つも出てこなかった。これはXという媒体の限界ではなく、検索語選定の失敗によるものと考えられる。
  • 驚いた点:40投稿中でAIに言及していたのは実質1件(@abdulrahmanway、宗教文献検索ツールの文脈)のみで、それすらも画像・動画生成とは無関係だった。
Limits
  • 収集そのものがテーマとズレている:x.posts.md に記録された検索語10個はすべてExploreのトレンド見出し語であり、画像・動画生成AI関連の語(Sora、Midjourney、Stable Diffusion、Runway、Kling、Veo、ComfyUIなど)は1つも検索されていない。結果、40件の投稿は収集できたものの、ブリーフの完了基準(各SNSで約20件を解析)を件数としては満たしても、内容としてはクローズドソース/オープンソースいずれの気づきも得られなかった。
  • 気づきを10件ずつ書けというブリーフの指示には従えなかった。手元のデータから画像・動画生成AIに関する実質的な気づきを1件も抽出できないため、存在しないものを捏造するよりも「0件」と正直に報告する。
  • Explore のトレンドリストは接続元1拠点のローカルなものであり、世界のトレンドではない(10件中3件が明示的に「Trending in Croatia」)。
  • このステージを画像・動画生成AIの実態把握として使うには、AI関連の検索語で改めてXの収集をやり直す必要がある。

YouTube

YouTube — 画像生成・動画生成AIの最新ニュース(クローズドソース/オープンソース)

チャンネル
  • OpenAI(公式チャンネル) — Sora 2やGPT Image系の公式発表動画を投稿。
  • Higgsfield AI — Kling 3.0など商用動画AIのレビューを多数投稿するツール系チャンネル。
  • AI Copium — Nano Banana Pro など最新画像AIのハンズオンレビュー中心。
  • Theoretically Media — 現役映像制作者視点でのAI動画/画像ツールレビュー(Flux.2など)。
  • ArtOfficial Labs — オープンソース動画生成モデル(Wan2.2など)のチュートリアル/デモ。
  • Tongyi Lab(Alibaba公式) — Qwen-Image-Edit系のオープンソースモデル公式発信。
  • kilObit — Qwen-Imageなどオープンソース画像編集AIの解説チャンネル。
  • Tyrel Barstow — オープンソース動画AI比較(Wan 2.2 vs LTX 2.3など)。
  • JSFILMZ — Seedance 2.0など動画生成AIのハンズオン比較レビュー。
  • MaxonShire — ローカル動画生成モデル比較(HunyuanVideo 1.5 vs Wan 2.7)。
  • Woollyfern — Midjourneyの月次アップデートを継続的に追う専門チャンネル。
  • Lev Selector — AIニュース週次まとめチャンネル(画像・動画AI含む広範なAI速報)。

チャンネル登録者数はYouTube検索結果ページ・動画ページともにJavaScriptレンダリングされておりこのセッションから直接取得できなかった(詳細は「制限事項」参照)。

動画
クローズドソース
  1. Introducing Sora 2 — OpenAI / 2025-09-30 / https://www.youtube.com/watch?v=gzneGhpXwjU — OpenAI公式による、物理法則に沿った映像と同期音声・セリフを生成できる新モデルSora 2とSoraアプリの発表動画。
  2. OpenAI's Sora 2 Can Talk—and Follow Physics / 2025-09-30 / https://www.youtube.com/watch?v=CDAuUHdlKUA — Sora 2が物理的整合性のある映像と同期した台詞・効果音を生成できる点を検証。
  3. Google's New AI Image Model Is INSANE! (Nano Banana Pro) — AI Copium — https://www.youtube.com/watch?v=GEtiY-0fzO0 — Google DeepMindのNano Banana Pro(Gemini系画像モデル)の高精度テキスト描画・4K出力・実写再現力を検証。
  4. Nano Banana 2 Is INSANE – Full Test of Google's New Image Model! — https://www.youtube.com/watch?v=k0dujOUePeU — 後継モデルNano Banana 2.0のフルテスト、Photoshop代替としての実用性を評価。
  5. Kling 3.0 Review: Realism, Camera Moves, and Emotion Tested — Higgsfield AI / 2026-02-04 / https://www.youtube.com/watch?v=jQvHqKrGhy8 — Kuaishou Kling 3.0(1080p→4K・60fps・最大15秒に強化)のリアリズム・カメラワーク・感情表現をテスト。
  6. Kling 3.0 is HERE! Better than Sora 2 & Veo 3.1? (Full Review & Comparison) — 2026-02-06 / https://www.youtube.com/watch?v=LNWimxGY350 — Kling 3.0とSora 2・Veo 3.1をマルチショット/シネマティック機能で比較。
  7. Seedance 2.0: Honest Hands-On Review & Test — JSFILMZ / 2026-02-09 / https://www.youtube.com/watch?v=4zVS7sZT9UE — ByteDance Seedance 2.0が「Sora killer」と呼ばれる噂を実際に検証(音声・映像同時生成、複数入力対応)。
  8. Midjourney Update | January 2026: NEW NIJI 7!, Style Creator Updates, V8, Edit Model, and More! — Woollyfern / 2026-01 / https://www.youtube.com/watch?v=n8Iv3ZPh8yY — Midjourneyの月次アップデートで、Niji 7・V8開発状況・Editモデルの進捗を報告。
  9. Exciting AI Updates Weekly - September 18, 2026 — Lev Selector / 2026-09-18 / https://www.youtube.com/watch?v=Utu4zIcqPtM — OpenAIのGPT Image 2.5(スケッチ機能・レイテンシ50%削減・9月8日リリース)を含む直近1週間のAIニュースまとめ。
オープンソース
  1. Wan2.2 AI Video Tutorial & Demo | The best open-source video generation model to date just dropped! — ArtOfficial Labs / 2025-07-28 / https://www.youtube.com/watch?v=Tqf8OIrImPw — AlibabaのWan2.2をRunway/Pika級のオープンソース動画モデルとして紹介するチュートリアル。
  2. Best Open-Source AI Video in 2026: WAN 2.2 vs LTX 2.3 — Tyrel Barstow / https://www.youtube.com/watch?v=ZZ5VH-rqHXQ — オープンソース動画生成の二大勢力Wan 2.2とLightricks LTX-2.3(4K・音声・オープンウェイト同時提供)を比較。
  3. HunyuanVideo 1.5 vs Wan 2.7 Comparison: Which is The Best Free Local Video AI Generation Model? — MaxonShire / https://www.youtube.com/watch?v=4GNT4-QYekg — TencentのHunyuanVideo 1.5とAlibaba Wan 2.7をローカル実行前提で比較。
  4. Qwen-Image-Edit-2511 is now open source — Tongyi Lab(Alibaba公式) / 2026-01-04 / https://www.youtube.com/watch?v=UWy9Y1Ebjr4 — Qwen-Image-Edit-2511が複数人物の一貫性強化・コミュニティLoRA同梱でオープンソース公開されたことを公式発表。
  5. Amazing Open-Source AI for Image Editing – Qwen-Image — kilObit / 2025-08-26 / https://www.youtube.com/watch?v=eCJcMPHyoyw — Qwen-ImageをNano Bananaの無料・オープンソース代替として紹介。
  6. Flux.2 Has Landed! Is It the Open Source King? — Theoretically Media / 2025-11-25 / https://www.youtube.com/watch?v=D0_QGrdtvEg — 現役映像制作者視点でBlack Forest Labs Flux.2がオープンソース画像生成の王座に値するか検証。
  7. Flux 2 Klein 4B & 9B : enfin des modèles rapides et exploitables en local — 2026-01-16 / https://www.youtube.com/watch?v=tKnxraDejJo — Flux.2の軽量版Klein 4B/9Bをローカル実行可能なモデルとして紹介(フランス語)。
シグナル
  • クローズドソース陣営の主戦場は「音声同期」と「物理整合性」。Sora 2(OpenAI)、Kling 3.0(Kuaishou)、Seedance 2.0(ByteDance)がいずれも2025年9月〜2026年2月にかけて相次いで「台詞同期・効果音付き動画」を打ち出しており、各社のレビュー動画も判で押したように「Sora 2/Veo 3.1と比較してどうか」という切り口になっている。
  • 画像生成はGoogle(Nano Banana系)とOpenAI(GPT Image系)の2強比較軸が定着。「Nano Banana Proの代替になるか」という文言がQwen Image Edit系オープンソース動画のタイトルに頻出しており、オープンソース陣営がクローズドソースの後追い・代替訴求をしている構図が明確。
  • オープンソース陣営はAlibaba(Wan/Qwen)・Tencent(HunyuanVideo)・Black Forest Labs(Flux)・Lightricks(LTX)の4系列が主流。ComfyUIでのローカル実行チュートリアルが多数を占め、「無料」「ローカルで動く」「無修正(uncensored)」を訴求ポイントにする動画が目立つ。
  • Wanシリーズは2025年7月の2.2から2025年9月のWan 2.5、さらに2.7まで短期間でバージョンアップを重ねており、追従する解説チャンネルの投稿頻度も高い。
  • Midjourneyは他社が動画・音声に注力する中、静止画とV8/Editモデルの開発を独自路線で継続しており、Woollyfernのような月次専門チャンネルが定点観測を続けている。
制限事項
  • YouTube検索結果ページ(/results?search_query=...)および動画視聴ページはJavaScriptレンダリングされており、このセッションのWebFetchでは footer のみが返され、実際の検索結果一覧・視聴回数・チャンネル登録者数を直接取得できなかった。そのため本レポートの動画リストはWebSearch経由のsite:youtube.com検索結果と、YouTube oEmbed API(https://www.youtube.com/oembed?url=...)から取得したタイトル・チャンネル名を組み合わせて作成した。
  • 視聴回数と登録者数は取得できなかった。oEmbedは再生数・登録者数を返さない仕様のため、プレイブックが求める「視聴回数」「登録者数」は本レポートでは空欄としている。
  • 動画の内容説明はWebSearchのスニペット(検索エンジン側の要約)に基づいており、動画本編を直接視聴してのコメント欄分析は実施できていない。
  • Seedance 2.0の一次情報(ByteDance公式ブログ)はYouTube以外のソースであり、YouTube動画自体はレビュー系チャンネルのみでヒットした(公式チャンネルの動画は見つからなかった)。

Bluesky

Bluesky — 画像・動画生成AI最新ニュース

Accounts
  • @replicate.com — モデルホスティング大手Replicateの公式アカウント。クローズドソースの新モデルがAPIに追加されるたびに告知投稿をしている。エンゲージメントは低い(いいね1〜5件程度)が、リリース事実の一次情報として有用。
  • @arteesetica.bsky.social — スペイン語圏のアカウント。Midjourneyの学習データセット(LAION-5B)にCSAMが含まれていたというStanford Internet Observatoryの調査を引用し、AI企業批判の文脈で拡散(いいね79件・リポスト63件と、今回集めた投稿の中で最も反応が大きい)。
  • @minimaxir.bsky.social(Max Woolf) — 技術寄りのコメンテーター。画像生成AIの弱点(ペダルと脚の関係を理解していない等)をネタにする投稿など、開発者目線のツッコミ系。
  • wan-3.bsky.social — Alibaba「Wan 3.0」を謳うサードパーティ系プロモーションアカウント(wan30.ioへの誘導)。公式アカウントではない点に注意。
  • AI Images系の日常投稿アカウント群(キュレーションフィード経由で発見): @kazanomiya.bsky.social、@blackmagnet3400.bsky.social、@ai-visions.bsky.social など。MidjourneyとStable Diffusion(SDXL)で作った作品を毎日投稿しているホビイスト層。
  • Sora閉鎖に反応したアカウント: @riana.bsky.social(404 Mediaの記事を引用)、@ghossssstt.bsky.social(閉鎖を歓迎する投稿)、agentwyre.ai(TechCrunchの記事を引用)。
  • 探した範囲では、Stability AI、Black Forest Labs、Midjourney、Runway、Krea、Ideogram、Leonardo、Luma、Pika、Civitaiの公式ドメインハンドルはBlueskyに存在しなかった(getProfilesで全滅)。クローズド/オープン問わず業界公式アカウントの層は薄い。
Posts
  1. GPT Image 2がReplicateに登場(クローズド) — 2026-04-21, いいね5・リポスト0。「Killer photorealism and crisp text rendering with strong adherence to layouts, UI, and design use cases.」 投稿
  2. Seedance 2.0が全ユーザーに開放(ByteDance、クローズド) — 2026-04-09, いいね2・リポスト1。「Create studio-quality videos... Hollywood-level production in less than 2 minutes.」 投稿
  3. Runway Gen-4.5公開(クローズド) — 2026-02-18, いいね2。「unprecedented physical accuracy and realism」を謳う映像生成モデル。 投稿
  4. Kling 3.0 / Kling Omni公開(Kuaishou、クローズド) — 2026-02-17, いいね2。マルチショット4K・音声同期・スタイル転送対応。 投稿
  5. Vidu Q3公開(クローズド) — 2026-03-11, いいね1。最大16秒・1080p、アニメ/カートゥーン用途を明記。 投稿
  6. Wan 3.0のサードパーティ宣伝投稿(Alibaba系だが非公式) — 2026-09-01, いいね2。30秒・1080p30fps・最大20枚の参照画像を謳うが、Wan 2.2まであった「オープンウェイト」の明言はなく、外部サイト(wan30.io)経由の商用サービスとして紹介されている点が旧世代との違い。 投稿
  7. 画像生成AIの限界をペリカンネタで揶揄(@minimaxir) — 2026-09-19, いいね1。「Generated a vector-style image of a pelican riding a bicycle for...reasons, and I don't think image generators understand how legs and bike pedals work.」 投稿
  8. Midjourneyの学習データにCSAM混入と告発(@arteesetica、スペイン語) — 2025-08-25, いいね79・リポスト63(今回最大)。「Midjourney y el contenido CSAM en su dataset... Stanford Internet Observatory」を引用し、Meta×Midjourney提携を批判。日付は古いが今も再拡散され続けている模様。 投稿
  9. Sora閉鎖を404 Mediaの言葉で切り捨て(@riana) — 2026-03-25, いいね7。「slop on a product people pay for」という404 Mediaの評を引用。 投稿
  10. Sora閉鎖を歓迎(@ghossssstt) — 2026-03-25, いいね9。Sora/OpenAIへの批判的な祝福投稿。 投稿
  11. MidjourneyとStable Diffusionによる日常作品投稿(@kazanomiya「おはよう」) — 2026-09-20, いいね34・リポスト6。「AI Images」キュレーションフィードで見つかった、直近48時間で最もいいねの多かった作品投稿。 投稿
Signals
  • 公式企業アカウントの不在: Stability AI、Black Forest Labs、Midjourney、Runway、Krea、Ideogram、Leonardo、Luma、Pika、Civitaiいずれも公式ドメインハンドルが存在しない。ニュースの一次発信源はBlueskyになく、Replicateのようなホスティング事業者経由でしか主要モデルの動向が流れてこない。
  • 反AI感情が強い土壌: Blueskyは「他プラットフォームが自分の作品をAI学習に使うことへの懸念」からアーティストが移住してきた経緯があり、Sora閉鎖(2026年3月に発表・4月にアプリ終了・APIは2026年9月24日に終了予定)への反応も「歓迎」「404 Media/TechCrunchの批判記事を引用」が目立ち、X(旧Twitter)やRedditで見られるような新モデル歓迎ムードとは温度差がある。
  • オープンソース勢のニュースが薄い: Flux.2、Qwen-Image、HunyuanVideoなど話題のオープンウェイトモデルについて、Bluesky上の一次投稿はほとんど見つからなかった。唯一見つかったWan 3.0関連投稿も、非公式のサードパーティ商用ラッパーによる宣伝で、オープンウェイト提供を明言していない(Wan 2.2まではオープンだった系譜が閉じつつある兆候)。
  • ホビイスト層は健在: 「AI Images」フィードでは直近2日間だけでMidjourneyとStable Diffusion(SDXL)を使った作品投稿が継続的に流れており、コミュニティ自体は生きている。ただしいいね数は1〜34件程度と小規模で、「ニュース」というより日常の創作共有。
  • 総じて、Blueskyは画像・動画生成AIの新モデル発表そのものを追うプラットフォームではなく、(1)Replicate経由の淡々とした告知、(2)AI倫理・著作権・閉鎖を巡る批判的言説、(3)小規模なAI画像コミュニティの3層構造になっている。
Limits
  • Bluesky公式の投稿検索API(app.bsky.feed.searchPosts)がこの環境からは常にHTTP 403を返し、キーワード検索が一切できなかった(sortやlimitの有無、クエリの表記を変えても再現)。一方でgetProfile・getAuthorFeed・getPostThread・getFeedなど検索以外のエンドポイントは正常に応答した。
  • 上記の制約のため、(a)既知/推測したアカウントのタイムライン取得、(b)第三者キュレーションフィード(「AI Images」「Sora Shutdown」)の取得、(c)Web検索でbsky.appの投稿URLを発見してからgetPostThreadで本文を取得、という迂回策で投稿を収集した。網羅的なキーワード検索の代替にはなっておらず、見つけられなかった有力な投稿が他に存在する可能性が高い。
  • Nano Banana Pro、Grok Imagine、Flux.2、Qwen-Image、Seedream、Wan 3.0本体などクローズド・オープン双方の大型リリースについて、Bluesky上の一次投稿は探索した範囲では見つけられなかった(検索不可が主因)。
  • @wan-3.bsky.socialは公式Alibabaアカウントかどうか確認が取れておらず、非公式の可能性が高い前提で扱った。
  • 収集した投稿の多くは2026年2月〜4月のもの(Replicateの告知投稿)で、直近1週間以内の投稿は「AI Images」フィードの作品投稿と@minimaxirのペリカン投稿程度に限られる。

Lemmy

Lemmy — 画像・動画生成AIニュース

Lemmyは連合型(fediverse)の小規模SNS。専用の「画像/動画生成AIニュース」コミュニティはなく、stable_diffusion系は生成物の投稿が中心、ニュース系はRSSボットが流すai_redditやhackernews、あるいはtechnology/world/techtakesのような汎用コミュニティに散らばっている。lemmy.worldのAPI検索(/api/v3/search)で"Sora"「Midjourney」「Nano Banana」「Qwen Image」「Seedream」「Wan 2.2」「HunyuanVideo」「ComfyUI」「open source diffusion」「Kling」「Grok Imagine」など計12クエリを横断し、返ってきた投稿を全件確認した。

Communities
  • [email protected] — 5,713 subscribers。オープンウェイト生成AI全般(SDXL, Flux, ComfyUIワークフロー等)の技術投稿。
  • [email protected] — 2,362 subscribers。生成物の作品投稿中心、ニュース性は低い。
  • [email protected] — アニメ系生成物の作品投稿コミュニティ(購読者数は確認できず)。ニュースというより生成物ギャラリー。
  • [email protected] — 52 subscribers。r/ArtificialIntelligence等からのRedditクロスポストBotで、AI全般ニュースを毎日拾っている。規模は小さいが今回一番「ニュース」に近い内容が多かった。
  • [email protected] — 5,434 subscribers。Hacker NewsのRSS自動転載。画像/動画生成AI関連の技術記事がたまに流れる。
  • [email protected]、[email protected]、[email protected]、[email protected] — 汎用ニュース/批評コミュニティ。AI企業の動向がバズると単発で上がる。
Posts
  1. OpenAIがSora APIを来週停止、その裏で中国のKlingが30億ドル調達 — [email protected]、2026-09-20、score 1(コメント0)
    https://lemmy.durstig.online/post/61333
    Soraのコンシューマー向けアプリは4月に終了済み、APIも9/24で終了。一方Klingは評価額180億ドルで30億ドル調達、四半期売上9,500万ドル(前年比+200%)。投稿の論旨は「動画生成AIは一般消費者向けでは儲からず、企業向け(研修動画・製品デモ)が生き残る」——生き残り組としてSynthesia, HeyGen, Kling, Argilを挙げている。

  2. Qwen-Image-2.1: Compact, efficient, and unified image creation — [email protected]、2026-09-20、score 1
    https://lemmy.bestiver.se/post/1352428
    AlibabaのQwenチームによる新しい統合画像生成モデルのリリース記事。オープンソース系の最新モデルとしてHacker News経由で転載。

  3. Midjourney AI pivots to Theranos: Ultrasonic CT — [email protected]、2026-06-19、score 41(コメント15)
    https://awful.systems/post/8731127
    Midjourney CEOのDavid Holzが「水中エコー(イルカの反響定位方式)で全身スキャンする医療機器」への事業転換を発表したことへの批判記事(出典: pivot-to-ai.com)。上位コメントは「Theranosと同じ末路になるのでは」「深さ5フィート以下しかスキャンできず心臓など主要臓器が映らない」「AIバブル崩壊で本業から逃げているのでは」という辛辣な反応。関連スレッドが同コミュニティ群で複数立っている(下記Signals参照)。

  4. Midjourney wants Hollywood studios to reveal the details of their AI usage — [email protected]、2026-07-05、score 73
    https://lemmy.today/post/56011946
    Midjourneyが著作権訴訟対応の一環としてハリウッドスタジオにAI利用実態の開示を求めているという記事。クローズドソース大手と映画業界の緊張関係を示す一件。

  5. Seedream 5.0 Pro is here: an honest comparison and technical breakdown — [email protected]、2026-07-10、score 1
    https://lemmy.durstig.online/post/46063
    ByteDance製Seedream 5.0 ProとGoogleのNano Banana Proを実戦比較。Seedreamは「ポイント編集」「レイヤー分離でPNG化」「参照画像最大10枚合成」「15言語の文字入りテキスト生成」が強み、Nano Banana Proは写実性・顔のディテールで優位という評価。

  6. Nano Banana 2 Lite — [email protected]、2026-06-30、score 1(独語圏ミラー: [email protected]、2026-07-02、score 0 https://lemmy.world/post/48936394)
    https://lemmy.bestiver.se/post/1199483
    Googleの画像生成モデルの軽量版リリース。

  7. China's 2026 pivot to open-source AI is a calculated geopolitical strategy — [email protected]、2026-07-21、score 9
    https://scribe.disroot.org/post/10253969
    画像/動画生成に限らずAI全般だが、中国勢がオープンソース化を地政学的戦略として使っているという分析。Qwen/Seedream/Klingなど中国発オープン・クローズド混在モデルの背景理解に関連。

  8. Elon Musk maakt complete AI-film met zijn versie van The Odyssey(オランダ語)— [email protected]、2026-07-22、score 1
    https://lemy.nl/post/4342454
    xAIのGrokで「オデュッセイア」のAI映画を作るとイーロン・マスクが発言、という記事。Grok Imagine系のクローズドソース動画生成の話題。

  9. Google quietly discontinues its Earth AI feature a day after its rollout after users made no-no images — [email protected]、2026-08-07、score 1
    https://lemmy.durstig.online/post/52162
    Google Earthの新AI画像機能が公開翌日に不適切生成が相次ぎ即撤去された件。

  10. tencent/HunyuanVideo-I2V — [email protected]、score 5
    https://huggingface.co/tencent/HunyuanVideo-I2V
    TencentのオープンソースImage-to-Video動画生成モデルのHugging Faceリリース告知。オープンソース動画生成の代表例としてstable_diffusionコミュニティで共有。

  11. Boogu-Image-0.1 — Efficient Image Generation Foundation Model — [email protected]、2026-06-17、score 5
    https://lemmy.dbzer0.com/post/70746299
    軽量・効率重視の新しいオープンソース画像生成基盤モデル。

  12. China's plan to undermine western AI? Bleed its investor-funded efforts dry, by open-sourcing equal or better alternatives — [email protected]、score 13
    https://futurology.today/post/2957812
    やや古め(2024年12月)だが、中国のオープンソースAI戦略についての継続的な議論として#7と合わせて文脈理解に有用。

Signals
  • Midjourneyの「エコー式医療スキャナー」ピボット話(#3)は関連ポストが複数([email protected]の"Behind the scenes with the Midjourney scanner" https://lemmy.bestiver.se/post/1210528 score1、"I was wrong about the Midjourney ultra-sound scanner" https://lemmy.bestiver.se/post/1181375 score1、[email protected]の"Wait, Midjourney Is Building a What Now?" https://lemmy.world/post/48512443 score5)で繰り返し取り上げられており、Lemmy上ではこの1本がクローズドソース系で最も「バズった」画像生成AIニュース(score 40〜73)。
  • ニュース性の高い投稿の多くは[email protected](購読者52人のRSS転載ボット)発で、score・コメント数はほぼ常に1件前後。Lemmyコミュニティ内で独自に議論が盛り上がっている様子はほぼない(ほとんどが単発ミラー投稿)。
  • [email protected]と[email protected]は活動量自体は多い(毎日複数投稿)が、大半はモデル/サンプラー/LoRA名を添えた生成物投稿であり、「ニュース」ではなく作品ギャラリーとしての性格が強い。
  • オープンソース系の話題(Qwen-Image-2.1、HunyuanVideo、Boogu-Image、中国のオープンソース戦略)はクローズドソース系(Sora終了、Midjourneyのピボット、Nano Banana、Seedream、Grok Imagine)と比べてLemmy上での言及数はやや少ない。
Limits
  • ブリーフの完了基準(各SNSで約20件の投稿を解析)に対し、Lemmyでは「画像/動画生成AIのニュース」と呼べる実質的な投稿は上記12件が確認できた上限に近い。検索自体は12クエリ・100件以上のヒットを確認したが、大半は(a)stable_diffusion系コミュニティの作品投稿(ニュースではない)、(b)無関係なヒット("Sora"がLove Live!のキャラ名に一致する等のノイズ)で、実質的なニュース記事はごく少数に絞られた。Lemmy自体の規模が小さく(画像生成AI専用コミュニティの購読者は最大でも5,713人)、Reddit/Xのような速報性・議論の厚みは元々存在しない。
  • 検索はlemmy.world/lemmy.dbzer0.com/lemmy.durstig.online/lemmy.bestiver.se等、連合先の投稿もlemmy.worldの検索APIが横断的に拾う範囲でのみ確認した。全連合インスタンスを網羅したわけではない(lemmy.ml, lemm.eeへの直接検索は試行したが、lemmy.worldの結果と重複が多く追加の有効な結果は得られなかった)。
  • 「クローズドソース最低10件・オープンソース最低10件」の気づきという全体レポート側の要件に対し、Lemmy単体ではクローズドソース寄り(Sora, Midjourney, Nano Banana, Seedream, Grok Imagine関連)が7〜8件、オープンソース寄り(Qwen-Image, HunyuanVideo, Boogu-Image, 中国オープンソース戦略関連)が4〜5件と、クローズドソース寄りの話題がやや優勢だった。

Pinterest

Pinterest — Image and Video Generation AI News

Visual themes
  • The humanoid AI robot as generic "AI" mascot — a white/chrome android head or full figure (often blue-eyed, sometimes in a business suit at a news desk) stands in for "AI" itself, regardless of what the pin is actually about. Seen in [3, 39, 42, 49], including a robot "news anchor" behind a BREAKING NEWS chyron [49] and a robot pointing at a glowing globe over a city [42].
  • YouTube-thumbnail "shocked/skeptical bearded man" format — a talking-head creator face (wide eyes, open mouth) pasted next to a row of neon company logos (OpenAI, Google, Microsoft, Meta, Notion) to sell "AI NEWS" roundup videos. Seen in [5, 9, 14, 48]. This is clearly a dominant genre of AI-news content that gets re-pinned onto Pinterest as a thumbnail/listicle image rather than for its own visual merit.
  • Big-tech logo clusters — OpenAI's flower mark, Google/Gemini's "G", Microsoft's four-square, Meta's infinity loop appear together repeatedly as shorthand for "the AI industry," almost always in a neon/glowing style against a dark background [5, 9, 14, 40].
  • Neon-on-black infographic listicles — dense, template-driven graphics with numbered boxes, checkmarks/X's, and pastel neon accent colors, summarizing "X tools/updates you need to know." This is the single most common pin format on the board: [9, 12, 22, 31, 37, 38]. #31 is the most information-dense, cataloguing 20 named tools by category.
  • Before/after and transformation pairs — a source photo/video next to one or more AI-altered outputs, used to demonstrate model capability: a person turned into LEGO/origami/flowers [10], a face aged into a child then a young adult ("AI Baby") [18], a purple plush character placed into different generated video scenes [25]. This "prove it with a side-by-side" format is the main way image/video quality is actually demonstrated, more than any spec sheet.
  • "Is it real?" / detection anxiety imagery — a robot holding a phone next to a "FAKE" stamp and a cute cat photo with inflated like/view counts [3]; a "good or bad" pro/con listicle about AI video [22]; a magnifying glass over a glitchy eye [27]. Distrust/detection of AI content is a recurring visual anxiety, not just a hype angle.
  • Cinematic/sci-fi mood-board collages — a tiled grid of moody, desaturated concept-art-style stills (astronauts, ruined cities, glowing biotech shapes) with no accompanying product name, presented purely as an aesthetic showcase of what generative video "looks like" now [24].
  • Colour palette: overwhelmingly dark navy/black backgrounds with neon cyan, purple, orange and red accents — the "tech news thumbnail" palette — with only the demo/output content itself (LEGO car, plush monster, portraits) breaking into natural colour [10, 18, 25].
Notable pins
  1. #5 — "AI News: Anthropic Leak Shows Us The Future of AI..." — classic reaction-thumbnail format (shocked creator + OpenAI/Google/Microsoft logos); shows how AI news gets packaged for virality on Pinterest even when re-pinned from YouTube.
  2. #8 — Google Veo 2 promo, https://www.pinterest.com/pin/716705728243313502/ — official-style tiled preview (swimmer underwater, dancing constellation figure, Pixar-like kitchen scene) with a "Sign up to try on VideoFX" CTA — closed-source marketing straight from Google.
  3. #9 — "4 Major AI Updates You Need to Know", https://www.pinterest.com/pin/982558843745608433/ — names GPT-6 Astra (OpenAI), Gemini going "more agentic" across Gmail/Docs/Slides, Adobe Premiere adding in-timeline generative video/audio, and Cognition (Devin) raising a $2B Series E at a $48B valuation — a genuinely dense, dated news pin rather than generic hype.
  4. #10 — Luminfire/Luma-style transformation demo, https://www.pinterest.com/pin/4603664076054312576/ — one source video re-rendered as "wooden blocks," "origami," "toy bricks," "flowers" across a person, a dog, and a Tesla — a strong concrete example of style-transfer video generation.
  5. #12 — "Veo 3 Image-to-Video: Fast Generation & Native Audio via Gemini API", https://www.pinterest.com/pin/871728071631063018/ — developer-facing framing (API, not consumer app), signalling Veo 3 is being marketed to builders too.
  6. #18 — "7 Best AI Baby Generators: Predict Your Child's Face (2026)", https://www.pinterest.com/pin/4605352928366346304/ — a whole sub-niche of face-generation apps aimed at couples predicting baby faces, dated 2026, distinct from the news/tool-roundup genre.
  7. #27 — "OpenAI's Secret Image Generation Tool to Debut Soon", https://www.pinterest.com/pin/34410384649773668/ — but the actual image is an Analytics India Magazine (AIM) diagram of a cascaded diffusion pipeline naming "Frozen T5 XXL," "IF‑I‑M (400M)" and "Stable x4" — i.e. DeepFloyd IF, an open-source model — mismatched to the closed-source headline, suggesting recycled/stock editorial art rather than a real leak.
  8. #31 — "AI Tools for Video Editing — What Creators Actually Use to Make Content in 2026", https://www.pinterest.com/pin/555983516521792130/ — the single richest data point on the board: names Veo 3, Gemini Video, Kling AI 2.0, Runway Gen-3 Alpha, Pika 2.2 (text-to-video); Luma Dream Machine, Hailuo AI (MiniMax), Stable Video Diffusion, Runway ML Inpainting, CapCut (image-to-video); Descript, Topaz Video AI, Clipsai, Submagic (editing); ElevenLabs, PlayHT (voiceover). Mixes closed (Veo, Gemini, Kling, Runway, Pika) and open-weight (Stable Video Diffusion) tools in one creator-facing cheat sheet.
  9. #35 — "More than 20% of YouTube is now AI-generated", https://www.pinterest.com/pin/803329652325946084/ — a stat-driven claim pin (YouTube logo + AI brain icon) speaking to AI video's real-world platform saturation rather than a specific model.
  10. #37 — "This Week in AI News – Aug 15 2026," THE AI DISPATCH newsletter cover, https://www.pinterest.com/pin/644577765463965693/ — a dense newspaper-style pin listing "Open Models / Open weights, open future," "Sovereign AI," "Canada Strategy," alongside inference speed, memory, regulation, agent harnesses — the clearest signal that "open models" is being treated as its own persistent news beat, not a niche topic.
Signals
  • Closed-source names actually surfaced: OpenAI/GPT‑6 Astra [9], Google Veo 2 [8] and Veo 3 [12, 25, 31], Gemini/Gemini Video [9, 12, 31], Grok/Grok 5 [40, 49] (titles only, images generic), Kling AI 2.0, Runway Gen‑3 Alpha, Pika 2.2, Hailuo AI/MiniMax [31], Adobe Premiere generative media [9], Cognition/Devin funding [9]. Closed-source players clearly dominate the branded news pins.
  • Open-source signal is thin and mostly implicit: the only concrete open-weight artifacts found are Stable Video Diffusion (named in the tool list, [31]) and DeepFloyd IF's architecture diagram (misattributed under a closed-source headline, [27]), plus a general "Open Models / open weights, open future" newsletter section heading with no named model [37]. Pinterest is not where open-source AI news circulates in detail — it's a downstream aesthetic/tool-list medium, not a discussion venue like a forum or X.
  • What's absent: no pins surfaced specific mentions of Flux, ComfyUI, LTX-Video, Mochi, HunyuanVideo, Wan, SDXL/SD3, or any Hugging Face release — despite being major 2025–2026 open-source video/image names elsewhere. No pins showed GitHub repos, model cards, or benchmark charts. Pinterest's format (visual boards, not text discussion) filters out the technical/comparative content that would carry open-source specifics.
  • The dominant Pinterest genre for this topic is not news at all but "AI news as a listicle/thumbnail aesthetic" — reaction-face thumbnails and neon infographic templates outnumber pins that show an actual generated image/video result. Demonstration content (before/after transforms [10, 18, 25]) is the exception, not the rule.
  • Undertone of skepticism: several pins frame AI image/video primarily as a trust problem — fake engagement stamps [3], "good or bad" debates [22], deepfake detection [27, 38] — rather than pure celebration, suggesting Pinterest's audience (or the accounts pinning to it) engages with this topic partly through an anxiety/media-literacy lens.
Limits
  • Per the playbook, images for this stage were pre-collected by a headless browser worker (images/pinterest/manifest.json, 50 pins, single unnamed query/genre — no genre split was defined for this run). I did not browse Pinterest directly; all findings come from reading the collected images and pin titles/URLs.
  • I opened and described 25 of the 50 collected pins in depth (a representative spread across all visually distinct formats found), which comfortably exceeds the ~20-post analysis bar in the brief's completion criteria; the remaining 25 pins repeat the same handful of formats already covered above (reaction-thumbnail roundups, neon-infographic listicles, generic robot-mascot art, and additional Grok/GPT-branded news thumbnails) based on their titles.
  • Several pins are untitled ((untitled) in the pins table, e.g. [6, 17, 20, 32, 33, 36, 41, 45]) and were not individually opened; titles alone gave no reason to expect they'd add a new theme beyond what's already documented.
  • Pinterest pin titles/descriptions are often generic marketing copy rather than dated news, so several pins (e.g. Grok 5, GPT 5.2) could not be corroborated with a publication date the way the AI Dispatch newsletter cover [37] could.
  • No open-source-specific board or dedicated open-source pins were found; this is a genuine gap in what Pinterest offers for this brief, not a missed search — see the Signals section above.

推奨アクション

  • Xステージは検索語をSora・Midjourney・Nano Banana・Wan・Klingなどテーマ固有名詞に差し替えて再実行すべき。
  • Redditの次回収集にはr/StableDiffusionやr/comfyuiなどオープンソース専門コミュニティを加えてバランスを取るべき。
  • Sora API終了(2026-09-24)後の企業向け動画AI市場(Synthesia, HeyGen, Kling, Argil)の動きを次回追跡すべき。
  • Wan 3.0が公式にオープンウェイトを維持するかどうか、Alibaba公式発表で確認すべき。
  • BlueskyはキーワードAPIが403で使えないため、既知アカウントリストを拡充する形で監視を継続すべき。
  • Midjourneyの医療スキャナー事業とハリウッド著作権訴訟の展開を次回チェックすべき。

収集画像

🎨 AI Image and Video CreationJust Nail It 🎥AI content and social media concernsAi Content Creation Concept With Icons For Text Image Music And Video Generation Artificial Intelligence Images – Browse 66 Stock Photos, Vectors, and VideoAI News: Anthropic Leak Shows Us The Future of AI...image🤯 GENERATIVE AI EXPLAINED! 🤖✨ How AI Creates Text, Images, Video & More!Google Unveils Veo 2: Advanced AI Video Generation Tool with Enhanced Realism and Cinematic Features4 Major AI Updates You Need to Know in 2026Google announces ultra-high quality video...AI Generated Videos for Content MarketingVeo 3 Image-to-Video: Fast Generation & Native Audio via Gemini APINew York's Bold Gambit: Inside the Legislative...AI News: OpenAI Finally Released What We Asked ForWhat is Imagvio AI and how it helps creators...Ai Content Creation Concept With Icons For Text Image Music And Video Generation Artificial Intelligence Images – Browse 57 Stock Photos, Vectors, and Videoimage7 Best AI Baby Generators: Predict Your Child's Face (2026)The Secret Weapon for Content Creators: AI-Powered Video GenerationimageAI Video Creation SoftwareAI-Generated Videos: Good or Bad? Here's the Truth! 🤖🎥Create photorealistic AI photoshoots of yourself with ChatGPT + Higgsfield 📸🤖Top AI Video Generators of 2025Google announces video generation AI 'Veo 3',...Can You Spot the Fake? AI Video vs. Real Life Challenge!OpenAI’s Secret Image Generation Tool to Debut SoonAI driven image and video analysisProfessional AI Video Creation | Cinematic AI Videos | Custom Video EditingTransform your ideas into stunning visuals! 🎥AI Tools for Video Editing — What Creators Actually Use to Make Content in 2026imageimageAI Image GenerationMore than 20% of YouTube is now AI-generatedimageThis Week in AI News - Aug 15 2026‎🚨 AI is getting scary good.AIGrok 5: Elon Musk’s AI Revolution: A Surprising...image"Transform Your Vision with Personalized AI-Powered 4K Videos 🎥✨"AI-Generated Realistic Portrait Video | Cozy Indoor Setting, No CameraAI Make money Online By Selling AI Photo and VideoimageWhy a Unified AI Inference API Is Becoming Essential for Modern DevelopersMastering Video and AI: Key Social Media Marketing Trends 2025GPT 5.2, realtime video editor, AI stereo videos, mobile AI agents, full body control: AI NEWSDiscover how Grok is revolutionizing video...AI Video Creation Services | AI-Powered Video Production

データ品質メモ

Xは検索語がテーマと無関係なExploreトレンドに引っ張られ関連投稿を1件も拾えず、Reddit(12スレッド)とLemmy(実質12件)はブリーフの「各SNS約20件」基準に届かなかった。BlueskyはキーワードAPIが常時403で使えず既知アカウント頼りの迂回収集にとどまり、YouTubeは視聴回数・登録者数が取得できなかった。

ギャラリー