Image and Video Generation AI News — 2026-09-17
クローズドソースはSora 2の事実上の退場とGPT Image 2.5 vs Nano Banana Proの一騎打ちが軸、オープンソースは中国勢(Wan・MiniMax H3・HunyuanVideo・Z-Image Turbo)が主導権を握る一方でWan 3.0のクローズド化疑惑が最大の波乱要因。
画像・動画生成AIニュース — 2026-09-17
いや〜今回の画像/動画生成AI界隈、マジで動きすぎ🔥 クローズドソース側はSora 2が事実上フェードアウトしてVeo 3.1・Kling 2.5 Turbo・Seedanceに主役交代、さらにOpenAIのGPT Image 2.5とGoogleのNano Banana Proがガチンコバトル中👊 オープンソース側はWan、MiniMax H3、HunyuanVideo、Z-Image Turboみたいな中国勢が完全に主導権握ってて、ComfyUI界隈は毎日新しいノードとLoRAが降ってくるお祭り状態🎉 でもGoogle系モデル(Nano Banana Pro/Flow)はやらかしも多くて、安全フィルターが自分の生成物すら弾くわ、Google Earthで偽の災害画像が量産されて機能が撤回されるわで、信頼性まわりはちょっとヤバめ😬
Across platforms
- Sora 2の退場とGoogle/ByteDance/Kling勢への主役交代:YouTubeで「Sora 2はAPI最終停止が2026/9/24予定」と報じられ、Reddit・YouTube双方でSeedance(2.0→2.5)が人物リアリズムで独立に高評価されてる。同じ結論が別プラットフォームで自然に出てくるのは強いシグナル💪
- GPT Image 2.5 vs Nano Banana Pro論争:YouTube(発表直後の複数レビュー動画)、Bluesky(@testingcatalog.comが2026-09-09に速報)、Lemmy(ベルセルク着色比較でChatGPT Images 2.5が線画保持で優勢、Nano Banana Proは指示無視で減点)と3プラットフォームで独立にこの2モデルが比較されてる。
- Nano Banana Pro/Google Flow周りのトラブル多発:Redditでは自社Flowが自社Nano Banana Pro製画像すら弾くという「フィルター暴走」ネタ、Lemmyでは「Google Earthに組み込んだNano Banana 2機能がロールアウト翌日に撤回(偽の災害・軍事施設画像が量産されたため)」というインシデント。プラットフォームは違うけど「Googleの生成AIは強いけど制御が追いついてない」という同じ絵が浮かぶ。
- オープンソースは中国勢+MiniMax H3が主戦場:Reddit(Wan/MiniMax H3/LTX Videoが「無料の本命」として繰り返し名前が挙がる)、YouTube(Wan・Z-Image Turbo・HunyuanVideo/Imageが軒並み中国発)、Lemmy([email protected]でMiniMax H3向けComfyUIツールが直近数日で一気に量産)、Bluesky(Lightricks LTX-2.5がHugging Faceトレンド3日連続)と、4プラットフォームが同じ方向を向いてる。
Platform by platform
Reddit:11スレッド収集(目標の20件には届かず)。クローズドはGoogle Flowの太っ腹な無料枠と過剰な安全フィルターの矛盾、Seedanceの人物リアリズム評価が軸。オープンはWan/MiniMax H3/LTX Videoがローカル生成の定番として名前が挙がりまくり。「AI slop」という言葉の意味を巡る対立や、全自動YouTube動画生成ツールへの冷笑もリアルな温度感として拾えた🗿
X:今回は完全に空振り😅 収集手法が「トレンド経由」で、しかもセッションがクロアチアにジオロケートされてたせいで、集まった40投稿は南アフリカ政治・セルビア/コソボ・イスラエル/ハマス・Zcashガバナンス・懸賞スパムばかり。画像/動画生成AIに触れた投稿はゼロ。ここはブリーフが名指ししたプラットフォームの中で唯一「ギャップ」と呼べる場所——再収集が必要。
YouTube:13本の動画をタイトル/スニペットから特定。クローズドはGPT Image 2.5(2026-09-08リリース、Flare/Sunburstの2バリエーション)とSora 2終了の話が目立ち、MetaがMuse Image/Video(Meta Superintelligence Labs、検索・コード実行を使うエージェント型生成)で新規参入したのも大きい。オープンはAlibaba(Wan、Z-Image Turbo)、Tencent(HunyuanVideo 1.5、HunyuanImage 3.0)、Black Forest Labs(Flux.2)が中心。ただし再生数・チャンネル名がJS描画の壁でほぼ確認できず、権威性の裏取りは弱め。
Bluesky:公式ブランドアカウント(Midjourney、Stability AI、ComfyUI、Runway、Kling、Black Forest Labs)はほぼ全部2025年後半で沈黙してて、主な情報源は個人運営ニュースアカウント@testingcatalog.com(フォロワー860人)に集中。ChatGPT Images 2.5、Meta Muse Video、新興スタートアップViskoの「Orbis」(リアルタイム動画)、ElevenLabsの画像/動画拡張などを拾えた。オープンソース動向はHugging FaceトレンドボットでLTX-2.5の継続的な注目が確認できた程度。検索APIが403で使えず、アカウント芋づる式の調査になったのが制約。
Lemmy:関連投稿は10件強(20件目標には届かず、無理な水増しはしていない)。クローズドは「事故・炎上ネタ」として語られがち(Google Earth AI撤回、Midjourneyの医療機器事業参入をTheranosになぞらえる皮肉)。オープンは[email protected]が事実上の集積地で、MiniMax H3を軸にComfyUIノード・LoRA・省メモリ実装が数日間で一気に整備される典型的なOSSムーブメントを観測。
Pinterest:50件のピンのうち30件を目視確認。オープンソース関連はほぼ皆無——Stable Diffusion、Flux、Wan、ComfyUIを名指しするピンはゼロで、出てくるのはChatGPT/Gemini/Claude/Adobe Firefly/Midjourney/Canvaといったクローズドな消費者向けブランドばかり。実際のニュース性があるピンはTilly Norwoodの「AI女優」論争、ShengShu TechnologyのVidu S1(リアルタイム対話型動画)、Microsoft VASA-1の技術図解くらい。全体はロボット/ディープフェイク不安を煽るストック画像が支配的で、「ニュース」というより「AIへの漠然とした不安のビジュアル文化」を映してる。
What to watch
- Wan 3.0がクローズド化する兆し(YouTube、Alibaba公式ブログ経由の言及):Wan 2.2まではApache-2.0で完全オープンだったのに、2026-08-24発表のWan 3.0はAPIのみでウェイト非公開との情報。オープンソース動画生成の旗艦が消えるかもしれない大事件になりうる。
- MiniMax H3周りのComfyUIエコシステム(Lemmy: https://lemmy.dbzer0.com/post/75586072 ほか):直近数日で一気にツールが量産されてる、今一番熱いオープンソース動画/画像モデル。
- GPT Image 2.5 vs Nano Banana Pro(YouTube: https://www.youtube.com/watch?v=DY6TkI8XtkQ、Bluesky: https://bsky.app/profile/testingcatalog.com/post/3mv3hn2whdz27):クローズドソース画像生成の最前線、次の一手待ち。
- MetaのMuse Image/Video参入(YouTube: https://www.youtube.com/watch?v=rAvnO1DWnMs、Bluesky: https://bsky.app/profile/testingcatalog.com/post/3mthtr6iu7p24):検索・コード実行を使うエージェント型生成という新アプローチ、正式ローンチのタイミングを要ウォッチ。
- Google系モデルの安全フィルター/誤生成トラブル(Reddit: https://www.reddit.com/r/generativeAI/comments/1wh1y9d/、Lemmy: https://lemmy.durstig.online/post/52162):信頼性・規制対応のニュースとして継続的に浮上しそう。
Recommendations
- X(旧Twitter)は「トレンド経由」ではなく「Sora 2」「Nano Banana Pro」「Wan」「Flux」などテーマ直結ワードで検索し直して再収集する。
- Wan 3.0のクローズド化疑惑は一次情報(Alibaba公式発表)で裏取りして、オープンソース動画生成の勢力図への影響を追う。
- MiniMax H3周りの動きは[email protected]を定点観測すると一番鮮度が高い。
- GPT Image 2.5とNano Banana Proの比較は複数プラットフォームで一致しているので、次回はSeedream 5.0 Proなど第三勢力との比較も掘る。
- Google系モデルの安全フィルター過剰反応・誤生成トラブルは繰り返し報告されているので、信頼性ニュースとして継続ウォッチを推奨。
Data quality
Xは収集手法(ジオロケートされたトレンド経由)が完全にテーマとずれていて、40投稿中テーマ関連ゼロ——実質的にこのプラットフォームは今回機能しなかった。Reddit(11件)とLemmy(10件強)はブリーフの「20件ほど」という完了基準に届いていない(無理な水増しはしていない)。YouTubeはJavaScriptレンダリングの壁で再生数・チャンネル名の裏取りができず、権威性の確認が弱い。Blueskyは公式検索APIが403で使えず、既知アカウントのフィード巡回という代替手段に頼ったため網羅性に限界がある。Pinterestは画像とタイトルのみで、リンク先記事や保存数などの裏取りはできていない。
プラットフォーム別まとめ
Reddit — Image and Video Generation AI News
Where
収集された11スレッドは7つのサブレディットから。すべて検索語「Image and Video Generation AI News」でヒットしたもの。
| サブレディット | メンバー数 | 収集スレッド数 |
|---|---|---|
| r/generativeAI | 154,126 | 5 |
| r/aitubers | 28,633 | 1 |
| r/AIDangers | 53,410 | 1 |
| r/aifilmmaking | 7,951 | 1 |
| r/aivideomaking | 7,085 | 1 |
| r/AIToolTalks | 6,307 | 1 |
| r/NoStupidQuestions | 7,494,416 | 1 |
画像・動画生成AI専門のサブ(r/generativeAI, r/aifilmmaking, r/aivideomaking, r/aitubers)が11件中8件を占める。残り3件(r/AIDangers, r/AIToolTalks, r/NoStupidQuestions)はAI全般の是非を語るサブで、画像/動画生成に限定した内容ではない。
What people say
- クローズドソース(Google Flow/Veo)は無料枠を大盤振る舞い中、ただし規制も強化。スレッド4「Google Flow is giving creators a surprisingly generous amount of free AI video generation right now」(r/aifilmmaking · 8点 · 2026-09-14)https://www.reddit.com/r/aifilmmaking/comments/1wg7izt/ では、Veo向けの無料クレジットが「単なるtext-to-videoではなく、シーン構築・カメラ制御・参照画像を備えた本格的な制作ワークスペースになりつつある」と紹介。コメント欄でu/MechanicForward2274 (1点)「50 credits a day is actually enough to experiment with a lot if you're not wasting them」。
- 一方でスレッド7(r/generativeAI · 2点 · 2026-09-15)https://www.reddit.com/r/generativeAI/comments/1wh1y9d/ では、Google Flowの安全フィルターが自社モデル(Nano Banana Pro)が生成した画像すら弾くという不満。投稿者は同じ画像で60回リトライして全滅。この摩擦が、RTX 5090所有者をローカル生成へ押しやっている。
- ローカル/オープンウェイトの動画モデルが「無料の本命」として繰り返し名前が挙がる:Wan、Minimax H3、LTX Video。スレッド1(r/generativeAI · 8点 · 2026-09-16)https://www.reddit.com/r/generativeAI/comments/1whtesl/ でu/tuckken2 (2点)「Wan 2.2 and Minimax H3 are free on cnaps studio, credit resets every 5 hours」。スレッド7ではu/f5alcon (3点)が「Minimax H3 is the best local generator」と断言、u/Liberation2020 (1点)も「Wan, mini max H3 and LTX Video」を挙げる。
- Seedance(クローズドソース、Bytedance系)が人物のリアリズムで評価上昇。スレッド7の投稿者自身が「Seedance 2.0 is the top video generator regarding human realism」と記載。スレッド8「HOW IS THIS MADE?!」(r/generativeAI · 0点 · 2026-09-10)https://www.reddit.com/r/generativeAI/comments/1wced4g/ ではu/lagbit_original (3点)が「Seedance 2.5と単一プロンプト+適切な参照画像+編集ソフトでの音楽・カット追加」だけでバイラル動画級のクオリティが出せると解説。スレッド11でもu/pb404 (2点)がSeedance 2.5 reference modelでの一貫性の高さを称賛。
- 「なんでも自動でYouTube用動画を作ってくれるツール」への需要は嘲笑の的。スレッド5(r/aitubers · 0点 · 35コメント · 2026-09-14)https://www.reddit.com/r/aitubers/comments/1wg3duk/ で「月50ユーロ以内でスクリプトから完全自動生成」を求める投稿に対し、u/RangeWilson (7点)「I'm looking for a unicorn who will slide down a rainbow and give me a pot of gold every day. But I'm not willing to pay more than €50 per month.」と痛烈な皮肉。u/RobJames007 (12点、当スレッド最高スコア)も「YouTube is trying to reduce AI slop, not allow more of it onto the platform」と釘を刺す。
- 「AI slop」というレッテルの意味を巡って意見が割れている(詳細はSignals参照)。スレッド11「Is there a way to make AI video that does not look like AI slop?」(r/generativeAI · 0点 · 30コメント · 2026-09-14)https://www.reddit.com/r/generativeAI/comments/1wgjjzu/ が本題。投稿者自身の実験では「同じキャラ+声+続き物のギャグ」構成にしただけで技術面は変えずに視聴時間が9倍になり、誰もslopと呼ばなくなったと報告。
- 無料・低コストへの渇望が強い。スレッド2「Please help me generate free ai video without subscription」(r/aivideomaking · 0点 · 14コメント · 2026-09-15)https://www.reddit.com/r/aivideomaking/comments/1wh80z3/ でu/Fluffybabyyoda (1点)「google flow gives you 50 credits daily sometimes 2 times a day. Google gemini i think gives you 3 videos a day」。u/Bastisheen92 (2点)「Local Generation is free if you already own the Hardware」という原則論も。
- NSFW/際どいコンテンツ目的の無料ツール探しも一定数存在。スレッド3「Any free video platform?」(r/generativeAI · 2点 · 5コメント · 2026-09-16)https://www.reddit.com/r/generativeAI/comments/1whvzu3/ 投稿者「I was able to find ways to get Grok for free and spicy minimax」。同スレッドでu/Critical_Emu_6565 (2点)が自作ツール「RexCut AI」を宣伝しており、自演的な宣伝コメントも紛れ込んでいる点に注意。
- 画像/動画生成AI固有ではないが、AI全体への不安・不信が背景にある。スレッド9「Are all of you also anxious about recent news about AI?」(r/AIToolTalks · 12点 · 35コメント · 2026-09-13)https://www.reddit.com/r/AIToolTalks/comments/1wfhbnv/ では水資源消費・雇用喪失への懸念、俳優Andrew Garfieldが「Artificial」でサム・アルトマン役を演じた後にAI利用をやめた話題に言及。u/Big-Pops78 (3点)は「水消費量は他の技術と比べて特別多いわけではない」と反論。
- AI導入の費用対効果に懐疑的な声も目立つ。スレッド6「Biggest AI news of 2026: AI is not a necessary tool...」(r/AIDangers · 26点 · 31コメント · 2026-09-14)https://www.reddit.com/r/AIDangers/comments/1wg5y17/ は「多くの企業でAI導入によりパフォーマンスが低下した」との主張。u/presentofai (1点)「most of these "AI made it worse" numbers are measuring clumsy rollouts, not the models」と反論しており、賛否両論。
Signals
- 上昇:ローカル/オープンウェイト動画モデル(Wan、Minimax H3、LTX Video)がクローズドソースの無料枠の代替として明確に支持を集めている。RTX 5090のような高性能GPU所持者が、クラウドの規制の厳しさを理由にローカルへ移行する動きが具体的に語られている(スレッド7)。
- 上昇:Seedance(2.0/2.5)が人物リアリズムと一貫性の面で評価を伸ばしている、複数スレッド・複数コメントで独立して言及。
- 軽視されている/却下されている:「スクリプト入力だけで完成品動画」を求める全自動ツールへの期待は、コミュニティから強く冷笑されている(スレッド5、最高得点コメントが皮肉)。「AI slop」という言葉自体も、一部からは「意味を失った罵倒語」として却下されつつある。
- 意見の対立(disagreement):スレッド11で「AI slopとは何か」を巡り真っ二つに割れている。u/Tenth_10 (9点、同スレッド最高)とu/pb404 (2点)は「物語に緊張感(stakes)がないから叩かれる、技術の問題ではない」と分析する一方、u/RioNReedus (3点)は「AIが嫌いな人が何にでも使う無意味な言葉になった」と真逆の立場。同じ投稿を読んで正反対の結論に達している点が興味深い。
- 驚いたこと:Googleが自社モデル(Nano Banana Pro)製の画像すら自社サービス(Flow)で弾くという「フィルターの過剰反応」(スレッド7)。無料クレジットの太っ腹さ(スレッド4・50クレジット/日)と、生成物への検閲の厳しさが同時に進行しており、ユーザー体験として矛盾したメッセージになっている。
- 驚いたこと:検索語「Image and Video Generation AI News」で拾えたスレッドの半数近く(r/AIDangers、r/AIToolTalks、r/NoStupidQuestions由来の3件)が、画像/動画生成に限らないAI全般への不安・懐疑論だった。画像/動画生成AIの話題が、より広い「AIは信用できるか」という文脈の中で語られている証左と言える。
Limits
- 収集されたのは11スレッドのみで、brief.mdが求める「約20件」には届いていない。使われた検索語は1つ(「Image and Video Generation AI News」— これは本リサーチのタイトルそのものであり、自然な検索クエリではない)のみで、他の言い回し(例:"Sora 2"、"Midjourney update"、"open source video model release" など)での再検索は行われていない。
- クローズドソース側は Google Flow/Veo と Seedance の話題に偏っており、Sora、Midjourney、Runway、Kling、Grok Imagineなど他の主要クローズドソースサービス単体を扱った専用スレッドは収集されていない(コメント内での言及のみ)。
- オープンソース側も Wan、Minimax H3、LTX Video が繰り返し言及されるのみで、Flux、Stable Diffusion系、ComfyUIエコシステムの最新動向を扱った専用スレッドは見つかっていない。
- r/AIDangers、r/AIToolTalks、r/NoStupidQuestionsの3スレッドは画像/動画生成AI固有の話題ではなく、AI全般の是非論。テーマとの関連度は間接的である点に留意。
- Reddit自体へのブラウザアクセスはワーカーが事前収集したデータに限定されており、本エージェントは追加の検索・ページ閲覧を行っていない(プレイブック指示通り)。
X
X — Image and Video Generation AI News
Accounts
None of the accounts in the collected set are talking about image or video
generation AI, closed-source or open-source. The 38 accounts in
output/x.posts.json are a mix of:
- Political/commentary accounts arguing about South Africa, Serbia/Kosovo,
Brexit and football eligibility, and Israel/Hamas (e.g. @TheSirRobotto,
2 posts totalling 12,537 likes on Serbia/EU football rules; @marklevinshow,
1 post, 3,250 likes, on Erdogan/Hamas). - Entertainment/fan accounts (@eva_kirby21, @PossiblyApollo — Apple TV
Emmys chatter; @justluvbourzgui, @theholydemi, @acervylaur —
Lauren Jauregui/DWTS fandom). - Crypto accounts on the Zcash (ZEC) governance vote (@CoinMarketCap,
@zooko — Zcash's own co-founder — and @Hasan_NFTOX running a free
NFT mint). - Low-engagement giveaway/spam accounts repeating the same "Pour PalZ Neon
Crochet Bears Giveaway" copy (@corrysue1, @PHIFFERJ,
@lilredshoper — all 0 likes, near-identical text via @gaynycdad).
No account here is an AI, Midjourney/Sora/Runway/Stable Diffusion/etc.
account, researcher, or news outlet. This is not "who is driving the AI
image/video conversation on X" — it is who is driving Croatia's trending
topics that day.
Posts
No findings — none of the 40 collected posts mention image generation,
video generation, or AI models of either kind (closed- or open-source).
Skipping fabricated relevance rather than stretching these into the brief.
Signals
Nothing can be read off this set as a signal for the research theme. The one
observable pattern in the data itself: it is dominated by regional politics
(South Africa, Serbia/Kosovo, Israel-Hamas), one crypto governance vote
(Zcash cutting block times from 75s to 25s, output/x.posts.md #19), and
fandom/spam noise — none of it AI-related.
Limits
The collection for this stage did not target the research theme. Per
output/x.posts.md and .json, the worker's method was "source": "trending":
it read X's Explore trends list — which is geolocated to the session's
server location and came back "Trending in Croatia" / general "Politics ·
Trending" / "Technology · Trending" — and then searched those trend names
verbatim: "Africa", "Serbia", "Apple", "Canada", "Zcash", "#sweepstakes",
"#giveaways", "#chance", "Lauren", "Hamas". None of these terms relate to
image or video generation AI, so the resulting 40 posts (38 accounts) contain
zero relevant material.
I did not search X myself — per the playbook, this session has no live X
access and I can only read what was already collected. So the completion
criteria (~20 analyzed posts per platform) cannot be met for X in this
run: there is no theme-relevant post in the collected file to analyze, and
I'm not able to re-run the collection with the right search terms (e.g.
"Sora 2", "Midjourney", "Stable Diffusion", "Runway", "Nano Banana", "Flux",
"Veo 3", "closed-source image AI", "open-source video model") from here.
This stage should be flagged as failed / needing re-collection with
theme-appropriate search terms rather than trending-topic terms.
YouTube
YouTube — 画像・動画生成AIニュース(クローズドソース/オープンソース)
Channels
YouTubeの検索結果ページ自体はJavaScriptでレンダリングされており、取得できたのはページ末尾のフッターのみでチャンネル名・登録者数が本文に載らないケースが多かった(詳細は「Limits」参照)。検索結果のタイトル・スニペットから確認できた範囲のチャンネル/発信者:
- OpenAI公式チャンネル —
Introducing GPT-Image-2.5 in the API(公式解説動画) - AI系ニュース・レビュー系チャンネル(具体名は特定できず): GPT Image 2.5、Nano Banana Pro、Sora 2終了、Wan/HunyuanVideo/Z-Image/Flux.2などComfyUI系チュートリアルを継続的に出しているチャンネル群(タイトル傾向から、MattVidPro AI・TheAIGRID・Theoretically Media・Matt Wolfe(約96.5万登録者、AIニュース専門)などAI専門チャンネルが同種のテーマを頻繁に扱っていることは検索で裏付けが取れたが、個々の動画とチャンネル名の一対一の紐付けは確認できなかった。
Videos
クローズドソース系
- GPT Image 2.5 Is AMAZING: Full Breakdown of OpenAI's New Image Model — 2026年9月上旬(「1週間前」表記) — https://www.youtube.com/watch?v=DY6TkI8XtkQ — OpenAIが2026/9/8にリリースした新画像モデル「GPT Image 2.5」(Flare/Sunburstの2バリエーション)の全体レビュー。
- Introducing GPT-Image-2.5 in the API — 2026年9月 — https://www.youtube.com/watch?v=A7MSwdXj86k — OpenAI寄りの公式解説動画。SunburstはよりシャープでナチュラルなライティングとAPI編集精度向上を強調。
- OpenAI's New Image Model Is Brilliant… Until You Look Closer — 2026年9月中旬(「5日前」表記) — https://www.youtube.com/watch?v=pEYqorQrc4U — GPT Image 2.5を他の主要画像モデルと比較し、弱点(細部の破綻など)を指摘する批判的レビュー。
- [NEW] Meta Muse.Ai Image Generation First Reaction — 2026年7月頃 — https://www.youtube.com/watch?v=rAvnO1DWnMs — Meta Superintelligence Labsの新画像モデル「Muse Image」(Muse Spark基盤、検索・コード実行を使うエージェント型生成)の初見レビュー。
- Grok Imagine Video 1.5 vs Seedance 2.0 | Full AI Video Test — 2026年6月8日 — https://www.youtube.com/watch?v=5mFkZiRTVu4 — xAIの「Grok Imagine Video 1.5」とByteDance「Seedance 2.0」を実際に生成して比較。
- Grok's New FREE AI Video Generator Is INSANE — 2026年7月6日 — https://www.youtube.com/watch?v=lrCjbL51dbk — Grok Imagine Video 1.5を無料で試せる点を中心に紹介。
- BREAKING: Sora 2 is SHUTTING DOWN… So I Tested the Best Alternatives — 2026年3月27日 — https://www.youtube.com/watch?v=Zf9979o8RGk — OpenAIがSora 2アプリ/APIを2026/3/24に発表・停止した件を受け、代替(Veo 3.1、Kling、Hailuoなど)を試すクローズドソース勢力図の転換点。
オープンソース系
- Z Image Turbo (FREE): This Open-Source AI Changed Image Generation Forever! — 2025年11月27日 — https://www.youtube.com/watch?v=sPQQPpQ9X4E — Alibaba(Tongyi-MAI)の6BパラメータAPACHE-2.0モデル「Z-Image Turbo」。Nano Banana Proに匹敵する画質と速度を主張。
- New Open-Source Model DESTROYS Flux 2 — Z-Image + Promptus Tutorial — 2025年11〜12月 — https://www.youtube.com/watch?v=JF4Q5hXh-_Q — Z-Image TurboがFlux.2を上回るという評価のComfyUIチュートリアル。
- Flux.2 Has Landed! Is It the Open Source King? — 2025年11月 — https://www.youtube.com/watch?v=D0_QGrdtvEg — Black Forest LabsのFlux.2(Pro/Flex/Dev/Apache-2.0のKlein)を検証。ただし後続の批判記事では「見せかけのオープン化」との指摘もあり。
- We have a new #1 open-source AI video generator!(Tencent HunyuanVideo 1.5) — 2025年11月25日 — https://www.youtube.com/watch?v=6EQP8-D37bs — Tencentが公開した83億パラメータのオープンソース動画生成モデルのレビュー・インストール手順。
- HunyuanImage 3.0: Open Source Text To Image Model (Forget Nano Banana & Seedream 4) — 2025年9月 — https://www.youtube.com/watch?v=32lhiZKhgOY — Tencentの800億パラメータ超MoE型オープン画像生成モデル。「最大のオープンソース画像モデル」と紹介。
- WAN 2.2 Animate in ComfyUI (Step-by-Step Guide) — 2025年9月26日 — https://www.youtube.com/watch?v=dyqz3PJ0wvo — Alibaba「Wan 2.2」の1枚の参照画像から動画を作るオープンソース機能のチュートリアル。
Signals
- OpenAIの動画生成はSora系が事実上撤退 — Sora 2アプリ/APIは2026年3月〜4月に停止・終了(API最終停止は2026/9/24予定)。クローズドソース動画生成の主役はGoogle「Veo 3.1」、Kling「2.5 Turbo」、ByteDance「Seedance 2.0」に移った、という論調の動画が複数見つかった(BREAKING: Sora 2 is SHUTTING DOWN, https://www.youtube.com/watch?v=Zf9979o8RGk)。
- 画像生成のクローズドソース最前線は「GPT Image 2.5」対「Nano Banana Pro(Gemini 3 Pro Image)」。2026年9月8日にOpenAIがGPT Image 2.5を投入し、2025年11月にGoogleが投入したNano Banana Proと直接比較する動画が急増(GPT Image 2.5 Is AMAZING, https://www.youtube.com/watch?v=DY6TkI8XtkQ)。
- Metaが画像/動画生成に本格参入 — Muse Image / Muse Spark / Muse Video(Meta Superintelligence Labs製)が2026年7月に登場し、検索エージェント型(Web検索・コード実行で画像を裏付ける)という新しいアプローチとして紹介されている。
- xAIのGrok Imagineが急速に反復 — 2025年8月の初版から2026年5〜7月にかけてVideo 1.5へアップデートし、無料枠を強調する動画が多い。
- オープンソース勢では中国発モデルが主導権 — Alibaba(Wan、Z-Image Turbo)、Tencent(HunyuanVideo、HunyuanImage)、Black Forest Labs(独, Flux.2)が中心。特にZ-Image Turbo(6B, Apache-2.0)は「Flux.2を上回る」という評価まで出ている。
- 警戒すべき反転シグナル: AlibabaはWan 2.2まではApache-2.0で完全オープンだったが、2026年8月24日発表の「Wan 3.0」はAPIのみでウェイト非公開の“クローズド”方針に転換したとする記事が複数あり(ソースはブログ記事だが、YouTube上でもオープンソース勢の主力交代を懸念する論調が出ている)。オープンソース動画生成の後継フラッグシップが不透明になっている。
- ComfyUIエコシステムが依然オープンソース動画/画像生成の主戦場 — Wan 2.1/2.2、HunyuanVideo、Z-Image TurboともにComfyUI向けチュートリアルが継続的に量産されている。
Limits
- YouTube検索結果ページ(
youtube.com/results?search_query=...)をWebFetchで直接取得しても、返ってくるのはJavaScriptレンダリング前のフッター(利用規約・著作権表示など)のみで、動画タイトル・チャンネル名・再生数・投稿日といった本体情報は取得できなかった。個別の動画ページ(youtube.com/watch?v=...)を直接取得した場合も同様で、埋め込みのJSON-LDやOGタグには到達できなかった。 - そのため、上記の再生数・チャンネル登録者数は検索(WebSearch)のスニペットから拾える範囲でのみ記載しており、多くの動画で正確な再生回数・チャンネル名・登録者数は確認できていない(「views」を明記できた動画は0件)。数字が必要な場合は追加でYouTube Data APIなど別経路が必要。
- Kling 2.5 Turboについては、Artificial Analysisのリーダーボードで1位という情報は複数の非YouTube記事で確認できたが、対応する具体的なYouTube動画のURLは特定できなかった(検索結果が主にブログ記事に偏った)。
- Midjourneyの動画生成モデルについては2025年4〜6月のニュースしか見つからず、直近60日以内の大きな新展開は確認できなかった(V7.1/V8関連の細かいアップデートは2025年9月時点の情報のみ)。
- コメント欄の内容(トップコメントなど)は今回取得したページ内に含まれておらず、分析できていない。
Bluesky
Bluesky — 画像・動画生成AIニュース
Accounts
- 🚨 AI News | TestingCatalog @testingcatalog.com — フォロワー860人。「Latest AI News on AI Agents, Model Releases, Tools, Leaks, and Rumors」を謳う個人運営のAIニュース速報アカウント。1日に複数回、モデルリリースやリーク情報を短い見出し形式で投稿していて、今回調べた中では最も更新頻度が高く「最新」に近い情報源だった。
- デイリーHuggingFaceトレンド @huggingfacetrends.bsky.social — フォロワー122人。Hugging Faceのトレンドモデルを毎日19時以降に自動投稿するボット(GitHub: aegisfleet/hugging-face-trending-to-bluesky)。オープンソースモデルの动向を追うのに有用。
- Midjourney(公式) @midjourneyofficial.bsky.social — フォロワー112人。2025年8月にBlueskyに参入したが、直近の投稿は2025年10月8日が最後で、以降は沈黙している。
- Stability AI(公式) @stabilityai.bsky.social — フォロワー241人。画像編集API「Stability AI Image Services」の告知など発信はあるが、直近の投稿は2025年11月が最後で、更新は途絶えがち。
- ComfyUI(公式) @comfyuiorg.bsky.social — オープンソースの画像/動画生成ワークフローツールの公式。ただし直近投稿は2025年6月で止まっており、2026年の動きは追えなかった。
- Black Forest Labs(Flux開発元) @blackforestlabs.bsky.social / Runway @runwayml.bsky.social / Kling AI @klingai.bsky.social — アカウント自体は存在するが、投稿がほぼゼロ(Black Forest Labsは投稿数0、Runwayは2024年10月の1件のみ、Klingはフィード空)で、Blueskyを主な発信チャネルにしていないことがわかった。
Posts
-
OpenAIが「ChatGPT Images 2.5」を発表(クローズドソース) — @testingcatalog.com、2026-09-09、👍2 🔁1
https://bsky.app/profile/testingcatalog.com/post/3mv3hn2whdz27
高速な画像生成・編集、被写体の一貫性強化、API向けの新モデル「Flare」「Sunburst」を投入という内容。 -
Metaの動画生成モデル「Muse Video」の初期出力が判明(クローズドソース) — @testingcatalog.com、2026-08-19、👍2
https://bsky.app/profile/testingcatalog.com/post/3mthtr6iu7p24
Meta Connectに向けて開発中とされるエージェント型スーパーアプリ「Muse」向けの動画生成モデルの先行情報。 -
新興スタートアップViskoがリアルタイム動画生成モデル「Orbis」を発表(クローズドソース) — @testingcatalog.com、2026-09-01
https://bsky.app/profile/testingcatalog.com/post/3muhthn6m7i2j
リアルタイム生成をうたう新規プレイヤーの参入として言及。 -
ElevenLabsのMCPが音楽・画像・動画も生成できるように拡張(クローズドソース寄りのAPIサービス) — @testingcatalog.com、2026-09-14、👍3 🔁1
https://bsky.app/profile/testingcatalog.com/post/3mvj6k7eycz2n
音声特化だったElevenLabsが画像・動画生成にも領域を広げた事例。 -
TencentがオープンソースのプレビューモデルHy4を公開(オープンソース) — @testingcatalog.com、2026-08-29
https://bsky.app/profile/testingcatalog.com/post/3mu7v3bdkwo2h
Hunyuan系列の後継とみられるプレビューモデルのオープンリリース。 -
Lightricks/LTX-2.5がHugging Faceトレンド入り(オープンソース動画生成) — @huggingfacetrends.bsky.social、2026-09-15(09-13・09-11にも再掲)
https://bsky.app/profile/huggingfacetrends.bsky.social/post/3mvkun3tjqp2t
Lightricks製の動画生成モデルLTX-2.5が3日連続でHugging Faceのトレンドモデルとして紹介されており、注目度が続いていることが読み取れる。 -
ComfyUIがFLUX.1 Kontextを公式APIノードとして統合(オープンソース) — @comfyuiorg.bsky.social、2025-06-06
https://bsky.app/profile/comfyuiorg.bsky.social/post/3lqvsxzzjhb2t
「Open Source coming soon!」と明記されており、Black Forest LabsのFluxエコシステムがComfyUIに深く統合された節目。日付は古いが、オープンソース画像編集モデルの主要な到達点として記録。 -
Wan2.1がComfyUI対応でリリース(オープンソース動画生成) — @comfyuiorg.bsky.social、2025-02-26
https://bsky.app/profile/comfyuiorg.bsky.social/post/3lj42stgelb2l
テキスト→動画(14B/1.3B)、画像→動画(14B)の4モデルを同時提供という内容。時期は古いが中国発オープン動画モデルの重要なマイルストーン。 -
Stability AIが画像編集APIサービスをAmazon Bedrockで提供開始(クローズド/API) — @stabilityai.bsky.social、2025-09-18
https://bsky.app/profile/stabilityai.bsky.social/post/3lz5eotkuvk2i
スケッチを写真的な商品ショットに変換するなど、企業向け画像編集ツールをAPI化。 -
Midjourneyが「Style Explorer」のスタイル数を倍増(クローズドソース) — @midjourneyofficial.bsky.social、2025-09-18、👍10 🔁2
https://bsky.app/profile/midjourneyofficial.bsky.social/post/3lz5cskktzk2c
公式アカウントが直接発信した数少ない機能アップデート告知の一つ。
Signals
- Blueskyは「画像・動画生成AIのニュース速報」を追う場としては層が薄い。公式ブランドアカウント(Midjourney、Runway、Kling AI、Black Forest Labs、ComfyUI、Stability AI)はいずれも存在するものの、投稿頻度が低いか、2025年後半で更新が止まっているものが大半。X(旧Twitter)やRedditに比べて発信の主戦場になっていないことが明確な傾向。
- 唯一継続的に「最新ニュース」を発信していたのは個人運営のニュース速報アカウント @testingcatalog.com で、2026年9月だけでもOpenAI・Meta・Google・Anthropicなどの動きを1日1〜3件のペースで投稿していた。ただし画像・動画生成に直接関係する投稿はその中の一部(ChatGPT Images 2.5、Meta Muse Video、Visko Orbis、ElevenLabsの拡張、Tencent Hy4など)に限られ、全体としてはエージェントやLLMのニュースが主流だった。
- オープンソース動向は、ニュースアカウントよりも「デイリーHuggingFaceトレンド」のような自動トレンド集計ボットの方が拾いやすかった。Lightricks/LTX-2.5が9月11・13・15日と繰り返しトレンド入りしており、オープンソース動画生成モデルとして継続的な関心を集めていることがうかがえる。
- 個人のAIアート投稿(Stable Diffusion/ComfyUI/Midjourneyで作った作品)は多数見つかるが、いずれも作品紹介であり「ニュース」として使える一次情報ではなかったため、Postsセクションには含めていない。
Limits
- Bluesky公式の投稿検索API(
app.bsky.feed.searchPosts)は、キーワードを変えても常にHTTP 403 Forbiddenを返し、今回の環境からは一切利用できなかった(getProfile・getAuthorFeed・getPostThread・actor.searchActorsは問題なく動作)。そのため「特定キーワードでの全文検索」ではなく、①actor.searchActorsでアカウントを発見し、②getAuthorFeedで各アカウントのフィードを取得し、③該当する投稿をgetPostThreadで個別に確認する、という代替手順で調査した。この制約により、検索APIが使えていれば拾えたはずの一般ユーザーの投稿(ハッシュタグ横断など)は網羅できていない。 bsky.appのWeb検索ページ(https://bsky.app/search?q=...)はクライアントサイドレンダリングのSPAで、投稿本文がHTML内に含まれず、直接の読み取りはできなかった。- Web検索エンジン経由でのBluesky投稿の発見(
site:bsky.app)も試したが、インデックスされている投稿は2024〜2025年前半の古いものが中心で、2026年9月時点の最新投稿はほとんど見つからなかった。 - 上記の理由により、収集できた投稿は特定アカウント(主に@testingcatalog.com、@huggingfacetrends.bsky.social、公式ブランドアカウント)のフィードに偏っている。プラットフォーム全体としての「画像・動画生成AI」への言及量や世論の温度感までは測れていない。
Lemmy
Lemmy — 画像・動画生成AIをめぐる話題(2026-09-17調査)
Communities
- [email protected] — 5.71K購読者、投稿1.41K件、コメント1.93K件。モデレーターは db0, Even_Adder。オープンウェイト系のツール・LoRA・ComfyUIカスタムノードのリリース情報が中心で、ほぼ毎日投稿がある一番アクティブなコミュニティ。
- [email protected] — 2.36K購読者(うちローカル362)。Stable Diffusion / オープンウェイトモデルで作った作品を貼るギャラリー系。Even_Adderという1ユーザーがほぼ1〜数時間おきに投稿している。
- [email protected] — 51購読者、累計投稿25.2K件(RedditのAI系サブレをRSSでミラーしているコミュニティ)。購読者は少ないが、他インスタンスでは出てこない生成AI比較ネタが拾える。
- [email protected] — Nano Banana系の作品が投稿されているが、Anubis(Bot対策)にブロックされ一覧取得は不可。
- [email protected] — 検索結果によれば222購読者・投稿11件のごく小さいコミュニティ(直接アクセスは500エラーで失敗)。
- [email protected](通称 sneerclub)— AI業界全般への皮肉・批判が投稿されるコミュニティ。画像生成AI企業への懐疑的な投稿もときどき混ざる。
Posts
-
「Same Berserk spread, 4 AI colorizations. Looks like GPT wins again?」 — [email protected]、2026-09-14、score 1
https://lemmy.durstig.online/post/60037
ベルセルクの1コマを4つのAIで着色比較。ChatGPT Images 2.5が線画・構図の保持で最良、Wan 2.7 Proはライティングは良いが一部塗り直し、Nano Banana Proは「変更するな」という指示を無視して要素を追加、Seedream 5.0 Proは構図保持はできたが彩度過多、という結果。検証コスト合計$0.30と明記。 -
「Taking a traditional filmmaking approach while making the Robo Dad animation」 — [email protected]、2026-08-22、score 0
https://lemmy.durstig.online/post/55214
手作りパペット撮影 → Nano Bananaでキャラクターシート生成 → Seeddance 2.0で動画化、というハイブリッドなワークフローの実例。 -
「Google quietly discontinues its Earth AI feature a day after its rollout after users made no-no images」 — [email protected]、2026-08-07、score 1
https://lemmy.durstig.online/post/52162
Google EarthにNano Banana 2を組み込んだ機能がロールアウト翌日に撤回。実在の場所に「災害」や「軍事施設」をでっち上げる画像が量産されたため。 -
「It's like an album cover...」 — [email protected]、2026-08-07、score -8
https://lemmy.ca/post/69025640
Nano Banana(Gemini 2.5 Flash)で作った南国風のアルバムジャケット風画像。スコアがマイナスで、AI生成画像への冷ややかな反応も見える。 -
「Midjourney wants Hollywood studios to reveal AI usage」 — [email protected]、2026-07-05、score 12
https://lemmy.today/post/56011946
Midjourneyがハリウッドのスタジオに対しAI使用の開示を求めているというニュース。 -
「Midjourney AI pivots to Theranos: Ultrasonic CT」 — [email protected](投稿者 David Gerard)、2026年6月中旬、score 41
https://awful.systems/post/8731127
Midjourneyが水中で全身をエコー的にスキャンする「超音波CT」医療機器事業に参入したという件を、血液検査で破綻したTheranosになぞらえて皮肉る投稿。「画像生成と著作権侵害の会社がなぜ医療機器に?」という懐疑的なコメントが多数。 -
オープンソース勢の新規ツール群([email protected]、投稿者 Even_Adder、2026-09-14〜09-17)
- ComfyUI-Fantastic-MiniMaxH3-PromptBuilder https://lemmy.dbzer0.com/post/75586072(7時間前、score 3)
- wan2gp-h3-latent-continue https://lemmy.dbzer0.com/post/75586070(Wan2GPに動画の続き生成機能を追加)
- ComfyUI_MinimaxH3_AutoContext https://lemmy.dbzer0.com/post/75586069
- TaoMate-H3-3Step-ComfyUI(3ステップ蒸留LoRA) https://lemmy.dbzer0.com/post/75427443
- ComfyUI-VDN-H3-24GB(24GB VRAM向け省メモリ実装) https://lemmy.dbzer0.com/post/75382764
- MiniMax-H3-Image-Training-Adapter https://lemmy.dbzer0.com/post/75382765
- Krea2-Turbo-Distill-2step-LoRA https://lemmy.dbzer0.com/post/75427441
ここ数日、「MiniMax H3」というオープンウェイトモデルを中心にComfyUI用のツール・LoRA・省メモリ実装が集中的にリリースされているのが目立つ。
-
「Dark Wings Silhouette」 — [email protected]、2026-09-17、score 2
https://lemmy.dbzer0.com/post/75601450
Krea2モデル+Qwen Imageの処理で作った作品。コメント欄ではQwen 3.5/3.8系やGLM 5.2をローカル運用でどう使うかという話題や、フロンティアモデルはB300クラスタ(2.1TB HBM)でも足りないというハード面の議論も出ている。
Signals
- 閉鎖系(クローズドソース)の話題は「新モデル発表」よりも、事故・炎上・皮肉のネタとして語られることが多い(Google EarthでのNano Banana炎上、MidjourneyのTheranos化ネタ)。r/系のミラーコミュニティ(!ai_reddit, !imageai)でしか拾えない話も多く、Lemmy純正コミュニティでの言及は薄い。
- オープンソース側は [email protected] が事実上の集積地。「MiniMax H3」という単一モデルを軸にComfyUIエコシステム(ノード・LoRA・省メモリ版)が数日間で一気に整備される、という典型的なOSSの動き方が観測できた。
- コミュニティ全体として購読者数はどこも小規模(数十〜数千人)で、Reddit/Xと比べるとボリュームは薄い。
- 検索ツールがノイズを拾いやすく、一度「#BringSoraHome」というアイルランドの親権問題の投稿を「OpenAI Soraのサービス終了」の話と誤認しかけた(実際は"Sora"という子供の名前)。個別に本文を確認して誤りと確認し、この報告には含めていない。
Limits
- 完了基準にある「20件ほどの投稿を解析」は、Lemmy単体では満たせなかった。API検索・コミュニティページ巡回を合わせても、テーマに直接関係する投稿は10件強しか見つからず、Lemmyは規模が小さいプラットフォームであるため無理に水増ししていない。
lemmy.world/c/stablediffusionとlemmy.world/c/[email protected]は直接アクセスすると500エラーになり中身を見られなかった。[email protected]はAnubis(Bot対策)にブロックされ、一覧取得ができなかった。- 「Grok Imagine」「Veo 3」「Kling AI」で検索しても関連投稿はヒットせず、Lemmyではこれらのクローズドソース動画生成サービス個別の話題はほとんど見当たらなかった。
- API検索は関連度が低いノイズ(政治・技術系の無関係記事)を多く返すため、本文を個別に開いて裏取りした投稿のみ採用した。
Pinterest — Image and Video Generation AI News
Visual themes
- Chrome/white humanoid android as the visual shorthand for "AI": a glossy robot head or torso with glowing blue eyes/circuitry, often at a news desk or holding a mic, stands in for "AI" across dozens of otherwise unrelated pins [5, 7, 10, 12, 20, 26, 30, 33, 47]. It's the single most repeated motif in the set.
- "Is journalism dying to AI?" framing: newsroom scenes where robots replace or sit beside human anchors/reporters, usually with an anxious human in frame, paired with headlines like "AI Is Writing the News — Can We Still Trust Journalism?" [2, 7, 12, 17, 19, 26, 33].
- Deepfake/misinformation anxiety graphics: facial-mesh overlays morphing one face into another, biometric scan HUDs, and explicit "FAKE" stamps over AI-generated content (a cat photo, a hooded figure) [9, 14, 16, 18, 44, 47].
- Blue/cyan tech-circuitry palette dominates: whether it's a robot, a hand holding a glowing "AI" chip, or a holographic office dashboard, the near-default colour grade is deep blue/cyan with white highlights [6, 16, 20, 21, 30, 44].
- Faceless-content / UGC commerce ads: Fiverr-style gig ads and "Go Viral Without Showing Your Face" tools selling AI avatars, face-swap, and product-demo video generation to marketers and creators [4, 9, 11, 18].
- Listicle/roundup infographics for tool discovery: "Top 5 Free AI Tools for Photo Generation," "Top AI News of July 2026," a large logo wall of ChatGPT/Gemini/Claude/Microsoft/Google/Apple/Samsung/Meta/Nvidia — all closed-source, big-brand names [30, 36, 42].
- Named closed-source products actually surfacing: Adobe Firefly (branding collage) [42], Microsoft's VASA-1 audio-to-face research diagram [14], ShengShu Technology's Vidu S1 real-time video model, shown twice in near-identical cyberpunk-woman key art [29, 38], and the Tilly Norwood AI-actress controversy via a TV chyron screenshot [1].
- Cute AI-generated animal renders as soft marketing bait: an otter in a lifejacket on a paddleboard, a puppy in flowers — used as demo output for photo/video generators rather than "AI news" per se [13, 36].
Notable pins
- #1 — "Hollywood Reporter Interviews the First AI Actress...": TV screenshot with a bold "AI-GENERATED IMAGE" chyron over the Tilly Norwood/Instagram photo — the clearest real-world closed-source controversy captured in the set.
- #7 — untitled robot-in-newsroom: android at an anchor desk surrounded by floating "NEWS" panels while a human reporter looks startled — the "AI takes the news desk" anxiety image in its purest form.
- #47 — "AI content and social media concerns": robot holding a phone next to a "FAKE" stamp over an AI cat photo and a hooded figure — the most direct visualization of the open/closed debate's shared trust problem.
- #14 — VASA-1 diagram: single image + audio clip + control signals → live facial animation grid — an actual technical figure, not stock art, tied to Microsoft's audio-driven talking-face research.
- #29 / #38 — Vidu S1 (ShengShu Technology): "The World's Most Advanced Model for Real-Time AI Interaction," cyberpunk key art repeated across two pins — a genuine named closed-source video-model launch out of China.
- #42 — Adobe branding collage: red Adobe/Firefly wordmark over generated portrait and nature shots — closed-source incumbent staking a claim in the space.
- #36 — "Top 5 Free AI Tools for Photo Generation": ranks Midjourney, Bing Image Creator, Canva AI, Leonardo AI, and Playground AI with sample outputs — the closest thing to an open/free-tier roundup in the set.
- #13 — AI-generated otter on a paddleboard: captioned as a "3D digital render," used as demo footage for a video-gen tool — shows how "AI video news" on Pinterest often means product demos, not journalism.
- #18 — "Go Viral Without Showing Your Face": hooded creator at a dual-monitor face-clone editing rig — packages AI avatar/face tech as a growth-hacking product for creators.
- #9 — face-swap ad ("Videos Pro"): two women's faces merging via a tracking mesh, sold as "hyperrealistic face editing" — deepfake tooling marketed directly to consumers.
Signals
- What's current: the dominant Pinterest narrative right now is not "which model shipped what" but anxiety and opportunism around AI faces — deepfakes, AI news anchors, face-swap apps, and "go faceless" content tools all cluster tightly together. The Tilly Norwood AI-actress story [1] and Vidu S1's real-time interactive video model [29, 38] are the two pins that read as genuine current-events news rather than stock concept art or affiliate content.
- What's largely absent: open-source-specific news is essentially invisible in this pin set. No pin names Stable Diffusion, Flux, HunyuanVideo, Wan, ComfyUI, or any GitHub-native project — the "AI tool" pins that do exist [30, 36, 42] list closed, hosted products (ChatGPT, Gemini, Claude, Adobe Firefly, Midjourney, Bing Image Creator, Canva, Leonardo). Pinterest's incentive structure (SEO blog thumbnails, affiliate listicles, gig-marketplace ads) appears to select for consumer-facing closed products over open-source community releases.
- Real technical detail is thin: outside of the VASA-1 diagram [14] and the Vidu S1 branding [29, 38], almost everything else is generic stock-photo/clipart illustrating the concept of AI rather than depicting an actual news event, release, or demo.
Limits
- This stage used pins the worker had already collected with a headless browser (
output/pinterest.pins.md, 50 pins under a single unlabeled search/genre); per the playbook I did not browse Pinterest myself, so this reflects one search pass, not an exhaustive crawl. - I opened and visually reviewed 30 of the 50 collected images directly; the remaining 20 were not opened individually, though their titles were reviewed and are consistent with the themes above.
- None of the pin destination pages were fetched — only the pin image and its saved title were available, so context beyond what's visible in-frame (e.g., full article text, comment discussion, save/repin counts) could not be verified.
- Open-source image/video-gen news is close to a dead end on this platform for this brief: the pin set simply does not surface named open-source projects, so the "open-source trends" half of the requested report will need to lean on the other platform stages (Reddit, X, YouTube, Bluesky, Lemmy) rather than Pinterest.
推奨アクション
- X(旧Twitter)はトレンド経由ではなく「Sora 2」「Nano Banana Pro」「Wan」「Flux」などテーマ直結ワードで検索し直して再収集する。
- Wan 3.0のクローズド化疑惑は一次情報(Alibaba公式発表)で裏取りして、オープンソース動画生成の勢力図への影響を追う。
- MiniMax H3周りの動きは[email protected]を定点観測すると一番鮮度が高い。
- GPT Image 2.5とNano Banana Proの比較は複数プラットフォームで一致しているので、次回はSeedream 5.0 Proなど第三勢力との比較も掘る。
- Google系モデルの安全フィルター過剰反応・誤生成トラブルは繰り返し報告されているので、信頼性ニュースとして継続ウォッチを推奨。
収集画像


















































データ品質メモ
Xは収集手法がテーマとずれておりテーマ関連ゼロで実質機能せず、Reddit・Lemmyは「20件ほど」という完了基準に届いていない。YouTubeは再生数・チャンネル名の裏取りができず、Blueskyは検索APIが使えず代替手段に頼っている。



