Image and Video Generation AI News — 2026-09-23
Closed-source image/video AI is retrenching hard (Sora 2's API shutting down 2026-09-24, Midjourney pivoting to medical devices, Grok Imagine/Seedance pricing backlash) while open-source tools built around ComfyUI (Wan, HunyuanVideo, FLUX.2, Qwen-Image, MiniMax H3) are quietly becoming the default for real production work.
画像・動画生成AI、オープンvsクローズドの最前線マジ熱い件 — 2026-09-23
いや〜見てきたけどマジで今めっちゃ面白い局面じゃん🔥 クローズドソース勢(Sora 2, Midjourney, Grok Imagineとか)は派手にリリースしてる裏でガンガン撤退・値上げ・方向転換してて、正直グラつき始めてる感あるわ😳 一方でオープンソース勢(Wan, FLUX.2, Qwen-Image, HunyuanVideo)はComfyUIってハブに集まって、地味だけどガチで実制作の現場に食い込んできてる💪 Reddit・X・YouTube・Bluesky・Lemmy・Pinterestの6か所を見た感じ、「派手なニュース=クローズド」「地道な実用=オープン」って構図がくっきり浮かんできた感じ。あと世論的には「AI生成物ってわかるようにしろよ」っていう表示義務化の声もめっちゃ強くなってる📢
プラットフォーム横断
- クローズド勢の失速・方向転換が複数プラットフォームで確認できた。 YouTubeではSora 2がわずか半年でアプリ終了(2026-04-26)、API終了も調査翌日の2026-09-24に予定されてて、1日約100万ドルの運用コストに対し課金収益が累計210万ドルしかなかったって報道が紹介されてた(https://www.youtube.com/watch?v=bIL7uU4CYnE)。Lemmyでも同じSora API終了ニュースがr/ArtificialInteligenceミラー経由でシェアされてて(https://www.reddit.com/r/ArtificialInteligence/comments/1wluu0n/)、しかも中国のKuaishou(Kling)が30億ドル調達したのと対比されてマジで「地味な業務用こそ稼ぐ」って論調になってた。
- オープンソースはComfyUIを軸にした"実務インフラ"としてどこでも顔を出す。 Reddit(ComfyUI+FramePackで低スペックPCでも動画生成)、Lemmy(MiniMax H3向けComfyUI拡張が直近1週間で2件)、YouTube(Wan/HunyuanVideo/LTXのローカル実行チュートリアルが量産)と、3プラットフォームで独立にComfyUIとWan系がキーワードとして浮上してた。
- 「もう有料化しすぎ」への不満がクローズド勢に向いてる。 Redditで「無料の動画生成AI探してる」スレが3本も立ってて(クローズドの無料枠縮小が原因)、Blueskyでも東京のアーティストがSeedance 2.5の料金の高さを「devastating」って繰り返し嘆いてた(https://bsky.app/profile/metalmickey.bsky.social/post/3mu25rbs4dk2e)。
- 「どのツール使えばいいの」って比較疲れが消費者側で起きてる。 YouTubeはSora 2 vs Seedance 2.0 vs Runwayみたいな比較動画が定番化してるし、Pinterestも「Best Quality vs Best Free」の決定マトリクスがめっちゃバズってた(YouTube: https://www.youtube.com/watch?v=rb0p_mY3tPs / Pinterest #10)。単体モデルの信奉より「今どれが強いか」を知りたい層が増えてる。
- AI生成物への不信・表示義務化の空気は複数プラットフォームで共通。 Redditの法案提案スレは13,841コメントで今回収集した中で断トツの議論量(https://www.reddit.com/r/CriticalState/comments/1wmktek/)、Pinterestでも「FAKE」スタンプやAI検出バッジのビジュアルが独立したジャンルとして定着してた。
プラットフォーム別
Reddit — 収集12スレッドのうち画像・動画生成AI専門コミュニティ発は4件だけで、残りは一般サブレディットの「AI生成物みっけ/ムカつく」系。無料・ローカル動画生成へのニーズが繰り返し出てくる一方、DeepSeek(オープンウェイト)はユーザー急増(DAU 1.2億→2億)にコンピュート増強が追いつかず品質劣化ってレアな「オープンが人気になりすぎて自滅しかける」構図も見えた(https://www.reddit.com/r/DeepSeek/comments/1wmcgex/)。
X — 日本語アカウント中心にClaude Opus 5.5とGrok 4.7の「一発生成デモ」祭りが起きてた。@cherry_mx_reds、@NFT_Chen、@riku720720、@chetasluaがほぼ同時期(9/21〜22)に別々のデモを投稿してて、リリース直後の一斉検証の波って感じ。オープン側は@shinshin86や@GeekCatXみたいな個人開発者がGitHubスター数を誇る投稿が目立った。ただし収集40件中20件超がテーマ無関係のノイズ(X独自のトレンドワード由来)だったのがネック。
YouTube — 一番情報が濃かった。Sora 2の栄枯盛衰(華々しい発表→半年で撤退)が最大トピックで、Nano Banana 2・GPT Image 2.5・Midjourney V8系のアップデート競争も継続中。オープン側はAlibaba(Wan)、Tencent(HunyuanVideo)、Black Forest Labs(FLUX)、Lightricks(LTX)が主戦場で、ComfyUIが新ノード続々投入の「配線盤」として定着してた。
Bluesky — 画像・動画生成AI専門の強いハブは存在せず、公式アカウント(Stability AI、Midjourney、Runway等)はほぼ休眠状態。唯一継続発信してたのはxAIの中の人@ethanhe。ただし全文検索APIが終始403で使えず、既知アカウント巡回でしか調査できなかったのが痛かった。
Lemmy — 規模は小さい(主要コミュニティでも5,713人)けど、[email protected]のComfyUI周辺投稿は情報濃度が高かった。クローズド側は「撤退・方向転換」ニュース(Sora API終了、Midjourneyの医療機器転向、GoogleのEarth AI即時撤回)がやたら目立ち、派手なリリースより軌道修正の話が多かった。
Pinterest — ニュース記事というより「AI NEWSサムネ風」画像や比較チャート、ディープフェイク警告系のビジュアルが中心。オープンソースはAMDの「Amuse 3.0」くらいしか見つからず、ほぼ不在。逆に消費者の「どれ選べばいいの」不安とAI生成物への警戒心がビジュアルジャンルとして強く出てた。
注目ポイント
- Sora 2 API終了(2026-09-24) — YouTube: https://www.youtube.com/watch?v=bIL7uU4CYnE
- DeepSeekのDAU急増とコンピュート不足による品質劣化 — Reddit: https://www.reddit.com/r/DeepSeek/comments/1wmcgex/
- AI生成物の表示義務化を求める法案提案(13,841コメント) — Reddit: https://www.reddit.com/r/CriticalState/comments/1wmktek/
- ComfyUI+MiniMax H3の長尺動画生成拡張が続々登場 — Lemmy: https://github.com/supElement/ComfyUI_MinimaxH3_AutoContext
- Grok 4.7がBlenderで3Dシーン自動生成(41万views) — X: https://x.com/cherry_mx_reds/status/2102098340699668865
- Midjourneyが画像生成から医療機器(超音波CTスキャナー)事業へ大転換 — Lemmy: https://www.theregister.com/ai-and-ml/2026/06/18/midjourney-pivots-to-medical-devices/
推奨アクション
- クローズド勢の値上げ・撤退が続く今、Wan・HunyuanVideo・FLUX.2・ComfyUI+MiniMax H3のOSSスタックを本命の代替として継続ウォッチする。
- Reddit・Pinterestで強まってるAI生成物の表示義務化の空気を先取りして、コンテンツの出所表示ポリシーを準備しておく。
- Sora 2のAPI終了(9/24)後、ユーザーがKling・Seedance・Runwayのどこに流れるかを追う。
- X上のOpus 5.5/Grok 4.7一発生成デモ祭りはリリース直後の短命ハイプと捉え、OSS側のシェアへの脅威と過大評価しない。
- DeepSeekのようにオープンウェイトが急激に人気化した際の自前インフラ限界を、供給制約の先行指標として注視する。
- YouTube・Pinterestで顕著な「比較・決定疲れ」ニーズに対しては、単体ニュース発信より比較コンテンツで接点を作る。
データ品質
完了基準(各SNS約20件解析)を満たせたのはYouTubeとPinterest(各20件・50件収集)くらいで、他は不足あり。Redditは12スレッドどまりで専門サブレディット発はわずか4件。Xは40件収集したが半分超がテーマ無関係のトレンドワード由来ノイズで、テーマ直撃は約11件。BlueskyはAPI(全文検索)が終始403で使えず既知アカウント巡回のみ、収集できたのは10件。Lemmyはプラットフォーム規模自体が小さく(主要コミュニティ5,713人)、20件到達はそもそも不可能な規模で、しかも半数がRedditミラー転載。Pinterestは50件中26件しか目視確認しておらず、いいね数などのエンゲージメント指標も取得不可だった。
プラットフォーム別まとめ
Reddit — 画像・動画生成AIニュース
どこで(サブレディット)
収集された12スレッドは10のサブレディットに分散。画像・動画生成AI専門コミュニティは少数で、残りは一般サブレディットでのAI生成物への言及・苦情スレッドだった。
| サブレディット | メンバー数 | 収集スレッド数 |
|---|---|---|
| r/generativeAI | 156,181 | 3 |
| r/mildlyinfuriating | 12,586,808 | 1 |
| r/aivideomaking | 7,498 | 1 |
| r/CriticalState | 39,096 | 1 |
| r/Instagramreality | 1,155,566 | 1 |
| r/Purdue | 100,731 | 1 |
| r/DeepSeek | 140,681 | 1 |
| r/ImagineAiArt | 19,446 | 1 |
| r/youngpeopletiktoks | 8,226 | 1 |
| r/youtube | 3,459,719 | 1 |
生成AIに特化しているのは r/generativeAI・r/aivideomaking・r/DeepSeek・r/ImagineAiArt の4つのみ(4スレッド)。残り8スレッドは一般サブレディットで「AI生成物を見つけた/腹が立った」という文脈で言及されたもの。
みんなの反応
- 無料の動画生成AIを探す声が3つの別スレッドで繰り返し発生(スレッド#2「Which AI video generator can still be used for free?」r/generativeAI・20pt・73コメント・2026-09-16 / スレッド#3「Looking for a free AI video generator」r/aivideomaking・7pt・28コメント・2026-09-20 / スレッド#10、同タイトル r/generativeAI・4pt・28コメント・2026-09-20)。クローズドソースは軒並み有料化が進み、u/RioMetal(+4)は「ローカルで動かせるならWanやMinimaxがいくらでもある」とオープンソース勢を推薦。
https://www.reddit.com/r/generativeAI/comments/1whtesl/ - 「AIが勧めてくるものが全部有料になった」という不満(スレッド#2、投稿本文)。クローズドソース系の無料枠縮小に対する典型的な反応。
https://www.reddit.com/r/generativeAI/comments/1whtesl/ - ローカル・オープンソース運用の具体策:u/AztecWheels(+2、スレッド#3)が「Pinokio経由でFramePackを導入すれば低スペックPCでも画像→動画変換ができる(音声なし、1〜120秒)」と回答。ComfyUI+FramePackの組み合わせが低スペック環境でのオープンソース動画生成の定番として言及。
https://www.reddit.com/r/aivideomaking/comments/1wled0f/ - 「無料をねだるな」という反発:u/activematrix99(+2、スレッド#3)「レストランでタダ飯を要求するようなもの。企業はこの技術に数十億かけている」。無料要求への風当たりも強く、コミュニティ内で意見が割れている。
https://www.reddit.com/r/aivideomaking/comments/1wled0f/ - DeepSeek(オープンウェイト)の急成長とコンピュート不足:スレッド#7「some deepseek news, if you care」(r/DeepSeek・292pt・45コメント・2026-09-21)投稿本文によると、DeepSeekのDAUは1.2億→2億(+66.7%)に急増した一方、計算能力は+8.3%しか増えておらず、品質低下や再生成の不具合が発生。対策としてHuaweiのAscend 960DTを16万個発注したと言及。u/Equivalent-Grass-527(+13)「需要と計算資源のミスマッチが最近の劣化の説明として一番腑に落ちる」。
https://www.reddit.com/r/DeepSeek/comments/1wmcgex/ - GPT Image 2.5 Flare(クローズド)vs KREA 2(オープン)論争:スレッド#9「GPT Image 2.5 Flare — is this actually the best AI image generating model right now?」(r/ImagineAiArt・93pt・62コメント・2026-09-16)。u/Dependent_Quit_3730(+3、ポルトガル語)「簡単に使いたい人には完璧なモデル、でも自分はまだKREA 2を使う」、u/SeaworthinessFresh16(+2)「ComfyUI+Krea2の結果は同じに見える」。クローズド新モデルの話題性に対し、オープンモデルとの体感差はほぼないという声。
https://www.reddit.com/r/ImagineAiArt/comments/1wi79wi/ - AI生成の不動産写真への強い反発:スレッド#1「It should be illegal to post AI-generated "inspirational" images in house listing photos.」(r/mildlyinfuriating・25,962pt・706コメント・2026-09-21、収集スレッド中最高スコア)。u/BojackWorseman13(+1,128)「不動産業者ならSNSに苦情を送りまくる、違法でなくてもAI生成である旨を大きく明記すべき」。
https://www.reddit.com/r/mildlyinfuriating/comments/1wmja6n/ - AI生成物への表示義務化を求める法案提案:スレッド#4「[Law Proposal] Every ai generated image and text must need to have watermark.」(r/CriticalState・1,246pt・13,841コメント・2026-09-21、収集中で最多コメント)。上位コメントは軒並み賛成票(u/Timedforfun +16「隠すべきものじゃない、賛成に投票」)。
https://www.reddit.com/r/CriticalState/comments/1wmktek/ - 一般人には見分けがつかないレベルのAI生成画像がバズる:スレッド#5「AI generated images on Reddit with thousands of upvotes and comments」(r/Instagramreality・2,148pt・343コメント・2026-09-18)。u/Habibti-Mimi81(+146)「自分では気づけなかった、グレーのタイルの角が唯一のヒント。悲しくて危険な時代」。
https://www.reddit.com/r/Instagramreality/comments/1wk0euk/ - 大学の公式掲示物にまでAI生成画像が使われ「スロップ」と批判:スレッド#6「AI generated image on MSEE wall」(r/Purdue・139pt・19コメント・2026-09-21)。投稿本文「グラフィックデザイナーを雇えなかったのか、どこに行ってもAIスロップから逃げられない」。
https://www.reddit.com/r/Purdue/comments/1wmq43f/ - Sora等の動画生成AIコンテンツがTikTok転載サブに流入:スレッド#11「another ai generated grounded video」(r/youngpeopletiktoks・81pt・35コメント・2026-09-19)。u/Pretend-Goat-8065(+5)「Another Sora ai」と一言でクローズドソース製品名を名指し。
https://www.reddit.com/r/youngpeopletiktoks/comments/1wkjvor/ - YouTubeのAI自動生成チャプターへの反発:スレッド#12(r/youtube・3pt・22コメント・2026-09-17)。u/avatar0027(+2)「文字起こしから自動生成されたチャプターがより積極的に表示されるようになった。視聴者側に一括オフの手段はなく、投稿者が個別に無効化するしかない」。動画生成そのものではないがAI機能拡大への疲労感を示す傍証。
https://www.reddit.com/r/youtube/comments/1wiqamq/
シグナル
- 上昇:無料・ローカルで動く動画生成(Wan 2.2、Minimax H3、ComfyUI+FramePack)へのニーズが3つの独立したスレッドで繰り返し出現。クローズドソースの値上げ・有料化がオープンソースへの関心を後押ししている構図。
- 上昇:AI生成物であることの「表示義務」を求める世論(スレッド#4は13,841コメントと収集中最大の議論量)。モデルの性能競争よりも、規制・透明性の話題の方がReddit全体では圧倒的にエンゲージメントが高い。
- 軽視されがち:「無料でよこせ」という要求そのものに対する反発(u/activematrix99など)。コミュニティ内には「タダで使えて当然」への冷めた視線もあり、一枚岩ではない。
- 意外だった点:DeepSeek(オープンウェイト)がユーザー数急増の一方でコンピュート不足により品質劣化を起こしているという話(スレッド#7)。オープン/クローズドの対立軸ではなく、「オープンモデルが人気になりすぎて自前のインフラが追いつかない」という新しいタイプの供給制約が語られていた。
- 意見の対立:スレッド#9でクローズドの新モデル(GPT Image 2.5 Flare)とオープンのKREA 2を比較するコメントが割れており、「話題性はクローズドだが体感差はない」という声が複数あった。
制限
- ブリーフの完了基準は各SNSで約20件の投稿を解析することだが、reddit.threads.md/.jsonに収集されていたのは12スレッドのみ(検索語は"Image and Video Generation AI News"の1種類のみ)。ワーカーが既に収集済みのデータを読む方針のため、追加検索は行っていない。
- 収集された12件のうち、画像・動画生成AI専門コミュニティ(r/generativeAI、r/aivideomaking、r/DeepSeek、r/ImagineAiArt)発は4件のみ。残り8件は一般サブレディットでの「AI生成物を見つけた」系の派生スレッドで、クローズドソース/オープンソースの新製品・アップデートそのものを主題にした「ニュース」スレッドはほぼ含まれていない。
- r/StableDiffusion、r/midjourney、r/runwayml、r/aivideoなど、画像・動画生成AIの主要な専門サブレディットは収集セットに一件も含まれていない。
- スレッド#9(GPT Image 2.5 Flare)の投稿本文はプロンプト全文の途中で切れており、投稿の続きや添付画像の内容は確認できない。
- Redditは自分でブラウズできない制約のため、この12件を超える範囲(他の検索語や他のスレッドの深掘り)は調査していない。
X
X — 画像・動画生成AIニュース
X(Twitter)は日本語アカウントを中心に「Claude Opus 5.5」と「Grok 4.7」の
動画・アニメーション生成デモが盛り上がっている一方、収集された40件中の
半分以上はテーマと無関係なノイズだった(詳細は下の Limits を参照)。
Accounts
- @cherry_mx_reds(Tak) — 今回の収集で最も存在感が大きい。Opus 5.5の
アニメ「Oktoberfest」一発生成の投稿(373 likes)と、Grok 4.7がBlenderで
3Dシーンを作った投稿(1,636 likes・~410,000 views)の2件を投稿。1アカウントで
2つの別モデルのデモを検証しており、比較目線の実況アカウント。 - @NFT_Chen(SuSu_酥酥) — Opus 5.5がコードでコマ撮りアニメーションを
手描き風に生成したデモを1件投稿(151 likes・~40,000 views)。単発だが
詳しい説明文つきで拡散されている。 - @chetaslua — Opus 5.5でアセット・MCP・スキルなしのJSのみでインタラクティブ
動画生成をした事例を1件投稿(435 likes)。実装寄りの技術デモ系。 - @riku720720(Rikuo) — Opus 5.5のピクセルアニメーション生成を1件投稿
(173 likes)。プロンプトをリプライ欄で共有する実践共有型。 - @old_pgmrs_will(NeuralWire.org運営) — Grok 4.7関連を2件投稿。1件は
フォトレタッチアプリ自動生成+デモ機能(8 likes)、もう1件はGrok-4.7への
否定的な声への反論と動画編集アプリのUI改善報告(8 likes)。2件とも小規模
だが、AIニュースアカウントとして継続的に発信している。 - @shinshin86(AITuber OnAir開発者) — オープンソースツール
「Still2Rig PSD」(静止画→PSD自動レイヤー分け)の開発者本人による
GitHubスター60超え報告(586 likes・~28,000 views)。 - @ishitaku39(いしたく) — NVIDIAの研究モデル「ARDY」を個人開発者が
ブラウザ動作まで軽量化した派生版「ARDY Mini」を紹介(226 likes)。 - @GeekCatX(知识猫AI实验室) — オープンソースの「Hand-drawn Video
Skill」(story-to-handdrawn-video)のGitHubスター2,000超え報告(103
likes)。1ヶ月ぶりの更新内容も共有。 - @so_ainsight — 週間GitHub急上昇AIリポジトリまとめ投稿(573 likes・
~49,000 views)。画像・動画生成に限らないAIリポジトリ横断まとめで、
文脈の一部としてのみ関連。
Posts
クローズドソース(Opus 5.5 / Grok 4.7)
-
#1 @riku720720 — 173 likes・19 reposts・1 reply・約19,000 views・
2026-09-22。https://x.com/riku720720/status/2102515055116063144opus 5.5、本当にやばすぎる... 5分もかからずこのピクセルアニメーション出してきやがった。
5分未満でピクセルアニメーションを一発生成、という速度への驚きが投稿の核。 -
#2 @NFT_Chen — 151 likes・20 reposts・13 replies・約40,000 views・
2026-09-22。https://x.com/NFT_Chen/status/2102455102896509431This isn't drawn by a human! Claude Opus 5.5 used code to hand-draw this animation frame by frame. ... 32 seconds, all generated by AI.
「コードで手描き風にコマ撮り」という生成手法自体が驚きポイントとして語られている。 -
#3 @cherry_mx_reds — 373 likes・17 reposts・10 replies・約36,000
views・2026-09-21。https://x.com/cherry_mx_reds/status/2102493303388475855Opus 5.5 one-shot this animation in 14m and 48s "Oktoberfest" by Opus 5.5
「one-shot」(一発生成)を強調。所要時間14分48秒という具体的数字を明記。 -
#4 @chetaslua — 435 likes・23 reposts・10 replies・約20,000 views・
2026-09-22。https://x.com/chetaslua/status/2102501773705670994Interactive video gen in whatever art style you want by @claudeai Opus 5.5 coded no assets, mcp, skill, only js
アセット・MCP・スキル不使用、JSのみでインタラクティブ動画を生成という
実装の身軽さを強調した技術系デモ。 -
#17 @AbhinavXJ — 57 likes・2 reposts・2 replies・約3,200 views・
2026-09-22。https://x.com/AbhinavXJ/status/2102473742723260606they said pace the frontier and now we have Grok 4.7 Claude Opus 5.5 GPT-6 sol and luna in span of 2 days
個別モデルの話ではなく「2日間で複数の主要モデルが出た」という業界の
リリース速度そのものへの反応。 -
#19 @cherry_mx_reds — 1,636 likes・215 reposts・127 replies・約
410,000 views・2026-09-21。
https://x.com/cherry_mx_reds/status/2102098340699668865Grok 4.7 made this in blender. I didn't tell it what to make but only that it should be something it can accomplish in 10 minutes or so.
今回の収集の中で最もエンゲージメントが大きいAI生成デモ投稿。Blenderでの
3D生成に踏み込んでいる点が新規性。 -
#18 @old_pgmrs_will — 8 likes・0 reposts・0 replies・約611 views・
2026-09-21。https://x.com/old_pgmrs_will/status/2102182047989338264Grok 4.7 で自分で使うためのフォトレタッチアプリを生成。ついでに実際の操作を実演するための自動デモ機能も実装させた
個人用途アプリ生成+デモ機能付きという実用寄りの活用報告。 -
#20 @old_pgmrs_will — 8 likes・0 reposts・0 replies・約599 views・
2026-09-22。https://x.com/old_pgmrs_will/status/2102376309020299517海外勢を中心に?「Grok-4.7 使えねぇ」みたいな投稿を散見するが、アンチか使いこなせてないかのどちらか
Grok 4.7への否定的な声がある一方、本人はAI動画編集アプリのUI/UX改善が
捗っていると反論。評価が割れている様子が伺える。
オープンソース
-
#33 @shinshin86 — 586 likes・59 reposts・2 replies・約28,000 views・
2026-09-21。https://x.com/shinshin86/status/2102163713679577301静止画からPSDを作れるAIツール『Still2Rig PSD』、GitHubスターが60を超えました...CodexなどのAIエージェントに画像を渡して依頼すると、Google Colab上でSee-throughを動かしてレイヤー分けし、PSDの組み立てまで進めてくれます
個人開発OSSツールがGitHubスター60超えを報告。AIエージェント連携が特徴。 -
#34 @ishitaku39 — 226 likes・22 reposts・3 replies・約9,800 views・
2026-09-21。https://x.com/ishitaku39/status/2102038146489946532キャラの動きを、コメントに合わせてリアルタイムで生成できた…!自作AITuberに「ARDY Mini」を組み込んでみた。NVIDIAの研究モデル「ARDY」を、個人開発者の方がブラウザで動くまで軽量化した派生版です。
NVIDIA研究モデルの軽量化派生版がブラウザで動くまでになった、という
OSSコミュニティによる実用化の例。 -
#35 @GeekCatX — 103 likes・18 reposts・4 replies・約7,800 views・
2026-09-22。https://x.com/GeekCatX/status/2102336276230025224Hand-drawn Video Skill has been updated again! ...the GitHub Stars for story-to-handdrawn-video have now exceeded 2,000. This time, the focus is on adding more art styles
OSSの「story-to-handdrawn-video」がスター2,000超え。アートスタイル
追加が今回のアップデートの目玉。 -
#36 @so_ainsight — 573 likes・75 reposts・6 replies・約49,000
views・2026-09-21。
https://x.com/so_ainsight/status/2101871551255830529今週GitHubで急上昇したAIリポジトリ10選:1. OpenCodeReview...
画像・動画生成に限らない週間GitHub急上昇AIリポジトリまとめ。テーマ
直撃ではないが、OSS AI界隈の勢いを示す文脈として言及。
Signals
- 伸びているもの: Claude Opus 5.5とGrok 4.7による「短時間・低コストで
動画/アニメーションを一発生成できた」という個人の実演投稿が軒並み
エンゲージメントを稼いでいる。特にOpus 5.5は複数の独立したアカウント
(@riku720720, @NFT_Chen, @cherry_mx_reds, @chetaslua)がほぼ同時期
(2026-09-21〜22)に別々のデモを投稿しており、リリース直後の一斉検証の
波が見える。 - 軽視されている/賛否が分かれるもの: Grok 4.7については称賛
(Blenderでの3D生成、~410,000 views)と否定(「使えねぇ」という声)が
同居しており、@old_pgmrs_willが自ら反論する形で投稿している。単純な
礼賛一色ではない。 - 意外だった点: オープンソース側は日本語圏の個人開発者(
@shinshin86, @ishitaku39, @GeekCatX)がGitHubスター数を具体的な指標として
誇る投稿が目立ち、企業発表よりも「個人が既存の研究モデルやAIエージェントを
組み合わせて実用ツール化した」という文脈の投稿が多かった。 - 意外だった点その2: X検索語のうち画像・動画生成AIに直結する語は
「Opus 5.5」「Grok 4.7」「GitHub」の3つのみで、残り7語(#chance,
England, #sweepstakes, #giveaways, Lauren, $SONG, Jesus)はいずれもX
独自のExplore急上昇ワードであり、テーマとは無関係だった。
Limits
- 検索語10個のうち #chance(ABEMAの恋愛リアリティ番組)、England(
天候・サッカー関連の雑談)、#sweepstakes(Fanaticsアプリ等の懸賞
キャンペーン)、#giveaways(インドの祭礼関連の懸賞投稿)、
Lauren(R&B歌手のスキャンダルおよびブラジルのテレノベラ「Estrelas da
Casa」)、$SONG(Cardano上の仮想通貨トークン)、Jesus(宗教的
文脈、ゲーム業界批判、サッカー実況) の7語は画像・動画生成AIとは
無関係で、収集した40件中20件超がこのノイズに該当する。これらはX自身の
Explore急上昇ワード(下記参照)から機械的に検索された結果とみられ、
テーマに対する意味のあるシグナルはない。 - X's own Explore trends list(このセッションが接続したサーバーの所在地
ベース)は「Trending in Croatia」を含む、クロアチア中心の地域トレンド
だった。世界的な動向として提示できるものではなく、上記のノイズ検索語
もこのローカルなトレンドリストに由来している可能性が高い。 - クローズドソース・オープンソースともに「テーマに直結する投稿」は
Opus 5.5関連4件、Grok 4.7関連4件、GitHub発オープンソースツール3件の
合計11件にとどまり、ブリーフが求める「オープンソース・クローズドソース
各最低10件の気づき」を満たすには、投稿の分析だけでは点数が不足している。
他プラットフォーム(Reddit等)の結果と合わせて補う必要がある。 - OpenAI(GPT-6/Sora系)やMidjourney、Stable Diffusion、Runwayなど、
他の主要な画像・動画生成AIプレイヤーの名前は今回のX検索語には含まれて
おらず、収集データにも登場しなかった。これらのプレイヤーについてXでの
反応は本ラン内では確認できていない。
YouTube
YouTube — 画像・動画生成AIの最新ニュース(クローズドソース/オープンソース)
Channels
- OpenAI(公式チャンネル)— Sora 2、ChatGPT Images 2.5 の公式発表を配信。
- Google / Google DeepMind(公式)— Gemini「Nano Banana」シリーズの発表。
- Adobe(公式)— Firefly のマルチモデル展開の発表。
- Runway(公式)— Gen-4.5、MCPサーバー関連の発表。
- Lev Selector — 週次でAIニュースをまとめる個人チャンネル("Exciting AI Updates Weekly"シリーズ)。
- ComfyUI / Stable Diffusion系チュートリアル勢(例: 番組名"AI on the Lot"関連チャンネル、ComfyUIワークフロー解説者)— Wan、LTX、Flux、HunyuanVideoなどオープンソースモデルのローカル実行チュートリアルを量産。
- 比較・レビュー系チャンネル("Best AI Video Generator"系タイトルを連発するチャンネル群)— Sora 2 / Seedance 2.0 / Runway / Kling を横並びで比較する動画が多数。
- 購読者数はページのHTMLがJSレンダリング必須で取得できず、検索結果のスニペットにも記載がなかったため未確認(
## Limits参照)。
Videos
クローズドソース
- Introducing Sora 2 — OpenAI公式 / 2025-09-30 / https://www.youtube.com/watch?v=gzneGhpXwjU — Bill Peebles・Rohan Sahai・Thomas Dimsonが登壇し、物理演算に忠実でセリフ同期もできる新世代動画生成モデルSora 2と新アプリSoraを発表。
- OpenAI Abandons Sora to Refocus on Enterprise Solutions — 解説チャンネル / 2026年3月頃 / https://www.youtube.com/watch?v=bIL7uU4CYnE — OpenAIがSoraアプリを2026年4月26日に終了し、APIも2026年9月24日(=この調査の翌日)に終了させる方針を解説。1日約100万ドルの運用コストに対し課金収益が生涯で210万ドルしかなかったという報道内容を紹介。
- OpenAI Shuts Down Sora & Kills ChatGPT Integration Plans | What Happened? — 解説チャンネル / 2026年3月〜4月頃 / https://www.youtube.com/watch?v=9rhmczPT6Jk — Sora終了の背景として、DisneyとのAI提携(10億ドル規模)が発表直前に破談になった経緯を解説。
- Introducing ChatGPT Images 2.5 — OpenAI公式 / 2026-09-08頃 / https://www.youtube.com/watch?v=6l7ble9P74o — GPT Image 2.5(ChatGPT Images 2.5)発表。生成速度を従来比50%高速化し、手描きスケッチをそのまま画像化する新機能「Sketch」を追加。
- Sketch with ChatGPT Images 2.5 — OpenAI公式 / 2026年9月 / https://www.youtube.com/watch?v=imPtIEAEHSU — 「@Sketch」とタイプしてChatGPT内で直接下絵を描き、そのままAI画像化するデモ。
- The New Gemini Image Generator is Insane (Nano Banana 2) — レビュー系 / 2026-02-27 / https://www.youtube.com/watch?v=nikIxHM_AQY — GoogleがGeminiアプリの標準画像生成モデルを「Nano Banana 2」に刷新したことをレビュー。
- Midjourney Update | March 2026: V8 Alpha, BIG Changes Coming, New Edit Model + More — Midjourney解説チャンネル / 2026-03頃 / https://www.youtube.com/watch?v=TZ1zWvbXFug — V8アルファ版の発表回。以後V8.1(2026-04-14)→V8.2(画質・パーソナライズ強化、編集モデルを2026-08-27に全ユーザー開放)と続くアップデートの起点。
- Kling 3.0: the biggest advancement in AI video generation? — レビュー系 / 2026年前半 / https://www.youtube.com/watch?v=G1VHCrl4jy4 — Kuaishou「Kling 3.0」を検証。ネイティブ4K・60fpsで動画生成する初のモデルとしてArtificial Analysisの動画部門1位を獲得したと紹介。
- Grok Imagine 1.5 Preview - Mind-Blowing AI Video Just Dropped 🔥 | xAI — レビュー系 / 2026-06-03 / https://www.youtube.com/watch?v=grxiFAC-NNI — xAIのGrok Imagine 1.5プレビューを検証。
- Sora 2 vs. Seedance 2.0 vs. Runway: The 2026 AI Video War Explained — 比較系 / 2026-02-13 / https://www.youtube.com/watch?v=rb0p_mY3tPs — Sora 2・ByteDance「Seedance 2.0」・Runwayの三つ巴を比較。
- Runway Ships an MCP Server - Generate Video From Inside Claude, ChatGPT, Cursor and Replit — Runway公式 / 2026-05-27頃 / https://www.youtube.com/shorts/t9Bg_4rOQqM — RunwayがMCPサーバーを公開し、Claude・ChatGPT・Cursor・Replitから直接動画生成できるようになったと発表。
オープンソース
- Now that Wan 2.5 (open source model from Alibaba China) can do AI dialogues, AI Lip Syncing to... — 解説系 / 2026年前半 / https://www.youtube.com/watch?v=kzXNJO6caGw — AlibabaのオープンソースモデルWan 2.5がセリフ生成・リップシンクに対応したことを紹介。
- Wan2.6: Multi-shot Storytelling & Cinematic Shot Control — チュートリアル系 / 2025年末〜2026年初頭 / https://www.youtube.com/watch?v=VHJ925WoWgw — Wan 2.6が1プロンプトから最大15秒・複数ショットの映画的な動画を生成できる新機能「マルチショットストーリーテリング」を解説。
- Black Forest Labs: FLUX 2 – The King of AI Image Generation — レビュー系 / 2026-06-04 / https://www.youtube.com/watch?v=WZfKzzX65-o — Black Forest LabsのFLUX.2を検証。
- FLUX.2 Just Beat Every AI Image Model — Black Forest Labs' Most Powerful Release Yet — レビュー系 / 2025-11-27 / https://www.youtube.com/watch?v=VMBSUBKON_U — FLUX.2が既存の画像生成モデルの品質・制御性・一貫性を上回ったと主張。
- Qwen Image-2512 First Test – The BEST Open Source Image Model! — レビュー系 / 2026年 / https://www.youtube.com/watch?v=SBaK616nP6Q — AlibabaのQwen-Image-2.1系最新版(テキストレンダリング・画像編集・透過画像生成を統合、生成部は7Bパラメータ)を検証。
- HunyuanVideo 1.5 vs Wan 2.7 Comparison: Which is The Best Free Local Video AI Generation Model? — 比較系 / 2026年 / https://www.youtube.com/watch?v=4GNT4-QYekg — TencentのHunyuanVideo 1.5(8.3Bパラメータ、コンシューマ向けGPUでも動作)とAlibabaのWan 2.7をローカル実行で比較。
- LTX 2 Full Tutorial | Run on Low VRAM PC + Video & Audio AI Generation (2026 Strongest Open-Source?) — チュートリアル系 / 2026年 / https://www.youtube.com/watch?v=ytxbq9ZSgxo — LightricksのLTX-2(2026年1月に完全オープンソース化、3月にはLTX-2.3としてデスクトップ動画エディタも登場)を低VRAM環境で動かす手順を解説。
- Best Open-Source AI Video in 2026: WAN 2.2 vs LTX 2.3 — 比較系 / 2026年 / https://www.youtube.com/watch?v=ZZ5VH-rqHXQ — オープンソース動画生成の二大勢力Wan 2.2とLTX 2.3を比較。
- Inpaint Canvas for ComfyUI: Krita-Style Layers, Colour Match & Retouch in One Node — ComfyUI解説系 / 2026-09上旬(投稿2週間前) / https://www.youtube.com/watch?v=Lz7AT8SByx8 — 2026年9月5日に公開されたオープンソースのComfyUIカスタムノード「Inpaint Canvas」を紹介。レイヤー・選択範囲・SAM支援選択・PSDエクスポートまで備え、ComfyUIを本格的なペイントツールに変える内容。
Signals
- クローズドソース最大のニュースはSora 2の終了:2025年9月末に華々しく発表されたSora 2だが、わずか半年でアプリ提供終了(2026-04-26)、APIも今日の調査時点(2026-09-23)の翌日である2026-09-24に終了予定。1日約100万ドルの運用コストに対し課金収益が累計210万ドルしかなかったとする報道が複数のYouTube解説動画で取り上げられている。10億ドル規模と言われたDisneyとの提携も、Sora終了の発表直前に破談になった。
- 画像生成はGoogle・OpenAI・Midjourneyが矢継ぎ早に更新:Nano Banana 2(Gemini、2026-02)、GPT Image 2.5/ChatGPT Images 2.5(2026-09-08、スケッチ機能追加)、Midjourney V8→V8.1→V8.2(2026-03〜08、編集モデルを全ユーザー開放)と、クローズドソース勢は数ヶ月おきに新モデルを投入し続けている。
- 動画生成の「戦国時代」比較コンテンツが定番化:Sora 2 / Seedance 2.0 / Runway Gen-4.5 / Kling 3.0 / Grok Imagineを横並びで比較する動画・Shortsが大量に存在し、視聴者の関心が特定ツールの信奉ではなく「どれが今一番強いか」の見極めに向いていることを示唆。
- オープンソース勢はAlibaba(Wan)、Tencent(HunyuanVideo)、Black Forest Labs(FLUX)、Lightricks(LTX)が主戦場:いずれもモデルをHugging Face/GitHubで公開し、ComfyUIやローカルGPUで動かすチュートリアルが量産されている。Wanはセリフ生成・リップシンク・マルチショット撮影(2.5→2.6)へと急速に機能拡張中。
- ComfyUIエコシステムが生成AIの「配線盤」として定着:2026年9月だけでもCore Sparse Attention Node、Comfy Compiler、Inpaint Canvas、MiniMax H3 RefMods、Krea2T Enhancerなど新ノードが立て続けに登場し、オープンソースモデルを実運用に落とし込む中間レイヤーとしての存在感が増している。
- Adobe Fireflyがクローズド・オープン両陣営の集約ハブ化:自社モデルに加え、Runway Gen-4.5、Google Nano Banana Pro、OpenAI画像生成、Black Forest Labs FLUX.2 [pro] など30以上の外部モデルを一つのワークスペースに統合。単一ツールを選ぶのではなく「使い分ける」動きが企業向けにも広がっている。
- タイトルが煽り気味なレビュー・比較動画が全体のかなりの割合を占める:"BEST AI Image Generator in 2026 (Don't Choose Wrong!)"のような釣りタイトルが乱立しており、実際の技術情報よりモデル選び自体がコンテンツ化している。
Limits
- YouTubeの検索結果ページ・動画ページはJavaScriptレンダリング必須で、WebFetchでは実際の再生回数・チャンネル登録者数・投稿日のHTMLを取得できなかった(フッターのみ返る)。そのためWebSearchのスニペットから得られた日付・概要情報のみを根拠にしており、正確な再生回数は本レポートに記載していない。
- 一部動画(Wan 2.6関連、HunyuanVideo比較など)は検索結果上「2026年」としか特定できず、月まで確定できなかったため「60日以内」の基準を厳密に満たすか未確認。直近性が高いと判断できるもの(Sora API終了報道、ChatGPT Images 2.5、Inpaint Canvasなど)を優先して掲載した。
- Sora API終了(2026-09-24)そのものを速報するYouTube公式動画は見つからず、解説チャンネルの後追い動画のみ確認できた。
- 日本語のYouTubeチャンネル・動画は今回の検索クエリでは上位に出てこず、英語圏の情報が中心になっている。
Bluesky
Bluesky — 画像生成AI・動画生成AIの最新動向
Accounts
- @stabilityai.bsky.social — Stability AI公式。ただし2025年後半は画像モデルよりStable Audio(音声生成)とエンタープライズ提携の告知が中心で、いいね数はほぼ0。
- @midjourneyofficial.bsky.social — Midjourney公式。2025年8月にBluesky進出を宣言したが、直近の投稿は2025年10月8日で止まっており最新ニュースなし。
- @promptheroofficial.bsky.social — PromptHero(プロンプト共有サービス)公式。Sora 2などクローズドモデルの対応状況を告知するタイプのアカウント。
- @ethanhe.bsky.social — xAIのGrok Imagineチームのエンジニア(元NVIDIA/Meta)。Grok Imagineの機能追加や採用情報を直接発信する数少ない「中の人」アカウント。
- @chorizemabang.bsky.social — Grok Imagineで動画生成をする日本語ユーザー。実際の利用者目線での不満・障害報告が見られる。
- @metalmickey.bsky.social(澤村徹) — Seedance 2.5・GPT-6・Suno V6を組み合わせてMVや展示作品を作る東京在住アーティスト。実制作コストの生々しい報告あり。
- @you32081.bsky.social — Qwen-Image、Z-Image-Turboなどオープンソース系モデルでR-18イラストを量産するクリエイター。
- @lijack1001.bsky.social — Nano Banana Pro/Seedance/Sora 2/Veo 3/Wan/GPT-5 Imageなどのクローンサイト(アフィリエイト)を大量投稿するSEOスパム型アカウント。ニュースソースではないが、どのモデル名が「稼げるキーワード」として扱われているかの参考になる。
- @runwayml.bsky.social / @blackforestlabs.bsky.social / @comfy-ui.bsky.social — RunwayとBlack Forest Labs、ComfyUI公式ハンドルは存在するが投稿がほぼ空か、直近投稿が2024年のもの1件のみで実質休眠中。
Posts
- PromptHero: 「Sora 2 is now available on Prompthero: No watermarks, Available in Europe, Combine it with other models」 — 2025-10-13、いいね0/リポスト0。投稿
クローズド。Sora 2をサードパーティのプロンプトサービスが「透かしなし・欧州対応」で再販していることを示す投稿。 - xAI・Ethan He: 「Excited to share our most advanced image generation model at xAI! Grok Imagine Quality mode — enhanced details, stronger text rendering...」 — 2026-04-05、いいね0/リポスト0。投稿
クローズド。Grok ImagineにQuality modeを追加、テキストレンダリング強化を公式エンジニアが発表。 - xAI・Ethan He: 動画トレーナー採用告知「familiarity with AI video generation tools (Grok Imagine, Runway, Kling, Sora, Veo, or similar)」 — 2026-03-29。投稿
クローズド。xAIが動画生成モデルの学習データ作成に人員投資している証拠で、比較対象としてRunway/Kling/Sora/Veoを名指し。 - @chorizemabang: 「Grok Imagineマジで全然生成できなくなっちゃったけどじっくり1日1作品作るのも趣があるな。」 — 2026-06-05、いいね13/リポスト1。投稿
クローズド。ユーザー目線でGrok Imagineの生成障害を報告。 - @chorizemabang: 「Grok Imagineが終わってしまってるのでお詫びに過去作を…」 — 2026-05-31、いいね11/リポスト1。投稿
クローズド。上と合わせて5〜6月にGrok Imagineの安定性に問題があったことを裏付ける。 - @metalmickey: 「road movie rain version. Stitched Seedance2.5's 30-second clips. Fees are devastating.」 — 2026-08-27。投稿
クローズド。ByteDance系Seedance 2.5を使った実制作(約5分のAIロードムービー)と、料金の高さへの不満。 - @metalmickey: 「Attempted creating music video entirely AI-delegated without writing a single prompt line. GPT-6 Astra enables voice-directed workflow.」 — 2026-09-07。投稿
クローズド。GPT-6 Astraによる音声指示だけでのMV制作という新しいワークフローの実例。 - Stability AI: 「We're launching our Stability AI Image Services on Amazon Bedrock, bringing professional-grade image editing capabilities...」 — 2025-09-18、いいね0/リポスト0。投稿
クローズドAPI寄り。画像編集(インペイント/スタイル転写)をAWS Bedrock上でサービス化。 - Midjourney公式: 「#Midjourney is now on BlueSky! Who are the best creators to follow here?」 — 2025-08-15、いいね41/リポスト4。投稿
Midjourney自体はクローズドだが、この投稿を最後にBlueskyでの発信はほぼ停止しており「参入したが定着しなかった」事例として記録。 - @you32081: Qwen-Image / Z-Image-Turboを使ったR-18 AIイラスト投稿 — 2026-08-01、いいね6/リポスト0。投稿
オープンソース。中国発オープンウェイトモデルQwen-ImageとZ-Image-Turboが同人・R18界隈で実際の制作ツールとして定着している一例。
Signals
- Bluesky上に「画像・動画生成AIニュース」専門の強いハブは存在しない。 Midjourney公式・Stability AI公式・Runway公式・Black Forest Labs公式・ComfyUI公式のいずれも、直近の投稿がほぼ皆無かエンゲージメント0〜数件で、実質休眠状態(最新でも2025年9〜11月止まり)。X/Redditのような速報性のある議論の場になっていない。
- クローズド系の話題はモデル企業の「中の人」個人アカウント経由でしか出てこない。 唯一継続的に発信していたのはxAIのGrok ImagineエンジニアEthan He(@ethanhe.bsky.social)で、2026年3〜4月にQuality mode発表・動画トレーナー採用など実務寄りの投稿をしている。
- Grok Imagineは2026年5〜6月に不安定化していた形跡がある。 日本語ユーザー@chorizemabangが「生成できなくなった」「終わってしまってる」と複数回投稿(2026-05-31, 2026-06-05)、直前の4月にはxAIが機能強化を発表したばかりで、急拡大に運用が追いついていない可能性。
- 実作業ログとしてはByteDanceのSeedance 2.5が目立つ。 東京のアーティスト@metalmickeyが2026年8月に約5分のAIロードムービーをSeedance 2.5クリップで制作し、費用の高さを繰り返し嘆いている(closed/有料API寄りの課題感)。
- オープンソース系(Flux、Wan、Qwen-Image、Z-Image-Turbo、HunyuanImage、ComfyUI)への言及は、ニュース投稿としてではなく、個人のR-18/同人AIアート投稿のハッシュタグとして断片的に出てくるのみ。 r/StableDiffusionのような専用ニュース発信者はBluesky上で見つからなかった。
- モデル名を使ったアフィリエイト/SEOスパムが多い。 @lijack1001のように「Nano Banana Pro」「Seedance 2.0」「Sora 2」「Veo 3」「Wan 2.2」「GPT-5 Image」等のクローンサイトへのリンクを無機質に投下するアカウントが複数存在し、どの名称が検索需要として注目されているかの傍証にはなるが、ニュース源としては無価値。
- Nano Banana Pro(Google系画像生成)がR-18/AIアート界隈で頻繁に言及される。 ハッシュタグ・自己紹介文レベルでの言及が多く、Ideogram 4・Krea 2と並んで「今使われている商用ツール」の一つとして定着している様子。
Limits
- Bluesky公式の全文検索API(
app.bsky.feed.searchPosts)は、今回試した全てのクエリ(Stable Diffusion、Midjourney、Flux、testなど)でHTTP 403を返し続け、一度も利用できなかった。app.bsky.actor.getProfile・app.bsky.actor.searchActors・app.bsky.feed.getAuthorFeedは問題なく動作したため、今回はアカウント検索→各アカウントの投稿一覧取得、という間接的な方法でしか調査できていない。 bsky.appのWeb版はクライアントサイドレンダリングのSPAで、フェッチしても空のページしか取得できなかった(公開JSON APIを直接叩く必要があった)。- 全文検索が使えなかったため、フォロー関係や検索でヒットしにくい未知のアカウントによる関連投稿は取りこぼしている可能性が高い。特に「オープンソース系モデルのニュースを专门に発信するアカウント」は見つけられなかった — 存在しないのか、検索手段の制約で発見できなかったのか切り分けられていない。
- Stability AI・Midjourney・Runway・Black Forest Labs・ComfyUIの公式アカウントを調査したが、いずれも直近の画像/動画生成モデルに関する新規ニュースは無かった。これは「Blueskyというプラットフォームの特性」であり、他プラットフォームでの話題の有無を示すものではない。
Lemmy
Lemmy — 画像・動画生成AIニュース(オープンソース/クローズドソース)
Lemmyは規模が小さい分散型フォーラムで、AI画像生成の話題は主に [email protected]
とその周辺コミュニティ、および Reddit の r/ArtificialInteligence をミラーする
[email protected](Botによる自動転載アカウント経由)に集中している。
lemmy.world の検索API (/api/v3/search) とWeb検索を使い、「image generation」「video
generation」「Stable Diffusion」「Flux」「Qwen Image」「Sora」「Midjourney」「Nano
Banana」「Grok Imagine」「ComfyUI」等のキーワードで横断的に調査した。
Communities
[email protected]— 5,713 subscribers。オープンウェイトの画像/動画生成モデルやComfyUI関連の技術投稿が中心。[email protected]— 2,361 subscribers。生成画像の作品共有がメイン(ニュース性は薄い)。[email protected]— civitai経由のアニメ風生成画像を毎日大量投稿(ニュース記事ではなく作品投稿)。[email protected](Free Open-Source AI) — 4.84K subscribers(うちローカル1.81K)。オープンソースAI全般向けだが画像/動画生成特化の投稿は少なめ。[email protected]— r/ArtificialInteligence を自動ミラーするコミュニティ。Lemmy発の議論ではなくReddit転載である点に注意。!stable_diffusion_abstraction(50人)/!stable_diffusion_furry(52人)/!stable_diffusion_mycology(97人) — ニッチな作品共有コミュニティ、購読者数は小さい。
Posts
オープンソース寄り
-
Qwen-Image-2.1 in ComfyUI: Open-Weight Image Generation and Editing, Now with Transparency
[email protected]、2026-09-22、score 9
https://blog.comfy.org/p/qwen-image-21-in-comfyui-open-weight
AlibabaのQwenチームによる70億パラメータのオープンウェイト画像生成/編集モデル。RGBA透過出力(ロゴやカットアウト素材に対応)、2048×2048ネイティブ解像度、最大10枚の参照画像入力に対応し、ComfyUIにネイティブ統合された。 -
Qwen-Image-2.1: Compact, efficient, and unified image creation
[email protected]、2026-09-20、score 1
https://qwen.ai/blog?id=qwen-image-2.1
Qwen公式ブログの発表告知。上記ComfyUI記事の一次ソース。 -
supElement/ComfyUI_MinimaxH3_AutoContext: A long video generation solution that breaks through the memory barrier
[email protected]、2026-09-16、score 1
https://github.com/supElement/ComfyUI_MinimaxH3_AutoContext
MiniMax H3モデル向けのComfyUI拡張。動画を自動でセグメント分割し、セグメント間をLatentアンカリングでつなぐことで長尺動画生成時のVRAM制約を回避する。Apache-2.0、31 stars、153コミット。 -
Adudeguyman/ComfyUI-Fantastic-MiniMaxH3-PromptBuilder
[email protected]、2026-09-16、score 3
https://github.com/Adudeguyman/ComfyUI-Fantastic-MiniMaxH3-PromptBuilder
同じくMiniMax H3向けのComfyUIプロンプトビルダーツール。ローカル動画生成ワークフローの周辺エコシステムが活発に更新されている一例。 -
Boogu-Image-0.1 — Efficient Image Generation Foundation Model
[email protected]、2026-06-17、score 5
https://boogu.org/
軽量・効率重視を謳う新規オープンソース画像生成基盤モデルの公開。 -
AI video generation is becoming less about the model and more about the workflow
[email protected](Reddit転載)、2026-09-19、score 1
https://www.reddit.com/r/ArtificialInteligence/comments/1wkl4db/
オープンウェイトモデル+ComfyUI的なワークフロー構築が動画生成のクオリティを左右する、という論調の投稿。
クローズドソース寄り
-
OpenAI is shutting down Sora's API next week while a Chinese competitor raised $3B
[email protected](Reddit転載)、2026-09-20、score 1
https://www.reddit.com/r/ArtificialInteligence/comments/1wluu0n/
OpenAIがSora 2 APIを9/24に停止予定(アプリは4月に停止済み)という話題と、中国の競合Kuaishou(Kling)が30億ドルを調達したという対比。「派手な消費者向けは失敗し、地味な業務用途こそ稼いでいる」という論調。 -
Midjourney pivots from AI image generation to body scanning medical spa(背景記事、6月の大転換だが影響が続いている話題)
[email protected]、2026-06-18、score 58
https://www.theregister.com/ai-and-ml/2026/06/18/midjourney-pivots-to-medical-devices/
MidjourneyがAI画像生成から超音波CTスキャナー等の医療機器事業へ大きく舵を切ったという報道。関連して[email protected]に "Midjourney Medical"、"Midjourney Ultrasonic CT Scanner" の投稿あり(いずれも2026-06-18)。 -
Midjourney wants Hollywood studios to reveal the details of their AI usage
[email protected]、2026-07-05、score 73
https://techcrunch.com/2026/07/04/midjourney-wants-hollywood-studios-to-reveal-ai-usage/
医療転向後もMidjourneyが画像/動画生成AIの著作権・利用実態を巡ってハリウッドと対立している続報。 -
Google lanciert KI-Bildgenerierung Nano Banana 2 Lite
[email protected]、2026-07-02、score 0
https://www.itmagazine.ch/artikel/87529/
GoogleがGemini系の画像生成モデル「Nano Banana 2 Lite」をリリースしたというスイスのテック系ニュース。[email protected]にも同モデルの一次ソース(deepmind.google)へのリンク投稿あり(2026-06-30)。 -
Seedream 5.0 Pro is here: an honest comparison and technical breakdown
[email protected](Reddit転載)、2026-07-10、score 1
https://www.reddit.com/gallery/1usc03q
ByteDance系クローズドモデル「Seedream 5.0 Pro」のレビュー・比較投稿。 -
Google quietly discontinues its Earth AI feature a day after its rollout after users made no-no images
[email protected](Reddit転載)、2026-08-07、score 1
https://fortune.com/2026/08/07/
Googleが公開直後に問題画像生成を理由として「Earth AI」機能を撤回したという報道。クローズドソース系ベンダーのガードレール問題の一例。 -
Elon Musk maakt complete AI-film met zijn versie van The Odyssey
[email protected]、2026-07-22、score 1
https://lemy.nl/post/4342454
イーロン・マスクがGrok(xAI)の動画生成機能を使い『オデュッセイア』の独自解釈映画を制作しているというオランダ語記事。クローズドソース陣営のマーケティング色が強い話題。 -
Same Berserk spread, 4 AI colorizations. Looks like GPT wins again?
[email protected](Reddit転載)、2026-09-14、score 1
https://www.reddit.com/gallery/1wfyqdy
同じ漫画の1ページをGPT系画像モデルを含む4つのAIで着色比較した投稿。GPT系が優勢という感想。
Signals
- Lemmyでの画像/動画生成AI関連の「生きた議論」は
[email protected]のComfyUI周辺ツール投稿と、!ai_redditによるRedditミラーにほぼ限定される。オリジナルのLemmy発ニュースは少ない。 - オープンソース側は「モデル単体」よりも「ComfyUIワークフロー/拡張ノード」の投稿頻度が高く、MiniMax H3向け拡張が直近1週間で2件立て続けに投稿されるなど、動画生成の実務ツール層が活発。
- クローズドソース側は「撤退・方向転換」のニュースが目立つ(Sora API終了、Midjourneyの医療機器転向、GoogleのEarth AI即時撤回)。派手なリリースよりも収益化の失敗・軌道修正が話題になっている。
[email protected]のような作品共有コミュニティは投稿数こそ多いが、civitai画像の羅列でありニュース性はない。
Limits
- Lemmyの規模はReddit/Xと比べて著しく小さく、
[email protected]でも購読者5,713人に留まる。ブリーフが求める「約20件の投稿を分析」を満たすほどの独自ニュース量はLemmy単体には存在しない(プレイブックの想定通り「5〜12件」に収まる規模)。 !ai_redditはLemmyネイティブの議論ではなくReddit投稿の自動転載(コメント数はほぼ0)で、Lemmyコミュニティ自身の反応は事実上観測できなかった。- Lemmy公式APIの
/api/v3/communityエンドポイントはcommunity_id指定が必要な場合が多く、一部コミュニティ(aiwars、imageai単体検索など)は400/404エラーで直接照会できなかった。該当分はWeb検索結果からの補完に留めた。 - Video生成モデル固有の検索("Wan"、"HunyuanVideo"、"Kling"単体)は、一般名詞・略称と衝突するノイズが多く、明確にLemmy発と言える投稿は見つけられなかった。
Pinterest — Image and Video Generation AI News
Visual themes
- "AI NEWS" YouTuber-thumbnail format: shocked/excited bearded creators in front of neon rounded-square logos for OpenAI, Google, Microsoft, Meta and Notion, laid out in a grid — the single most repeated pin style in the set. [1, 8, 30]
- SaaS hero shots for AI video-generation tools: dark navy/purple UI mockups with a glowing "text prompt → generate" box, or a cute white cartoon robot mascot holding a clapperboard, paired with feature-icon rows (Text to Video / AI Editing / Auto Soundtrack / Captions). [6, 11, 16]
- "Best tool" comparison charts and ranked listicles: neon-bordered decision matrices and "My Top Picks" cards weighing ChatGPT Plus, Midjourney, Gemini, Ideogram, Kling, Runway, Luma, Pika by price tier and use case. [10, 20]
- Deepfake / misinformation warning imagery: red "FAKE" rubber-stamp graphics, magnifying glasses over a "?", a half-human/half-wireframe eye morph, a "97% likely AI generated" voice-detector badge, and an "AI GENERATED NEWS CLIP" caption burned over a fabricated anchor. [4, 27, 38, 49]
- Face-swap and identity-blend app ads: two faces dissolving into a triangulated mesh ("Professional Face Swap"), and a mom+dad→predicted-child triptych ("AI Baby in Seconds"). [43, 44]
- AI-generated whimsy used as style demos / engagement bait: a hyperreal otter in a life jacket on a surfboard, an old fisherman portrait, and a fantasy-image collage (castle, polar bear, samurai couple, cake) showcasing generation quality rather than reporting news. [13, 34, 45]
- Plain-language explainer infographics: an 8-step "how AI generates video" diagram (prompt → language understanding → latent space → frame diffusion → consistency check → output) aimed at a lay audience, not developers. [12]
- Newsroom-disruption and avatar-economy imagery: a control-room collage of AI-rendered anchors filling wall screens, a grid of stylized influencer avatars behind one photoreal face, and a "Human Journalism vs Machine-Generated Media" split-road graphic. [38, 40, 23]
Notable pins
- #1 — "AI News: Anthropic Leak Shows Us The Future of AI...": archetypal shocked-creator thumbnail with OpenAI/Google/Microsoft/ChatGPT logos; sets the visual template most other "AI NEWS" pins copy.
- #3 — "Google announces ultra-high quality video...": a 3×5 grid turning one source video into "made of wooden blocks / origami / Lego / flowers" style transfers — a concrete Lumiere-style video-restyling demo, not just a headline card.
- #10 — "AI Image Video: Best Quality vs Best Free": a full decision matrix (10 paid tools vs 10 free tools vs use-case) — the clearest single artifact of the "which AI tool do I actually use" anxiety running through this set.
- #12 — "AI & Machine Learning: How AI Generates Video Infographic": an 8-step diffusion/frame-prediction pipeline explainer from LivePhysics.com aimed at beginners — useful as the "explain it to a friend" reference pin.
- #27 — "AI is getting scary good": bundles AI video generators, AI voice detectors ("97% likely AI generated"), and AI ethics into one infographic — the most concentrated distillation of the deepfake-anxiety theme.
- #38 — "AI News Anchors & Creator-Led Coverage Take Over U.S. Media": newsroom collage showing AI-rendered anchors filling a wall of monitors — directly visualizes AI anchors displacing traditional broadcast talent.
- #40 — Dutch-language "Het perfecte avatar-tijdperk" (the perfect avatar era): one photoreal face in front of a grid of stylized AI avatars — captures the AI-influencer trend as a specifically European Pinterest search result (multi-lingual spread of the theme).
- #43 — Akool "Professional Face Swap" (Spanish-language ad): two women's faces merging via a face-mesh overlay — a commercial face-swap product being marketed directly on Pinterest, not just discussed.
- #44 — "AI Baby in Seconds": mom/predicted-child/dad triptych — a distinct, fast-growing sub-genre (AI baby generators) that showed up as its own pin cluster rather than a one-off.
- #49 — "You Are Not Prepared for This Terrifying New Wave of AI-Generated Videos": an AI-generated fake news anchor labeled "AI GENERATED NEWS CLIP" directly in-frame — the bluntest warning-style pin in the set.
Signals
- Tool-decision fatigue is the dominant consumer angle. A large share of pins are comparison charts, "best free vs paid" matrices, and "my top picks" cards rather than news about any single release — Pinterest users are searching for buying/adoption guidance more than for announcements. [10, 20, 29]
- Deepfake/misinformation anxiety is its own visual genre, not a footnote: FAKE stamps, voice-detector badges, and "AI generated" disclosure labels appear almost as often as promotional tool content. [4, 27, 38, 41, 49]
- The AI-news-anchor trend has real visual traction: multiple independent pins (control-room collages, Channel1-branded anchor content, "AI generated news clip" labels) treat AI anchors as a live, discussed phenomenon rather than a hypothetical. [38, 49, 50]
- Absent: open-source is nearly invisible. Across the sample, the only clearly local/open tool is AMD-branded "Amuse 3.0" [34]; there are no Stable Diffusion, ComfyUI, or local-model UI screenshots, in contrast to a very strong closed-source-adjacent presence (ChatGPT, Gemini, Midjourney, Kling, Runway, Luma logos and UI mockups throughout).
- Absent: direct product screenshots of the newest named closed models. No Sora 2, Nano Banana, or native Veo 3 UI captures turned up in this sample — most "closed source" pins are affiliate/creator thumbnails talking about the news rather than screenshots of the product itself.
- Caution flag: pin #47, titled "Elon Musk's New AI Already Being Used to Generate...", actually shows a composited image of Donald Trump and a woman giving a thumbs-up in a cockpit with a burning World Trade Center in the background — the title does not describe the image at all. It's a concrete example of realistic AI-composited disaster/political imagery circulating under a mismatched, clickbait-style title, and a reminder that pin titles in this dataset cannot be trusted to describe pin content.
Limits
- No genres were defined for this collection run (single unfiltered search on "Image and Video Generation AI News"), so the 50 pins mix creator thumbnails, product ads, stock photography, and news-style imagery rather than being pre-sorted by topic.
- Of the 50 collected images, 26 were opened and visually inspected (a representative spread across the set, prioritizing variety of title/topic) rather than all 50; conclusions above are based on that sample.
- Several titles did not match their images (most notably #47, see Signals) — this means any theme built only from the title table (not the image itself) would be unreliable; this report is based on what the images actually show.
- Pinterest pins carry no repin/like counts in the collected data, so "what's trending" here is inferred from how often a visual style repeats across the sample, not from measured popularity.
- Pinterest itself skews toward secondary/derivative content (thumbnails, blog headers, ad creative) rather than primary product announcements — confirming specific product/version claims (e.g. exact Veo or Kling release details) would need the primary-source platforms covered elsewhere in this run (X, Reddit, YouTube).
推奨アクション
- Track the OSS local-video stack (Wan, HunyuanVideo, FLUX.2, ComfyUI + MiniMax H3) as the practical alternative as closed tools raise prices and shut down products.
- Get ahead of the AI-content-disclosure sentiment building on Reddit and Pinterest by preparing provenance/labeling messaging now.
- Watch where users migrate after Sora 2's API shutdown on 2026-09-24 (Kling, Seedance, Runway are the likely beneficiaries).
- Treat the Opus 5.5 / Grok 4.7 one-shot generation demo wave on X as a short-lived release-window hype cycle, not a lasting threat to OSS mindshare.
- Monitor DeepSeek's compute-scaling strain as an early signal for what happens when open-weight adoption outpaces an operator's own infrastructure.
- Meet the 'which tool do I use' comparison fatigue visible on YouTube and Pinterest with comparison-style content rather than single-product news.
収集画像


















































データ品質メモ
Only YouTube and Pinterest reached roughly the brief's ~20-item target; Reddit yielded just 12 threads (mostly off-topic general subreddits), X's 40 posts were more than half unrelated trending-word noise, Bluesky's full-text search API returned 403 throughout so coverage relied on known accounts only, and Lemmy is simply too small a platform (main community ~5,713 subscribers, half its posts are Reddit mirrors) to reach 20 native posts.



