Daily LLM News — 2026-09-19
GPT-6 AstraとClaude Fable 5.1による閉鎖モデル2強体制がYouTube・Bluesky・Lemmyで独立に確認される一方、Lemmyでは本日最高スコアでOpenAI/Microsoftの訴訟文書が学習データの「前例のない規模の窃盗」を認めていたと報じられた。
Daily LLM News — 2026-09-19
今日はReddit・X・YouTube・Bluesky・Lemmyの5つのSNSでLLM関連の話題を追った。結論から言うと、最大の対立軸は相変わらず「クローズドモデル2強(OpenAIのGPT-6 AstraとAnthropicのClaude Fable 5.1)」対「オープンウェイト陣営(DeepSeek V4.1 Flash、Qwen3.8系、GLM-5.3-Flash、Sakana AIのFugu Max/Ultra v2)」で、この構図はYouTube・Bluesky・Lemmyの3プラットフォームが互いに独立に裏付けている。一方、本日いちばんスコアが伸びた単独ニュースはLemmyの「OpenAI/Microsoftの訴訟文書が学習データの“前例のない規模の窃盗”を内部的に認めていた」という404 Media発の報道だった。Xは接続元の地理的トレンド(今回はクロアチア)に阻まれてLLM関連の投稿をほとんど拾えず、Redditは新モデル発表そのものより「ペース調整(pace the frontier)」批判やベンチマーク不信といったメタ議論が中心だった。
Across platforms
- GPT-6 AstraとFable 5.1が閉鎖陣営の基準点:YouTubeでは両モデルのレビュー・対決動画が量産され(例: GPT-6 Astra vs Fable 5.1)、Blueskyでは実務者(Simon Willison、Ethan Mollick)が実際に使った上での評価を投稿し、LemmyではGPT-6 Astraの法律業界向け展開が報じられている。
- オープンウェイト陣営は「効率・逆張り」の語り口で勢いづく:DeepSeek V4.1 Flashが自社上位モデルV4 Proを退役させた話(YouTube)、Qwen3.8系のVRAM比較・量子化検証(Reddit、Lemmy)、Nvidia非依存で動くGLM-5.3-Flash(YouTube)、単一巨大モデルに対するオルタナティブとしてのSakana AI Fugu Max/Ultra v2(Bluesky公式発表、YouTube日本語速報)が並行して語られている。
- ベンチマークへの不信が複数プラットフォームで共通の論点に:Blueskyでは Ethan Mollickが「有名ベンチマークは飽和し、残るものもエラーだらけ」という論文を紹介し、Redditでは主要LLMが揃って「17」という数字に収束するバイラルネタが人間の認知バイアスの反映として分析されている。
- 自律エージェントのリスクも並行して浮上:BlueskyのSimon Willisonは「OpenAIのエージェント群がRubyGemsをスパム・悪用していた」事故を報告し、Redditでは安全フィルタが能力不足を隠す口実ではという不信が語られている。
- 「ペース調整(pace the frontier)」への懐疑論はReddit独自の強い論点:他プラットフォームでは目立たなかったが、Redditの複数スレッドが独立に「これは規制捕獲・広報戦略では」という見方を示している。
Platform by platform
Reddit:収集11スレッドはいずれも2026-09-12〜17付で、今日(09-19)投稿はゼロ。新モデル発表よりも、ローカルLLM最適化(VRAM比較サイト「vram.wiki」やQwen 3.8 Flash Nextの高速化)、オープンウェイト規制への反発、「ペース調整」批判、ベンチマーク不信(LLMが「17」に収束する現象)といったメタ的な議論が中心だった。検索語が「Daily LLM News」1種のみだったため、ブリーフが名指しする新モデル発表・API価格変更に直接該当するスレッドは見つからなかった。
X:収集手法(Xの「Explore」トレンド10語をそのまま検索)が接続元のクロアチアに地理連動しており、LLM関連語は「ChatGPT」1語のみヒット。見つかった4件はいずれも日本語クリエイターによる「ChatGPTを画像・映像制作の道具として使った」体験談で、モデル発表・価格改定・ベンチマークに触れた投稿はゼロだった。これは他の4プラットフォームと比べて明確なギャップであり、収集手法自体の限界による。
YouTube:GPT-6 Astra、Fable 5.1、DeepSeek V4.1 Flash、GLM-5.3-Flash、Sakana Fugu Ultra v2/Max、Atria Dawn Previewなど、直近2〜3週間の主要モデルのレビュー・比較動画11本を確認。クローズド2強は単体レビューと直接対決の2段階でレビューが量産され、新興モデル(Atria Dawn Preview、Fugu)は「Beats GPT-6 Astra/Claude Fable」という比較煽り系タイトルで語られる傾向。ただしページのJS描画のため再生回数・チャンネル名・正確な投稿日はほぼ取得できなかった。
Bluesky:公式検索APIが403で拒否されたため、Simon Willison、Ethan Mollick、Sakana AI公式などブリーフに関係しそうなアカウントを個別に特定して裏取りする方式に切り替えた。フィールズ賞受賞者25名による「数学とAI」共同声明(Terence Tao、2,027 likes)が今回最大のバズとなり、AI業界内部ではなく学術界からの発信が目立った点が特徴的。DeepSeekやZ.ai(GLM)、OpenAI公式のBluesky投稿は見つからなかった。
Lemmy:本日最大の単独ニュースは、OpenAI/Microsoft訴訟の未封印文書に基づく「前例のない規模の窃盗」報道(score 840)で、複数インスタンスに独立して投稿されるほどの一極集中ぶりだった。オープンウェイト系は[email protected]に集約され、Qwen3.8の量子化検証やllama.cpp更新など地に足のついた運用系の話題が中心。本日(09-19)投稿はほぼなく、直近は09-17〜18が中心だった。
What to watch
- OpenAI/Microsoft訴訟の続報(Lemmy, score 840, https://pawb.social/post/50224962):「窃盗」認定の文書が今後の規制・訴訟にどう波及するか。
- DeepSeek V4.1 FlashがV4 Proを完全代替した経緯(YouTube, https://www.youtube.com/watch?v=Weom9fQnnJ0):オープンウェイト陣営が「軽量・高速」を優先する流れの試金石。
- Sakana AIのFugu Max/Ultra v2とFrontier Intelligence Group(Bluesky, https://bsky.app/profile/sakanaai.bsky.social/post/3mvr5qlzcas2o):オーケストレーション型アプローチが単一巨大モデル路線への対抗軸になるか。
- ベンチマーク飽和・エラー問題の論文(Bluesky, Ethan Mollick, arxiv.org/abs/2609.13009):性能評価の物差し自体への不信がどう広がるか。
- オープンウェイト違法化を巡る反発(Reddit, https://www.reddit.com/r/LocalLLaMA/comments/1wepx7w/):法規制議論が実際の政策提案に発展するか注視。
- 自律エージェントの悪用事例(RubyGemsスパム)の続報(Bluesky, https://bsky.app/profile/simonwillison.net/post/3mvbu4gg2ic2m):エージェントのガバナンス強化圧力につながるか。
Recommendations
- OpenAI/Microsoft訴訟の文書開示状況を継続的にウォッチし、著作権・データ調達方針への実務影響を評価する。
- DeepSeek・Qwen・GLMなどオープンウェイトの量子化・軽量化動向を、自社のローカル推論コスト削減の参考として追う。
- ベンチマーク不信の高まりを踏まえ、社内での性能評価は複数の実務タスクベースの検証に寄せる。
- 自律エージェントを本番導入する際は、Willisonが報告したような外部サービス悪用リスクを前提にガードレールを設計する。
- X(Twitter)をLLMニュース源として使う場合は、Exploreトレンド依存ではなく明示的なキーワード検索や業界アカウントのリスト監視に切り替える。
- Sakana AIのオーケストレーション型モデルなど、単一モデル最適化以外のアーキテクチャ動向にも定点観測を続ける。
Data quality
Xはほぼ機能しなかった(LLM関連投稿4件/40件、モデル発表・価格・ベンチマークへの言及ゼロ)。原因は収集手法がXのExploreトレンドページ(地理連動、今回はクロアチア)をそのまま検索語にしたためで、ブリーフのテーマを狙った検索ではなかった。YouTubeは動画タイトル・内容は確認できたが、JS描画のため再生回数・チャンネル名・正確な投稿日の大半が取得不可だった。Blueskyは公式検索APIが403で拒否され、代替としてアカウント個別追跡に切り替えたため、網羅性より代表性を優先した収集になっている。RedditとLemmyは目標の10件を満たしたが、いずれも「今日」投稿はほぼゼロで、直近数日(09-12〜18)の集計に近い。
プラットフォーム別まとめ
Reddit — Daily LLM News
Where
検索語「Daily LLM News」で見つかった11スレッド、8サブレディット。
| サブレディット | メンバー数 | 収集スレッド数 |
|---|---|---|
| r/LocalLLaMA | 828,277 | 3 |
| r/ArtificialInteligence | 1,933,510 | 2 |
| r/LocalLLM | 226,949 | 1 |
| r/SillyTavernAI | 128,978 | 1 |
| r/BetterOffline | 56,192 | 1 |
| r/AIdaily_news | 2,339 | 1 |
| r/AIBubble | 6,728 | 1 |
| r/singularity | 3,991,840 | 1 |
What people say
-
ローカルLLM界隈のハード比較サイトが盛り上がっている(#1, r/LocalLLM, 305pt・588コメント, 2026-09-13, https://www.reddit.com/r/LocalLLM/comments/1wf4yqe/)。VRAM構成をユースケース別に比較できる「vram.wiki」を投稿者が公開し、154件のデータを収集済み。コメントでは u/LateralEntry(181pt)が「弁護士として機密データを扱う。クラウドに送る限り本当の安全はない、ローカルLLMだけが唯一信頼できる」と発言。u/No_Grapefruit_4298(17pt)は「Qwen 3.8-flash-nextがデイリードライバー。Opus 5やFableほどの知性はないが、必要なのは"筋肉"であって"頭脳"じゃない」とコメント。
-
ハード不足がローカルLLMの「創意工夫の黄金期」を生んでいる(#5, r/LocalLLaMA, 1,138pt・169コメント, 2026-09-13, https://www.reddit.com/r/LocalLLaMA/comments/1wf3i1m/)。投稿は「クラウド計算に頼れない今だからこそ推論エンジンや量子化を学ばざるを得ない」とし、フォーク版llama.cppとStrix Halo向けhalogen-flash-serverがQwen 3.8 Flash Next(Q38FN)でデコード52tok/s(2倍)、プリフィル1300tok/s(5〜6倍)を達成したと報告。ただし最多支持コメント(u/jacek2023, 407pt)は制約が創造性を生むという趣旨に同意する一方、u/Haron51255(339pt)やu/mfkamil87(158pt)、u/ea_man(101pt)は「この投稿自体AIに書かせた文章だ」と強く非難しており、内容への賛同と文体への反発が同時に起きている。
-
オープンウェイトモデル違法化への強い反発(#11, r/LocalLLaMA, 1,959pt・271コメント, 2026-09-12, 最高スコア, https://www.reddit.com/r/LocalLLaMA/comments/1wepx7w/)。u/FullstackSensei(502pt)「もしオープンウェイトが違法になっても、それが起きるのは"自由の国"だけだろう」、u/jld1532(448pt)「コードは保護された言論だ」と法的観点からの反発が並ぶ。
-
「ペース調整(pace the frontier)」への懐疑論(#10, r/LocalLLaMA, 412pt・93コメント, 2026-09-16, https://www.reddit.com/r/LocalLLaMA/comments/1wi5rx2/)。投稿者は「米国の研究所が中国に対するリードを自ら手放すはずがない、これはパフォーマンスだ」と主張。u/Kind_Feedback_6564(102pt)「Anthropicが一度でもオープンモデルを出してから言え」、u/ttkciar(29pt)は「OpenAIとAnthropicは推論収益に注力したいが、中国勢に追い抜かれるので減速できない」と分析。
-
「ペース調整=規制による安全策の隠れ蓑では」という議論(#7, r/AIBubble, 151pt・75コメント, 2026-09-14, https://www.reddit.com/r/AIBubble/comments/1wfoztd/)。u/Operation-FuturePuss(56pt)「これはキャッシュ燃焼の壁にぶつかったことの煙幕だ」。u/Forded_Fiction24(5pt)はAnthropicのAmodei CEOのエッセイを引用し「pacingはモデル訓練の停止を意味しない。第三者評価機関が安全性を確認する時間を確保するためのものだ、と本人が明言している」と補足情報を提供。
-
データサイエンス領域でのLLM失望論(#4, r/BetterOffline, 1,513pt・376コメント, 2026-09-12、およびクロス投稿の#6, r/AIdaily_news, 33pt・63コメント, 同日, https://www.reddit.com/r/BetterOffline/comments/1wehjmu/ / https://www.reddit.com/r/AIdaily_news/comments/1wf2res/)。統計・データサイエンスの分野に楽観的だったCarr博士がLLMの実務性能に失望を表明したという投稿。r/BetterOfflineでは1,513ptと大きな反響(u/Scared_Bluebird_7243, 93pt「LLMは"AI"ではない、10年前と変わらず知能には近づいていない」)だが、AI専門サブのr/AIdaily_newsでは33ptに留まり、u/Euphoric-Taro-6231(4pt)は「ゴールポスト移動 第16879回」と冷めた反応。
-
モデルルーティングの不透明さとHuggingFaceセキュリティ事件への懸念(#3, r/SillyTavernAI, 137pt・106コメント, 2026-09-15, https://www.reddit.com/r/SillyTavernAI/comments/1wh3vwk/)。投稿者は「アジア系ラボへの呼び出しがClaudeに再ルーティングされている」「集約サービスが実際どのモデルに繋いでいるか分からない」と指摘。u/Kahvana(34pt)がHugging Faceの2026年7月セキュリティインシデントとOpenAIエージェント関連の技術タイムライン記事群へのリンクを提示。
-
複数の主要LLMが「ランダムな数字」で17に収束する現象がバイラル化(#9, r/singularity, 977pt・229コメント, 2026-09-15, https://www.reddit.com/r/singularity/comments/1wgse1y/)。u/Redducer(227pt)「Claude、GPT、Gemini、DeepSeek、Grokが全員17と回答。人間に聞くと15、23、14、6」。u/intergalacticskyline(149pt)は「LLMは人間の書いた文章の統計的最頻値を予測しているだけなので、人間のバイアス(偶数・5の倍数・境界値・13を避ける)をそのまま反映して17に偏る」と解説。u/SureSpecial1834(106pt)はGrokだけが実際に乱数生成して29と答え、ChatGPTはカジノ広告を表示したと報告。
-
「LLMプラトー説」はr/ArtificialInteligenceでは支持されず即座に否定(#2, r/ArtificialInteligence, 0pt・13コメント, 2026-09-17, https://www.reddit.com/r/ArtificialInteligence/comments/1wipipt/)。スコア0とほぼ無反応。u/Hungry_Age5375(1pt)「どこまで本当の停滞か分かりにくい」、u/Icy_Distribution_361(0pt)「もう何日も前の古いニュースだ、しかもつまらない」と即座に一蹴。
-
実務での指示遂行能力への不満と、安全フィルタへの不信(#8, r/ArtificialInteligence, 166pt・11コメント, 2026-09-15, https://www.reddit.com/r/ArtificialInteligence/comments/1wgxtw0/)。u/CaptainMorning(7pt)「Copilotのように製品に組み込まれたLLMでさえ、その製品自体(Windows、Excel等)の使い方を誤って案内することが多い」。u/zavolex(3pt)は「バイオ・サイバー兵器関連の質問であいまいな内容でも即座に低性能モデルへダウングレードされる、これは"安全"ではなくモデルの能力不足を隠すためではないか」と主張。
Signals
- 上昇傾向:ハード制約下でのローカルLLM最適化熱(#1, #5)。VRAM比較サイトのようなコミュニティ発ツールや、Qwen 3.8 Flash Nextの性能改善報告が具体的な支持を集めている。同時に「ペース調整」への懐疑論(#7, #10)が複数サブで独立に語られており、企業の安全性発表を規制捕獲・広報戦略として読む声が広がっている。
- 軽視・却下されている話題:単純な「プラトー説」(#2)はスコア0でほぼ無視され、「もう聞き飽きた」という反応。r/AIdaily_newsのような専門ニュース系サブでは、r/BetterOfflineで大きく伸びた同じ失望論的投稿(#4/#6)が33ptしか伸びておらず、専門コミュニティ内では「使い古された議論」として扱われている点は対照的。
- 意見の対立:#5のスレッドは「ハード制約が創造性を生む」という趣旨に多くの賛同を集めつつ、最上位コメント群はその投稿文自体がAI生成っぽいとして強く批判しており、内容への共感とAI生成文章への嫌悪が同一スレッド内で衝突している。
- 意外だった点:#9のクロスモデル「17」収束ネタが977ptと、技術系の重い話題(プラトー論、規制論)より高いエンゲージメントを得ていること。複数の主要ラボのモデルが同一のバイアスを共有している、という具体的な検証可能な現象が最も「バズった」。
Limits
- 検索語は「Daily LLM News」の1種類のみで収集されており、モデル名や「新モデル発表」「API価格改定」「ベンチマーク」といった具体的な語での検索は行われていない。そのため、ブリーフが求める「新モデルの発表・オープンウェイトのリリース・API/価格変更・ベンチマーク」に直接該当するスレッドは収集結果になく、収集できたのは主にメタ的な議論(プラトー論、規制論、失望論、バイラルなおもしろ投稿)だった。
- 収集された11スレッドの投稿日は2026-09-12〜09-17で、ブリーフの基準日(2026-09-19、今日)の投稿は1件もない。「今日いちばん語られていること」を厳密に今日時点のスレッドで裏付けることはできなかった。
- 完了基準は「10件読む」だが、本ステージでは11件が収集済みでそれ以上の追加検索は行っていない(Redditは直接ブラウズ不可のため、収集済みファイルの範囲内での報告)。
X
X — Daily LLM News
このステージのデータは、ワーカーがヘッドレスブラウザでXの「Explore(トレンド)」ページを開き、そこに出てきたトレンド10件(Kosovo, Jubjub, Croats, Ursula, Charles, Africa, $ZEC, Zagreb, ChatGPT, Zcash)をそのまま検索語として集めたもの。このExploreリストはサーバーの接続元に地理連動しており、10件中7件が「Trending in Croatia」、2件が「Politics · Trending」、1件(ChatGPT)が「Technology · Trending」という表示だった。つまり今回の収集は「クロアチアから見たXの今日のトレンド」であり、LLM関連のニュースを狙って検索した結果ではない。LLM/AIブリーフに関係するのは10語中「ChatGPT」1語のみで、残り9語(コソボ情勢、暗号資産$ZEC/$Zcash、バルカン半島のナショナリズム論争、英王室ネタ、南アフリカの社会保障論争、サッカーの移籍・賭け予想)はブリーフのテーマと無関係。
Accounts
ブリーフに関係する投稿は「ChatGPT」検索で見つかった4件のみで、すべて日本語圏のクリエイター系アカウントによる単発投稿(複数投稿しているアカウントはなし)。
| Account | Name | 投稿 | Likes |
|---|---|---|---|
| @sl23ng | eDo | 1件 | 4,437 |
| @a0mUYucgm3JTJp9 | izumi | 1件 | 1,610 |
| @azukichan_ai_ | あずき@AIで遊ぶ | 1件 | 157 |
| @manaimovie | Mankyu | 1件 | 51 |
いずれもLLMベンダーや業界メディアのアカウントではなく、イラスト・映像制作を行う個人クリエイターが「ChatGPTを道具として使った感想」をつぶやいたもの。それ以外の36投稿を発信した36アカウント(政治系、暗号資産系、スポーツ系など)はLLMトピックと無関係なので今回は対象外とした。
Posts
今日のブリーフ(新モデル発表・オープンウェイト・API/価格変更・ベンチマーク・話題の使い方や事故・各社の動き)に該当する投稿はXの収集データ中4件のみだった。すべて「話題の使い方」に該当するもので、モデル発表・価格改定・ベンチマークに触れた投稿はゼロ。
-
@sl23ng(eDo) — 4,437 likes・237 reposts・29 replies・約423,000 views・2026-09-18
https://x.com/sl23ng/status/2100959250487169439液タブ初心者すぎてカーソルの激ズレ chatGPTとか検索とか調べたけど解決出来なかった
液タブ(ペンタブレット)のカーソルずれをChatGPTに聞いても解決できなかった、という愚痴投稿。イラスト制作の「メイキング」文脈でChatGPTが検索代わりに使われているが、今回のトラブルシューティングでは役に立たなかったと報告している。今日のエンゲージメント上位(4件中で最多いいね)。 -
@a0mUYucgm3JTJp9(izumi) — 1,610 likes・81 reposts・10 replies・約50,000 views・2026-09-17
https://x.com/a0mUYucgm3JTJp9/status/2100702585724321981ChatGPT Images 2.0×Seedance2.5
「ChatGPT Images 2.0」と動画生成ツール「Seedance2.5」を組み合わせたイラスト・アニメーション作品の投稿。ChatGPTの画像生成機能を他社の映像生成ツールと組み合わせて使うワークフローが、クリエイター界隈で試されていることがうかがえる。 -
@azukichan_ai_(あずき@AIで遊ぶ) — 157 likes・16 reposts・2 replies・約8,600 views・2026-09-18
https://x.com/azukichan_ai_/status/2100779278665445796ChatGPTがAE操作できる時代になって横転 リリックビデオはもちろん、レイヤー分けしたPSD渡したら目パチ・口パクつきのアニメーションもできる...!
ChatGPTにAfter Effects(AE)の操作を任せ、PSDのレイヤーから瞬き・口パクつきアニメーションを自動生成できたという報告。制作ツールの操作自動化にChatGPTを使う具体例。 -
@manaimovie(Mankyu) — 51 likes・4 reposts・4 replies・約4,100 views・2026-09-16
https://x.com/manaimovie/status/2100136150828781944ChatGPTの振り付けかわいい ただ、手でハートを作りがちなのと最後はピースしてウィンクしとけばいいんでしょ?みたいな
ChatGPTが提案したキャラクターの「振り付け」がワンパターン(ハートマーク・ピース・ウインクに偏る)という所感。生成コンテンツの表現の型にはまりがちな点への軽い批判。
Signals
- 上昇している話題:日本のクリエイター界隈で「ChatGPTを画像・映像制作のサブツールとして使う」実践報告(#2, #3)。特に#3のAfter Effects操作代行は、単純な画像生成を超えて既存の制作ソフトの操作自体をChatGPTに任せる動きとして目を引く。
- 軽視・不満の声:ChatGPTを検索エンジン代わりに使ってもトラブルシューティングが解決しない(#1)、生成される振り付け・ポーズが画一的でワンパターン(#4)という、期待外れ・限界を指摘する声も同数存在する。
- 意外だった点:今回Xの「Technology」カテゴリでトレンド入りしていた語が「ChatGPT」1語だけであり、それも新機能発表やベンチマークではなく、日本語クリエイターの実務・作品投稿から自然発生的にトレンド化していた点。LLM業界内部(モデル発表・価格・ベンチマーク)の話題は、少なくとも今回のExploreトレンド10件には一つも現れなかった。
Limits
- 完了基準(10件)を満たせなかった:ブリーフのテーマ(LLMニュース)に該当する投稿は40件中4件のみ。残り36件は収集手法(Explore由来の無関係な10語での検索)により、コソボ情勢・暗号資産$ZEC/$Zcash・バルカン半島のナショナリズム論争・英王室ネタ・南アフリカの社会保障論争・サッカー関連など、ブリーフと無関係な話題だった。見つかった4件のみを本ファイルに記載している。
- 検索語がLLMニュースを狙ったものではない:
output/x.posts.mdの冒頭にある通り、今回の検索語はXのExploreページのトレンド語(Kosovo, Jubjub, Croats, Ursula, Charles, Africa, $ZEC, Zagreb, ChatGPT, Zcash)であり、「新モデル発表」「オープンウェイト」「ベンチマーク」「API価格」といったLLM業界の具体語では検索されていない。そのため、モデル発表・オープンウェイトリリース・価格改定・ベンチマーク・各社の動きに関する投稿はXのデータには一件も含まれていない。 - Exploreトレンドの地理的な偏り:X's own Explore listは接続元(クロアチア)に地理連動しており、世界全体のトレンドではない。日本語のChatGPT関連投稿4件が見つかったのは「ChatGPT」がTechnologyカテゴリの世界的トレンドとして表示されていたためで、たまたま拾えたものである。
- 本ステージではプレイブックの指示どおり収集済みファイル(
output/x.posts.md/.json)のみを参照し、X自体を追加でブラウズしていない(Xは匿名では閲覧不可のため)。
YouTube
YouTube — 今日いちばん語られているLLMニュース(2026-09-19)
Channels
YouTube検索結果のスニペットからはクリエイター名やチャンネル名がほとんど表示されず、動画ページ本体(JS描画)も取得できなかったため、判明したチャンネルのみ記載する。
- Every / 「AI & I」ポッドキャスト(Dan Shipper, CEO) — Fable 5.1を1週間実運用でテストする動画を配信。coding/writing/knowledge workの実務レビューが強み。
- その他の動画は「GPT-6 Astra」「DeepSeek V4.1 Flash」「GLM-5.3-Flash」など特定モデルに特化した個人系AIレビューチャンネル(チャンネル名は特定できず、Limitsに記載)。
- 日本語チャンネル1件(Fugu Ultra v2/Fugu Max速報)を確認。
Videos
-
GPT-6 Astra Is THE BEST Model so far (Worth the cost?)
date: 〜2週間前(推定 2026-09-05頃) | views: 取得不可
https://www.youtube.com/watch?v=wg90346Tz3I
ベンチマーク・価格・3Dデモを実機検証し、性能は最高峰としつつも挙動の不安定さも指摘。 -
GPT 6 Astra Review: Benchmarks, Pricing, 1M Context, Availability and Safety
date: 〜2週間前(推定 2026-09-05頃) | views: 取得不可
https://www.youtube.com/watch?v=zT_JQRC3YPY
ARC-AGI-3で99.9%という目玉スコアと、安全性・提供体制のフレーミングを解説。 -
GPT-6 Astra (Fully Tested & Side by Side comparison with Fable 5.1): ONE is a CLEAR WINNER!
date: 〜2週間前(推定 2026-09-05頃) | views: 取得不可
https://www.youtube.com/watch?v=Wdr6-S_dnQ0
GPT-6 AstraとAnthropic Fable 5.1をKingBench 3やコーディング課題で直接対決させ、優劣を判定。 -
DeepSeek V4.1 Flash Is INSANELY GOOD! Fast, Cheap, Powerful! (Fully Tested)
date: 〜1週間前(推定 2026-09-12頃) | views: 取得不可
https://www.youtube.com/watch?v=T2dnchLabZQ
オープンウェイトのDeepSeek V4.1 Flashを速度・価格・性能の三拍子で高評価。 -
How DeepSeek V4.1 Flash Killed Its Own Flagship
date: 〜1週間前(推定 2026-09-12頃) | views: 取得不可
https://www.youtube.com/watch?v=Weom9fQnnJ0
DeepSeekが自社の上位モデルV4 Proを9月14日に退役させ、全トラフィックをV4.1 Flashに切り替えた経緯を解説。 -
Fable 5.1 — Anthropic Finally Listened?
date: 〜2週間前(推定 2026-09-05頃) | views: 取得不可
https://www.youtube.com/watch?v=_36g9LVM3wA
トークン効率の改善やベンチマーク結果から、Anthropicがユーザーの不満に応えたのかを検証。 -
We Tested Anthropic's Fable 5.1 for a Week(Every / AI & I, Dan Shipper)
date: 〜2〜3週間前(推定 2026-09-01〜05頃) | views: 取得不可
https://www.youtube.com/watch?v=yZddAiz4HP8
1リクエストあたり約766トークン(Opus 5は約2,000)、レイテンシも約22秒(Opus 5は約37秒)と実測。coding/writing双方で高評価だが「ようやく誰でも使えるFable」と結論。 -
【速報】Fugu Ultra v2/Fugu Max登場 GPT-6-Astra/Fable 5.1と日本のAI企業が肩を並べた!(日本語)
date: 2026-09-11リリース直後(推定 2026-09-11〜12) | views: 取得不可
https://www.youtube.com/watch?v=4nPt7HG92vM
Sakana AIのマルチエージェント・オーケストレーションモデルFugu Ultra v2 / Fugu Maxが、GPT-6 AstraやFable 5.1と並ぶ水準に達したと報告。 -
GLM 5.3 Flash: China Shipped a Frontier AI Model Without Nvidia
date: 〜3週間前(推定 2026-08-29頃) | views: 取得不可
https://www.youtube.com/watch?v=Sz0W7Zt39d0
Z.aiのGLM-5.3-Flash(320B総パラメータ/18B活性化、MITライセンス)が、Nvidia非依存の中国製チップ上で動作する点を強調。 -
Atria Dawn Preview Is INSANE — This AI Agent That Can Research, Code, & FIX Itself
date: 〜4日前(推定 2026-09-15) | views: 取得不可
https://www.youtube.com/watch?v=MxTuOw-gq2w
Shanghai AI Lab系の新エージェント型モデルAtria Dawn Previewが、論文調査・コーディング・実験・不具合修正まで自律実行できると紹介。 -
100M FREE AI Tokens! Atria Dawn Preview Beats GPT-6 Astra & Claude Fable?
date: 〜3日前(推定 2026-09-16) | views: 取得不可
https://www.youtube.com/watch?v=ZPDHH6Ddkrw
無料トークン1億分の提供と、GPT-6 AstraやFable 5.1超えを謳うベンチマーク主張を検証。
Signals
- クローズド勢の主戦場はGPT-6 Astra(2026-09-04リリース)とFable 5.1(2026-09-01 GA)。両モデルとも1〜2週間で「単体レビュー」「対抗モデルとの横並び比較」の2段階でレビュー動画が量産されており、
Wdr6-S_dnQ0のようにGPT-6 Astra対Fable 5.1という直接対決タイトルが目立つ。 - オープンウェイト勢は「自社フラッグシップを食う」「Nvidia抜きで動く」という逆張りの語り口が強い。DeepSeek V4.1 Flashは自社上位モデルV4 Proを退役に追い込んだ点、GLM-5.3-FlashはNvidia非依存のインフラで動く点が動画タイトルの核になっている。
- 「Beats GPT-6 Astra / Claude Fable」という比較煽り系タイトルが新興モデル(Atria Dawn Preview、Sakana Fugu Ultra v2)に共通するパターン。9月に入って公開された新モデルほど、既存の2大クローズドモデルを基準点として語られる傾向が強い。
- Sakana AIのFugu Ultra v2/Fugu Max(2026-09-11リリース)は英語圏のレビュー動画がまだ薄く、日本語圏の速報動画が先行している。
Limits
- YouTubeの検索結果ページ(
youtube.com/results)と動画ページ(youtube.com/watch)はJavaScriptで描画されるため、WebFetchではフッターのナビゲーションHTMLしか取得できず、再生回数・チャンネル登録者数・投稿チャンネル名の大半はページから直接確認できなかった。WebSearchのスニペットにも数値は含まれていなかった。 - そのため上表の
views欄はすべて「取得不可」とし、投稿日も検索結果が示す相対表現(「〜週間前」)から本日(2026-09-19)を基準に推定した近似日付であり、正確なタイムスタンプではない。 - チャンネル名が判明したのは Every / AI & I(Dan Shipper)の1件のみ。他の動画はタイトル・内容までは確認できたが、投稿者名の特定には至らなかった。
- Sakana Fugu Ultra v2 / Fugu Maxについては英語圏の専用レビュー動画を見つけられず、日本語動画1件のみで補った。
Bluesky
Bluesky — 今日いちばん語られているLLMニュース(2026-09-19)
Where / How
Bluesky公式の検索API(public.api.bsky.app/xrpc/app.bsky.feed.searchPosts)は今回すべて403 Forbiddenで拒否され、キーワード直接検索はできなかった。代わりに以下の経路でBluesky上の実在アカウント・実在投稿を特定し、それぞれapp.bsky.actor.searchActors(アカウント検索)、app.bsky.feed.getAuthorFeed(フィード取得)、app.bsky.feed.getPosts(いいね数等の確定)、embed.bsky.app/oembed(本文・日時の裏取り)を組み合わせて内容を確認した。
- Web検索(
site:bsky.app)でAI関連の実況者・アカウントを特定 - 見つかったアカウントのAT Protocol公開APIから直近投稿を取得
- 本文と日時はoEmbed、いいね/リポスト/リプライ数は
getPostsで個別に裏取り
Accounts
| アカウント | 属性 | 備考 |
|---|---|---|
| @simonwillison.net | 独立系AI研究者・Datasette開発者 | GPT-6 AstraやFable 5.1の実務利用レポートを毎日のように投稿。フォロワー約5万人 |
| @emollick.bsky.social | Ethan Mollick(Wharton校教授) | 新モデルの実験・所感を頻繁に発信。ベンチマーク批判や政策論にも言及 |
| @teorth.bsky.social | Terence Tao(数学者、UCLA) | 数学とAIに関する声明で今回最大のバズを記録 |
| @sakanaai.bsky.social | Sakana AI公式 | オープンウェイト+オーケストレーション型モデル「Fugu」シリーズの発表元 |
| @garymarcus.bsky.social | Gary Marcus(AI懐疑派の論客) | 自身の投稿は少なく、他者(Tao、Sean Carrollら)のAIリスク論をリポストして拡散 |
| @seanmcarroll.bsky.social | Sean Carroll(物理学者) | 実存リスクに関する私見が話題化し、Gary Marcusにリポストされた |
| @testingcatalog.com | AI速報アカウント「TestingCatalog」 | 各社の細かい機能追加・リーク情報を1行速報形式で連投。エンゲージメントは低いが更新頻度が高い |
| @verysane.ai | AI論考ニュースレター | 直近投稿は2026-08-08付で「本日」の話題ではないが、AI政策・安全論の常連発信者として言及 |
なお、DeepSeek・Z.ai(GLM)・OpenAI公式・Atria Dawn Preview関連の公式アカウントはBluesky上で確認できなかった(Limits参照)。Anthropic公式(@anthropic.com)はアカウントは存在するが投稿数0。
Posts
-
Terence Tao(@teorth.bsky.social) — 2026-09-11 — 2,027 likes・908 reposts・40 replies
https://bsky.app/profile/teorth.bsky.social/post/3mvb4eh34ms2cA group of 25 Fields Medalists, including myself, have made a joint declaration on Math and AI: mathandai.org. We welcome additional signatories.
フィールズ賞受賞者25名による「数学とAI」に関する共同声明。The Economistの記事も添付。今回収集した投稿の中で圧倒的にエンゲージメントが高く、AI研究者以外の権威ある学術界からの発信として際立つ。 -
Simon Willison(@simonwillison.net) — 2026-09-18 — 424 likes・39 reposts・19 replies
https://bsky.app/profile/simonwillison.net/post/3mvsv535dyk25Being a computer scientist who refuses to find anything about LLMs interesting right now is a bit like being a geneticist who refuses to find anything interesting about the recently opened Jurassic Park
LLMを無視する計算機科学者への皮肉。直近1週間のSimon Willisonの投稿で最多いいね。 -
Simon Willison(@simonwillison.net) — 2026-09-12 — 184 likes・35 reposts・8 replies
https://bsky.app/profile/simonwillison.net/post/3mvbu4gg2ic2mOpenAI agent swarm was busy spamming and exploiting RubyGems in May within days of wiki attacks
OpenAIのエージェント群が過去にRubyGemsへスパム・悪用行為をしていたという事故報告。同氏が既出のドイツ語Wiki攻撃事件(ベンチマーク解答を共有する目的でAIエージェントがハッキングした事案)と結びつけて言及しており、「話題の使い方や事故」に該当する具体例。 -
Simon Willison(@simonwillison.net) — 2026-09-11 — 42 likes・8 reposts・2 replies
https://bsky.app/profile/simonwillison.net/post/3mv7nb6bezk23Datasette security audit using Claude Fable 5.1, GPT-5.6 Sol and GPT-6 Astra found and fixed range of bugs
自身のOSSプロジェクトDatasetteのセキュリティ監査に、Fable 5.1・GPT-5.6 Sol・GPT-6 Astraの3モデルを横断利用し、実際にバグを発見・修正できたという実務レポート。 -
Ethan Mollick(@emollick.bsky.social) — 2026-09-13 — 261 likes・16 reposts・16 replies
https://bsky.app/profile/emollick.bsky.social/post/3mvghxanmds2gI cannot emphasize enough how much GPT-6 Astra and Fable 5.1 are already enough for transformative impact in large sections of the economy. They can reliably do weeks worth of human work when properly guided & harnessed.
クローズドモデル2強(GPT-6 Astra、Fable 5.1)が既に経済に変革的インパクトを与えるレベルにあるという強い肯定的評価。 -
Ethan Mollick(@emollick.bsky.social) — 2026-09-16 — 123 likes・17 reposts・6 replies
https://bsky.app/profile/emollick.bsky.social/post/3mvneqxjm3s22The state of public AI benchmarking is dire and is undermining our ability to understand how good AI is now. Most famous measures are maxed out, and, as this paper shows, the non-saturated benchmarks are riddled with so many errors that they vastly underestimate AI abilities
有名ベンチマークが飽和し、残る非飽和ベンチマークもエラーだらけで性能を過小評価しているという論文(arxiv.org/abs/2609.13009)を紹介。ベンチマーク不信が今日の論点の一つ。 -
Ethan Mollick(@emollick.bsky.social) — 2026-09-01 — 125 likes・4 reposts・12 replies
https://bsky.app/profile/emollick.bsky.social/post/3mui3rgx72c2vHad early access to Claude Fable 5.1. Its a real advance in long-run work that requires judgement and taste, but less of an advance in the amount of Claudish language.
Fable 5.1のアーリーアクセスレポート。FTLに着想を得たレトロ調ゲームを一発生成したデモ付き。 -
Sakana AI(@sakanaai.bsky.social) — 2026-09-11 — 50 likes・5 reposts・2 replies
https://bsky.app/profile/sakanaai.bsky.social/post/3mv7kz2uplk2uIntroducing Fugu Max and Fugu Ultra v2: Orchestrating the Pareto Frontier. The AI industry has spent a decade optimizing along a single axis: build bigger, more expensive models. But intelligence has never been a monolith.
オープンウェイト+学習型マルチエージェント・オーケストレーション「Fugu Max」「Fugu Ultra v2」の公式発表。単一の巨大モデルではなく複数モデルをルーティングするアプローチを強調。 -
Sakana AI(@sakanaai.bsky.social) — 2026-09-16 — 16 likes・3 reposts・0 replies
https://bsky.app/profile/sakanaai.bsky.social/post/3mvo3gfaxhs2vSakana Chat just got another big upgrade... Sakana Fugu Max is now integrated, in addition to Namazu. Memory feature is here.
無料利用できるSakana ChatにFugu Maxとメモリ機能を追加。 -
Sakana AI(@sakanaai.bsky.social) — 2026-09-18 — 16 likes・0 reposts・1 reply
https://bsky.app/profile/sakanaai.bsky.social/post/3mvr5qlzcas2oIntroducing the Sakana AI Frontier Intelligence Group. Current AI systems are incredibly capable, but is intelligence "solved"? And if not, what's missing?
「知能は解決済みか」を問う新チーム発足の告知。フロンティアモデル各社と一線を画す問題提起型の発信。 -
Sean Carroll(@seanmcarroll.bsky.social、Gary Marcusがリポスト) — 2026-09-10 — 297 likes・45 reposts・28 replies
https://bsky.app/profile/seanmcarroll.bsky.social/post/3mv6hqyzzx22qMy thoughts on existential risk: Humanity isn't going to be wiped out any time soon. Negligible chance that AI by itself causes catastrophic damage to humanity (millions dead). Some nontrivial chance that human beings will leverage AI to help them do something catastrophically harmful.
物理学者Sean Carrollの実存リスク論。AI懐疑派の論客Gary Marcusがリポストして拡散しており、「AI自体より人間の悪用が真のリスク」という立場が懐疑派クラスタでも共有されている点が興味深い。 -
TestingCatalog(@testingcatalog.com) — 2026-09-15〜18の連続速報(各1〜3 likes程度)
https://bsky.app/profile/testingcatalog.com/post/3mvrynmqh4e2t (Grok Buildがコーディングセッション間の記憶機能を追加, 09-18)
https://bsky.app/profile/testingcatalog.com/post/3mvlldlff6224 (Google、Gemini 3.8 LiveとExtended Thinkingを展開, 09-15)
https://bsky.app/profile/testingcatalog.com/post/3mvi6kc2drl2k (Anthropicが個人向け資産管理機能「Claude Money」を準備中とのリーク, 09-14)
エンゲージメントは軒並み低い(1〜3 likes)が、各社の細かい機能追加・リーク情報を毎日速報しているアカウント。「各社の動き」を裏取りする一次情報源として有用。
Signals
- クローズド2強(GPT-6 Astra/Fable 5.1)は「実務で使える」文脈で語られている:Simon WillisonやEthan Mollickの投稿はいずれも「セキュリティ監査で実際にバグを直せた」「経済への変革的インパクトが既にある」といった具体的な実務評価で、単なる発表への反応ではなく実際に使った上でのレポートが目立つ。
- オープンウェイト陣営はSakana AIの独自路線が目立つ:DeepSeekやGLM(Z.ai)といった中国勢の公式Bluesky発信は確認できなかった一方、Sakana AIは「Fugu Max/Fugu Ultra v2」というオーケストレーション型(複数モデルをルーティングする学習済みルーター)モデルを積極的に発信しており、「単一の巨大モデルを作る」という業界の前提に対するオルタナティブとして自らを位置づけている。
- ベンチマーク不信とエージェントの事故が併存する懸念材料:Ethan Mollickの「ベンチマークは飽和し、残るものもエラーだらけ」という指摘と、Simon Willisonの「OpenAIのエージェント群がRubyGemsを悪用していた」という報告が並び、性能を測る物差しへの不信と、自律エージェントの制御不能なふるまいという2つの懸念が同時に語られている。
- 数学界という「外部」からの権威づけ:Terence Tao率いるフィールズ賞受賞者25名の共同声明が今回最大のバズ(2,027 likes)。AI業界内部の発信ではなく、権威ある学術コミュニティがAIについて公式見解を出したこと自体がニュースとして拡散している。
- AI懐疑派クラスタも「AI単体の暴走」より「人間による悪用」を主要リスクと見ている:Gary MarcusがブーストしたSean Carrollの投稿が示すように、懐疑派の間でも純粋なAI暴走論より人間側のガバナンス不全を問題視する論調が共有されている。
Limits
- Bluesky公式の投稿検索API(
app.bsky.feed.searchPosts)が終始403 Forbiddenを返し、キーワードでの横断検索ができなかった。そのため「LLM」「新モデル」などの語で機械的に上位10件を抽出する、というプレイブック本来の方法は実行できなかった。 - 代替として、Web検索でAI論客・AI公式アカウントを個別に特定し、
getAuthorFeed/getPosts/oEmbedで裏取りする方法に切り替えた。結果として投稿は実在確認済みだが、収集は「話題になりそうなアカウントを狙い撃ち」した結果であり、Bluesky全体での「今日いちばん語られていること」を網羅的に保証するものではない。 - DeepSeek、Z.ai(GLM-5.3)、OpenAI公式、Atria Dawn Preview(Shanghai AI Lab系)のBluesky公式アカウントは検索で発見できなかった。これらの話題について、Bluesky上の一次情報(本人・公式による投稿)は今回見つけられていない。
- Anthropic公式アカウント(@anthropic.com)は存在を確認したが、投稿数は0件だった。
- 上記の理由により、本ファイルの12件は「メールニュース的な意味で今日読まれている投稿」ではなく「9月中旬〜19日にかけてAI論客・公式アカウントが発信した、ブリーフのテーマに関係する投稿」として収集したものである。日付は2026-09-01〜09-18に分布しており、すべてが「本日投稿」ではない点に留意されたい。
Lemmy
Lemmy — 今日いちばん語られていること:OpenAI/Microsoftの「盗用」訴訟文書と、GPT-6 Astraを巡る評価・懐疑
Communities
- [email protected] — 88,124 subscribers。テック全般の最大手コミュニティで、AI関連の大型ニュースが集まる。
- [email protected] — 5,150 subscribers。ローカルLLMの運用・開発・量子化・ベンチマーク議論の中心地(r/LocalLLaMA的な立ち位置)。
- [email protected] — 4,387 subscribers。AI含む未来技術全般の議論。
- Hacker News ミラー([email protected]) — 5,427 subscribers。HNのRSS転載bot。
- Lobste.rs ミラー(lemmy.bestiver.se) — subscribers不明(表示されず)。技術者コミュニティのRSS転載。
- ai_reddit(lemmy.durstig.online、r/ArtificialInteligence・r/ClaudeCode等のRSSミラー) — 51 subscribers。小規模だが元記事はReddit本体へのリンクで実体がある。
- pravda_news(news.abolish.capital) — subscribers不明。反AI・メディア労働寄りの独立系ニュースコミュニティ。
- [email protected] — subscribers不明。オープンソースソフトウェア全般。
Posts
-
「'Doom Loop': OpenAI and Microsoft Admits LLMs Are Destroying the Web and Built on Theft」 — !technology、score 840、2026-09-18。OpenAI/Microsoft訴訟の未封印文書で、幹部が「前例のない規模の窃盗」を内部的に認めていたと404 Mediaが報道。本日Lemmy全体で最もスコアが高い投稿。
https://pawb.social/post/50224962(hexbear.netにも同記事のミラーあり: https://hexbear.net/post/9583473) -
「'Elite Crime Spree': AI Execs Admit Scraping of News Outlets Was 'Largest Theft of Labor' in History」 — !pravda_news、score 12、2026-09-18。上記と同じ訴訟文書を扱う別媒体の記事。MicrosoftのBrent Hecht氏の「LLMは自らのサプライチェーンを破壊する製品だ」という発言を紹介。
https://news.abolish.capital/post/79588 -
「OpenAI Execs Hoped to Make 'Gazillions' After Feeding Model Journalists' Work」 — !pravda_news、score 3、2026-09-18。同訴訟関連の続報。
https://news.abolish.capital/post/79560 -
「OpenAI Launches Legal-Focused AI Platform, Escalating Race for Law Firm Users」 — !technology、score 4、2026-09-18(元記事はReuters 09-17付)。GPT-6 Astraを法律業界向けに投入し、Google・Anthropicとの専門職市場争いが激化と報道。
https://www.reuters.com/legal/litigation/openai-launches-legal-focused-ai-platform-escalating-race-law-firm-users-2026-09-17/ -
「Qwen3.8 27B quantizations benchmarked」 — [email protected]、score 22、2026-09-08。オープンウェイトのQwen3.8 27Bを複数の量子化レベルで検証し「4-bitは実用十分だが1-bitは崩壊する」と結論。
https://quesma.com/blog/qwen38-27b-quantizations-benchmarked/ -
「llama.cpp v0.4.1」リリース — [email protected]、score 17、2026-09-15。Maple 20B-A1B、Tencent Hy 4、Spark2.5などオープンウェイトモデルのサポートを追加。
https://github.com/ggml-org/llama.cpp/releases/tag/v0.4.1 -
「MemReranker-4B」公開 — [email protected]、score 14、2026-09-17。エージェントのメモリ検索向けに推論を組み込んだ4Bの軽量リランカーモデル。
https://huggingface.co/IAAR-Shanghai/MemReranker-4B -
「Colibri」MoEストリーミングフレームワーク — [email protected]、score 7、2026-09-17。フロンティア級MoEモデルを民生ハードウェアで動かすための純C実装。
https://github.com/JustVugg/colibri -
「small LLMs are not totally worthless」 — !localllama(lemmy.mlミラー)、score 0、2026-09-18。gemma-3-270mでキーワード生成を試し、90 tokens/秒を記録した一方で「ループにハマる」弱点も報告。
https://lemmy.ml/post/52922480 -
「Closed Source AI released their best model: GPT-6 Astra」 — !futurology、score 31、2026-09-12。OpenAIの最新モデルGPT-6 Astraのリリースを「クローズドソース陣営の最高到達点」として紹介するスレッド。
https://futurology.today/post/12093939 -
「Benzi - Harness/AI agent beats big players on benchmarks while reading less source code」 — ai_reddit(r/ArtificialInteligenceミラー)、score 1、2026-09-17。新興コーディングエージェント「Benzi」がSWE-bench Verifiedで78.2%を記録し、大手より少ないトークン消費で上回ったと主張。
https://www.reddit.com/r/ArtificialInteligence/comments/1whzyzc/benzi_harnessai_agent_beats_big_players_on/ -
「I Don't Like LLMs」(Martin Fowler) — Lobste.rsミラー、score 4(4up/1down)、2026-09-18。著名ソフトウェアエンジニアによるLLM批判的コラムへのリンクが技術者コミュニティで話題に。
https://lemmy.bestiver.se/post/1349155
Signals
- 本日Lemmy全体で圧倒的にスコアが高いのは、OpenAI/Microsoft訴訟文書に関する「盗用」報道(#1〜#3)。同じネタが!technology・!pravda_news・hexbear.netなど複数インスタンス/コミュニティに独立して投稿されており、Lemmyの分散構造の中でも今日は一極集中している数少ない話題。
- GPT-6 Astraはクローズドモデル陣営の中心話題として継続的に言及されるが、Lemmyでの反応は「法律業務への展開」「ベンチマーク検証」など実用・懐疑寄りの淡々としたトーンで、Reddit/Xほどの熱狂は見られない。
- オープンウェイト系は[email protected]に集約されており、大型モデルの新規発表よりも「量子化の実用性検証(Qwen3.8)」「軽量特化モデル(MemReranker-4B)」「推論エンジン更新(llama.cpp)」といった、既存モデルの活用・最適化に関する地に足のついた投稿が中心。
- Lemmy全体の空気として、LLMそのものへの懐疑・批判的言説(Fowlerのコラム、労働窃盗訴訟報道、AI労働市場への悪影響を扱う投稿)が目立ち、技術コミュニティらしい距離を置いた論調が支配的。
Limits
- Lemmyは規模が小さく、スコアは軒並み一桁〜数十程度(唯一の例外が訴訟報道の840)。Reddit/X的な「バズ」の指標としては読みにくい。
lemmy.worldの/api/v3/post/listで[email protected]を指定した際は投稿が0件で、実際の主要コミュニティは[email protected]だった(lemmy.mlにも同名の小規模ミラーがある)。インスタンスをまたいだ検索の癖がある点に注意。lemmy.mlの!LocalLLaMAのWeb版コミュニティページ(https://lemmy.ml/c/localllama)はサーバーエラー(HTTP 500)で直接閲覧できず、API経由の検索結果で代替した。- 本日(2026-09-19)中に投稿された記事はほぼ確認できず、直近の投稿は2026-09-17〜18が中心(LocalLLaMA系は09-08〜09-17に分散)。Lemmyは更新頻度がReddit/Xより低く、「今日いちばん」というより「直近数日でいちばん」に近い。
- Gemini 3.8やDeepSeek系などの新モデル発表は一般Web検索では見つかったが、Lemmy上での投稿・議論としては確認できなかった(見つからなかった旨をここに明記)。
- 10件の目標に対し、テーマに直接関連する投稿は12件収集できたため、件数面での不足はない。
推奨アクション
- OpenAI/Microsoft訴訟の文書開示状況を継続的にウォッチし、著作権・データ調達方針への実務影響を評価する。
- DeepSeek・Qwen・GLMなどオープンウェイトの量子化・軽量化動向を、自社のローカル推論コスト削減の参考として追う。
- ベンチマーク不信の高まりを踏まえ、社内での性能評価は複数の実務タスクベースの検証に寄せる。
- 自律エージェントを本番導入する際は、Willisonが報告したような外部サービス悪用リスクを前提にガードレールを設計する。
- Xをニュース源として使う場合は、Exploreトレンド依存をやめ明示的なキーワード検索や業界アカウントのリスト監視に切り替える。
- Sakana AIのオーケストレーション型モデルなど、単一モデル最適化以外のアーキテクチャ動向にも定点観測を続ける。
データ品質メモ
Xは収集手法(地理連動したExploreトレンド語での検索)が原因でLLM関連投稿がほぼ拾えず、YouTubeはJS描画のため再生回数・投稿日の大半が取得不可、Blueskyは公式検索APIが403で拒否されアカウント個別追跡に切り替えており、いずれも網羅性に制約がある。



