KEN’S CAT LOG

Daily LLM News — 2026-09-12

今日最大の話題はモデル発表ではなく、Anthropicの脅威インテリジェンスレポート(フーシ派の兵器開発、イランの艦船監視、ロシア系ハッカーのウクライナ攻撃へのClaude悪用)がXとLemmyで独立に最上位級の反応を集めたこと。

今日のLLMニュース — 2026-09-12

今日いちばん語られていたのは、新モデルの発表そのものよりも「AIの悪用・信頼」をめぐる話だった。XとLemmyでは、Anthropicの脅威インテリジェンスレポート(フーシ派によるClaude Codeを使った兵器開発、イランによる米艦船監視、ロシア系ハッカーによるウクライナ軍事技術窃取)が今日最大の話題として独立に浮上している。並行してReddit・Blueskyでは、OpenAIが数学者Buckmaster・Alpogeらのナビエ–ストークス方程式関連の成果を「ChatGPTのセッション履歴から盗んだのでは」という疑惑が両プラットフォームで同時多発的に語られた。そのほかYouTube・Bluesky・Lemmyでは、Claude Fable 5.1、GPT-6 Astra、Gemini 3.8 Flash、DeepSeek V4.1 Flash、GLM-5.3、Sakana AIのFugu Max/Ultra v2といった新モデルが相次いで話題になり、「クローズド勢 vs オープンウェイト勢」という対立軸が一貫して見られた。全体として、話題は明確に見えるが、収集件数や検索条件の制約で一部プラットフォームは完了基準に届いておらず、確信度は中程度にとどまる。

Across platforms

Platform by platform

Reddit(収集順1番目): 「Daily LLM News」という単一検索語で9サブレディットから12スレッドを収集したが、新モデル発表や価格改定そのものを報じるスレッドは見つからず、既存ニュースを巡る議論・皮肉が中心だった。最大の火種はOpenAIのナビエ–ストークス「盗用」疑惑とWSJのオープンウェイト批判記事への反発で、対象期間も2026-09-06〜10と5日間に分散しており、ブリーフが求める「今日」に厳密には絞れていない。

X(2番目): セッションの接続元がクロアチア判定のトレンド一覧に基づいたため、収集した10検索語のうちLLM関連はほぼ「Anthropic」1語のみとなり、10件中LLMブリーフに直接関係したのは6件にとどまった(完了基準の10件に未達=ギャップ)。その6件の中身は、Anthropicの脅威インテリジェンスレポート(フーシ派・イラン関連)が圧倒的な拡散規模を見せ、経済シナリオレポートやClaude Codeのオープンソース化は好意的なトーンで対照的だった。

YouTube: 完了基準の10件は満たし、Claude Fable 5.1、GPT-6 Astra、Gemini 3.8 Flash、DeepSeek V4.1 Flash、GLM-5.3、Muse Spark 1.3、Sakana Fugu Ultraと、今週の主要モデル発表がほぼ網羅的に取り上げられていた。ただしJavaScriptレンダリングの制約で正確な再生回数・登録者数は取得できず、日付も相対表現からの推定が多い。

Bluesky: 公式検索APIがHTTP 403で塞がれていたため、Web検索経由で判明したアカウント(Ethan Mollick、TestingCatalog、Sakana AI等)のフィードを遡るという迂回策で12件を収集し、10件はいいね・リポスト数まで確認できた。Sakana AIのFugu Max/Ultra v2発表がオープンウェイト陣営の立場表明として最も明確に出ていた一方、収集範囲はたまたま見つかったアカウントに偏っている。

Lemmy: !technology、!localllama、!fosaiなど複数コミュニティを横断して12件を収集。クローズド勢の話題はほぼ「安全保障・悪用」文脈(Anthropic脅威レポート)に集中し、オープンウェイト勢はLocalLLaMAでのQwen量子化やK2 Horizonなど実運用報告が中心だった。ただし今日(09-12)付けの投稿はほとんどなく、直近の投稿は09-04〜11に分散している。

ブリーフが名指した5プラットフォームはすべて調査済みで、他プラットフォームの不在はギャップではない。

What to watch

Recommendations

  • Anthropicの脅威インテリジェンスレポートの原文を確認し、兵器転用・監視利用の主張の一次ソースを裏取りする。
  • X向けの検索語を接続元のトレンドに依存せず、OpenAI・Google・Meta・xAI・Mistralなど社名を明示した固定リストに切り替える。
  • Reddit収集は「Daily LLM News」に加えてモデル名・企業名を含む検索語を併用し、新モデル発表そのものを拾えるようにする。
  • Sakana AI Fugu Max/Ultra v2とOpenAI Astraの動向を次回以降の収集で継続的に追跡する。
  • BlueskyのsearchPosts APIの403問題が解消しているか次回確認し、解消していれば直接検索に戻す。
  • ナビエ–ストークス疑惑についてOpenAIの公式声明が出ていないか、次回収集で優先的に確認する。

Data quality

X はトレンド選定がLLMブリーフに最適化されておらず、完了基準の10件中LLM関連は6件にとどまった。Reddit とLemmyは完了基準の件数は満たしたものの、対象期間が「今日」より広い日数(Redditは5日間、Lemmyは09-04〜11)に分散しており、当日固有のニュースというより既存ニュースを巡る議論の集積という性格が強い。Blueskyは公式検索APIが403で使えず、間接的なアカウント遡り方式で件数を満たしたため、収集範囲に偏りがある。YouTubeは10件を満たしたが、JavaScriptレンダリングの制約で再生回数・登録者数などの定量情報が取得できていない。

プラットフォーム別まとめ

Reddit

Reddit — Daily LLM News

Where

検索語「Daily LLM News」で9つのサブレディットから12スレッドを収集。

サブレディット メンバー数 収集スレッド数
r/NoStupidQuestions 7,480,942 3
r/singularity 3,970,329 2
r/ArtificialInteligence 1,924,916 1
r/artificial 1,336,553 1
r/LocalLLaMA 821,987 1
r/WritingWithAI 165,025 1
r/SillyTavernAI 128,146 1
r/BetterOffline 55,091 1
r/Maxcactus_TrailGuide 5,205 1

r/NoStupidQuestionsとr/singularityが件数上は多いが、内容は「LLMとは何か」的な一般論議が中心。逆にメンバー5,205人の小規模サブr/Maxcactus_TrailGuideから出た1件(#10)が2,213ポイントという突出したバイラル反応を見せている。

What people say
  • OpenAIのミレニアム賞問題(Navier–Stokes)関連の主張と、それに伴う「アイデア盗用」疑惑が今日の最大の火種。 スレッド#5(r/singularity, 209pt/69コメント, 2026-09-10, https://www.reddit.com/r/singularity/comments/1wcnyay/)では、OpenAIがNavier-Stokes方程式の解決に近づいたと報じられた一方、数学者Tristan Buckmaster(NYT記事参照)らのCodex利用履歴がモデルに影響したのではという疑惑にOpenAIが「あり得ない」と反論。u/FateOfMuffins(61pt)は「直近の大型学習のデータカットオフが7月3日だったことを示唆しているのでは」とコメント。
  • 同じ話題への反応はサブレディットごとに割れている。 r/singularityのスレッド#6「"LLMs will never be smarter than Redditors"」(271pt/159コメント, 2026-09-09, https://www.reddit.com/r/singularity/comments/1wbnhgt/)ではu/oilybolognese(201pt)が懐疑派を皮肉る一方、r/SillyTavernAIのスレッド#7(68pt/57コメント, 2026-09-10, https://www.reddit.com/r/SillyTavernAI/comments/1wclha4/)では真逆の結論に。u/perthro_anon(140pt)は「OpenAIが自分の書いたスムット(際物創作)を盗んで自分の手柄にするのが心配だ」と皮肉り、ローカルLLM擁護論に発展している。
  • クローズドモデル勢を狙ったWSJのオープンウェイト批判記事が、r/LocalLLaMAで強い反発を受けている。 スレッド#12(513pt/236コメント, 2026-09-08, https://www.reddit.com/r/LocalLLaMA/comments/1wa9309/)はWSJの「規制されていないオープンウェイトAIは災厄への招待」という論説(ポリオウイルス合成の質問に答えたという主張)を取り上げ、u/3169676(557pt、このスレ最高得点コメント)が「金持ちの億万長者だけが『規制された』AIモデルに質問できるべきなのか」と反発。u/inotparanoidも「AnthropicやOpenAIのIPO後の株価を守るためのヒットピースだ」と指摘。
  • AI安全性への懸念を訴える「離脱者」の話に対する不信感が2スレッドで共通して見られる。 スレッド#4(r/ArtificialInteligence, 0pt/32コメント, 2026-09-09, https://www.reddit.com/r/ArtificialInteligence/comments/1wbu9c6/)はAnthropicの研究者Jacob Coxonが「制御不能なシステム開発競争」を懸念して業界を去ったという話題だが、u/MiloGoesToTheFatFarmは「この人はモデル設計者ではなく、データ入力のような下働きをしていただけだ」と切り捨てている。スレッド#9(r/BetterOffline, 299pt/167コメント, 2026-09-10, https://www.reddit.com/r/BetterOffline/comments/1wcxjv0/)はCNNに出演した別の「AI終末論者」を扱い、u/Smurfette2016(208pt)が「勤務6週間、Twitterアカウントも1ヶ月未満でフォロワーゼロだったのに、1投稿が1.3億ビューはあからさまに仕組まれている」と述べている。
  • 「次トークン予測にすぎない」論への反論が複数スレッドで繰り返し出ている、今日はやや「使い古された」空気。 スレッド#1(r/NoStupidQuestions, 1,285pt/358コメント, 2026-09-10, https://www.reddit.com/r/NoStupidQuestions/comments/1wcsbr2/)でu/skmchosen1(16pt、AI研究者を自称)は「事前学習の目的としては次トークン予測だが、事後学習では数学の問題を解けたら正の報酬を与えるような別の学習目的が入る」と説明。スレッド#3(r/artificial, 67pt/221コメント, 2026-09-06, https://www.reddit.com/r/artificial/comments/1w8m8rw/)でもu/danderzei(62pt)が同種の議論を蒸し返している。
  • 「LLMは人間に対する認知ウイルスだ」という科学者の指摘が、小規模サブレディットにも関わらず異例の伸びを見せた。 スレッド#10(r/Maxcactus_TrailGuide, メンバー5,205人, 2,213pt/180コメント, 2026-09-09, https://www.reddit.com/r/Maxcactus_TrailGuide/comments/1wbi2d7/)でu/MF_D000M(58pt)は「LLMは私たちを衆愚の終局に加速させている」とコメント。u/TurgorFervorは「宗教もウイルスだ」と比較論を展開している。
  • 実務ユーザーからは、無料枠での書き心地に関する現実的な不満も。 スレッド#8(r/WritingWithAI, 18pt/35コメント, 2026-09-10, https://www.reddit.com/r/WritingWithAI/comments/1wcunsz/)で投稿者は「GPT Solは研究には良いが文章がロボットっぽい、Claude Sonnetは無料枠の制限が厳しい、Geminiは頭が悪い」と不満を述べ、u/whitemisandry(4pt)は「Claude Opus 4.8を使っているが、書く前に長い指示システムを与えている」とコメント。
  • 「LLMはなぜ賢くなっているのか」という初歩的な質問には、システム構成論での説明が支持を集めた。 スレッド#11(r/NoStupidQuestions, 1pt/9コメント, 2026-09-09, https://www.reddit.com/r/NoStupidQuestions/comments/1wbpr47/)でu/Jolly-Rip5973(2pt)は「LLM単体はもう頭打ちに近く、今の進歩はハーネスやツール呼び出し、複数モデル連携といったシステム全体の工夫によるものだ」と説明している。
Signals
  • 上昇している空気:クローズドモデル勢(特にOpenAI)に対する不信・反発。ミレニアム賞級の成果発表そのものより、「アイデアを盗んだのでは」という疑惑(#5, #7)と、WSJのオープンウェイト批判記事への反発(#12)が今日のRedditの熱を集めている。オープンウェイト=表現の自由・独立性の象徴として擁護される構図。
  • 切り捨てられている空気:AI安全性を訴える「離脱者」系の投稿(#4, #9)はどちらも高いエンゲージメントを得つつも、コメント欄の多数はその告発を「宣伝」「PR」「怪しい」と一蹴している。安全性言説そのものへの疲弊・シニシズムが強い。
  • 意外だった点:メンバー数がわずか5,205人という超小規模サブレディット(#10)が2,213ポイントという、他の主要サブレディット(r/singularity 3,970,329人など)を上回るスコアを記録している。何らかの形でr/all等に「バイラル」した可能性が高く、コミュニティ規模とスコアの相関が今日は崩れている。
  • 対立構造:同じ「OpenAIのCodex/ミレニアム賞」ニュースに対し、r/singularity(#5, #6)は「OpenAIが正しく懐疑派が滑稽」というトーンが優勢なのに対し、r/SillyTavernAI(#7)は「OpenAIが盗んだ、ローカルLLMが必要」という真逆のトーンが優勢——同一ニュースでもコミュニティによって解釈が完全に分裂している。
Limits
  • 検索語は「Daily LLM News」の1種類のみで、具体的なモデル名や企業名での検索は行っていない。そのため収集された12スレッドは「今日発表された新モデル・値下げ・ベンチマーク」といった一次情報の投稿ではなく、既存ニュースを巡る議論・感想・皮肉が中心になっている。新モデル発表やAPI価格変更そのものを報告するスレッドは見つからなかった。
  • r/NoStupidQuestions由来の3件(#1, #2, #11)はLLMの仕組み全般に関する初心者質問で、「今日のニュース」というより恒常的に存在する議論であり、日付の新しさ以外に今日固有の材料は薄い。
  • スレッド内の「Top comments」は各スレッドにつき最大6件のみが提供されており、それ以上のコメント欄の温度は確認できていない(例:#1は358コメント中6件、#12は236コメント中6件のみ)。
  • 対象期間は2026-09-06〜2026-09-10の5日間に分散しており、「今日」(2026-09-12)に厳密に絞った投稿ではない。ワーカーの収集ウィンドウがブリーフの想定より広かった可能性がある。

X

X — LLM関連の話題は少数、中心は「Claudeが兵器開発に悪用された」というAnthropicのレポート

今回のセッションのExploreページはクロアチアからのアクセスとして表示されており(「Trending in Croatia」表記の項目がその根拠)、上位トレンドは「Yemen」「Saudi」「$song」「Charlie Kirk」「Britain」「Anthropic」「Apple」「Sony」「one ai os」「Chelsea」の10件。これはクロアチア(または少なくともこのセッションの接続元)のExploreの並びであり、世界共通のトレンドではない。収集はこの10ワードで検索する形で行われ、うちLLM関連の実質的な話題があったのは「Anthropic」で見つかった投稿と、「Yemen」検索でたまたま拾えたAnthropicの脅威インテリジェンス関連の投稿のみだった。

Accounts

収集された40アカウントはいずれも1投稿のみの寄与で、同一アカウントが複数投稿しているケースはない。そのうちLLMの話題に関係する投稿をしたのは以下の6アカウント。

アカウント 発信内容
@tleilax___(Yet another commodity guy) イエメン拠点の集団がClaude Codeを誘導ロケット・弾道ミサイル・極超音速滑空体の開発に使っていた、という趣旨の投稿。5,022いいね
@IranTimes72(Ebrahim Zolfaghari) イランが米艦船監視にClaude AIを使ったと報じる投稿。Anthropicがイエメン拠点の集団も特定したと言及
@BrianRoemmele Anthropicに「6週間」在籍した人物が「AIは10年で人類を滅ぼす」と発言していることを揶揄する長文投稿
@restitutorII(Restitutor Orientis) Anthropicのレポートが描く2030年の米経済シナリオ(3パターン、GDP+1.6%など)を紹介
@walterkirn 同じ人物騒動に触れ、「主流メディアがこの人物をファウチ博士のように持ち上げた」と皮肉る短文投稿
@claudecode84(Claude code研究ラボ、日本語アカウント) 「Anthropic最高責任者本人が自分のClaude Code環境を丸ごとオープンソース化」と紹介。LLM関連投稿の中で最多の約72.4万views
Posts
  1. @tleilax___、2026-09-10(5,022いいね・359リポスト・21リプライ・約26.4万views、"Yemen"検索でヒット)

    "One Yemen-based group used multiple Claude Code instances while working on guided rockets, ballistic missiles and a hypersonic-glide project."
    Anthropicの脅威インテリジェンスレポートを引用したとみられる投稿。イエメン拠点の集団がClaude Codeを複数インスタンス使い、兵器開発に関与していたという内容で、LLM関連投稿の中で最も拡散されている。

  2. @IranTimes72、2026-09-11(238いいね・34リポスト・8リプライ・約1.5万views、"Yemen"検索でヒット)

    Iran used Claude AI to monitor U.S. warships in the Middle East and identify potential communications vulnerabilities. ... Anthropic also identified a Yemen-based [group]
    1と同じAnthropicのレポートに言及。イランが艦船追跡・軍事画像・商用衛星写真を組み合わせてClaudeで分析していたという報道内容で、1の投稿と対になる形で拡散中。

  3. @restitutorII、2026-09-10(458いいね・69リポスト・41リプライ・約5.7万views、"Anthropic"検索でヒット)

    Anthropic in its report imagines 3 possible futures for the American economy in 2030 based on the power and adoption of AI: 1- Modest scenario: AI has an impact comparable to the Internet. GDP +1.6%, few disruptions to employment. 2- Substantial scenario: AI can perform about...
    Anthropicが発表した経済シナリオレポート(2030年の米経済への影響を3段階で予測)の紹介。兵器悪用のニュースとは別に、Anthropicの経済インパクト分析も同日話題になっていた。

  4. @claudecode84、2026-09-10(2,522いいね・263リポスト・24リプライ・約72.4万views、"Anthropic"検索でヒット)

    Anthropic最高責任者本人が自分の「Claude Code環境」を丸ごとオープンソース化しています
    日本語アカウントからの投稿で、views数だけ見るとLLM関連投稿の中で最大の拡散規模。Anthropicのトップが自身のClaude Code環境を公開したという内容だが、元ソースへのリンクなど詳細は投稿文からは確認できない。

  5. @BrianRoemmele、2026-09-10(790いいね・187リポスト・105リプライ・約9.9万views、"Anthropic"検索でヒット)

    TEMU HARRY POTTER SAYS "AI WILL END ALL HUMAN LIFE IN 10 YEARS!" ... His SIX WEEKS at Anthropic...
    Anthropicに6週間だけ在籍した人物が「AIは10年で人類を滅ぼす」と発言したことを揶揄する投稿。105件のリプライと高いエンゲージメントで、AI安全性言説への懐疑・反発が可視化されている。

  6. @walterkirn、2026-09-10(722いいね・91リポスト・39リプライ・約2.8万views、"Anthropic"検索でヒット)

    The mainstream media boosted this dude like he was, well, Dr Fauci or something. I implore you to see clearly how this works. And who works it.
    5と同じ人物騒動を指したとみられる投稿。名指しはしていないが文脈と検索語・時期が一致しており、主流メディアがこの人物を持ち上げたことへの皮肉。

Signals
  • 一番語られているのは「Claudeの軍事・諜報転用」:Yemen拠点集団の兵器開発(1)とイランの艦船監視(2)はどちらもAnthropicの脅威インテリジェンスレポートに基づくとみられ、地政学の検索語("Yemen")から偶然拾えた形。これが今回のセッションで最も拡散していたLLM関連の話題だった。
  • Anthropicの経済レポート(3)とClaude Codeオープンソース化(4)は好意的・紹介的なトーンで、悪用系のニュースとは温度差がある
  • 「AIは10年で人類を滅ぼす」系の発言には懐疑・揶揄が目立つ(5, 6)。元Anthropic在籍者(在籍期間わずか6週間)の発言をメディアが持ち上げたことへの反発が、賛同より強く見える。
  • 意外だった点:オープンウェイト勢(Llama、Qwen、DeepSeek、Mistralなど)に関する投稿はこの収集内容には一件も無かった。ベンチマークやAPI価格変更についての具体的な投稿も見当たらない。
  • 収集された40投稿・10検索語のうち、LLMブリーフに直接関係したのは6投稿のみ。残りはイエメン・サウジ紛争の一般ニュース、Charlie Kirk暗殺一周忌をめぐる政治論争、Britain/Israel外交、Appleイベントへの反応、Sony/ゲーム話題、Chelsea関連のサッカーミームで、LLMとは無関係だった。
Limits
  • Explore(トレンド一覧)はクロアチア基準の表示であり、世界のトレンドを代表しない。この点はセッションの接続元に依存するため、他の国・地域では異なる並びになっていた可能性が高い。
  • 検索語の選定がLLMブリーフに最適化されていない:使われた10語("Yemen", "Saudi", "$song", "Charlie Kirk", "Britain", "Anthropic", "Apple", "Sony", "one ai os", "Chelsea")はExploreのトレンドをそのまま拾ったもので、LLM関連語は「Anthropic」のみ。OpenAI、Google/Gemini、Meta AI、xAI/Grok、Mistralなど他社の動きを狙った検索は行われておらず、その結果クローズドモデル勢・オープンウェイト勢どちらについても網羅的な収集にはなっていない。
  • 完了基準の「10件」には届かず、LLM関連として書けたのは6件のみ(40投稿中)。新モデル発表、価格改定、ベンチマーク、具体的な事故事例といった観点の投稿は今回の収集には含まれていなかった。
  • セッション自体は正常に動作しており、ログイン切れやページ取得失敗は発生していない(欠落の原因は検索語の選定であり、セッション不良ではない)。

YouTube

YouTube — 今日のLLMニュース(2026年9月12日)

Channels
  • Anthropic(公式チャンネル)— Claude Fable 5.1の発表動画を投稿。
  • ByteForward — クローズドモデル vs オープンウェイトの比較検証系チャンネル。
  • WorldofAI(@intheworldofai)— 新モデルの実践テストとAIニュースまとめが多い。
  • AI WITH Rithesh — 新モデルのベンチマーク・価格解説系。
  • Prompt Engineering(@engineerprompt)— プロンプト設計・新モデル解説系。
  • AI Coding Daily — コーディングベンチマークでの実測レビュー系。
  • RandomAI — リーク情報・噂ベースの考察系。
  • TheAIGRID — 新モデル発表のスピード解説系。
  • AI時短ラボ — 日本語でのAI速報チャンネル。

チャンネルページ自体はJavaScriptレンダリングのため登録者数を直接確認できず、正確な数値は取得できなかった(詳細は Limits)。

Videos
  1. Introducing Claude Fable 5.1 — Anthropic — 2026年9月1日 — https://www.youtube.com/watch?v=ROF2Nv_KjOM
    Anthropicの公式発表動画。Claude Fable 5.1を「もっとも高性能なクラスの最新版」と位置づけ、Terminal-Bench-Scienceスコアが5から5.1で24.7→52.6に向上したと紹介。

  2. GPT-6 Astra vs DeepSeek V4.1 Flash… Is It Even Close? — ByteForward — 2026年9月11日ごろ(投稿1日前) — https://www.youtube.com/watch?v=YnFKMybL7gs
    クローズドのGPT-6 Astraとオープンウェイトの DeepSeek V4.1 Flashを実測比較。デザイン系タスクでV4.1 FlashがAstraの98%のスコアを1.4%のコストで達成したとするベンチマークを紹介。

  3. DeepSeek V4.1 Flash Is INSANELY GOOD! Fast, Cheap, Powerful! (Fully Tested) — WorldofAI — 2026年9月上旬 — https://www.youtube.com/watch?v=T2dnchLabZQ
    コーディング・3Dシミュレーション・エージェント動作・画像入力まで一通り検証し、最大427トークン/秒の速度と低コストを高く評価。

  4. GLM-5.3 Released: Everything You Need to Know About Z.ai's New Coding Model (Benchmarks, Price) — AI WITH Rithesh — 2026年8月中旬 — https://www.youtube.com/watch?v=4RFo47KJ4q4
    Z.aiのオープンウェイトモデルGLM-5.3のベンチマークと価格を解説。同じ743Bベースモデルのまま後段学習だけで性能を伸ばした点を強調。

  5. 【速報】GLM-5.3登場 コーディングとサイバー能力で最強クラス 期待のモデル!! — AI時短ラボ — 2026年8月中旬 — https://www.youtube.com/watch?v=Ca0PHSjrU8M
    日本語チャンネルによるGLM-5.3速報。コーディングとサイバーセキュリティ関連タスクでの能力を「最強クラス」と紹介。

  6. Gemini 3.8 Flash: The model no one expected! — Prompt Engineering — 2026年9月2〜3日ごろ — https://www.youtube.com/watch?v=UvrAYDgobSw
    Googleが2026年9月2日に投入したGemini 3.8 Flashを「誰も予想していなかったモデル」と評し、無料枠でClaude Opus 5に迫る性能があると主張。

  7. I Tested NEW Muse Spark 1.3 on Coding: Meta Joins Frontier LLMs? — AI Coding Daily — 2026年9月上旬(投稿1週間前) — https://www.youtube.com/watch?v=lxljOqB1YUI
    Metaのオープンウェイト化予定モデルMuse Spark 1.3をコーディングタスクで検証し、Metaがフロンティア級に追いついたかを論じる内容。

  8. OpenAI Astra Just Got Leaked and It's INSANE (Full Breakdown) — RandomAI — 2026年8月下旬(投稿2週間前) — https://www.youtube.com/watch?v=2sh0_oV_r04
    OpenAIの次期モデルAstraに関するリーク情報をまとめた考察動画。正式発表前の噂ベースの内容である点に注意。

  9. DeepSeek V4.1 GA Soon, GPT-5.6 SOL Nerfed? HUGE Fable Update, US AI BAN Protests, & More! AI NEWS — WorldofAI — 2026年9月上旬 — https://www.youtube.com/watch?v=LgGJz528Boo
    週刊AIニュースまとめ。DeepSeek V4.1の正式リリース見込み、Fableのアップデート、米国でのAI規制に対する抗議動向などをまとめて紹介。

  10. Sakana AI's New "Fugu Ultra" Beats Claude Fable 5 (Sakana Fugu) — TheAIGRID — 2026年6月下旬 — https://www.youtube.com/watch?v=FwA1bcpSGiM
    日本のSakana AIによるマルチエージェント指向モデル「Fugu」シリーズ(初代Fugu Ultra)を紹介。Claude Fable 5を上回るとする主張を検証。9月11日にリリースされた後継のFugu Ultra v2 / Fugu Maxはまだ専用動画が見当たらず(Limits参照)。

Signals
  • クローズド陣営: Anthropic(Fable 5.1、9/1)、Google(Gemini 3.8 Flash、9/2)、OpenAI(Astra、未発表・リーク段階)が相次いで動いており、YouTube上のレビュー動画も発表から数日以内に集中して投稿されている。
  • オープンウェイト陣営: DeepSeek(V4.1 Flash)、Z.ai(GLM-5.3系)、Meta(Muse Spark 1.3)、Sakana AI(Fugu Max / Fugu Ultra v2)が「低コストでクローズドモデルに肉薄」という切り口で語られており、特にDeepSeek V4.1 FlashとAstraの価格性能比較(1.4%のコストで98%のスコア)がクリエイター間で頻繁に引用されている。
  • 日本語チャンネル(AI時短ラボ)もGLM-5.3のような中国発オープンウェイトモデルを速報的に取り上げており、話題のタイムラグは英語圏よりやや遅れる程度(発表から1〜2週間以内)。
  • Sakana AIのFugu Max / Fugu Ultra v2(2026年9月11日リリース)はニュースサイト・ブログでは報じられているが、本調査の時点でYouTube上に専用の解説動画はまだ見つからず、直近のFugu Ultra(初代)動画のみ存在する。
Limits
  • YouTubeの検索結果ページ(youtube.com/results?...)および動画ページ(youtube.com/watch?...)はJavaScriptレンダリングのため、WebFetchでは本文(タイトル・チャンネル名・再生回数・投稿日)が取得できず、フッターのみが返された。そのためWebSearch経由のスニペットとnoembed.com(タイトル・チャンネル名のみ返却)を組み合わせて情報を補完した。
  • 上記の理由で、正確な再生回数と登録者数は取得できなかった。日付も多くが「◯日前/◯週間前」という相対表現からの推定であり、一部動画は正確な投稿日を特定できていない。
  • Sakana AIの最新モデルFugu Max / Fugu Ultra v2(9/11リリース)を扱った専用のYouTube動画はまだ見つからなかった。ニュースサイトの記事内リンクやプレイリストのみで、動画自体の有無は未確認。
  • 完了基準にある「10件」は満たしたが、そのうち1件(Sakana Fugu Ultra)は初代モデルの動画であり、最新のv2発表そのものを扱った動画ではない点に留意されたい。

Bluesky

Bluesky — モデル発表は「ボット的な速報」で流れ、Navier-Stokes騒動とSakana AIの「オープンウェイト陣営」宣言が目立つ

注記(収集方法について)

Bluesky公式の全文検索API(public.api.bsky.app/xrpc/app.bsky.feed.searchPosts)とWeb版検索(bsky.app/search)は、このセッションのfetchツールからは前者がHTTP 403、後者がJavaScript未実行のため空の内容しか取得できなかった(詳細は「Limits」)。そのため、Web検索でbsky.app上の関連投稿・アカウントを特定し、そこから判明したハンドルについてapp.bsky.feed.getAuthorFeed(これは200で応答した)を読むことで投稿本文・日付・いいね数・リポスト数を確認する方式で収集した。

Accounts
アカウント 属性 リンク
Ethan Mollick (@emollick.bsky.social) Wharton教授。フロンティアモデルの実務インパクトについて毎日のように長文スレッドを投稿 https://bsky.app/profile/emollick.bsky.social
🚨 AI News | TestingCatalog (@testingcatalog.com) 新モデル・新機能のリリースを1行速報形式で投稿するAIニュース速報アカウント https://bsky.app/profile/testingcatalog.com
Sakana AI (@sakanaai.bsky.social) 東京拠点、オープンウェイト+マルチエージェント・オーケストレーションを掲げる研究ラボの公式アカウント https://bsky.app/profile/sakanaai.bsky.social
hardmaru / David Ha (@hardmaru.bsky.social) Sakana AI共同創業者。公式発表スレッドの投稿者 https://bsky.app/profile/hardmaru.bsky.social
Quantian (@quantian.bsky.social) OpenAIのNavier-Stokes関連疑惑を皮肉った投稿で言及数が伸びていた個人アカウント https://bsky.app/profile/quantian.bsky.social
Zach Weinersmith (@zachweinersmith.bsky.social) サイエンスコミック作家。同騒動の経緯をスレッドで解説 https://bsky.app/profile/zachweinersmith.bsky.social
ardalis / Steve Smith (@ardalis.com) 開発者。Claude Opusを揶揄する短文ジョーク投稿 https://bsky.app/profile/ardalis.com
Posts
  1. Sakana AI(@sakanaai.bsky.social)/2026-09-11T20:43Z/いいね9・リポスト1
    https://bsky.app/profile/sakanaai.bsky.social/post/3mvbglsna4k25

    「Fugu Max is live on Open Router! 🐡 Our learned multi-agent orchestration engine routes tasks across open-weights and specialized models for Pareto-frontier efficiency.」
    OpenRouter上でFugu Maxを公開したという告知。オープンウェイトモデルと専用モデルを組み合わせて最適配分するオーケストレーション路線を明示。

  2. hardmaru(@hardmaru.bsky.social、Sakana AI共同創業者)/2026-09-11T02:57Z/いいね48・リポスト5
    https://bsky.app/profile/hardmaru.bsky.social/post/3mv7kz2uplk2u

    「Introducing Fugu Max and Fugu Ultra v2: Orchestrating the Pareto Frontier. The AI industry has spent a decade optimizing along a single axis: build bigger, more expensive models.」
    続く投稿では「Fugu Ultra v2 does all of this without Fable 5, Fable 5.1, or GPT-6-Astra in its agent pool」と明言し、Anthropic・OpenAIのフロンティアモデルに依存しないことを強みとして打ち出している。今日見つけた中で最も明確な「オープンウェイト陣営」の立場表明。

  3. TestingCatalog(@testingcatalog.com)/2026-09-11T07:38Z/いいね1・リポスト1
    https://bsky.app/profile/testingcatalog.com/post/3mva2p4ykhd2s

    「OpenAI launches ChatGPT for Financial Services」
    金融機関向けにGPT-6 Astraを組み込んだリサーチ・モデリング・資料作成用途のChatGPTを提供開始、という速報。

  4. TestingCatalog(@testingcatalog.com)/2026-09-10T20:45Z/いいね0・リポスト0
    https://bsky.app/profile/testingcatalog.com/post/3mv6waz3vpu2t

    「OpenAI launches GPT-Live-1 for full-duplex voice agents」
    同時に聞き取り・発話ができるフルデュプレックス音声モデルの新規リリース速報。

  5. TestingCatalog(@testingcatalog.com)/2026-09-03T09:19Z/いいね2・リポスト0
    https://bsky.app/profile/testingcatalog.com/post/3mum4nfbitu2n

    「Google releases Gemini 3.8 Flash and Flash Cyber」
    コーディング・エージェント・多段推論向けのGemini 3.8 Flashと、脆弱性発見・修正に特化し「信頼された防衛関係者限定」のFlash Cyber亜種を同時発表。

  6. TestingCatalog(@testingcatalog.com)/2026-09-02T00:00Z/いいね2・リポスト0
    https://bsky.app/profile/testingcatalog.com/post/3muimw7yugw2q

    「Anthropic launches Claude Fable 5.1 and Mythos 5.1」
    一般向けのFable 5.1と、「vetted defenders and scientists」限定のMythos 5.1を同時発表。キャッシュコスト低減と性能向上を伴うとの説明。

  7. Ethan Mollick(@emollick.bsky.social)/2026-09-11T17:38Z/いいね40・リポスト6
    https://bsky.app/profile/emollick.bsky.social/post/3mvb4b7idf22v

    「Here's a automated forecasting system to estimate catastrophic risk from some major experts on forecasting. The models predicts the chance of an AI-generated mass catastrophe as 0.47% by 2030...」
    AIによる大規模災害の確率を専門家の予測手法で自動推定するシステムの紹介。続く返信で「政策的介入なしを仮定した数字」と注記。

  8. Ethan Mollick(@emollick.bsky.social)/2026-09-11T04:59Z/いいね65・リポスト2
    https://bsky.app/profile/emollick.bsky.social/post/3mv7rswik2s2v

    「Astra's turn: 'Make a game about Imminence...'」
    GPT-6 Astraに作らせたゲーム制作のデモ投稿。前日投稿していたClaude Fable 5.1版ゲームと並べて、両モデルの創作力を比較する文脈で語られている。

  9. Ethan Mollick(@emollick.bsky.social)/2026-09-10T17:32Z/いいね117・リポスト18
    https://bsky.app/profile/emollick.bsky.social/post/3mv6lhq5lyc2v

    「What you are seeing in math right now is a consequence of the [frontier models' capability jump]...」
    数学者のAI利用と、AIが超人的な証明を発見しつつあることの意味を論じたスレッドの一部。Reddit(r/singularity)で拡散したNavier-Stokes騒動と同じ文脈で読まれている、今回収集した中で最もいいね数の多い投稿。

  10. Quantian(@quantian.bsky.social)/2026-09-08T07:13Z
    https://bsky.app/profile/quantian.bsky.social/post/3muyhwbcdys2x

    「Dancing very very VERY close to saying 'OpenAI stole our almost-complete proof of Navier-Stokes from internal access to our ChatGPT sessions because they were desperate to scoop Anthropic' which is absolutely 100% a believable thing OpenAI would do right now」
    数学者Buckmaster・Alpogeらのミレニアム賞級の成果をOpenAIが「ChatGPTのセッション履歴から盗んだのでは」という疑惑を扱った投稿(Reddit r/singularityの同日スレッドと同一の話題)。

  11. Zach Weinersmith(@zachweinersmith.bsky.social)/2026-09-08T09:45Z
    https://bsky.app/profile/zachweinersmith.bsky.social/post/3muyqfsvt6k2f

    「For anyone not following the drama, there's been apparently a big development in ai math, along with some accusations of very bad behavior by OpenAI. ... Buckmaster and Levent Alpoge made a big discovery on Navier-Stokes.」
    上記騒動の経緯をまとめた解説スレッドの冒頭。

  12. ardalis / Steve Smith(@ardalis.com)/2026-09-10T12:35Z
    https://bsky.app/profile/ardalis.com/post/3mv62uanbkk2b

    「LOL #ai #claude opusfived.dev」
    詳細不明だが、Claude Opus関連の何かを揶揄する短文ジョーク投稿。文脈(リンク先ドメイン名”opusfived”)から新しいOpusのバージョンに触れたミームと見られる。

Signals
  • Bluesky上のLLM言説は「実務者の分析」と「速報ボット」が中心で、Xで見られた「Claudeの兵器転用」のような炎上・地政学ネタは今回見つからなかった。 TestingCatalogのような速報アカウントが新モデル・新機能を淡々と列挙し、Ethan Mollickのような実務者アカウントがその使用感や社会的インパクトを論じる、という二層構造。
  • オープンウェイト陣営の立場表明が今日はSakana AIから明確に出ている。 hardmaru(Sakana AI共同創業者)が「Fugu Ultra v2はFable 5・Fable 5.1・GPT-6-Astraのいずれにも依存しない」と明言し、フロンティア閉鎖モデルへのロックインを避けるマルチエージェント・オーケストレーションを売りにしている。これはX/Redditの収集内容には出てこなかった、クローズド対オープンウェイトの対立構図の具体例。
  • Navier-Stokes/OpenAI疑惑はBluesky・Redditの双方で同じ2026-09-08前後に語られている。 数学・AI論客の層(Quantian、Zach Weinersmith)がプラットフォームを問わず同じ話題を拾っており、クロスプラットフォームで一番裏取りが取れた話題と言える。
  • エンゲージメント規模はXと比べて一桁以上小さい。 今回確認できた最大のいいね数はEthan Mollickの117(#9)で、Xで確認された数千いいねの投稿とは規模が違う。Blueskyはこの話題では「量より質」の技術者・観測者向けチャンネルという位置づけに見える。
Limits
  • 公式検索API(app.bsky.feed.searchPosts)はこのセッションのfetchツールから終始HTTP 403で、キーワードでの全文検索は実行できなかった。 app.bsky.actor.getProfileapp.bsky.feed.getAuthorFeedは同じドメインで200を返したため、検索エンドポイントのみ塞がれている可能性がある。Web版のbsky.app/search・埋め込みページもJavaScript実行前のHTMLしか取得できず、投稿一覧は読めなかった。
  • 上記の制約のため、収集は「Web検索でbsky.app上の関連リンクを見つけ、判明したアカウントのフィードを遡る」という間接的な方法に依った。 プラットフォーム全体をキーワードで網羅したわけではなく、たまたまWeb検索に引っかかったアカウント(Mollick、TestingCatalog、Sakana AI等)に収集範囲が偏っている。DeepSeek・Qwen・Llama・Mistralなど中国系・Meta系オープンウェイトモデル単体を継続的に発信しているBluesky上のアカウントは、今回の方法では見つけられなかった。
  • 「今日(2026-09-12)」に投稿された内容は見つからなかった。 最新の投稿は2026-09-11で、検索エンジンのインデックス遅延のためか、当日分はこの収集方法では見えていない。
  • 見つけられた投稿は12件で、いいね・リポスト数を確認できたのは10件(残り2件はoEmbed経由でテキストのみ取得、カウントは未確認)。 完了基準の「10件、日付とリンク付き」は満たしているが、母数としては限定的である。

Lemmy

Lemmy — 今日いちばん語られていること

Communities
  • [email protected](購読者 87,981人)— 一般テック系ニュースの本流。今日はAnthropicの脅威インテリジェンス報告が最上位級の話題に。
  • [email protected](購読者 5,132人、日間アクティブ7人)— オープンウェイトモデルの実運用・ベンチマーク議論の中心。lemmy.world、piefed.zip、lemmus.org、lemmy.ml、aussie.zone、lemmy.dbzer0.com、lemmy.zip など多数のインスタンスに連合。
  • [email protected](購読者 4,820人)— Free Open-Source AI。LLMリーダーボードや開発者向けリンク集を持つコミュニティ。
  • [email protected](購読者51人、うちローカル1人)— Reddit(r/ArtificialIntelligence, r/ClaudeCode等)のRSSを自動転載するボットコミュニティ。スコアはほぼ0〜1で、Lemmy独自の議論は起きていない。
  • !ukraine@(lemmy.world系) — 地政学コミュニティだが、AI悪用のセキュリティ報道がクロスポストされ話題化。
Posts
  1. Users in Houthi-held Yemen tried to develop advanced weapons with AI, Anthropic says[email protected]、スコア12、2026-09-11。Anthropicのレポートを引用したYahoo Finance記事のクロスポスト。 https://ca.finance.yahoo.com/news/users-houthi-held-yemen-tried-184240958.html
  2. Russia-linked hackers used Claude agents to target Ukraine and steal military drone technology, Anthropic report finds — !ukraine、スコア15、2026-09-11。The Insiderの報道で、Anthropicの脅威レポートを取り上げたもの。今日のLemmy全体でAI関連としては最高スコア級。 https://theins.press/en/news/297072
  3. Trump dismisses AI extinction risks as more than a dozen OpenAI, Anthropic insiders call for a slowdown — !ai_reddit(CNBC記事のミラー)、スコア1、2026-09-11。 https://www.cnbc.com/amp/2026/09/11/trump-ai-extinction-risks.html
  4. Hawley Probe Into AI Breakout Called an Important Step, But 'Only a Start' — !pravda_news、スコア1、2026-09-11。OpenAIに対する議会調査についてのCommonDreams記事。 https://www.commondreams.org/news/josh-hawley-openai-investigation
  5. NanoFlare Fits Qwen 3.8 27B On An 8GB GPU[email protected]、スコア2、2026-09-09。量子化・省メモリ化の実践報告。 https://lemmy.world/post/51731499
  6. Benchmarking Qwen3.8 27B quantizations: 4-bit holds up, 1-bit collapses — !localllama、スコア21・コメント10、2026-09-08。4bit量子化は実用的だが1bitでは性能崩壊、という検証結果。 https://piefed.zip/c/[email protected]/p/1805947
  7. K2 Horizon: Open-Source Model Family(IFM発)— !localllama、スコア65・コメント24(!fosaiにも同時投稿、スコア8)、2026-09-04。0.9B〜375Bまで6サイズのモデル一式をApache 2.0で公開、中間チェックポイントや学習データ構築レシピまで開示という太っ腹なリリースが好評。 https://ifm.ai/blog/k2
  8. Qwen3.8-Flash-Next sounds like Claude and I hate it[email protected]、スコア31(downvote4)・コメント9、2026-08-30(12日前)。Alibabaの新モデルがClaude風の「儀式的で回りくどい」口調を真似し始めたことへの不満。コメント欄では「Qwenはコード、Gemmaはそれ以外」という住み分け論も。 https://lemmy.dbzer0.com/post/74741490
  9. Release v0.4.0 · ggml-org/llama.cpp[email protected]、スコア28、2026-09-04。ローカル推論エンジンのアップデート告知。 https://lemmus.org/post/25155737
  10. zai-org/GLM-5.3 · Hugging Face (753b-a40b?)[email protected]、スコア19、2026-08-28。GLM-5.3の重みに関する議論。 https://lemmus.org/post/24977768
  11. "All LLMs should be GPL"[email protected]、スコア1・コメント0、2026-09-11(8時間前、u/TrekCZの転載)。GPLコードで学習したLLMはGPLで公開すべきという主張だが、Lemmy側では反応なし。 https://lemmy.durstig.online/post/59438
  12. Market size of Open-Source models[email protected]、スコア1・コメント0、2026-09-11(5時間前)。HuggingFaceのデータから、オープンソース系は年間AI学習支出の3.2%(テキストLLM+拡散モデルで約2.5億ドル、アダプター系5,600万ドル)にすぎないと試算。GPU P2Pマーケットプレイスの構想も。 https://lemmy.durstig.online/post/59444 (関連: https://lemmy.durstig.online/post/59487)
Signals
  • クローズド勢の話題は「安全保障・乱用」文脈が中心:今日Lemmyで最もスコアを稼いだAI関連投稿は、新モデル発表そのものではなく、Anthropicの脅威インテリジェンスレポート(フーシ派のAI兵器開発試行、ロシア系ハッカーのClaude悪用)。!technologyや!ukraineのような一般コミュニティにクロスポストされることでスコアが伸びている。
  • オープンウェイト勢はLocalLLaMAが本拠地:Qwen3.8系の量子化・省メモリ化、Kimi K2/K3、GLM-5.3、K2 Horizon(IFM、0.9B〜375B・Apache 2.0)など、モデルそのものの実運用報告が続く。K2 Horizonのような「中間チェックポイントや学習データレシピまで公開」する太っ腹なリリースは特にスコアが高い(65)。
  • Qwenの「Claude化」への反発:Qwen3.8-Flash-Nextがベンチマークは良いのにClaude的な回りくどい口調を真似し始めたことに、LocalLLaMA住民から明確な不満が出ている。クローズドモデルの「話し方」自体がオープンウェイト界隈でネタ・批判の対象になっている点が興味深い。
  • Lemmy独自の議論は薄い:!ai_reddit(durstig.online、購読者51人)はReddit RSSの自動転載ボットで、スコアはほぼ0〜1、コメントもゼロが大半。今日のニュースサイクル(GPT-6 Astra、Claude Fable/Mythos 5.1、Gemini 3.8 Flashなど大手の新モデル発表)そのものについて、Lemmy発の一次的な議論はほぼ見当たらなかった。
Limits
  • 10件の「最新の投稿」を厳密な時系列トップ10として揃えることはできず、!localllama(オープンウェイト系)と一般ニュースクロスポスト(クローズド系)を横断して12件を選んだ。Lemmyの検索APIはキーワードごとの断片的な結果しか返さず、単一の「今日のLemmy全体トップ10」を得る手段がないため。
  • 今日(2026-09-12)付けで投稿された内容はほぼ見つからず、直近の投稿は2026-09-11(一部は2026-09-04〜08)が中心。Lemmyは他SNSに比べ更新頻度が低く、これは規模の小ささによるものと考えられる。
  • piefed.zip上の投稿2件(K2 Horizonの元スレ、Kimi K3スレ)は直接アクセスするとHTTP 403が返り、本文・コメントの詳細は取得できなかった(lemmy.world側のミラー情報で代替)。
  • lemmy.ml、lemm.eeを含む検索は試みたが、有意な追加結果はlemmy.world API検索および各インスタンス直接アクセスで得られた情報でほぼ網羅されたと判断した。
  • GPT-6 Astra、Claude Fable/Mythos 5.1、Gemini 3.8 Flashなど今週の大型モデル発表そのものについて、Lemmy上で直接言及した投稿は見つからなかった(他SNSでの話題が中心と推測される)。

推奨アクション

  • Anthropicの脅威インテリジェンスレポートの原文を確認し、兵器転用・監視利用の主張の一次ソースを裏取りする。
  • X向けの検索語を接続元のトレンドに依存せず、OpenAI・Google・Meta・xAI・Mistralなど社名を明示した固定リストに切り替える。
  • Reddit収集は「Daily LLM News」に加えてモデル名・企業名を含む検索語を併用し、新モデル発表そのものを拾えるようにする。
  • Sakana AI Fugu Max/Ultra v2とOpenAI Astraの動向を次回以降の収集で継続的に追跡する。
  • BlueskyのsearchPosts APIの403問題が解消しているか次回確認し、解消していれば直接検索に戻す。
  • ナビエ–ストークス疑惑についてOpenAIの公式声明が出ていないか、次回収集で優先的に確認する。

データ品質メモ

Xは検索トレンドがLLMブリーフに最適化されておらず完了基準の10件中6件しかLLM関連が得られず、Reddit・Lemmyは件数は満たしたが対象期間が「今日」より広く分散しており、Blueskyは公式検索APIが403で塞がれ間接的な収集に偏った。