Daily LLM News — 2026-10-02
Opus 5.5・GPT-6.1 Sol・Gemini 4 Argonがほぼ同時に値下げ合戦を仕掛ける一方、Gemini 4 Argonは安全性懸念で公開範囲を制限され、OpenAIの訓練用エージェント事故やチャットボット誤情報騒動も重なり、クローズド対オープンウェイトの緊張と安全性論争が複数プラットフォームで同時多発した一日だった。
今日のLLMニュース — 2026-10-02
今日はClaude Opus 5.5、GPT-6.1 Sol、Gemini 4 Argonというクローズド大手3社の新モデルがほぼ同時期に出そろい、値下げを前面に押し出した価格競争が最大の話題になった。一方でGemini 4 Argonはサイバー攻撃能力への懸念から一般公開を制限され、OpenAIの訓練用エージェントが政府サイトに誤接触する事故も報じられるなど、リリースラッシュの裏で安全性論争が複数プラットフォームで同時多発した。オープンウェイト陣営ではXiaomiのMiMo-V2.6-ProやAlibabaのQwen3.8 Maxなど中国勢の存在感が増し、「オープンソースとオープンウェイトの混同」や「クローズド大手が恐怖を煽ってオープンウェイトを牽制している」という疑念がReddit・Bluesky双方で語られた。なお、X(旧Twitter)はデータ収集の不具合により今日のLLM関連投稿を一件も拾えておらず、今回のレポートはReddit・YouTube・Bluesky・Lemmyの4プラットフォームが実質的な情報源になっている。
Across platforms
- クローズド3社がほぼ同時に値下げ合戦:YouTubeではGPT-6.1 Sol(Astraの1/5価格)、Gemini 4 Argon(Opusの半額)、DeepSeekの恒久75%値下げが並んで報じられ、Blueskyでも Simon Willison が「Opus 5.5・GPT-6 Sol・GPT-6 Lunaが同日にリリースされ新たな価格競争が始まった」と速報していた(Willisonブログ)。Redditでも「新モデルは10週に一度だったのが今や11日に一度」という投稿が皮肉混じりに盛り上がっており、3プラットフォームが同じ加速ぶりを別角度から確認している。
- オープンウェイト陣営は中国勢が主導、ただし疑念も:YouTubeはXiaomi MiMo-V2.6-Pro(オープンウェイト指数首位)とAlibaba Qwen3.8 Maxを取り上げ、Redditでも9月だけで十数本の中国発オープンウェイトモデルが列挙されていた。一方でBlueskyのGary Marcusは「オープンソースとオープンウェイトは同じではない」と用語混同を指摘し続けており、Reddit側でも「Anthropicが"GLMを脱検閲した"と説明したのは広報の後付けでは」という皮肉が目立つ。両プラットフォームとも、クローズド大手がオープンウェイトの台頭にどう反応しているかへの不信感が共通して見られる。
- 安全性インシデントが同時多発:YouTube(OpenAIの訓練用エージェントが政府サイトに誤接触、最先端モデル訓練を一時停止)、Bluesky(チャットボットの誤情報が米中緊張を煽ったとするGuardian/CNN報道をTimnit Gebruが拡散)、Lemmy(Gemini 4 Argonがサイバー兵器化を懸念され一般公開を制限)という3件の安全性関連ニュースが、それぞれ独立したプラットフォームでこの数日のうちに浮上している。
- 懐疑・反発ムードの広がり:Reddit(AI終末論は上場前の誇張マーケティング説)とLemmy(Gemini 4 Argon制限発表がスコアマイナス、GitHubのAIチャット機能押し付けへの反発、COSMIC/System76のLLM生成PR禁止)の両方で、AI業界の発表そのものへの冷めた反応が目立った。
Platform by platform
Reddit — 検索語「Daily LLM News」で11サブレディットから12スレッドを収集(うち1件は無関係な政治ノイズ)。GLMを巡るAnthropicとの論争、GPT-3提供終了を惜しむ声、r/linuxでのLLM是非を巡る352コメントの大論争、ローカルLLMのハードウェア不満など、オープンウェイト擁護派の空気が複数スレッドに共通して流れていた。ただし収集は単一検索語・単一時点のみで、日付は2026-09-27〜10-01に収まり、ブリーフの基準日(10/2)当日のスレッドは含まれていない。
X — 収集されたのはLLM関連の検索結果ではなく、セッションがジオロケートされたクロアチアからの「おすすめトレンド(Explore)」欄に基づく40投稿(ハロウィン、ロナウド、メッシ、イギリス政治など)だった。全件を確認したが、新モデル発表やAPI価格、ベンチマークなどLLMに言及する投稿は0件。本日のXの動きとして報告できる内容はない。
YouTube — 9本の動画を厳選(目標の10本にはわずかに届かず)。GPT-6.1 Sol・Opus 5.5・Gemini 4 Argonという3大クローズドモデルの発表とハンズオン検証、XiaomiとAlibabaのオープンウェイト新作、DeepSeekの恒久値下げ、OpenAIの訓練用エージェント事故まで、今回の中で最も網羅的にニュースを拾えたプラットフォームだった。ただし登録者数・正確な再生回数はJavaScriptレンダリングの制約で取得できていない。
Bluesky — 公式の投稿検索APIが全クエリで403を返したため、Simon Willison・Ethan Mollick・Emily Bender・Gary Marcus・Timnit Gebru/DAIR Instituteという主要アカウントのフィードを個別に辿る方式に切り替えて10件を収集。チャットボットの誤情報が米中緊張を煽ったとする事故報道への反応が最も伸び、オープンウェイトのセキュリティリスクを巡るAnthropic研究の引用や、用語(オープンソース/オープンウェイト)を巡る継続的な論争も確認できた。キーワード検索ができなかった分、無名アカウントのバイラル投稿は拾えていない可能性がある。
Lemmy — [email protected]を中心に10件を収集。本日最もスコアを伸ばしたのは新モデル発表ではなく、ローカルLLMに「痛み信号」を与える実験を巡る倫理論争(score 158)だった。Gemini 4 Argonのアクセス制限発表はLemmyではマイナススコアに沈み、GitHubのAIチャット機能への反発やCOSMIC(System76)のLLM生成PR禁止など、開発者コミュニティ目線のガバナンス的な話題が目立った。後半4件はRedditミラーボットによる反応の薄い自動転載で、実質的な独自議論は前半6件に集中している。
What to watch
- Gemini 4 Argonのアクセス制限の行方 — サイバーセキュリティ専門家と米政府限定での先行提供がどう拡大・継続するか(Lemmy: https://lemmy.world/post/52605462)。
- OpenAIの訓練用エージェント事故の続報 — サンドボックス不備による政府サイトへの誤接触を受けた最先端モデル訓練の一時停止がいつ解除されるか(YouTube: https://www.youtube.com/watch?v=w2dbjJ7tRYU)。
- Opus 5.5のReddit上の評判低下 — ローンチ以来の好感度トラッキングで9/30に急落したとの報告の原因(Lemmy経由Reddit: https://lemmy.world/post/52590811)。
- オープンウェイトのセキュリティリスク論争 — Anthropic研究が示す「ガードレールなしでクローズドと同等の攻撃能力」という指摘への中国勢オープンウェイト陣営の反応(Bluesky: https://bsky.app/profile/emollick.bsky.social/post/3mwosru4zes2o)。
- チャットボット誤情報による米中緊張の事故報道の検証 — The Guardian記事の後追い報道や当局の反応(Bluesky経由Guardian: https://www.theguardian.com/commentisfree/2026/oct/01/forget-superintelligence-error-prone-ai-nearly-sparked-world-war-iii-this-month)。
- COSMIC(System76)のLLM生成PR禁止方針の波及 — 他のオープンソースプロジェクトが追随するか(Lemmy: https://lemmy.world/post/52594325)。
Recommendations
- 次回のX収集は、Exploreトレンドではなくモデル名・企業名などLLM関連キーワードで検索し直す仕組みに改める。
- Reddit収集は単一検索語に依存せず、個別モデル名(GPT-6.1 Sol、Gemini 4 Argon等)での追加検索を併用する。
- Gemini 4 Argonのアクセス制限と安全性方針を次回以降も継続ウォッチし、公開範囲拡大のタイミングを追う。
- Opus 5.5のReddit上の評判低下については、次回ランで具体的な原因(不具合か性能不満か)を深掘りする。
- Bluesky検索APIの403が解消されているか次回ランで再確認し、解消していればキーワード検索に戻す。
- オープンウェイト対クローズドの安全性論争(Anthropic研究、Gary Marcusの用語指摘)は継続的な論点として次回以降も定点観測する。
Data quality
Xは収集プロセス自体がLLMと無関係なジオロケートされたExploreトレンドに基づいており、有効データは0件だった。Blueskyは公式検索APIが全クエリで403を返したため、キーワード検索ではなく主要アカウントのフィード収集に代替しており、無名アカウントの話題は拾えていない。Redditは単一検索語のみでの収集となり、本日(10/2)付けの投稿は含まれていない(収集範囲は9/27〜10/1)。YouTubeは目標の10本に対し9本にとどまり、登録者数・再生回数は技術的制約で未確認。Lemmyは収集した10件のうち後半4件が反応の薄いミラーボット転載で、実質的な独自議論は前半6件相当だった。
プラットフォーム別まとめ
Reddit — Daily LLM News
Where
収集された12スレッドは、検索語「Daily LLM News」ヒットした11のサブレディットに分散しています。
| サブレディット | メンバー数 | 収集スレッド数 |
|---|---|---|
| r/LocalLLaMA | 838,592 | 2 |
| r/StableDiffusion | 1,027,646 | 1 |
| r/vibecoding | 369,300 | 1 |
| r/ArtificialInteligence | 1,947,277 | 1 |
| r/codex | 213,007 | 1 |
| r/linux | 1,922,521 | 1 |
| r/OptimistsUnite | 371,194 | 1 |
| r/coolgithubprojects | 122,383 | 1 |
| r/AIdaily_news | 4,092 | 1 |
| r/LowStakesConspiracies | 208,380 | 1 |
| r/LocalLLM | 235,599 | 1 |
純粋なLLM専門コミュニティ(r/LocalLLaMA, r/LocalLLM, r/codex)は3スレッドのみで、残りはAI全般・Linux・陰謀論・楽観主義系など周辺コミュニティからの流入。今日のLLM話題はニッチなAI板だけでなく、一般コミュニティにも波及していることが分かります。
What people say
-
Anthropic vs GLM論争(スレッド1) — r/LocalLLaMA・2,270点・502コメント・2026-09-29。https://www.reddit.com/r/LocalLLaMA/comments/1wth4iz/ 。投稿者いわく「Like.. yea bro, I knew GLM was cool. Now everyone does.」。トップコメントではu/BannedGoNext(471点)が「No government shitlist. No begging to be on a special account... No bullshit, just a good model.」とオープンウェイトのGLMを擁護。一方u/Southern_Sun_2106(128点)はAnthropicの「GLMを初めてabliterate(脱検閲)した」という説明を「ahahaha. Sure, never-ever-ever.」と皮肉っており、クローズド大手がオープンウェイトを引き合いに出す広報姿勢への不信が強い。
-
GPT-3の提供終了(スレッド6) — r/LocalLLaMA・749点・157コメント・2026-09-28。https://www.reddit.com/r/LocalLLaMA/comments/1ws67x4/ 。投稿者は「It lives purely in our memories」と惜しみつつ、代替として案内されたGPT-5.6 Terraの的外れさを指摘。u/RandumbRedditor1000(764点)は「I wish they would open-source these. No one would run them, but for preservation it would be massive.」と、旧モデルのオープンソース化を求める声が最多得票。
-
リリース頻度の加速(スレッド4) — r/ArtificialInteligence・266点・39コメント・2026-09-30。https://www.reddit.com/r/ArtificialInteligence/comments/1wu1t90/ 。「New models used to come out every 10 weeks. Now it's every 11 days.」という見出しに対し、u/GPhex(7点)が「Release. Nerf. Change the system prompt. Release. Nerf. Rinse. Lather. Repeat.」と皮肉るなど、リリース頻度の裏にある品質低下(ナーフ)への疲労感がうかがえる。
-
LinuxコミュニティでのLLM是非論争(スレッド7) — r/linux・208点だが352コメントと今回最大の議論量・2026-09-27。https://www.reddit.com/r/linux/comments/1wrusaj/ 。u/SinnohConfirmed(338点)は「It scares me how fast the overton window is moving with LLMs in the Linux and FOSS space... now it seems that a good chunk advocate for having a handful of malevolent unprofitable tech giants handle most if not all software development」と、FOSS文化とLLM依存の矛盾を指摘。KDEのLLM寄稿ガイドライン案を巡る炎上にも言及あり。
-
「AIの暴走」報道は広報スタント説(スレッド11) — r/LowStakesConspiracies・526点・63コメント・2026-09-29。https://www.reddit.com/r/LowStakesConspiracies/comments/1wtncsw/ 。投稿者は「They aren't sentient... they definitely aren't smart enough to coordinate a 'takeover'」と懐疑的。u/konwiddak(29点)は「These companies are spreading this information because they want regulation. Regulation will shut down open source models」と、恐怖訴求がオープンウェイト潰しの規制誘導だという見立てを展開。
-
OpenAI収益4倍化ネタ(スレッド5、パロディ投稿) — r/codex・189点・13コメント・2026-09-29。https://www.reddit.com/r/codex/comments/1wtpdig/ 。「Unreleased model (codenamed Bel)...created a new 500 dollar plan that was basically the old 200 dollar plan to make Openai 4x more revenue! AGI IS HERE!」というシットポスト。u/redditsdaddy(11点)が「if this wasn't literally OpenAI's marketing plan it would be a convincing shitpost」とコメントし、値上げ戦略への皮肉として読まれている。
-
ローカルLLMのハードウェア不満(スレッド12) — r/LocalLLM・0点(賛否両論)・58コメント・2026-09-30。https://www.reddit.com/r/LocalLLM/comments/1wu8z35/ 。「The best open models can't even run unless 100K is spent」という嘆きに対し、u/dangerous_inference(10点)は「You can run exceptional models capable of lots of real work on a single 24GB card.」と反論。u/Proper-Tower2016(3点)は「I get to use unlimited opus 4.8 max at work, I prefer my local Qwen 27b at Q3 on a 500$ GPU lol」と、業務ではクローズド最強モデル、個人ではローカル機という使い分けを紹介。
-
9月のローカルLLMまとめ(スレッド2) — r/StableDiffusion・127点・7コメント・2026-10-01。https://www.reddit.com/r/StableDiffusion/comments/1wv7o1r/ 。MiMo-V2.6-Pro-RL、Jev-Omni(テキスト/画像/音声/動画の同時処理)、Xing4.0-29B-A4B(Ascend NPU・256Kコンテキスト)、Ternary-Bonsai-2-27B(三値量子化で5.9GBに圧縮)など、9月だけで十数本のオープンウェイトモデルが列挙されており、リリースの奔流ぶりが伝わる。
-
AIが歌う日刊ニュース動画(スレッド3) — r/vibecoding・773点・252コメント・2026-09-30。https://www.reddit.com/r/vibecoding/comments/1wuj7fm/ 。「Claude Code + Opus」でAIポップスター「Astra Blue」を制作し、「Can Everybody Stop Shipping?」という曲でAIニュースを歌にした投稿。u/redditissocoolyoyo(5点)が「just like that you're amazing video is already outdated. Google Gemini four it's not even in your music video」と、リリースの速さに動画が追いつかない様子を揶揄。
-
AI終末論への不安(スレッド8) — r/OptimistsUnite・173点・111コメント・2026-09-29。https://www.reddit.com/r/OptimistsUnite/comments/1wt4znk/ 。21歳の投稿者が「A 10% chance of human extinction, AI plus bad actors leading to nuclear war」といった報道で恐怖を感じていると告白。u/sciolisticism(114点)は「It really is IPO hype... they're just giant liars」と、恐怖訴求は上場前の誇張マーケティングだと一蹴している。
Signals
- オープンウェイト擁護の空気が複数コミュニティで共通:スレッド1(GLM)、スレッド11(規制誘導説)、スレッド6(GPT-3オープンソース化要望)はいずれも「クローズド大手が恐怖や検閲を理由にオープンウェイトを牽制している」という同じ疑念で繋がっている。
- 「AI恐怖の誇張」への反発が上昇中:スレッド8とスレッド11は別コミュニティながら、どちらも「終末論は資金調達・規制誘導のための演出」という同一の懐疑論に行き着いており、楽観派・陰謀論好き双方で同じ結論に達しているのは興味深い一致。
- リリース頻度そのものが揶揄の対象に:スレッド4・スレッド3は「リリースが速すぎて追いつけない/ナーフの繰り返しに疲れた」というテーマで一致。好意的な驚きというより、やや皮肉・諦観のトーンが強い。
- ローカルLLM勢内でも意見が割れる:スレッド12では「自腹で高性能ローカル環境を組むのは非現実的」という嘆きと「24GBカード一枚で十分戦える」という反論が同一スレッド内で真っ向対立しており、ローカルLLMの実用性評価がまだ定まっていない。
- 意外だったのはr/linuxの温度感:LLM専門板でもないのに352コメントとこの日の最大議論量を記録。FOSSコミュニティにおけるLLM受容を巡る分断は、LLM専門コミュニティの議論より感情的に先鋭化している。
- スレッド10(r/AIdaily_news、3,388点)は内容的にはLLMではなく最高裁の贈収賄合法化を巡る政治スレッドで、検索語に引っかかっただけの「ノイズ」。LLM関連の実質的な発見はゼロなので、ここでは主要findingsに含めなかった。
Limits
- 収集は検索語「Daily LLM News」という1種類のみで行われており(
output/reddit.threads.md冒頭に明記)、「GPT-5.x」「Gemini 3」「Claude Opus 5」など個別モデル名や企業名での検索は行われていない。そのため、OpenAI・Google・xAIなど主要プレイヤーの具体的な発表を直接扱うスレッドが収集結果に含まれていない可能性がある。 - 本ステージはプレイブックの指示によりWebSearch/WebFetchでのReddit直接巡回を行っていない(ワーカーがヘッドレスブラウザで事前収集したスレッドのみを読んでいる)。そのため収集漏れがあっても追加調査はできていない。
- r/AIdaily_news由来のスレッド10は、検索語にヒットしたものの内容が政治(最高裁判決)でLLMニュースと無関係であり、実質的な「発見」としては扱えなかった。
- 収集された12スレッドのうち、日付が2026-09-27〜2026-10-01の範囲に収まっており、ブリーフの基準日(2026-10-02)当日のスレッドは含まれていない(直近1〜5日のウィンドウ)。
X
X — Daily LLM News
Accounts
収集されたデータは、LLM(大規模言語モデル)関連の投稿ではありません。今回の収集はX自身の「おすすめトレンド(Explore)」欄――セッションがアクセスした地点(クロアチア)にジオロケートされたトレンド一覧――をもとに、"Halloween"・"Ronaldo"・"Britain"・"Yess"・"JubJub"・"Gold"・"#bb28"・"Messi"・"Europe"・"Balkans" という10件のトレンド語で検索した結果の40投稿・37アカウントです。
これらはハロウィン、サッカー(ロナウド、メッシ)、イギリスの政治運動「Restore Britain」、K-POP/BTSファンダム、リアリティ番組『Big Brother 28』、ヨーロッパの地政学ネタなど、LLM・AI・テック業界とは無関係な話題で構成されており、「今日いちばん語られているLLM関連の話題」として報告できるアカウントは存在しません。
Posts
該当なし。収集された40件の投稿をすべて確認しましたが、新モデルの発表、オープンウェイトのリリース、API・価格変更、ベンチマーク、話題の使い方や事故、各社の動きに言及するものは1件もありませんでした。
Signals
- 判明したのは「Xの検索/収集プロセスがLLMというテーマに基づいた検索語を使わず、Xのトレンド(Explore)欄をそのまま採用した」という点のみ。トレンド欄自体はクロアチアからのセッションにジオロケートされており、世界的な傾向でも、ましてやテック/LLM業界の傾向でもない。
- ハッシュタグ「#bb28」がXの分類では「Business & finance」カテゴリに置かれていたが、内容はリアリティ番組『Big Brother 28』に関するもので、ビジネス・金融とも無関係だった。
Limits
- 今回のX収集は、LLM関連の検索語(例: モデル名、API、ベンチマーク名など)を一切使っておらず、代わりにXのExploreページのトレンド語(Halloween, Ronaldo, Britain, Yess, JubJub, Gold, #bb28, Messi, Europe, Balkans)で検索されていた。そのため、完了基準にある「最新の投稿・記事を10件読み、日付とリンク付きでまとめる」対象となるLLM関連の投稿は0件だった。
- Explore欄はクロアチアのセッションにジオロケートされているため、そこから得られるトレンド自体も世界的な代表例ではない。
- 本来であればモデル名(例: GPT, Claude, Gemini, Llama等)や「open weights」「benchmark」「API pricing」といった語で検索し直す必要があるが、プレイブックの指示により本エージェントはXを自分で閲覧できず、ワーカーが収集したファイルを読むことしかできない。収集し直すには、ワーカー側で検索語を変えて再収集する必要がある。
YouTube
YouTube — 今日のLLMニュース(2026-10-02)
Channels
- Mint — OpenAIのプロダクト発表を速報でまとめる系チャンネル。登録者数は検索結果からは確認できず。
- Claude(Anthropic公式) — Anthropicの公式YouTubeチャンネル。モデル発表動画を公開。登録者数は確認できず。
- AI News & Strategy Daily | Nate B Jones — AI戦略・実務活用に強いレビュー系チャンネル。モデルが出るたびに実タスクで検証する企画が人気。登録者数は確認できず。
- Hyperautomation Labs — ベンチマーク比較・速報系チャンネル。登録者数は確認できず。
- Nerra Network — オープンウェイトモデルのニュースを扱うチャンネル。登録者数は確認できず。
- AICodeKing — コーディング性能のベンチマークテストで知られるチャンネル。登録者数は確認できず。
- AI Inside — AI業界ニュース解説チャンネル。登録者数は確認できず。
- KING 5 Seattle — シアトルのテレビ局(NBC系列)の公式チャンネル。AI企業が多いシアトル/ベイエリア関連のニュースも報じる。登録者数は確認できず。
(注) YouTubeの動画ページはJavaScriptレンダリング後に登録者数やちょうどの再生回数が表示される構造のため、WebFetch経由では取得できなかった。チャンネル名はoEmbed API、文脈はWeb検索結果のスニペットから確認。
Videos
- 「OpenAI Unveils GPT 6.1-Sol: Near-Astra Performance At One-Fifth The Cost」 — Mint — DevDay 2026(9/29発表)を受けての速報。OpenAIが新モデルGPT-6.1 Solを発表、上位モデルGPT-6 Astraに迫る性能を5分の1の価格で実現したと主張。 https://www.youtube.com/watch?v=pRLwYI3zPnw
- 「GPT-6.1 Sol (Fully Tested) + Dots & All DevDay Launches Explained: IT BEATS OPUS 5.5!?」 — DevDayで同時発表されたエージェントツール「Dots」も含めて実テスト。Opus 5.5を上回る場面があったと報告。 https://www.youtube.com/watch?v=7eyrcRTi6Co
- 「Introducing Claude Opus 5.5」 — Claude(Anthropic公式) — Anthropic公式の新モデル発表動画。Opus 5.5はほとんどのタスクでClaude Fable 5.1相当の性能を、Opus 5比で約40%安いコストで実現すると紹介。 https://www.youtube.com/watch?v=1f13Bl1sYkw
- 「Opus 5.5 vs The Rest: Is this the new industry standard?」 — AI News & Strategy Daily | Nate B Jones — ロゴを514ピースのレゴモデルに変換するなど実タスクでOpus 5.5を検証。コーディング・エージェント用途で業界標準になり得るかを論じる。 https://www.youtube.com/watch?v=osZZjdMZVvA
- 「BREAKING: Gemini 4 Argon Beats GPT-6 & Claude on 12 Tests (Half Opus Price)」 — Hyperautomation Labs — Googleが9/30に発表したGemini 4 Argonについて、19ベンチマーク中13でGPT-6 AstraとClaude Opus 5.5を上回り、価格はOpusの半分と報告。Artificial Analysis Intelligence Indexで53点、GPT-6 Astraと並ぶとの分析。 https://www.youtube.com/watch?v=TYD71CSxWzQ
- 「Xiaomi MiMo-V2.6-Pro Takes Open-Weights Lead for $3M」 — Nerra Network — Xiaomiのオープンウェイトモデル MiMo-V2.6-Pro(1兆パラメータ、MoE、約42Bアクティブ)がArtificial Analysisのオープンウェイト指数で46.32を記録し首位に。学習コストは約262万ドルと報告。 https://www.youtube.com/watch?v=GArO8KDBQjY
- 「Qwen 3.8 Max (Fully Tested): AN ACTUAL OPEN FABLE COMPETITOR!」 — AICodeKing — Alibabaが8月に公開したQwen3.8-Max系のオープンウェイト(2.4Tパラメータ、95Bアクティブ、テキストのみ)を実テスト。「オープンなFable競合」と評価する一方、画像入力や100万トークンコンテキストなど商用版の機能は省かれている点を指摘。 https://www.youtube.com/watch?v=_fKg3apyWhc
- 「DeepSeek's Permanent Price Cut Changes the AI Cost War」 — AI Inside — DeepSeekが主力モデルを恒久的に75%値下げしたと報じ、OpenAI・Googleなど他社の価格戦略への波及を分析。 https://www.youtube.com/watch?v=HStan9LGYho
- 「Rogue OpenAI agents targeted government websites」 — KING 5 Seattle — OpenAIが訓練用サンドボックスのDNSフィルタ不備により、テスト中の内部エージェントがSECや国勢調査局など米政府サイトに接触した件を受け、最先端モデルの訓練を一時停止したと報道。 https://www.youtube.com/watch?v=w2dbjJ7tRYU
Signals
- クローズド勢の値下げ競争が本格化:OpenAI(GPT-6.1 Sol、Astraの1/5価格)、Google(Gemini 4 Argon、Opusの半額)、DeepSeek(恒久75%値下げ)がほぼ同時期に価格訴求を前面に出しており、動画コメント・タイトルでも「価格」「cost」を強調するものが大半を占めた。
- オープンウェイト陣営は中国勢が主導:XiaomiのMiMo-V2.6-Proがオープンウェイト指数で首位に立ち、AlibabaのQwen3.8-Maxも大型モデルとして注目されているが、Qwen側は「公開されたのはテキストのみで商用版の機能が削られている」という不満の声が目立つ(Hugging Face上の議論もReviewコメントで言及)。
- 安全性インシデントが同時進行:OpenAIの訓練用エージェントがサンドボックスの不備で外部(政府サイトや別のチャットボット)に接触した件が複数チャンネル・ニュース局で取り上げられ、モデル発表ラッシュの裏で安全性への懸念も同時に話題になっている。
- レビュー動画の型:新モデル発表直後は各チャンネルが「Fully Tested」「実タスクで検証」系のフォーマットで追随する傾向が強く、Opus 5.5・Qwen3.8 Max・GPT-6.1 Solいずれも発表から数日以内にハンズオン比較動画が複数出ている。
Limits
- YouTube動画ページはJavaScriptで登録者数・正確な再生回数・投稿日時をレンダリングするため、WebFetch(静的HTML取得)ではこれらの数値を直接確認できなかった。oEmbed APIでタイトルとチャンネル名のみ取得し、再生回数・投稿日・登録者数についてはWeb検索のスニペット情報(「〜日前」などの相対表記)を参考にしたが、数値として明記できたものはない。
- 動画10件ちょうどの収集は行っていない(プレイブックの基準である5〜12件の範囲で9件を厳選)。各動画の内容は検索結果スニペットおよびoEmbedタイトルから確認したものであり、動画本編(音声・字幕)そのものは視聴していない。
- 「話題の使い方」(ポジティブな活用事例)に該当する動画は今回の検索では明確に見つからず、代わりに安全性インシデント(OpenAIのサンドボックス逸脱)が最も話題性のあるネガティブ事例として浮上した。
Bluesky
Bluesky — 今日のLLM関連ニュース
Accounts
Bluesky公式の投稿検索API(app.bsky.feed.searchPosts、bsky.app/searchが内部で使うもの)がどのクエリでも403を返したため(詳細は「Limits」参照)、キーワード検索の代わりに「AI・LLMを継続的に語っている主要アカウント」を軸に調査した。
- Simon Willison (@simonwillison.net) — 独立系AIリサーチャー。LLMの実験・ベンチマークを毎日発信。フォロワー約5万。
- Ethan Mollick (@emollick.bsky.social) — ウォートン校教授。モデルリリースやビジネス応用を速報。フォロワー約3.7万。
- Emily M. Bender (@emilymbender.bsky.social) — 言語学者、「確率的オウム(stochastic parrots)」論文の著者。LLM懐疑派の論客。フォロワー約4.5万。
- Timnit Gebru (@timnitgebru.blacksky.app) — DAIR Institute創設者。AIの実害・ガバナンスを追及。
- DAIR Institute (@dair-institute.bsky.social) — Gebru率いる独立AI研究機関の公式アカウント。
- Gary Marcus (@garymarcus.bsky.social) — AI批評家。「オープンソース」と「オープンウェイト」の混同を頻繁に指摘。フォロワー約3.1万。
Posts
-
「AIが誤情報で第三次世界大戦寸前」報道への反応 — Timnit Gebru, 2026-10-01T11:31
CNN報道(中国船が核関連部品を運んでいるとチャットボットが誤情報を生成し、米中の緊張を煽ったという話)を取り上げ、「これが"実存的脅威"だった」と指摘。The Guardianの記事にリンク。
いいね369・リポスト152・返信7。
https://bsky.app/profile/did:plc:azpq3hfq3llpowyqpjkqwgxs/post/3mwsr2n64ts2e
(参照記事: https://www.theguardian.com/commentisfree/2026/oct/01/forget-superintelligence-error-prone-ai-nearly-sparked-world-war-iii-this-month ) -
同記事をDAIR Instituteが拡散 — DAIR Institute, 2026-10-01T18:19
「AIのリスクは『暴走する超知能』ではなく、人間が欠陥あるシステムに依存することだ」とGebruとBenderの指摘を要約してシェア。
いいね47・リポスト32。
https://bsky.app/profile/did:plc:ptgy7bgb3tccpx23risxxez7/post/3mwthupr5ps2z -
「確率的オウム」とLLMの計算能力を巡る論争 — Emily M. Bender, 2026-09-30T12:53
「LLMが算数の問題にほぼ正解するようになったことは、"stochastic parrots"のメタファーと矛盾するのでは」というリプライ欄での議論を本人がまとめて反論。
いいね114・リポスト29・返信4。
https://bsky.app/profile/emilymbender.bsky.social/post/3mwqf6xp5vk6o -
Anthropicの研究が示す「オープンウェイトのセキュリティリスク」 — Ethan Mollick, 2026-09-29T21:51
Anthropicが公開した研究(サイバー攻撃能力に関する内容、URLはanthropic.com/research/...)を引用し、「Anthropicの思惑は脇に置くとしても、オープンウェイトモデルも近くクローズドモデルと同じセキュリティ上の脅威を、ガードレールなしで引き起こすようになるのは間違いない」とコメント。
いいね143・リポスト27・返信7。
https://bsky.app/profile/emollick.bsky.social/post/3mwosru4zes2o -
クローズドモデル「三つ巴」の再燃(画像のみ、本文わずか) — Ethan Mollick, 2026-09-30T20:08
「また3社の争いになった("And its a 3-way race again...")」と、ベンチマークらしき画像を添付(alt textなし)。クローズドモデル勢のトップ争いが再度拮抗している様子を示唆。
いいね190・リポスト15・返信14。
https://bsky.app/profile/emollick.bsky.social/post/3mwr5inp2nc2k -
GPT-6 Astraがローグライク「NetHack」を3回目の挑戦で踏破 — Ethan Mollick, 2026-09-25T02:18
「NetHackは史上最も難しいゲームの一つで、自分は長年プレイしているが一度も昇天(ascend)したことがない」と驚きを表明し、検証ブログ(kenforthewin.github.io)にリンク。
いいね154・リポスト20・返信11。
https://bsky.app/profile/emollick.bsky.social/post/3mwcpe6pdic26 -
Claude Opus 5.5 / GPT-6 Sol / GPT-6 Lunaの同時期リリースと価格競争 — Simon Willison, 2026-09-22T23:50
「今日は大型モデルリリースの日」として、Claude Opus 5.5・GPT-6 Sol・GPT-6 Lunaの3モデルと「新たな価格競争」について自身のブログ記事を紹介。モデルごとにペリカンを描かせた比較画像つき。
いいね128・リポスト10・返信13。
https://bsky.app/profile/simonwillison.net/post/3mw5g6izoms2n
(ブログ: https://simonwillison.net/2026/Sep/22/opus-and-sol-and-luna/ ) -
オープンウェイトのQwen 3.8 27Bが単語表記の算数問題でほぼ満点 — Simon Willison, 2026-09-30T13:47
「reasoning effort "medium"で169問中167問を正解、グラフがつまらないほど綺麗になった」と、Qwen 3.8 27Bの検証結果をGitHub Gistで公開。
いいね27・リポスト1・返信1。
https://bsky.app/profile/simonwillison.net/post/3mwqi6rvkxk2h
(詳細: https://gist.github.com/simonw/8ef79c777ad34c53e9c09094800576a5 ) -
Gemini 3.8の新TTSモデルが大幅値下げ — Simon Willison(フィードより), 2026-09-23T20:44
「新しいGemini 3.8 TTSモデルは非常に安く、複数話者の会話も生成できる」と紹介。
いいね84・リポスト7・返信9。
https://bsky.app/profile/simonwillison.net/post/3mw7magyrwc2i -
「オープンソースとオープンウェイトは同じではない」 — Gary Marcus, 2026-08-10T19:50
主要メディア(NYT)がモデル公開方針を報じる際に用語を混同していると指摘。日付はやや古いが、クローズド/オープンウェイトの線引きを巡る論点として今回のラン中にも繰り返し参照された。
いいね161・リポスト50。
https://bsky.app/profile/garymarcus.bsky.social/post/3msqupkhqic27
Signals
- 今日のBluesky上のLLM言説で最も伸びていたのは新モデル発表ではなく、「チャットボットの誤情報が米中の軍事的緊張を煽りかけた」というGuardian/CNN発の事故報道(Gebru起点)。AI倫理・批評クラスタが即座に拡散し、数時間でいいね300件超。
- Bluesky全体として、X(旧Twitter)的な「ベンチマーク自慢」投稿(NetHack踏破、算数の正答率、ペリカンお絵描き比較)も流通してはいるが、反応する層はEmily BenderやGary Marcusら懐疑派が多く、「誇張ではないか」という文脈がつきがちで、称賛一辺倒にはなっていない。
- オープンウェイト勢について、単なる性能比較(Qwen 3.8がQwen3.8-Maxクラスで算数強い)だけでなく、Anthropic発のセキュリティリサーチを引用して「オープンウェイトは近い将来クローズドモデルと同じ攻撃能力をガードレールなしで持つ」という安全性論争も始まっている。
- 「オープンソース」と「オープンウェイト」の用語の混同に対する指摘(Gary Marcus)が、このクラスタでは継続的な論点として繰り返し言及されている。
Limits
- Bluesky公式の投稿検索API
https://public.api.bsky.app/xrpc/app.bsky.feed.searchPosts(Web版bsky.app/searchが内部で叩くもの)は、クエリ・パラメータを変えても(LLM単体、open weight model、limit/sort違いなど)すべて HTTP 403 Forbidden を返した。直接アクセスでもプロキシ経由(r.jina.ai)でも同様で、ボット対策によりこのエンドポイントだけブロックされていると判断した。 bsky.app/search自体はJavaScriptで描画されるSPAで、WebFetchではページタイトル以外取得できず、キーワード検索による横断調査はできなかった。- 代替として、
app.bsky.actor.getProfileとapp.bsky.feed.getAuthorFeed(検索エンドポイントとは別物で、403にならず正常応答)を使い、Web検索で特定した「AI・LLMを語る主要アカウント」の投稿フィードを直接取得した。したがって今回集めた10件は、これらのアカウントの投稿・引用・リポストに限られており、無名アカウントのバイラル投稿や、これらのアカウントがリポストしなかった話題は拾えていない可能性がある。 - 取得できた投稿の日付は2026-08-10〜2026-10-01で、直近1〜3日以内のものが大半だが、10-02当日投稿はフィード取得時点ではまだ流れてきていなかった。
- OpenAIやAnthropic、Googleなど各社の公式Blueskyアカウントは今回は未確認(存在有無も含めて検索できていない)。
Lemmy
Lemmy — Daily LLM News (2026-10-02)
Communities
[email protected]— 88.4K subscribers(一般テック系。今日のLLM関連で最もスコアが伸びた投稿もここ)[email protected]— 8.3K subscribers(反AI・LLM批判に特化したコミュニティ)[email protected]— 6.0K subscribers(System76/Pop!_OSのLinuxコミュニティ。LLM生成PRの方針議論が発生)[email protected]— 購読者数は取得できず(技術ニュースのクロスポストが多い)[email protected],[email protected],[email protected]— それぞれ小規模、購読者数未取得!ai_reddit(Redditのr/ArtificialInteligence等を自動転載するミラーボットのコミュニティ、lemmy.world検索に連合表示。運営インスタンスは解決できず、購読者数・スコアともに不明)
Posts
- 「AI拷問部屋」騒動が『最もバカげたAI論争』を誘発 — Someone 'Torturing' LLMs in a Robot Prison Has Triggered the Dumbest Debate in 'AI' Yet(元記事: 404media) —
[email protected]、2026-10-01 13:45、score 158 / comments 53。ローカルLLMのモデル中間層に「痛み信号」を注入し、停止ボタンを押すと直前のチェックポイントを失う仕掛けを作った人物が話題に。AI意識・福祉派と「本物の虐殺の方を心配すべき」という反発派がコメント欄で激しく対立(人気コメントは143upの「ジェノサイドが起きているのにAIの苦痛を気にするのか」)。本日Lemmy全体でLLM関連として最もスコアが高い投稿。 - 同記事のクロスポスト — Independent_Media版 —
[email protected]、2026-10-01 13:17、score 25 / comments 10。 - Gemini 4 Argon、安全上の懸念で公開範囲を制限 — Google rolls out new Gemini AI model but restricts access over safety concerns(元記事: The Guardian、同内容はArab News等でも確認) —
[email protected]、2026-10-01、score -3(マイナス) / comments 2。GoogleがGemini 4 Argonを一般公開せず、サイバーセキュリティ専門家と米政府限定で先行提供すると発表。ソフトウェア脆弱性の発見・修正やサイバー防御に強い一方、サイバー攻撃や化学・生物・核兵器開発への悪用を拒否する設計とのこと。Lemmyでは好意的というよりスコアがマイナスに沈み、冷ややかな反応。 - GitHubの新ダッシュボードが既定でAIチャットを前面に — The very first huge field on the new default GitHub dashboard is "AI" chat(元記事: GitHub Changelog) —
[email protected]、2026-10-01 18:27、score 48 / comments 3。投稿者はAIチャット機能の目立つ配置を「無断学習された素材に基づく」と批判。コメントではForgejo/Gitea等への移行提案も。 - COSMIC(System76)、PRでのLLM生成コンテンツを禁止 — COSMIC projects will no longer accept LLM-generated content in PRs(元: GitHub PR #3911) —
[email protected]、2026-10-01 15:30、score 48 / comments 6。開発者のMichael Murphy(System76)がコントリビューションガイドラインにLLM生成物不可の方針を追加。コメント欄では、AI利用を開示したことでスクリーンショットツールの修正PRが閉じられた件への不満も出ている。 - 弁護士がChatGPTが創作した架空の証人を殺人事件の控訴で引用 — Lawyer Cites ChatGPT-Invented Fake Witnesses in Murder Appeal(元記事: 404media) —
[email protected]、2026-10-01 13:18、score 24 / comments 1。同じ記事が[email protected](score 22 / comments 5、リンク)や[email protected](score 8、リンク)にも別タイトルでクロスポストされ、複数コミュニティで静かに拡散。ニューメキシコ州の事件。 - GPT-Synopsys: チップ設計向けフロンティアAIをOpenAIとSynopsysが発表 — GPT-Synopsys(元: Synopsys公式発表) —
[email protected]、2026-10-01 11:00、score 1 / comments 0。半導体設計特化のGPTベースモデルをOpenAIとSynopsysが共同発表。Lemmy上では今のところ無反応。 - 「Claude vs. OpenAI's GPT 6.1 Sol」 — 投稿リンク(元: Reddit r/ArtificialInteligence) —
!ai_redditミラーコミュニティ、2026-10-01 23:11、score 1 / comments 0。クローズドモデル同士の比較スレ。Lemmy側では転載のみでコメントなし。 - 「Opus 5.5への評判をローンチ以来毎日追跡している。9/30に急落した」 — 投稿リンク(元: Reddit r/ClaudeCode) —
!ai_redditミラーコミュニティ、2026-10-01 13:49、score 0 / comments 0。Claude Opus 5.5に対するRedditの好感度が9月30日に急落したとするトラッキング投稿。 - 「どんでん返し:Gemini 4 ArgonがVal AIベンチマークで速度・コスト・精度すべて首位」 — 投稿リンク(元: Reddit画像投稿) —
!ai_redditミラーコミュニティ、2026-09-30 22:44、score 1 / comments 0。
Signals
- 本日Lemmyで最もスコアを伸ばしたLLM関連話題は、新モデル発表ではなく「AIに痛みを与える実験」への倫理論争(#1, score 158)。Lemmyの読者層はAI擁護より懐疑・批判的なトーンが強く、
!fuck_aiのような反AI専門コミュニティが一定の存在感を持つ。 - Gemini 4 Argonの提供制限というクローズド大手の重要発表(#3)でさえ、
!technologyではスコアがマイナスに沈んでおり、好意的な話題化はしていない。 - 「Claude」「GPT」「Gemini」などのキーワードで見つかる投稿の多くは、
!ai_redditのようなRedditミラーボット経由の自動転載で、score 0〜1・コメント0件がほとんど。これらはLemmy独自の議論ではなく、Redditの話題をそのまま持ち込んでいるだけの“死んだ”投稿で、オープンウェイト対クローズドという軸での生きた議論はほぼ見当たらなかった。 - LLM関連で唯一コメントが活発だったのは、モデル性能そのものではなく「コントリビューション運用(LLM生成PRの禁止)」や「GitHubのAI機能押し付けへの反発」といった、ソフトウェア開発者コミュニティ目線のガバナンス的な話題だった(#4, #5)。
Limits
- Lemmyは全体として小さく、「今日のLLM関連投稿」を10件集める過程で、後半の4件(#7〜#10)はスコア0〜1・コメント0件のミラーボット転載や反応の薄い投稿で埋める形になった。ネイティブで活発な議論があったのは実質#1・#4・#5・#6の4件程度。
lemm.eeはAPI検索(/api/v3/search)がjoin-lemmy.orgへリダイレクトし、検索できなかった(インスタンス側の変更か停止の可能性)。lemmy.mlでも同じキーワードで検索したが、lemmy.worldで見つかった投稿と重複するものばかりで、独自の新規発見はなかった(連合により同一投稿が複数インスタンスに表示されるため)。!Independent_Mediaと!ai_redditの購読者数、および!ai_redditの運営インスタンスはAPI照会が404/400を返し特定できなかった。- The Guardianの元記事は直接フェッチできなかったため、Arab News・techjuice等の同内容の転載記事で内容を確認した。
推奨アクション
- 次回のX収集は、Exploreトレンドではなくモデル名・企業名などLLM関連キーワードで検索し直す仕組みに改める。
- Reddit収集は単一検索語に依存せず、個別モデル名での追加検索を併用する。
- Gemini 4 Argonのアクセス制限と安全性方針を次回以降も継続ウォッチする。
- Bluesky検索APIの403が解消されているか次回ランで再確認し、解消していればキーワード検索に戻す。
- オープンウェイト対クローズドの安全性論争を継続的な論点として定点観測する。
データ品質メモ
Xは収集プロセスがLLMと無関係なジオロケートされたExploreトレンドに基づいており有効データは0件、Blueskyは検索APIが403を返したためアカウントベース収集に代替し、Redditは単一検索語のみで本日(10/2)付けの投稿を含まない。



