必読 ★★★
Countering misuse of AI: September 2026
はてブ🔖24 users
ロシア諜報グループによるウクライナ標的のマルウェア自動改変、ShinyHuntersの大規模な認証情報収集、中国系による自律的な脆弱性探索など、直近8か月の悪用事例を実名コードで公開。人間の監督なしに数時間動き続ける多エージェント型の攻撃が現実になり、盗んだAPIキーでAI基盤そのものを狙う動きも出ている、というのが今回の主題。
はてブ🔖45 users
国内主要ホスティング事業者の侵害調査が着地。自社サービスを載せている側にとっては影響範囲と対応方針の確認が最優先。上のAnthropicレポートと同じ日に読むと、供給網を狙う攻撃の現在地がよく見える。
Moonshot AI surpasses $1B ARR
Techmeme
Kimi K3投入後の8月にARR 10億ドルを超え、年末までに20億ドルを目標と報道。中国勢は「安いオープンウェイト」だけでなく収益でもフロンティアに接近しつつあり、前日のDeepSeek V4.1-Flashと合わせて構図の変化が鮮明に。
OpenAI ends Caltech hackathon sponsorship
Techmeme
AI生成の粗い数学が学術コミュニティを圧迫しているという反発を受けての判断。昨日取り上げた「未発表の数学をOpenAIに預けて大丈夫か」の議論がそのまま実害として現れた形で、AI×数学の蜜月が一区切りついた週になった。
AI / LLM ★★
Trump dismisses AI extinction risks
Techmeme
米国の技術的優位は中国に対して1年程度で、AIで主導権を失えば「非常にまずい立場になる」と発言。Y CombinatorのGarry Tan氏も中国への蒸留規制に反対を表明しており、政策側の空気は明確に「加速」に傾いている。今週相次いだラボ内部からの警告とは正反対の向きなのが対比として興味深い。
MIT launches LLM Election Observatory
Techmeme
中間選挙に向け、各モデルが政治的な問いにどう答え分けるかをダッシュボードで追跡する試み。モデルのバイアスを「主張」ではなく継続計測で扱う点が新しく、Anthropicレポートが挙げた影響工作9件と併せて読みたい。
Enflame IPO surges 188%
Techmeme
テンセント出資のAIチップメーカーが約9.1億ドルを調達。国産アクセラレータへの資金流入が止まらず、NVIDIA依存を前提にした調達計画は中期で見直しが要るかもしれない。
AgentGrad: Intervention-guided Prompt Optimization for Multi Agent Systems
HF Daily Papers👍73
どのエージェントのどのプロンプトが結果を悪化させているかを逐次介入で切り分け、意味的クラスタリングでまとめて改善する手法。複数エージェントを組んで「なぜか精度が出ない」に悩んでいる人には実務的に効く話。
SWE-Bench Pro Verified: A Reliable Benchmark for Software Engineering Agents
HF Daily Papers👍19
学習データへの漏れと問題文の欠陥を取り除いた改訂版。SWE-2をはじめコーディングモデルのスコア競争が過熱している今、どの数字を信じるかの物差しとして押さえておきたい。
Zenn👍93
Turing社による、探索を回さず一発で解を出す特化モデルの構築記。汎用モデルに解かせるのではなく問題構造に合わせて小さく作る、という方向の良い実例。
開発・エンジニアリング ★★
Introducing Neki
Hacker News▲150 ・ 💬56
各シャードに改変なしの本物のPostgresを置き、拡張もSQLもそのまま使える設計。専用ドライバ不要で標準のwireプロトコルで繋がる。「Postgres互換」を名乗る分散DBがシャードキーや拡張を隠してしまう問題への回答という位置づけ。本番利用はまだ非推奨。
>10x More Efficient Pretraining
Hacker News▲98 ・ 💬51
長コンテキストで知られるMagicが学習側の効率で主張。この手の倍率は条件次第で大きく振れるので、比較対象と測定条件を見てから評価したいところ。
Zenn👍153
再現テストだけを入れた「赤いPR」と修正の「緑のPR」を積む運用。バグの存在をリポジトリの履歴として残せるのが利点で、エージェントに修正させる時代の相性も良い。
Qiita / はてブ👍161
タイトルの勢いに反して中身は真面目な最適化の話。Wasmまわりを触っている人には読み応えがあり、この手の「個人が本気で作った処理系」の記録はやはり面白い。
Zenn👍115
「完全性・純粋性・遅延実行」を同時に満たせないというトリレンマに、判断をDecisionとして切り出す形で答える設計論。kawasima氏から別解の記事も出ており、週末にまとめて読むと議論の輪郭がつかめる。
Zenn / はてブ🔖65 users
外部集約のアルゴリズムをソースを追いながら解説。DuckDBを使うだけの人にも、なぜ巨大データでも落ちないのかが腑に落ちる良記事。
そのほか ★
はてブ🔖155 users
結合・分割・注釈あたりの日常作業を無償で賄えるとして国内で大きく伸びた1本。業務PCに入れる前にライセンス条件だけ確認を。
List of references on Sony websites to players "owning" their digital games
Hacker News▲288 ・ 💬96
訴訟に向けて公式サイトの「購入」「所有」表現を集めた資料。デジタル配信の利用規約と広告文言のずれという、そろそろ決着がつきそうな論点。
はてブ
まっとうに運営していてもインデックスされないという報告。個人サイトの可視性がプラットフォーム側の判断ひとつで消える現実は、AI検索への移行を考えるうえでも他人事ではない。