必読 ★★★
Claude Code now reads AGENTS.md if there is no Claude.md
Hacker News / Techmeme▲515 ・ 💬182
OpenAI発のエージェント指示ファイル仕様にAnthropicが乗った形。ツールごとに同じ内容のファイルを並べる不毛が一つ減る。プロジェクト側は当面どちらでも動くが、新規リポジトリはAGENTS.mdに寄せておくのが無難になりそう。前日には「Claude Codeのrulesを全部やめた」という記事も出ており、設定ファイルの持ち方を見直す良いタイミング。
OpenJev / SemIf
Hacker News▲558 ・ 💬245
選択肢の確率を直接読む方式と、JSONをテキストとして生成させる方式を、同じ判断課題で比べられる独立研究プロジェクト。Qwen3 0.6BやMiniCPM5 2BをWebGPUでブラウザ内実行するので、待ち行列もアカウントも要らない。TypeSafe社とは無関係と明記されており、Jevの主張が「魔法」なのか「既知手法の丁寧な製品化」なのかを、手元で確かめられるようになった意義が大きい。
はてブ🔖268 users
50人規模の緊急勉強会を30分(紹介5分・デモ5分・発想20分)でやって案が50本出たという記録。出てきた軸は3つで、文章生成ではなく判断だけが必要な業務(書類の分類、自動承認の可否、名寄せ)、較正された信頼度を閾値にして高信頼は自動処理・低信頼は人や高価なモデルに回す設計、そして安くて速いから初めて成立する用途(全件走査、キー入力ごとの反応)。結論は「置き換えではなく配置」。昨日のmizchi氏の実測と合わせて、国内の受け止めが一気に具体化した。
OpenAI Financial Projections Leaked
Techmeme
FT報道。同じ期間で売上は3500億ドルまで伸ばす想定だが、それでも現金は出続けるという絵になっている。Oracleのニューメキシコ拠点向け約180億ドルの融資が工事遅延でストレス区分に移ったという報道も同日で、計算資源への投資が金融面で軋み始めた兆候が並んだ。IPOを延期した判断の背景としても読める。
AI / LLM ★★
How to Write with an LLM
Hacker News▲392 ・ 💬270
今週の「生成AIが書いた文章を読みたくない」「それでも自分の文章にする」の英語圏版。下書きを書かせるのではなく、自分の主張を詰める相手として使う、という立て付けが一貫している。
I vibed a proof of Conway's conjecture
Hacker News▲212 ・ 💬186
Dan Abramov氏が、数学の素人としてモデルと対話しながら証明にたどり着くまでの記録。フィールズ賞受賞者の書簡やGowers氏の反論が話題の週に、当事者ではない側から出てきた実例として面白い位置にある。
Cactus Needle 3: 8-29MB automation models can match DeepSeek V4 Flash
Hacker News▲165 ・ 💬78
特定タスクに絞れば極小モデルで足りる、という主張。JevやBonsaiと同じ方向で、「用途ごとに小さく作る」が今週ずっと通奏低音になっている。
Anthropic Considers New Model Release
Techmeme
Reuters報道。IPOを見据えた動きとされる。同社がAI創薬向けに自前の生物実験ラボを設けたという日経の報道も出ており、投資の向き先が広がっている。
はてブ🔖45 users
出版社側の生成物の扱いが問われた事例。日本出版販売がAnthropicへ書籍を販売したことに著者側から疑問が出ているという報道もあり、出版とAIの関係は当面もめ続けそう。
AI Safety Groups in Spotlight
Techmeme
一連のミスアライメント事案を受けて、評価を担う側の実態を追った記事。Irregularの件で「誰が評価者を評価するのか」が論点になった直後だけに、読み合わせると立体的になる。
開発・エンジニアリング ★★
Android 17 is the first since 3.x to add new APIs without releasing to the AOSP
Hacker News▲543 ・ 💬263
オープンソース公開の遅延ではなく、公開しないまま先に進むという性質の変化だという主張。事実なら代替ROMやフォークの前提が崩れるので、Android周辺で仕事をしている人は続報を追いたい。
Inside ZCode: Silently uploading your Git history to the cloud
Hacker News▲255 ・ 💬91
エディタやエージェント系ツールがワークスペースをどこまで送っているか、という問題の新しい実例。社内コードを扱うツールの選定基準に、通信先の検証を入れる必要が改めて示された。
Saving another 100TB of RAM
Hacker News▲229 ・ 💬43
確率的データ構造の見直しで消費を削った話。メモリ価格が高騰している今、こういう地道な圧縮の価値が上がっているのを実感できる。
C++26: Trivial infinite loops are no longer undefined behaviour
Hacker News▲148 ・ 💬201
最適化器が無限ループを消せてしまう長年の落とし穴が塞がれる。組み込みやRTOS周りで踏んだことがある人には朗報。
Photon-Emission-Guided Laser Fault Injection Enables RP2350 Secure Debug
Hacker News▲157 ・ 💬54
チップの発光から狙う場所を特定してレーザーを撃つという手法。物理アクセスがある前提の攻撃だが、手順の記述が詳しく読み物として上質。
Zenn👍25
ゲートウェイを挟んで利用量を可視化しつつ、モデルを切り替えられるようにする構成。先日のNTT ComのローカルLLM基盤と同じ発想を、クラウドAPI前提でやった版として参考になる。
そのほか ★
はてブ / Hacker News🔖192 users ・ ▲171
週末向けの明るいニュース。哺乳類の、しかもネコ科で新種というのは相当に珍しい。
How OpenAI Used Its Own LLMs to Design Its Jalapeño Chip
Hacker News▲58 ・ 💬58
RTL生成や検証の一部をモデルに任せた事例。自社チップの話としても、EDA領域へのAI浸透の話としても読める。
はてブ🔖14 users
利用は広がっているが、公表するかどうかは別問題という温度差も同時に見える調査。先日のレベルファイブの件とも地続き。