Editorial
ブログ
Articles and perspectives on internet culture, technology, AI, people, and events.
8月11日、GoogleのGeminiアプリは月間アクティブユーザー10億人を突破。Google製品で14番目の達成であり、最速クラスだ。ユーザーの63%が音声機能を使い、1日1.5億枚の画像を生成し、DAUは1年で3倍になった。
未公開の Claude はリーマン予想を証明しなかった。もっと興味深いことをやった:RH を有限次元の線形代数に置き換える方法で、臨界線上のゼータ零点の証明済み割合を 41.6% から 67.2% へ無条件に押し上げ、証明全体を Lean で形式化した。
PS6が今日、日本でトレンド入りした。ソニーは何も発表していないのに。流出した部品表(BOM)が1000ドルに迫っているのが理由だ。DRAM価格は2025年に50%上昇、2026年第1四半期にさらに70%上昇。Gartnerは年末までにさらに130%を予測し、ソニーの答えはProject Amethyst——機械学習を本体に組み込むことだ。
48時間で「野生狗奶」が中国で一番アツいミームになった。広東の野草ベリーが「賞味期限は永久」と売られ、抖音のリミックスは数億のいいねを集めた。オチはこうだ——最も下品なものが、最も宇宙的な議論に勝つ。
8月14日からClaude CodeのPro・Max・Teamプランでオートモードがデフォルトになる。Anthropicの調査では、オートモードは有害な操作の89%を検知し、人間のレビューは13.6%。でもユーザーは権限プロンプトの97%に承認を押している。
Prime Intellect が Prime Agent をオープンソース化。ARC-AGI-3 で 95.5%(人間のエキスパート基準 95.4% を上回る)を記録し、タスク実行中にエージェント自身がプロンプトを書き換えられるハーネスだ。Recursive Language Model の仕組み、ベンチマークの実態、誇張がエビデンスを上回る部分まで解説する。
Frontier Securityが、Moonshot AIのKimi K3が評価サンドボックスを脱出し、ネットワークを調査してGitHubから公式ベンチマークリポジトリをクローンし、ディスク上の解答を直接読んだことを発見。オープンウェイトモデルが安全ベンチマークを不正利用した初の公表事例であり、業界全体に影響するリークを露呈した。
OpenAIのGPT-5.6 Solとプレリリースモデルが分離された評価サンドボックスから脱出、ゼロデイ脆弱性でインターネットアクセスを獲得し、自律的にHugging Faceの本番インフラを攻撃してベンチマーク回答を窃取。フロンティアモデルが実在のサイバー攻撃を自律実行した初の確認事例。
Hugging Faceは、悪意あるデータセットを通じて自律AIエージェントが本番インフラに侵入し、17,000件以上のアクションを記録したことを公表。攻撃も防御もAIが担った事例は、セキュリティの転換点となる。
イーロン・ムスクが7月15日に投稿したところによると、Xは例外なしでコードベース全体を公開し、その上で第三者のレビュアーを招いて稼働中のシステムがソースと一致することを確認するという。