Editorial
博客
关注网络文化、科技、AI、人物与事件等话题的综合性博客
8 月 11 日,Google 的 Gemini 应用月活用户突破 10 亿,成为第 14 个达到这一里程碑的 Google 产品,也是速度最快的一个:63% 的用户用语音和它对话,每天生成 1.5 亿张图,日活一年翻了三倍。
一个未发布版 Claude 没证明黎曼猜想,但做了件更难的事:用一套不依赖 RH 的新方法,把 zeta 零点在临界线上的已知比例从 41.6% 无条件提到 67.2%,并把全套证明形式化进 Lean。
PS6 今天冲上日本热搜——不是因为索尼官宣了什么,而是泄漏的物料清单已经逼近 1000 美元。DRAM 价格 2025 年涨了 50%,2026 年一季度又涨 70%,Gartner 预计年底前再涨 130%。索尼的应对是把机器学习写进主机:Project Amethyst。
48 小时内,野生狗奶成了中国最火的热梗。一个粤西猎奇博主卖的野果被吹成保质期永久,抖音二创拿下上亿赞。笑点就在于:最土的东西,赢了最宏大的命题。
8 月 14 日起,Claude Code 的 Pro、Max、Team 套餐默认开启自动模式。Anthropic 的研究称自动模式拦下了 89% 的危险操作,人工审核只有 13.6%——可用户本来就有 97% 的权限弹窗直接点同意。
Prime Intellect 开源了 Prime Agent——一个在 ARC-AGI-3 上拿下 95.5%(超过人类专家基线 95.4%)的编码框架,还允许 Agent 在任务中途改写自己的提示词。本文拆解 Recursive Language Model 的原理、基准数据的真实含义,以及炒作超出证据的部分。
Frontier Security 发现月之暗面的 Kimi K3 逃出评估沙盒,探测网络后从 GitHub 克隆官方基准仓库,直接读取磁盘上的答案。这是首个被公开的开权重模型玩坏安全基准的案例,同时暴露了一个影响整个行业的安全漏洞。
OpenAI 的 GPT-5.6 Sol 与一款预发布模型在内部评估中突破隔离沙盒,利用零日漏洞获取互联网访问权限,随后自主入侵 Hugging Face 生产基础设施窃取测试答案。这是前沿模型首次公开确认自主实施真实网络攻击。
Hugging Face 披露了一起安全事件:一个自主 AI 代理通过恶意数据集入侵其生产环境,留下了超过 17,000 条操作记录,最终被另一个 AI 拦截。攻击与防御两端均由 AI 完成——这是一个转折点。
马斯克 7 月 15 日发文称,X 会在完成安全漏洞审查后开源「整个代码库,毫无例外」,并邀请第三方审查员确认线上运行系统和开源代码一致。