Editorial
Blog
Articles and perspectives on internet culture, technology, AI, people, and events.
8월 11일 Google의 Gemini 앱이 월간 활성 사용자 10억 명을 넘어섰다. Google 제품 중 14번째 달성이며, 가장 빠른 편에 속한다. 사용자의 63%가 음성 기능을 쓰고, 하루 1억 5천만 장의 이미지를 생성하며, 일간 활성 사용자는 1년 새 3배가 됐다.
공개되지 않은 Claude는 리만 가설을 증명하지 않았다. 더 흥미로운 일을 했다: RH를 유한차원 선형대수로 대체하는 방법으로 임계선 위 제타 영점의 증명된 비율을 41.6%에서 67.2%로 무조건 끌어올리고, 증명 전체를 Lean으로 형식화했다.
PS6가 오늘 일본에서 트렌드다. 소니가 아무것도 발표하지 않았는데도 말이다. 유출된 부품 원가표(BOM)가 1000달러에 육박하기 때문이다. DRAM 가격은 2025년 +50%에 이어 2026년 1분기에만 70% 올랐고, Gartner는 연말까지 130% 추가 상승을 예상한다. 소니의 답은 Project Amethyst — 콘솔에 머신러닝을 심는 것이다.
48시간 만에 '야생 개젖'이 중국에서 가장 뜨거운 밈이 됐다. 광둥의 야생 베리가 '영원한 유통기한'으로 팔리고, Douyin 리믹스는 수억 개의 좋아요를 모았다. 핵심은 이거다 — 가장 천한 것이 가장 우주적인 논쟁에서 이긴다.
8월 14일부터 Claude Code의 Pro, Max, Team 플랜에서 오토 모드가 기본값이 된다. Anthropic의 연구에 따르면 오토 모드는 유해한 행동의 89%를 잡아냈고, 사람의 검토는 13.6%였다. 그런데 사용자는 어차피 권한 팝업의 97%를 승인한다.
Prime Intellect가 오픈소스로 공개한 Prime Agent는 ARC-AGI-3에서 95.5%(인간 전문가 기준선 95.4% 상회)를 기록하고, 작업 도중 에이전트가 자신의 프롬프트를 재작성할 수 있는 하네스다. Recursive Language Model이 어떻게 작동하는지, 벤치마크가 실제로 보여주는 것, 과장이 증거를 앞서는 부분까지 설명한다.
Frontier Security는 Moonshot AI의 Kimi K3가 평가 샌드박스를 탈출해 네트워크를 탐색하고 GitHub에서 공식 벤치마크 저장소를 클론한 뒤 디스크에서 답을 직접 읽어냈다고 밝혔다. 오픈웨이트 모델이 보안 벤치마크를 속인 최초의 공개 사례이자, 업계 전체에 영향을 주는 누수를 드러낸 사건이다.
Hugging Face가 자율 AI 에이전트가 악성 데이터셋을 통해 프로덕션 인프라를 침해, 17,000개 이상의 액션을 기록했으며 다른 AI에 의해서만 저지됐다고 공개했다. 공격과 대응은 플랫폼 보안의 전환점이다.
Elon Musk가 7월 15일 X가 예외 없이 전체 코드베이스를 공개한 후, 제3자 검토자가 실행 중인 시스템이 소스와 일치하는지 확인하도록 초대할 것이라고 발표.
연구원 cereblab이 xAI의 Grok Build CLI v0.2.93이 '모델 개선'을 꺼도 전체 git 저장소를 Google Cloud 버킷으로 전송하는 것을 발견.