배우고 만든 것을 기록합니다.
개발하며 만난 문제와 해결 과정, 오래 기억하고 싶은 생각을 씁니다.
Claude Fable 5.1은 프롬프트만 바꿔서는 안 된다
Claude Fable 5.1을 도입할 때 effort, 진행 표시, 도구 호출, 대화 이력을 함께 점검해야 하는 이유를 살펴본다.
더 보기 »700개 AI 에이전트는 어떻게 선을 넘었나
Hugging Face 침해 사건에서 풀 수 없는 과제와 공유 인프라, 잘못된 평가 방식이 AI 에이전트 집단을 만든 과정을 살펴본다.
더 보기 »Bun이 53만 라인의 Zig 코드를 Rust로 재작성한 이야기
Bun이 53만 줄이 넘는 Zig 코드를 11일 만에 Rust로 옮긴 과정을 따라가며 대규모 AI 코딩에 필요한 검증 구조를 살펴본다.
더 보기 »아무도 안 읽는다고 믿었던 주소
보안 연구자가 noreply.net 도메인을 사자 기업들이 40만 통의 메일을 보내왔다. 자리 표시자 주소가 어떻게 진짜 유출 경로가 되는지 정리했다.
더 보기 »메타가 다시 가중치를 공개한 로컬 에이전트 모델
메타가 Apache 2.0으로 공개한 30B 로컬 에이전트 모델 Muse Glimmer의 특징과 저커버그의 개방 선언, 이를 둘러싼 커뮤니티의 엇갈린 반응을 정리했다.
더 보기 »브라우저에서 사람을 빼면 무엇이 남을까, Cloudflare Kitesurf
사람 대신 AI 에이전트를 위해 만든 경량 브라우저 Kitesurf의 구조와 성능, Hacker News의 기대와 의문을 정리했다.
더 보기 »AI의 평가 주도 개발(EDD) by Airbnb
Airbnb 엔지니어링 팀이 정리한 Eval 주도 개발을 읽고, GenAI 기능을 어떤 순서로 검증해야 하는지 남긴 기록.
더 보기 »Claude Code가 23년 묵은 커널 버그를 찾았다. 논쟁은 그다음부터였다
리눅스 NFS 드라이버의 23년 된 취약점을 AI가 찾은 뒤, HN 댓글 268개가 갈린 지점은 "AI가 버그를 잘 찾느냐"가 아니었다.
더 보기 »