Jungseob's Note
Jungseob's Note

기술과 생각의 기록

읽고, 이해하고,
행동합니다.

최근 지식 노트
원문 대표 이미지 · Self-Improving Harnesses, Local Personal AI And YC's Agent For Work

래퍼라고 무시받던 것이 30퍼센트를 95퍼센트로 만들었다 - YC 하네스 나이트의 세 발표

하네스가 연구 대상이 아니라고 폄하되던 것을 같은 가중치 파일에서 ARC-AGI 30퍼센트를 95퍼센트로 올린 결과로 반박하며 시작한 YC 하네스 나이트 기록. GPT-2의 while 루프부터 자기수정 메타 하네스까지 6년 계보를 정리하고, Prime Agent와 OpenJarvis, YC 사내 QM 세 발표에서 문맥을 캐시 계층으로 다루는 설계와 로컬 추론 800배 비용 절감, 그리고 에이전트 50대 운영이 왜 무너졌는지를 담았다.

원문 대표 이미지 · Inside xAI: Building Grok Imagine in 3 Months, Videogen vs World Models, and Video Agents— Ethan He

시각 지능은 대부분 언어에서 온다 - xAI 월드모델 리드가 3개월 만든 Grok Imagine의 내부

Nvidia Cosmos를 만들고 xAI로 옮겨 3개월에 Grok Imagine을 낸 Ethan He와의 104분 대담. 비디오 모델 훈련의 전체 계보와 저장 비용 실측, 월드모델을 실시간·상호작용·장기지평 세 조건으로 정의하는 방식을 담고, 시각 지능의 개선이 대부분 확산 모델이 아니라 언어 모델에서 온다는 주장과 그가 xAI를 떠나 언어 모델로 향한 이유까지 이어진다.

원문 대표 이미지 · The oldest architecture in computing

GPU는 700와트 뇌는 20와트다 - 버너 보겔스가 컴퓨팅에서 가장 오래된 아키텍처를 지목한 이유

AI가 일자리를 없애느냐는 질문에 아마도라고 답한 뒤 진화하지 않으면 그렇다고 조건을 붙인 글. Kiro Crew의 메모리 내부를 직접 파 보니 실용적 공학 제약에서 출발한 설계가 진화가 도달한 구조와 놀랍게 닮았다는 관찰에서, 뇌가 컴퓨팅에서 가장 오래된 아키텍처라는 명제와 능동적 잊기가 없으면 어떤 시스템도 결국 옛 맥락을 뒤지는 데 시간을 더 쓴다는 논거를 제시한다.

원문 대표 이미지 · Build vs Buy When Building Just Got Cheap

3년 차에 누가 패치하는지 물어라 - 만드는 비용이 싸져도 가진 비용은 그대로다

오픈소스 위에 인증을 직접 만들어 본전에 그친 자기 실패와 퇴사 30일 뒤 터진 그 컴포넌트의 심각한 취약점을 대비시킨 글. AI가 붕괴시킨 것은 만드는 비용뿐이고 가진 비용은 그대로라는 명제에서 폭발 반경과 소유 비용, 차별성, 탈출 경로라는 네 질문을 뽑아내고, 같은 판단이 채용과 공급망 위험 판단으로 확장되는 지점까지 다룬다.

요청을 세지 않고 응답을 세면 우회당한다 - AWS가 공개한 Dogwood의 시간 조건

도구 호출이 에이전트 위험의 가장 큰 원천이라는 진단에서 출발해, 행동의 시퀀스에 관한 규칙을 표현하도록 설계되지 않은 Cedar에 시간 조건을 더한 오픈소스 거버넌스 언어 Dogwood를 소개한 글. formerly와 count_within 같은 네 연산자, 속도 제한을 응답이 아니라 요청으로 세야 하는 이유, 그리고 상태 추적 비용과 자동 추론 미지원이라는 대가까지 담았다.

원문 대표 이미지 · Designing Grok Bot

이것이 위임을 돕는가 관리할 것을 하나 더 주는가 - Grok Bot이 인터페이스를 덜어낸 기준

대부분의 AI 인터페이스가 사용자가 조작하는 채팅 세션을 중심으로 조직되어 있다는 진단에서 출발해, 세션을 넘어 지속하는 에이전트를 위해 인터페이스를 다시 짠 기록. 열네 개 어휘를 원시 개념 다섯 개로 줄이고 상태 여섯 단계를 아바타에 통합한 과정, 컴퓨터를 두드러지게 만들수록 사용자가 감독하도록 유도된다는 발견, 그리고 능력과 맥락의 경계를 계정과 봇으로 나눈 판단을 담았다.

원문 대표 이미지 · Firsthand: How I Built a Brand with Heart at Lovable

30분에 만든 로고는 확장되지 않았다 - Lovable 첫 디자이너가 몸짓에서 브랜드를 뽑아낸 방법

30분에 프로토타이핑한 시각 정체성으로 출시한 뒤 60일에 1,000만 달러 ARR을 얻으며 확장 한계에 부딪힌 Lovable의 브랜드 재구축 과정을 첫 디자이너가 직접 쓴 회고. 사용자 통화 영상을 되돌려 보며 몸이 움직이는 순간을 적어 가능성·권한·속도라는 세 감정을 뽑아낸 방법과, 허락을 다시 구하지 않게 만든 오너십 문화가 핵심이다.

테스트 기법 이름만으로는 버그를 못 잡는다 - 에이전트 검증에서 입력과 판정 기준 살피기

Zstd 구현 과제에 TDD와 형식 방법, 속성 기반 테스트, 스킬을 포함한 26개 조건을 붙여 조건마다 80회씩 돌린 실험 기록. 무엇도 크게 능가하지 못하고 지시 없는 기본이 평균 이상이었으며 추천 스킬들은 오히려 못했다는 결과에서, 에이전트가 기법 이름을 받으면 그 기법의 틀 안에서 원래 쓰던 테스트를 쓰거나 표면만 흉내 낸다는 실패 양상과 그럼에도 무엇이 통하는지를 정리한다.

원문 대표 이미지 · An Alien Mind

지금 어떤 랩도 최고 속도로 계속 확장할 만큼 정렬을 풀지 못했다 - OpenAI 수석과학자가 스스로 감속을 요구한 글

OpenAI 수석과학자가 재귀적 자기개선이 현재 경로의 도착지라고 내부 결과를 근거로 밝히면서, 어떤 랩도 최고 속도 확장을 정당화할 만큼 정렬과 모니터링을 풀지 못했다고 판정한 글. 사고연쇄 모니터링 능력이 점진적으로 줄고 있다는 자체 평가와 자발적 감속·국제 조율 요구가 핵심이다.