영상으로 읽기: Special Topics in Kernels, RL, Reward Hacking in Agents
Daniel Han의 강연을 따라 모델 성능, 양자화, 하네스, 벤치마크, 커널 최적화, 보상 해킹을 하나의 시스템 문제로 읽습니다.
더 읽어보기Open notes for agentic learning
AI agent lab notes, learning workflows, PKM systems, and blog operations.
Topic
좋은 YouTube 영상에서 핵심 클립, 자막 근거, 해석, 내 생각을 분리해 정리한 영상 분석 노트를 모읍니다.
YouTube Lab은 좋은 영상을 그냥 링크로 보관하지 않고, 타임스탬프 클립과 짧은 자막 근거, 해석, 내 생각으로 다시 사용할 수 있는 분석 노트로 바꾸는 공간입니다.
Daniel Han의 강연을 따라 모델 성능, 양자화, 하네스, 벤치마크, 커널 최적화, 보상 해킹을 하나의 시스템 문제로 읽습니다.
더 읽어보기Hugging Face의 Training Agents 2 영상을 통해 teacher-student distillation, off-policy와 on-policy, GKD trainer, self-distillation을 에이전트 하네스 관점에서 읽습니다.
더 읽어보기거대 에이전트에 지침과 도구를 쏟아붓는 상속(Inheritance)의 임계점을 규명하고, 조율자 아래에 격리된 소형 에이전트들을 조립하는 결합(Composition) 중심 설계의 당위성과 토큰 효율성.
더 읽어보기AI 모델이 오케스트레이션(Orchestration) 시대로 진화함에 따라 개발자 도구의 스큐어모피즘을 극복하고, 무너지는 소프트웨어 티어 속에서 더 넓은 Breadth의 제품을 포착해야 하는 이유.
더 읽어보기Claude 채널의 Omni 사례를 통해 분석용 AI semantic layer, Blobby agent, SQL generation, eval loop를 하네스 관점에서 읽습니다.
더 읽어보기구글의 Open Knowledge Format(OKF) 오픈 스펙 상세 분석 및 스킬(Skill)과의 비교, 리소스 바인딩 및 참조 에이전트 가드레일 설계 방법론 해설.
더 읽어보기SEO 전문가 Marie Haynes가 Antigravity를 활용해 빌드한 개인용 OKF 지식 뇌(Personal Brain)의 아키텍처와 실제 활용기 정리.
더 읽어보기Google Cloud가 발표한 Open Knowledge Format(OKF)과 기존 RAG를 결합하여 데이터의 정확성과 대규모 검색을 모두 만족시키는 하이브리드 지식 아키텍처 정리.
더 읽어보기하나의 거대한 시스템 프롬프트가 되어버린 에이전트를 도구(Tool), 스킬(Skill), 서브에이전트(Subagent)로 나누고 Evals를 통해 지속적으로 아키텍처를 개선하는(Hill Climbing) 방법론 해설.
더 읽어보기Matt Pocock의 AI Engineer 영상에서 에이전트 스킬을 Trigger, Structure, Steering, Pruning 네 기준으로 점검하는 방법을 읽고, 우리 블로그의 스킬 운영과 연결합니다.
더 읽어보기Moara의 Claude Science 실사용 첫인상 영상을 통해, 과학 AI가 데이터셋·시각화·스킬 기반 연구 환경으로 이동할 때 생기는 가능성과 검증 책임을 분리해 읽습니다.
더 읽어보기징가(Zynga) 창업자 마크 핀커스(Mark Pincus)의 인터뷰를 통해 징가의 종교적 핵심 원칙인 'Proven Better New' 프레임워크와 야망을 내려놓는 겸손한 제품 설계, 그리고 AI를 실패 기계(Failure Machine)로 활용하는 애자일 프로토타이핑 공식을 분석합니다.
더 읽어보기카카오 황민호 FDE의 KIST 강연을 통해 클로드 코드(Claude Code)의 기본 사용법, 컨텍스트 압축 메커니즘, 그리고 @ 기호 참조와 커스텀 디자인 스킬을 결합한 웹사이트 자동 생성 기법을 분석합니다.
더 읽어보기카카오 황민호 수석의 강연을 통해 하네스 엔지니어링의 본질, 메타 하네스 설계, 그리고 클로드 코드의 에이전트 팀 수평 협업 메커니즘을 심층 분석합니다.
더 읽어보기단일 서버 입문부터 SQL/NoSQL 데이터베이스 비교, 수평 확장과 로드 밸런싱, 단일 장애점(SPOF) 방어 및 API 설계(REST vs GraphQL)까지 시스템 디자인의 핵심 개념을 도식과 함께 분석.
더 읽어보기Claude Code CLI의 기초부터 settings.json 권한 제어, 컨텍스트 관리, 스킬 설계, 서브에이전트 및 랄프 루프까지, 실전 자율 에이전트 구축에 필요한 27개 핵심 개념 분석.
더 읽어보기컨텍스트 최소화와 점진적 노출(Progressive Disclosure)을 통한 에이전트 생산성 극대화 방법론
더 읽어보기Claude Code의 진화사, Ralph Loop와 Generator-Evaluator 계약 전술, 그리고 장기 기동 에이전트 구축에 필요한 SOTA 하네스 패턴 설계.
더 읽어보기모델을 에이전트로 동작시키는 고정 아키텍처 '하네스'의 실체, 프레임워크와의 근본적 차이, 그리고 신뢰할 수 있는 에이전트를 구축하기 위한 9대 핵심 컴포넌트.
더 읽어보기AI 시대에 맞이하는 Smart Zone(추론 존) 보존법, Grill Me 정렬 인터뷰 전술, 그리고 대화 맥락을 리셋하는 Memento 철학.
더 읽어보기코드가 무한히 저렴해지는 AI 네이티브 개발 시대에 Anthropic의 기동성 있는 제품 배포 주기와 PM·엔지니어 직군 간 경계의 해체 철학.
더 읽어보기인간 개발자의 동기식 개입을 줄이고 에이전트의 실행력을 극대화하기 위한 정밀한 통제 인프라, '하네스 엔지니어링'의 핵심 설계 전략.
더 읽어보기A bilingual video note on Ponytail, the 'lazy senior developer' skill for AI coding agents, read together with its GitHub repo and benchmark writeup.
더 읽어보기개발동생의 Ponytail 실험 영상을 GitHub repo와 벤치마크 원문까지 함께 읽으며, '게으른 시니어 개발자'가 어떻게 에이전트 하네스가 되는지 정리합니다.
더 읽어보기Let's build GPT: from scratch, in code를 7개 클립으로 나누어, 토큰화, 배치, loss, self-attention, Transformer block, nanoGPT까지 정리합니다.
더 읽어보기Karpathy의 Deep Dive into LLMs like ChatGPT를 7개 클립으로 나누어, 토큰화, 사전학습, 포스트트레이닝, 도구, RL, 멀티모달을 정리합니다.
더 읽어보기Lex Fridman Podcast #333의 Andrej Karpathy 인터뷰를 7개 클립으로 나누어, 신경망, 언어모델, 도구 접근, 테슬라, AGI, 교육을 연결합니다.
더 읽어보기Karpathy의 Intro to Large Language Models 강의를 6개 클립으로 나누어, 다음 토큰 예측, 환각, 도구 사용, System 2, LLM OS 관점을 정리합니다.
더 읽어보기Karpathy의 2시간짜리 실전 LLM 사용 강의를 7개 클립으로 나누어, 컨텍스트 윈도우, 검색, 파일 업로드, 코딩, 음성, 메모리 사용법을 읽습니다.
더 읽어보기No Priors 2024 인터뷰를 6개 클립으로 나누어, 자율주행 이후의 AI 일반화, 모델 비용, 교육 튜터, 학습의 어려움을 읽습니다.
더 읽어보기Dwarkesh Podcast의 Karpathy 장문 인터뷰를 6개 구간으로 나누어 RL, LLM 인지 결함, AGI, 자율주행, 교육을 읽습니다.
더 읽어보기No Priors 대담을 6개 구간으로 나누어 코딩 에이전트 숙련, AutoResearch, 모델 분화, 협업 표면, 교육용 MicroGPT를 읽습니다.
더 읽어보기YC AI Startup School 키노트를 7개 구간으로 나누어 Software 1.0/2.0/3.0, LLM OS, people spirits, 인간-AI 협업 루프를 정리합니다.
더 읽어보기Sequoia AI Ascent 2026 대담을 6개 클립으로 나누어, Software 3.0, 검증 가능성, agentic engineering, 이해의 책임을 읽습니다.
더 읽어보기Anthropic의 Claude Code 실전 강의를 6개 구간으로 나누어, 코드베이스 Q&A, 계획 후 편집, CLAUDE.md, MCP, CLI SDK, 병렬 세션 운영을 블로그의 LLM Wiki/하니스 관점으로 해석합니다.
더 읽어보기David Ondrej × Matt Pocock 대담을 7개 구간 클립으로 끊어, '전략적 프로그래밍 → 에이전트 스킬 → 하니스 → 루프 vs 큐 → 개발자의 미래'로 읽고 내 생각을 붙인 영상 노트.
더 읽어보기