최근 신호
6편 · 최신순
2026-03-06Nvidia DGX Spark
I BUILT A FULLY AUTOMATIC MANSPLAINER
Yannic Kilcher가 Nvidia DGX Spark로 완전 자동 mansplainer를 구축해 시연하고 장점을 소개하는 영상.

2025-12-27TiDaR LLM 추론 최적화
TiDAR: Think in Diffusion, Talk in Autoregression (Paper Analysis)
Nvidia의 TiDaR 논문 분석: autoregressive와 diffusion을 결합해 GPU 유휴 용량 활용, LLM 추론 속도 대폭 향상.

2025-12-14긴 컨텍스트 처리
Titans: Learning to Memorize at Test Time (Paper Analysis)
Yannic이 Google의 Titans 논문을 분석하며 테스트 타임 메모라이징 아이디어를 칭찬하나 마케팅 과장을 비판.

2025-11-01트랜스포머 잠재변수 모델링
[Paper Analysis] The Free Transformer (and some Variational Autoencoder stuff)
Free Transformer는 VAE 구조를 트랜스포머 중간에 삽입해 잠재변수 Z를 명시적으로 모델링, 토큰 샘플링 대신 Z로 전체 시퀀스 일관성을 확보한다.

2025-10-19LLM tool calling vs code mode
[Video Response] What Cloudflare's code mode misses about MCP and tool calling
Cloudflare의 code mode가 MCP tool calling보다 LLM의 사전 학습된 코드 능력을 활용해 효율적이지만, 실제 세계의 비결정적·복잡한 도구 체인에서는 중간 결과 확인이 필수하다는 반론을 제시한다.

2025-10-11임베딩 기반 검색의 이론적 한계
[Paper Analysis] On the Theoretical Limitations of Embedding-Based Retrieval (Warning: Rant)
임베딩 기반 검색은 임의의 조합을 표현할 수 없다는 이론적 한계를 증명한 논문을 분석하며, 실용적 의미는 없다고 주장한다.