
Two Minute Papers · 2026-08-03
Another DeepSeek Moment Has ArrivedDeepSeek의 새 Flash 모델은 동일한 아키텍처에서 후학습만으로 성능이 2~7배 향상된 사례를 보여준다.
자동 묶음 · 미검토 · 변경 가능묶음 설명과 입장 분포 대신 원본 영상 목록을 제공합니다.

DeepSeek의 새 Flash 모델은 동일한 아키텍처에서 후학습만으로 성능이 2~7배 향상된 사례를 보여준다.

잼마 4의 멀티토큰 예측(MTP)으로 오픈소스 모델 출론 속도가 3배 빨라지며 품질 유지