언어 바꾸기English
이전 목록

NVIDIA AI, Nemotron-Labs-Diffusion 공개: Qwen3-8B 대비 한 번의 순전파당 토큰 6배를 처리하는 3모드 언어 모델

NVIDIA AI Releases Nemotron-Labs-Diffusion: A Tri-Mode Language Model with 6× Tokens Per Forward Over Qwen3-8B

TL;DR AI

핵심 요약

1분
  1. 엔비디아는 Nemotron-Labs-Diffusion 3B/8B/14B 모델 패밀리를 공개했습니다.

  2. 이 시스템은 하나의 공유 구조 안에 AR 디코딩, 확산 기반 블록 디코딩, 셀프 스페큘레이션을 결합했습니다.

  3. 공동 AR-확산 학습 목표로 빠른 병렬 생성과 높은 언어 모델 정확도를 함께 노립니다.

  4. 가중치를 바꾸지 않고도 엣지와 클라우드 서버에 맞춰 활용할 수 있는 단일 모델 스택을 지향합니다.

원문 보기