리퀴드 AI, '추측적 디코딩'으로 VLM 추론 3배 가속
리퀴드 AI가 소형 초안 모델이 여러 토큰을 예측하고 대형 모델이 이를 한꺼번에 검증하는 '추측적 디코딩' 방식을 비전-언어 모델(VLM)에 적용한 '디스파크(DSpark)'를 공개했다. 이는 기존에 텍스트 중심으로 쓰이던 추측적 디코딩 기술을 시각 정보 처리가 결합된 멀티모달 영역으로 확장해 추론 속도를 높였다는 점에서 의미가 있다.리퀴드 AI는 24일(현지시간) ‘LFM2.5-VL-3B’를 위한 실험용 초안 모델 ‘LFM2.5-VL-3B-디스파크’를 공개했다.초안 모델은 2억8000만개의 매개변수를 추가하며, 기존 모델 대비 배
AI타임스 · 2026. 09. 29. 오전 02:05