lyogavin/airllm
70B 대형 언어모델을 4GB GPU 한 장에서 양자화 없이 실행하는 메모리 최적화 추론 엔진
가장 최근에 차려진 착한식당은 누구나 무료로 읽을 수 있어요. 이 상은 그보다 앞선 배치라, 깃밥이 확인한 검증 근거와 심층 해설은 깃밥 PRO 서재에 보관됩니다.
70B 대형 언어모델을 4GB GPU 한 장에서 양자화 없이 실행하는 메모리 최적화 추론 엔진
가장 최근에 차려진 착한식당은 누구나 무료로 읽을 수 있어요. 이 상은 그보다 앞선 배치라, 깃밥이 확인한 검증 근거와 심층 해설은 깃밥 PRO 서재에 보관됩니다.