"llm" 태그로 연결된 3개 게시물개의 게시물이 있습니다.

[프로젝트] llm-lite — Gemma 3N E4B 경량 추론 엔진

2026년 4월 19일 · 약 2분

개발자

llm-lite 는 저사양 로컬 환경에서 Gemma 3N E4B 를 클라우드 없이 돌리는 걸 목표로 만든 멀티 백엔드 추론 엔진이다. 모델 구조는 그대로 두되 공격적인 양자화(INT4 weights + MMAP)와 저수준 하드웨어 가속으로 성능을 끌어내는 방향을 택했다.

[논문] Gemma 3 4B 내부 처리 과정

2026년 4월 17일 · 약 9분

hwkim-dev

개발자

Phase 1: 모델이 알아들을 수 있게 준비하기

[논문] GPT-1 핵심 정리

2026년 4월 17일 · 약 11분

hwkim-dev

개발자

이 문서는 GPT-1 논문의 architecture와 학습 과정을 수학적/정의와 직관적인 해설을 결합하여 정리한 노트이다.

Phase 1: 모델이 알아들을 수 있게 준비하기​

Phase 1: 모델이 알아들을 수 있게 준비하기