Show HN: 30B 모델 22tok/s, 109tok/s는 흔한 일, 6GB/16GB RAM으로 llama.cpp 한계 극복하기Show HN: I run 30B 22tok/s, 109tok/s not novel,6GB/16GB RAM overcoming llama.cpp▲ 4 · github.com · 1일 전 · 0 댓글원문 보기 → HN에서 보기 →원문 요약원문을 요약하고 있습니다…