CanRun 소개
CanRun은 "내 PC나 맥으로 이 로컬 LLM을 돌릴 수 있을까, 돌린다면 얼마나 쓸 만할까"에 답하는 사이트입니다. 그래픽카드나 애플 칩, 또는 GPU 없이 CPU만 고르면 어떤 오픈 모델이 들어가는지, 어떤 양자화 파일을 받으면 되는지, 메모리가 얼마나 필요한지, 속도는 대략 어느 정도인지 보여 드립니다.
무엇을 알 수 있나요
- 모델마다 판정: 메모리에 들어가는지와 예상 속도를 바탕으로 쾌적·원활·겨우 가능·불가 중 하나로 알려 드립니다.
- 필요한 메모리: 모델 파일, 컨텍스트 길이에 따라 늘어나는 KV 캐시, 실행 중에 쓰는 작업 메모리로 나눠 보여 드립니다.
- 속도는 한 숫자가 아니라 범위로 보여 드립니다. 얼마나 믿을 만한 값인지 알려 주는 신뢰 라벨도 함께 붙습니다.
- 바로 쓸 수 있는 명령어: llama.cpp와 Ollama 명령을 고른 컨텍스트 길이에 맞춰 드립니다.
원하는 조합은 계산기에서 바로 확인할 수 있고, GPU별·모델별 페이지와 "이 GPU에서 이 모델" 페이지도 따로 있습니다.
숫자는 어디서 오나요
모델 크기는 Hugging Face에 올라온 실제 GGUF 파일 크기를 쓰고, 필요 메모리는 각 모델이 공개한 설정값으로 계산합니다. GPU와 칩 사양은 제조사 페이지를 따릅니다. 속도는 메모리 대역폭으로 먼저 추정한 뒤 공개 벤치마크에 맞춰 보정합니다. 자세한 계산 방식과 지금까지의 오차, 틀릴 수 있는 경우는 계산 방법 페이지에 정리해 두었습니다.
얼마나 자주 갱신되나요
모델 데이터는 매주 Hugging Face와 대조해 갱신하고, 새 모델은 llama.cpp가 지원하기 시작하면 추가합니다. 지금 보고 계신 데이터의 기준일은 모든 페이지 맨 아래에 있고, 현재 기준일은 2026년 9월 29일입니다.
누가 운영하나요
CanRun은 개인이 운영하는 독립 프로젝트입니다. GPU 제조사나 모델 개발사와는 관계가 없고, 판정은 어떤 상업적 이해관계와도 상관없이 데이터로만 계산합니다. 숫자가 이상해 보이거나 찾는 모델이 없으면 문의 페이지를 통해 알려 주세요.