AI 모델

로컬 실행 조건을 분명히 보여 주는 AI 모델.

클라우드와 오픈 웨이트 모델을 함께 봅니다. 로컬 실행 프로필이 있는 모델만 장비 추천기에 들어갈 수 있습니다.

필터 더보기

19 개 모델

DeepSeek · local

DeepSeek V4 Pro 0813

DeepSeek의 공식 DeepSeek-V4-Pro-0813 릴리스는 프리뷰를 대체하고 V4-Pro 구조에 DSpark speculative-decoding 모듈을 추가합니다. 100만 토큰 컨텍스트를 유지하며 low·high·max 추론 강도를 제공합니다. 공식 로컬 서빙 예시는 4×GB300 GPU 노드를 사용하고 DeepSeek는 완전한 워크스테이션 용량 프로필을 공개하지 않았으므로 소비자 장비 추천에서는 제외해야 합니다.

로컬 설정 검토 대기

LG AI Research · local

EXAONE 4.0 32B

한국어·영어·스페인어를 지원하고 도구 호출, 추론·비추론 모드를 함께 제공하는 LG AI Research의 32B 하이브리드 추론 모델입니다. 공식 Transformers와 로컬 llama.cpp 경로가 있지만, 라이선스는 경쟁 모델 개발을 제한하며 완전한 하드웨어 요구 조건은 공개하지 않았습니다.

로컬 설정 검토 대기

Z.ai · local

GLM-5.3 Flash

총 320B·활성 18B 파라미터로 구성된 Z.ai의 MIT 라이선스 네이티브 멀티모달 GLM-5 모델입니다. 희소·선형 어텐션을 결합해 장문 컨텍스트 서빙 비용을 낮추는 구조이지만, Z.ai는 완전한 워크스테이션 요구 조건 프로필을 공개하지 않았습니다.

로컬 설정 검토 대기

Z.ai · local

GLM-5.3

Z.ai의 753B 오픈 웨이트·맞춤형 라이선스 코딩 및 장기 작업 모델입니다. Z.ai는 로컬 vLLM·SGLang 서빙 경로를 안내하지만 단일 완전형 워크스테이션 용량 프로필은 공개하지 않았습니다. 소비자 GPU 추천이 아니라 서버 인프라 후보로 평가해야 합니다.

로컬 설정 검토 대기

OpenAI · local

gpt-oss-120b

128K 컨텍스트를 지원하는 OpenAI의 총 117B·활성 5.1B 오픈 웨이트 추론 모델입니다. OpenAI는 MXFP4 가중치가 80GB H100급 GPU 한 장에 들어간다고 안내합니다. 일반 소비자 GPU 추천이 아니라 고용량 워크스테이션 또는 서버 경로입니다.

로컬 설정 검토 대기

Kakao · local

Kanana-2 30B-A3B

에이전트 작업, 한국어 중심 다국어 활용, 도구 호출, 추론을 위한 카카오의 총 30B·활성 3B MoE 모델 계열입니다. 카카오는 Instruct·Thinking 변형에 vLLM·SGLang 경로를 제공합니다. 네이티브 컨텍스트는 32K이며, 맞춤형 Kanana License로 배포됩니다.

로컬 설정 검토 대기

Moonshot AI · local

Kimi K3

100만 토큰 컨텍스트를 제공하는 Moonshot AI의 2.8T 파라미터 네이티브 멀티모달 에이전트 모델입니다. 공식 vLLM·SGLang·TokenSpeed 서빙 경로가 있지만, 맞춤형 Kimi K3 License를 사용하고 완전한 1차 워크스테이션 요구 조건이 없습니다. 배포 전 라이선스와 용량을 함께 검토해야 합니다.

로컬 설정 검토 대기

Meta · local

Llama 4 Maverick

이미지·텍스트 이해, 코딩, 범용 어시스턴트 작업을 위한 Meta의 총 400B·활성 17B 네이티브 멀티모달 MoE 모델입니다. Meta는 100만 토큰 컨텍스트와 H100 DGX 호스트 한 대 배포 경로를 안내합니다. 서버급 인프라로 보아야 하며, 상용 도입 전 맞춤형 Llama 4 Community License를 검토해야 합니다.

로컬 설정 검토 대기

MiniMax · local

MiniMax M2.7

코딩과 에이전트 작업을 위한 MiniMax의 229B 오픈 웨이트·맞춤형 라이선스 모델입니다. MiniMax는 vLLM·SGLang 서빙 경로를 공개하며, Apple Silicon용 독립 4비트 MLX 배포본도 있습니다. 다만 대상 Mac 용량과 런타임 동작은 로컬에서 검증해야 합니다.

로컬 설정 검토 대기

OpenAI · cloud

GPT-5

기존 워크로드를 위한 클라우드 전용 GPT 항목이며, 로컬 장비 추천 프로필은 제공하지 않습니다. OpenAI의 현재 모델 카탈로그는 GPT-5를 이전 모델로 분류하고 신규 코딩·추론·에이전트 사용에는 최신 GPT-6 Astra를 권장합니다. GPT-5를 신규 도입의 기본 선택으로 제시하지 않아야 합니다.

클라우드 전용

Qwen · both

Qwen-Image

Qwen-Image는 텍스트→이미지 생성과 이미지 편집을 지원하는 기존 20B Apache 2.0 이미지 기반 모델입니다. 공식 저장소는 이제 Qwen-Image-2.0을 후속 세대로 제시하므로, 이전 모델 호환성보다 최신 모델이 필요할 때에는 최신 가중치를 선택해야 합니다. Qwen은 구매 추천에 필요한 완전한 1차 데스크톱 요구 조건 프로필을 여전히 공개하지 않았습니다.

로컬 설정 검토 대기

Qwen · local

Qwen3-235B-A22B

총 235B·활성 22B 파라미터로 구성된 Qwen의 Apache 2.0 MoE 플래그십 모델입니다. 기본 문맥 길이는 32,768 토큰이며, 131,072 토큰을 사용하려면 YaRN 설정이 필요합니다. Qwen은 로컬·프로덕션 실행 경로를 안내합니다. 다만 단일 완전형 워크스테이션 요구 조건은 공개하지 않았으므로, 근거가 완성되기 전까지 장비 추천에서는 제외합니다.

로컬 설정 검토 대기

Qwen · local

Qwen3.8 2.4T-A95B

총 2.4T·활성 95B 파라미터로 구성된 Qwen의 텍스트 전용 추론 모델이며, 공식 vLLM·SGLang 경로를 제공합니다. Qwen3.8-Max 라이선스와 필수 추론 모드는 배포 전 검토 항목입니다. 별도 클라우드 Max 변형은 비전 입력과 기본 100만 토큰 컨텍스트 등 추가 기능을 제공합니다.

로컬 설정 검토 대기

OrcaRouter · local

Qwen3.8 27B Uncensored MLX

거부 성향을 제거한 커뮤니티 기반 Qwen3.8 27B MLX 빌드입니다. 현재 모델 카드는 2비트·4비트·6비트·8비트 변형을 제공하며, 기본값은 4비트입니다. Qwen의 공식 릴리스가 아니고 유의미한 기본 안전 장치가 없으며, 게시자는 합법적인 통제 환경의 안전 연구와 평가로 사용 범위를 제한합니다. 문서화된 모더레이션·악용 방지 계획을 소유자가 승인하지 않는 한 소비자 추천과 프로덕션 배포에서는 제외해야 합니다.

로컬 설정 검토 대기

Qwen · local

Qwen3.8 27B

262K 토큰 네이티브 컨텍스트를 제공하는 Qwen의 Apache 2.0, 27B 네이티브 비전 언어 모델입니다. 이는 공식 베이스 모델이며, Apple Silicon 포팅과 무검열 파생 모델은 별도의 커뮤니티 배포물로 분리해 평가해야 합니다.

로컬 설정 검토 대기

Qwen · local

Qwen3.8 Flash-Next

125B 메인 파라미터·활성 6B 파라미터와 추가 51B n-gram 임베딩 파라미터로 구성된 Qwen의 네이티브 멀티모달 MoE 모델입니다. Qwen은 vLLM·SGLang 서빙을 안내하며, Apple Silicon MLX 경로는 완전한 데스크톱 용량 프로필이 없으므로 대상 장비에서 검증해야 합니다.

로컬 설정 검토 대기

Qwen · both

Qwen3 8B

추론·LoRA·전체 파인튜닝·프로토타입 워치 프로필을 분리한 오픈 웨이트 언어 모델 항목입니다. 최소 메모리는 속도 추정치가 아니라 호환성 게이트입니다.

로컬 프로필 제공실행 장비 찾기

Upstage · local

Solar Open 2

한국어·영어·일본어 장기 에이전트 작업을 위한 Upstage의 250B-A15B 오픈 웨이트 MoE 언어 모델입니다. Upstage가 로컬 Transformers·vLLM 실행 경로를 제공하지만, 제공된 vLLM 빠른 시작은 각각 141GB 이상인 H200/B200급 GPU 8개를 전제로 합니다. 이는 소비자 GPU 추천이 아니라 서버급 인프라 경로입니다.

로컬 설정 검토 대기

Wan · local

Wan2.1 T2V 1.3B

480P 텍스트→영상 생성용 Apache 2.0 모델입니다. Wan 공식 저장소는 1.3B 모델에 8.19GB VRAM을 기록하지만, 데스크톱 RAM·저장 공간·운영체제를 포함한 완전한 요구 조건은 공개하지 않았습니다. 따라서 장비 추천은 보류합니다.

로컬 설정 검토 대기
로컬 실행 조건을 분명히 보여 주는 AI 모델.