본문으로 건너뛰기
AIDevOps
  • Learn
  • Learning Paths
  • Practice
  • Open Source
  • Books
  • Engineering

    AI DevOpsAI 서비스 개발·운영 전체 지도LLMOpsLLM 배포·평가·관측실전 프로젝트AI Agent 프로젝트 실습

    Knowledge

    Docs기술 문서 모음Blog엔지니어링 아티클Plogger개발 기록 피드

    Validate

    Certification3단계 역량 인증 · 준비 중
AI Models
LlamaMistralGemmaDeepSeekQwen
🧠 AI Core
AI 입문 & 로드맵ML FundamentalsLLM Fundamentals|Python AIC++|PyTorchTensorFlowJAX
🤖 AI 실전 개발
AI 실전 입문 & 로드맵Hugging FaceLangChainLlamaIndexLLMOps|LangGraphMCPMulti-AgentAgent Evaluation
🧠 AI Agent 개발
금융 AI AgentLLM API 서버주식 투자 AgentAIOps AI Agent교육 AI Agent코딩 AI Agent
🌱 Spring Cloud
Spring 입문 & 로드맵Spring Cloud GatewaySpring BootJava|Spring AISpring SecuritySpring BatchSpring JPA
🐳 DevOps
DevOps 입문 & 로드맵LinuxDockerCI/CD|Kubernetes 기본K8s 심화/실무PrometheusGrafana
🧱 인프라
인프라 입문 & 로드맵NginxRedis
☁️ 클라우드
클라우드 입문 & 로드맵AWSGCPAzureNCPCloudflare
🎨 Frontend
Frontend 입문 & 로드맵JavaScriptTypeScript|ReactNext.js|VueNuxt
📱 Mobile
Mobile 입문 & 로드맵KotlinAndroidFlutter
⚙️ Backend
Backend 입문 & 로드맵Python 기본FastAPIDjangoFlask|CGoGinNode.js
💾 Database
DB 입문 & 로드맵공통 SQLOracleMySQLPostgreSQL|MongoDB벡터 DB
🧪 검증
k6JMeternGrinder
AIDevOps

Engineering AI. From Code to Production.
AI와 AI Agent를 개발하고 운영하기 위한 엔지니어링 학습 플랫폼

Learn

  • 전체 가이드
  • Learning Paths
  • Practice
  • Books

Resources

  • AI DevOps
  • LLMOps
  • 실전 프로젝트
  • Docs
  • Blog
  • Plogger
  • Open Source
  • Certification (준비 중)

Start Here

  • AI Core 로드맵
  • AI 실전 개발 로드맵
  • Spring Cloud 로드맵
  • DevOps 로드맵
  • 인프라 로드맵

 

  • 클라우드 로드맵
  • Frontend 로드맵
  • Mobile 로드맵
  • Backend 로드맵
  • Database 로드맵
© 2026 AI DevOps Korea. All rights reserved.
이용약관개인정보처리방침Sitemaptestforge.kr
AI 오픈소스 모델 가이드

🤖 Qwen 완전 가이드

Visitors

Alibaba Group이 개발한 고성능 오픈소스 모델 Qwen 2.5. 뛰어난 한국어 능력, 코딩 성능 및 도구 호출 지시 이행력을 바탕으로 소형 0.5B부터 대형 72B까지 다양한 라인업을 제공합니다.

← AI DevOps 홈으로
🤖

Qwen 실전 예제

Ollama 실행, 도구 호출, 코딩 에이전트, 파인튜닝 예제 코드 모음.

실전 예제 보기 →

목차

0 / 7
  1. Qwen 소개
  2. 모델 라인업
  3. 라이선스 주의사항
  4. Ollama로 실행
  5. Hugging Face 활용
  6. Python 파이프라인
  7. 파인튜닝 (LoRA)
목차 7개 섹션
  1. Qwen 소개
  2. 모델 라인업
  3. 라이선스 주의사항
  4. Ollama로 실행
  5. Hugging Face 활용
  6. Python 파이프라인
  7. 파인튜닝 (LoRA)

Qwen 소개

Qwen(Tongyi Qianwen)은 Alibaba가 개발하고 오픈소스로 배포하는 최상위 고성능 LLM 시리즈입니다. Qwen 2.5 릴리스 이후, 다국어 처리 능력(특히 한국어 이해도)과 복잡한 수학적 문제 풀이, 코딩 능력이 비약적으로 상승하여 로컬 환경에서 가장 애용되는 모델 중 하나가 되었습니다.

모델 라인업

모델파라미터컨텍스트특징
Qwen 2.5 3B3B32768초경량, 모바일/온디바이스 최적
Qwen 2.5 7B7B32768로컬 개발 및 RAG 용 최적 밸런스
Qwen 2.5 14B / 32B14B / 32B32768중형 고성능, 정교한 에이전트 태스크
Qwen 2.5 72B72B32768상용 API급 최상의 성능

라이선스 주의사항

ℹ️

Qwen 2.5의 3B, 7B, 14B, 72B 등 주요 모델은 상업적 이용이 허용되는 Apache 2.0 라이선스로 배포됩니다. 단, 32B 등 일부 특정 모델 라인업의 경우 Alibaba의 Qwen Research License가 적용되므로 실무 도입 전 사용 약관 확인이 필요합니다.

Ollama로 실행

BASH
ollama run qwen2.5        # 7B (기본)
ollama run qwen2.5:3b     # 3B 경량
ollama run qwen2.5:72b    # 72B 고성능

Hugging Face 활용

BASH
pip install transformers torch accelerate
PYTHON
from transformers import AutoTokenizer, AutoModelForCausalLM
import torch

model_id = "Qwen/Qwen2.5-7B-Instruct"

tokenizer = AutoTokenizer.from_pretrained(model_id)
model = AutoModelForCausalLM.from_pretrained(
    model_id,
    torch_dtype="auto",
    device_map="auto",
)

messages = [{"role": "user", "content": "Spring Cloud Gateway의 필터 체인 동작 방식을 설명해줘"}]
input_ids = tokenizer.apply_chat_template(messages, tokenize=True, add_generation_prompt=True, return_tensors="pt").to("cuda")

outputs = model.generate(input_ids, max_new_tokens=512)
print(tokenizer.decode(outputs[0][input_ids.shape[-1]:], skip_special_tokens=True))

Python 파이프라인

PYTHON
from transformers import pipeline

pipe = pipeline(
    "text-generation",
    model="Qwen/Qwen2.5-7B-Instruct",
    torch_dtype="auto",
    device_map="auto",
)

result = pipe(
    [{"role": "user", "content": "LangChain ReAct 에이전트 개념에 대해 요약해줘"}],
    max_new_tokens=256,
)
print(result[0]["generated_text"][-1]["content"])

파인튜닝 (LoRA)

BASH
pip install transformers peft trl datasets
PYTHON
from transformers import AutoModelForCausalLM, AutoTokenizer, TrainingArguments
from peft import LoraConfig
from trl import SFTTrainer
from datasets import load_dataset

model = AutoModelForCausalLM.from_pretrained("Qwen/Qwen2.5-7B-Instruct", torch_dtype="auto", device_map="auto")
tokenizer = AutoTokenizer.from_pretrained("Qwen/Qwen2.5-7B-Instruct")

peft_config = LoraConfig(
    r=16, lora_alpha=32,
    target_modules=["q_proj", "v_proj", "k_proj", "o_proj", "gate_proj", "up_proj", "down_proj"],
    task_type="CAUSAL_LM",
)

training_args = TrainingArguments(
    output_dir="./qwen-finetuned",
    per_device_train_batch_size=2,
    gradient_accumulation_steps=4,
    num_train_epochs=3,
    learning_rate=1e-4,
    fp16=True,
)

trainer = SFTTrainer(
    model=model,
    args=training_args,
    peft_config=peft_config,
    train_dataset=load_dataset("your/dataset", split="train"),
    max_seq_length=512,
)
trainer.train()