bear mascotMOMIN09
HomeAbout
Archive
AI1CiCd1Cloud6IaC3Orchestration2Script1
Projects

태그: vllm

13건의 항목

  • 2026년 8월 05일

    서빙을 멈추지 않고 LoRA adapter 반영하기

    • vllm
    • lora
    • peft
    • fine-tuning
    • adapter-serving
    • nvidia-l4
  • 2026년 8월 04일

    복구, rollback, replica 확장 검증

    • kubernetes
    • deployment
    • rollback
    • recovery
    • scaling
    • vllm
    • kv-cache
  • 2026년 8월 04일

    N-gram speculative decoding 적용과 측정

    • vllm
    • speculative-decoding
    • ngram
    • latency
    • benchmark
    • nvidia-l4
  • 2026년 8월 03일

    GCP L4 vLLM 배포와 GPU memory 조정

    • vllm
    • qwen
    • awq
    • gpu-memory
    • model-serving
  • 2026년 8월 03일

    Service 구성과 클러스터 내부 호출 검증

    • kubernetes
    • service
    • endpointslice
    • vllm
    • networking
  • 2026년 8월 03일

    관측 stack 구성과 부하 구간 판독

    • prometheus
    • dcgm-exporter
    • servicemonitor
    • promql
    • vllm
    • load-test
  • 2026년 8월 03일

    GCP L4 기반 vLLM 서빙 환경 구축

    • gcp
    • nvidia-l4
    • k3s
    • vllm
    • gpu-serving
  • 2026년 7월 21일

    vLLM 리소스 최적화

    • vllm
    • gemma4
    • kubernetes
    • benchmark
    • gpu
  • 2026년 7월 20일

    자원 최적화

    • vllm
    • ollama
    • gemma4
    • kubernetes
    • benchmark
    • gpu
  • 2026년 7월 16일

    관측과 기준 벤치마크

    • prometheus
    • grafana
    • dcgm-exporter
    • vllm
    • gpu
  • 2026년 7월 15일

    Kubernetes Gemma 4 GPU 서빙

    • project
    • kubernetes
    • k3s
    • gemma4
    • vllm
    • gpu
  • 2026년 7월 14일

    Docker Gemma 4 12B 트러블슈팅

    • project
    • gemma4
    • vllm
    • docker
    • gpu
  • 2026년 7월 14일

    로컬 GPU 기반 AI Platform 구축

    • project
    • ai-platform
    • kubernetes
    • k3s
    • vllm
    • gemma4
    • gpu

그래프 뷰

Created with Quartz v4.5.2 © 2026