bear mascotMOMIN09
HomeAbout
Archive
AI1CiCd1Cloud6IaC3Orchestration2Script1
Projects

태그: nvidia-l4

4건의 항목

  • 2026년 8월 05일

    서빙을 멈추지 않고 LoRA adapter 반영하기

    • vllm
    • lora
    • peft
    • fine-tuning
    • adapter-serving
    • nvidia-l4
  • 2026년 8월 04일

    N-gram speculative decoding 적용과 측정

    • vllm
    • speculative-decoding
    • ngram
    • latency
    • benchmark
    • nvidia-l4
  • 2026년 8월 03일

    GCP L4와 k3s GPU stack 구성

    • gcp
    • nvidia-l4
    • k3s
    • nvidia-device-plugin
    • time-slicing
  • 2026년 8월 03일

    GCP L4 기반 vLLM 서빙 환경 구축

    • gcp
    • nvidia-l4
    • k3s
    • vllm
    • gpu-serving

그래프 뷰

Created with Quartz v4.5.2 © 2026