검색 결과
"inference" · 2개 기사 · Hacker News · Cloud/Infra
12
해커뉴스Cloud/Infra269422026-08-11
Apple Silicon과 macOS VM: llama.cpp로 더 빠른 LLM 추론
Apple Silicon and macOS VMs: Faster LLM Inference with llama.cpp
Apple Silicon과 macOS VM 조합에서 llama.cpp 추론 성능을 끌어올리는 방법을 다룸. 로컬 LLM 실행을 위한 VM 활용과 가속 구성이 핵심.
해커뉴스Cloud/Infra109202026-06-03
AMD MI300X에서 DeepSeek-V4-Flash 구동하기
Bringing Up DeepSeek-V4-Flash on AMD MI300X
AMD MI300X에서 DeepSeek-V4-Flash를 실제로 올리고 실행하는 과정을 다룸. 모델 포팅과 하드웨어 최적화 이슈를 중심으로 정리한 기술 글.