빠른 모델 두 개를 포기하고, 느린 모델을 골랐다. Qwen3.8-27B 로컬 실사용 후기
⚡ 한 줄 답변 Qwen3.8-27B는 맥미니 M4 Pro 64GB에서 decode 15 tok/s밖에 안 나와서 느리다. 그런데도 나는 이걸 최종 채택했다. 5~7배 빠른 MoE 모델 두 개를 먼저 테스트했는데, 둘 다 속도가 아니라 정확도에서 탈락했기 때문이다. Obsidian에 로컬 LLM을 붙여 쓰고 있다. 노트 정리하고, 웹 검색 시키고, 한국어로 깔끔하게 요약하도록 한다. 어느 날부터 “좀 더 똑똑하면 … 더 읽기