ks.dgoon.lee log

로컬에서 돌려본 qwen3.6-35b/27b, gemma4-26b/35b


2026/08/09 18:51:43 #server #dev #llm #ai

DGX Spark 5대 클러스터, 맥 3대 클러스터(64GB X 3) 에서 여러모로 써본 후 짦은 소감.

1. 코딩

  • 순수하게 코딩 용도로 저 중에 선택한다고 하면 qwen3.6-35b 밖에 없다.
  • 일단 코딩에는 dense 모델은 안 맞음. gemma4 MoE인 gemma4-26b 는 일이 좀 복잡해지면 적당히 하고 안 끝낸 상태로 다 했음 해버릴때가 너무 많음.
  • 하지만 나는 저기있는 모델들로 코딩하지 않을거야.

2. 번역

  • 특정 텍스트(언어 지정 할 수 없음)를 10개 언어(한국어, 영어, 일본어, 중국어, 독일어, 프랑스어, 스페인어, 인도네시아어, 베트남어 기타등등...)로 번역하는게 필요.
  • qwen 패밀리는 이런 일에 절대 쓸수 없음. 영어, 중국어, 한국어를 벗어나는 순간 고유명사 날조부터 시작해서 난리남.
  • gemma4-26b, 31b 는 이런 날조는 거의 없고 비교적 마이너 언어들도 거의 문제없이 잘 함. 역시 구글이 이런데 강하군...

3. GB10 vs Mac

  • single user 라면 mac 도 괜찮다. 아니 좀 더 빠를지도. 하지만 concurrency 가 조금만 올라가면 mac 은 절망적.
  • decode 보다는 prefill 차이가 결정적이다. 캐싱해도 뭐 근본적인 속도차이가 넘사벽.



댓글 0개