2026년 초 Meta의 Llama 4, Google의 Gemma 3, Mistral의 Large 3이 거의 동시에 출시되면서 LLM 시장이 정말 열기 불타고 있네요. 저도 지난 3월부터 쭉 지켜보고 있는데 매달 새로운 모델이 나오는 거 보니까 정말 미쳤더라고요. 요즘 OpenAI 말고 오픈소스 모델들이 진짜 쓸만해졌다는 게 체감되요.
특히 놀라웠던 건 Llama 4, Gemma 3, Mistral Large 3 같은 모델들이 상용 모델과 경쟁할 수 있음을 증명했다는 거예요. 예전에 이런 삽질을 했는데, LLaMA 초기 버전 쓰다가 성능이 부족해서 결국 GPT-4를 쓰거나 Claude로 갈아탔었는데, 이제는 오픈소스 모델들도 벤치마크에서 상용 모델과 거의 비슷한 수준이네요. Google Gemma 4, Alibaba Qwen3.6, Z.ai GLM-5.2, Meta Llama 3.3 70B, DeepSeek-R1 같은 모델들이 6월 쯤에 나왔는데 정말 선택지가 많아졌어요.
근데 실제로 뭘 써야 할지가 문제네요 ㅠㅠ 회사에서는 보안 때문에 API 기반 모델 못 쓰고 로컬에서 돌려야 하는데, Llama 4는 모델이 너무 크고, Qwen3는 한국어 처리는 괜찮은데 추론 성능이 아직 좀 아쉬워요. 개인적으로는 최근에 DeepSeek R1 써보고 있는데 추론 과정이 명확해서 정말 좋더라고요. 디버깅할 때도 훨씬 편하고요.