지푸 AI, 100만 토큰 컨텍스트 대규모 AI 공개

안녕하세요, 리키입니다. 오늘 여러분께는 중국의 지푸 AI(Zhipu AI)가 공개한 새로운 언어 모델에 대한 이야기를 좀 해드리려고 합니다. 이번에 출시된 GLM-5.2 모델은 특히 긴 작업이나 프로그래밍 같은 복잡한 에이전트 업무를 처리하는 데 중점을 두고 개발되었다고 하더군요.

이번에 지푸 AI가 내놓은 GLM-5.2 모델의 가장 큰 특징은 바로 100만 토큰이라는 엄청난 컨텍스트 창을 지원한다는 점입니다. 이 정도 길이의 정보를 한 번에 이해하고 처리할 수 있다는 것은, 기존 모델들이 어려워했던 장기적인 추론이나 복잡한 코드를 다루는 데 훨씬 유리하다는 의미가 있습니다. 또한 오픈 소스 솔루션으로 공개되었고 MIT 라이선스를 따르며, 사용자들이 로컬 환경에서 직접 배포하여 사용할 수 있도록 지원하고 있습니다.

모델의 기술적 발전

GLM-5.2 모델은 단순히 크기만 큰 것이 아니라 내부 구조에서도 많은 개선이 이루어졌습니다. 이 모델은 영어와 중국어 모두에서 텍스트를 생성할 수 있으며, 총 7,530억 개의 파라미터를 가지고 있습니다. 특히 성능을 높이기 위해 ‘추론 강도(reasoning intensity)’라는 여러 단계를 지원하여 사용자가 결과물의 품질과 처리 속도 사이에서 적절한 균형을 맞출 수 있게 했습니다. 내부 아키텍처에는 인덱스 공유(IndexShare)와 업데이트된 MTP 레이어가 포함되어 있는데, 이는 토큰당 연산량을 줄이고 확인 길이를 늘리는 데 기여했다고 합니다.

개발자들은 이러한 개선 사항 덕분에 여러 벤치마크에서 다른 오픈 소스 모델들보다 뛰어난 성능을 보였다고 이야기하고 있습니다. 특히 FrontierSWE나 SWE-Marathon 같은 주요 프로그래밍 관련 테스트에서 GLM-5.2가 강점을 보였으며, 일반적인 프로그래밍 성능 테스트에서도 가장 강력한 오픈 소스 모델 중 하나로 자리매김했다는 점이 주목됩니다.

또한, 이 모델은 다양한 환경에서 쉽게 사용할 수 있도록 배포 옵션도 잘 갖추고 있습니다. SGLang, vLLM 같은 도구들을 통해 로컬 디바이스에 설치하여 운영할 수 있으며, llama.cpp나 Ollama 같은 양자화(Quantization) 기술을 활용하면 메모리 효율성까지 높일 수 있더군요. 이는 사용자들이 고성능 AI 모델을 더 접근하기 쉽게 만드는 중요한 발판이 될 것입니다.


참고 원문: https://forklog.com/en/zhipu-ai-launches-glm-5-2-with-1-million-token-context/

댓글 달기

이메일 주소는 공개되지 않습니다. 필수 필드는 *로 표시됩니다

위로 스크롤