GLM‑4.5 logo

GLM‑4.5오픈 소스 하이브리드-이유 추론의 MoE 기반이 되는 모델은 에이전트, 코딩, 도구 사용과 같은 작업을 위해 설계되었습니다.

4.5 (6)
Daniel Nikulshyn리뷰어 Daniel Nikulshyn·업데이트됨 2026년 6월

개요

글라임‑4.5(GLM-4.5)은 지푸(지푸) 자이(GLM 모델 계열의 일원으로 지푸 AI(지푸)에 의해 개발된 공개 소스 대형 언어 모델이다. 그것은 혼합 전문가(Mixture-of-Experts, MoE) 아키텍처와 하이브리드 사고 디자인(hybrid-reasoning design)을 사용함으로써 모델은 의식적으로 "생각"하기 전에도 또는 직접적으로 답변할 수 있도록 허용함으로써 의사 작동 워크플로우, 코딩 및도구 사용을 목표로 한다. 모델은 128K 토큰 컨텍스트 창을 지원하고 내장형 도구 호출을 지원한다. 이 모델은 개발자가 AI 에이전트와 코딩 어시스턴트를 개발하는 개발자들을 위해 설계되었습니다. 이 모델은 "인터리브드 씽킹(Interleaved Thinking)"을 도입했는데, 모델은 각 응답과 도구 호출 이전에 사전적인 합의를 가지고 합의를 해내고, 나중에 GLM 버전 (GLM-4.6 및 GLM-4.7)에 이어 '퍼지드 씽킹(Preserved Thinking)'과 '턴-레벨 씽킹(Turn-level Thinking)'과 같은 특성을 확장했습니다. GLM-4.5는 에이전틱 코딩(agentic coding) emphasize, 메인스트림 에이전트 프레임워크와 코딩 도구와 통합하는 데 중점을 둘 뿐만 아니라 Claude Code, Cline, Roo Code, 및 Kilo Code와 같은 코딩 도구의 API와 통합하는 것을 포함하며 SDK 및 SaaS 제품으로도 출시됩니다. 지포스 깃허브 저장소에는 모델 리소스, 추론 코드 및 예시를 호스팅하며 가중치는 자체 호스팅을 위해 공개되며, API는 지아이 API 플랫폼을 통해 제공된다. 저장소에는 succeedsor 모델 지포스 - 4.6 (200K 토큰까지 확장한 컨텍스트)와 지포스 - 4.7, 가벼운 30B - A3B 버전 (지포스 - 4.7 - 플래시)까지 문서화된 이후, 더 효율적인 배포를위한 가벼운 30B - A3B 버전 지포스 - 4.7 - 플래시를 문서화했다. GLM-4.5은 공개 버전으로 인공지능 모델의 개발 시 다른 공개 모델과 경쟁을 하고 있습니다. 이 모델의 주요한 장점은 툴 사용, 논리적 사고 통제, 그리고 전면 공개 오픈의 특징에 있습니다. 하지만 이 모델은 많은 네트워크 단말점를 로컬로 실행하기 위해 강력한 하드웨어가 필요하고, 벤치마크에서 GLM의 후계 모델이 나옴에 따라 이 모델의 성능이 나중에는 후퇴했습니다. GLM-4.5은 인지 및 코딩 용도에 중점을 두는 다른 모델에 경쟁합니다. 이 모델의 강점은 툴 사용, 이득을 위한 논리 통제, 그리고 전면 공개에 있습니다.

주요 기능

  • Mixture-of-Experts (MoE) 아키텍처
  • 하이브리드 이론화와 사고/비사고 모드
  • 에이전트 내부에있는 도구 호출
  • 응답 및 도구 호출의 중간에 사고를 진행
  • 128K 컨텍스트 창
  • 에이전트 최적화를 위한 코딩 최적화

가격

모델
Free
평점
4.5 / 5 (6)

사용 사례

자율 AI 에이전트 생성

GLM-4.5의 에이전트 최적화된 DESIGN 및 툴 사용 능력을 기반으로 멀티 스테이지 태스크를 계획하고, 사고하고, 실행할 수 있는 자동 에이전트를 생성함.

장문 분석

128K 컨텍스트 창을 사용하여 단일 패스로 장문, 코딩베이스 또는 트랜스크립트를 처리하고 사고함.

하이브리드 이론화 워크플로우

단순한 응답과 더 깊은 단계별 문제 해결이 모두 필요할 때 하이브리드 이론화 MoE 아키텍처를 적용함.

오픈 소스 LLM 자체 호스팅

자가 호스팅하고자 하는 조직이 유니폼적이고 오픈 소스 기초 모델에 대해 전적인 데이터 제어가 필요할 때 GLM-4.5를 자체 서버에 배치함.

장단점

장점

  • 자체 호스팅을 위해 오픈 소스 가중치가 제공됨
  • 하이브리드-이유 체계화와 조정할 수 있는 사고 모드
  • 에이전트 코딩 및 도구 사용에 강력한 집중
  • popular 에이전트 프레임워크 인 Claude Code 및 Cline와 통합
  • 128K 토큰 컨텍스트 창
  • 호스트 Z.ai API의 최선의 성능

단점

  • 자체 호스팅을 위해 대규모 MoE 모델이 충분한 하드웨어가 필요함
  • 최신 GLM-4.6과 GLM-4.7 버전이 출시된 이후로 업그레이드 됨
  • 최상의 성능을 달성하는 경우 호스트 Z.ai API 사용

대결 기록

Pantheon에서 6회 대결.

2
1위
1
2위
1
3위

Last 5 battles

리뷰

4.5

6개 평가의 평균.

5
3
4
3
3
0
2
0
1
0

리뷰를 작성하려면 로그인하세요.

DW

Devin Walker

May 18, 2026

Does the job

Pretty happy overall. The core workflow just works and it saves real time. The docs could be deeper can be annoying, but no dealbreakers — I'd recommend it to a friend without hesitating.

JK

Joanna Kowalski

May 11, 2026

Use it every day

Honestly didn't expect to like it this much. The integrations is exactly what I needed, and it is genuinely easy to set up. I do wish the mobile experience lags, but I reach for it almost every day now and it just clicks.

Kwame Mensah

Kwame Mensah

Feb 21, 2026

Use it every day

Honestly didn't expect to like it this much. The integrations is exactly what I needed, and it is genuinely easy to set up. I do wish the mobile experience lags, but I reach for it almost every day now and it just clicks.

Priya Nair

Priya Nair

Jan 22, 2026

Solid for our team

We rolled this out across the team last quarter and it is genuinely easy to set up. The core workflow fits neatly into how we already work, and the automation removed a step we used to do by hand. but it has held up under daily use.

Mei-Ling Wong

Mei-Ling Wong

Jun 27, 2025

Years in this space

I've evaluated a lot of these over the years. What stands out here is the integrations — handled better than most — and the value for money is strong. Worth the time if this is your use case.

Daniel Schmidt

Daniel Schmidt

Jun 20, 2025

Solid for our team

We rolled this out across the team last quarter and support is responsive. The core workflow fits neatly into how we already work, and the core workflow removed a step we used to do by hand. A few rough edges remain, which is the main caveat, but it has held up under daily use.

Q&A

GLM-4.5의 Context Window 크기는 얼마인가요?

GLM-4.5는 128K Token Context Window를 지원하여 Long Documents, Extended Conversations 또는 Complex Multi-Step Agent Tasks를 처리할 수 있습니다.

Asked by Aisha Khan · Jul 5, 2025

GLM-4.5는 Open Source이며 Free로 사용할 수 있나요?

예, GLM-4.5는 Open-Source Foundation Model로, Weight와 Code에는 라이선스 수수료가 없지만, 배포 비용(컴퓨팅 인프라 포함)은 여전히 적용될 수 있습니다.

Asked by Yuki Mori · May 18, 2025

GLM-4.5는 Intelligent Agent Tasks에 적합한 이유는 무엇일까요?

GLM-4.5는 Hybrid-Reasoning Mixture-of-Experts(MoE) 기반 모델로, Agent 워크플로우를 위해 특별히 최적화되어 있으며 Tool Use Capabilities와 128K Context Window가 내장되어 Long, Multi-Step Tasks를 처리할 수 있습니다.

Asked by Carlos Mendoza · Mar 29, 2025

질문하기

AI 모델 서빙 플랫폼 대안