같은 베이스, 포스트트레이닝만으로: Z.ai가 자체적으로 지목한 GLM-5.3의 사이버 점프
743B 모델 GLM-5.3은 GLM-5.2와 동일한 베이스를 재사용하고 개선 전부를 포스트트레이닝 스케일링에서 얻었다. 벤더는 이번 릴리스에서 '의외로 나타난' 취약점 공격 역량까지 스스로 경고한다.
오늘의 핵심
모델
인프라
오픈AI와 세레브라스가 GPT-5.6 Sol을 초당 최대 750토큰으로 가속하는 'Ultrafast' 티어를 공개했다. 웨이퍼스케일 아키텍처가 GPU의 고질적인 메모리 병목을 어떻게 돌파하는지, 그리고 공개된 수치 뒤에 남은 과제는 무엇인지 짚어본다.
사회
기업 보안 프로그램이 파악하는 AI 공격면은 실제의 3분의 1에 불과한데, 풀스택 에이전트 도입은 빠르게 늘고 있다. 최근 발생한 샌드박스 탈출 사건은 이 관리 사각지대를 미 의회와 규제 당국의 핵심 쟁점으로 끌어올렸다.
인프라
토큰당 3B 파라미터만 활성화하는 목적형 MoE 실행기와 NeMo Switchyard 라우팅이 에이전트 워크로드의 비용 구조를 다시 쓰고 있다. 다만 속도 향상 수치는 아직 공급업체 자체 측정치에 머물러 있다.