llmfeed

Nex-N2.5-Max 공개 — 1.6조 파라미터 텍스트 전용 MoE 기반

Nex
  • Nex-N2.5 계열의 최상위 모델 Nex-N2.5-Max가 나왔다.
  • 1.6조 파라미터 규모의 텍스트 전용 MoE 기반 모델로, 회사는 조 단위 규모에서 처음으로 사후학습을 마쳤다고 밝혔다.
  • 가중치는 오픈소스로 공개된다.
모델Nex-N2.5-Max
저장소nex-agi/Nex-N2.5-Max
개방성오픈형
파라미터 1.6-trillion

무엇이 나왔나

  • Nex-AGI가 Nex-N2.5 계열의 가장 큰 모델인 Nex-N2.5-Max를 공개했다.
  • 같은 계열의 mini·Pro가 멀티모달인 것과 달리 Max는 텍스트만 다루는 모델이다.

규모와 구조

  • Nex-N2.5-Max는 1.6조(1.6-trillion) 파라미터 규모의 텍스트 전용 Mixture-of-Experts(MoE) 기반 모델이다.
  • 회사는 조 단위 파라미터 규모에서 사후학습을 처음으로 온전히 수행한 사례라고 밝혔다.
  • 또한 이 작업이 더 큰 모델의 에이전트 능력을 학습시키는 데 쓸 경험을 남겼다고 설명했다.

공개 형태

Nex-N2.5 계열의 가중치는 오픈소스로 공개되며, Nex-N2.5-Max는 Hugging Face와 ModelScope에서 받을 수 있다.

벤치마크

벤치마크 무엇을 재나 Nex-N2.5-Max (1.6-trillion) Claude Opus 5 (—) GPT-5.6 Sol (—)
Terminal-Bench 2.1 터미널 환경 작업 수행 86.1 89.1 88.8
SWE-Bench Pro 실제 소프트웨어 이슈 해결 65.7 79.2 64.6
DeepSWE v1.1 — 65.6 73.7 72.7
AutomationBench v1.0.6 — 50.2 50.3 45.8
Toolathlon Verified — 74.7 76.5 74.9
GDPval-AA v2 — 1713 1831 1711
Job Bench — 53.6 65.7 45.4
BrowseComp 웹 검색으로 정보 찾기 92.6 90.8 90.4
  • 회사는 자체 평가에서 temperature 0.7, top_p 0.95, top_k 40을 썼고, 코딩 과제는 NexAU 하네스로 평가했다고 밝혔다.
  • BrowseComp에서는 토큰 사용량이 컨텍스트 창의 60%를 넘으면 요약 방식의 컨텍스트 압축을 적용했다고 한다.

원문