본문으로 건너뛰기
Ox AlphaOpenRouterOpenCodeZhipu AI

정체불명 AI 모델 'Ox Alpha', 개발사 두고 상반된 추측 확산

OpenRouter와 OpenCode에 무료·무제한으로 공개된 신규 모델 'Ox Alpha'를 두고 개발 주체를 놓고 상반된 주장이 나오고 있다. 한쪽은 토크나이저 유사성과 벤치마크 결과를 근거로 Zhipu AI의 GLM 계열(GLM-6 추정)이라 주장했고, 다른 쪽은 GLM-5.x 기반이지만 서구 기업이 사후 학습했을 가능성을 제기했다. 어느 쪽도 공식 확인은 아니며, 실제 개발사는 아직 밝혀지지 않았다.

확인 출처 1발행 주체 빅시프트

무엇이 바뀌었나

X(트위터) 사용자 Ananay(@ananayarora)는 'Ox Alpha'라는 이름의 새 AI 모델이 OpenRouter와 OpenCode에서 무료·무제한으로 공개됐다고 밝혔다. 그는 이 모델의 토크나이저가 다른 연구소 모델들과 비교했을 때 가장 높은 유사도가 11개 항목 중 4개에 그친 반면, SWE 및 Cyber 벤치마크 결과 패턴이 특정 계열과 가깝다는 점을 근거로 Ox Alpha가 Zhipu AI의 GLM 계열, 잠정적으로 GLM-6일 가능성이 높다고 주장했다. 이 트윗은 6만1300회 이상 조회되며 관심을 모았다.[1]

이후 다른 사용자 Petri Kuittinen(@KuittinenPetri)이 'stealth/0x-alpha'를 직접 테스트한 결과를 공개하며 반박에 나섰다. 그는 이 모델이 중국 모델이 아니라 GLM-5.x 계열을 기반으로 서구 기업, 가능성 있게는 xAI가 사후 학습(post-training)한 결과물일 것이라는 상반된 견해를 제시했다.[1]

상반된 두 가지 추정이 나오는 이유

두 주장 모두 공식 발표가 아니라 외부 관찰자가 벤치마크 결과와 모델 동작 패턴을 근거로 추론한 것이라는 공통점이 있다. Ananay 쪽 근거는 토크나이저 구조와 SWE·Cyber 벤치마크 성능 프로파일이 GLM 계열과 가깝다는 것이고, Kuittinen 쪽 근거는 실제 사용 테스트에서 나타난 응답 스타일과 기반 모델 추정치다.[1] 같은 대상을 두고 '어느 회사의 베이스 모델인가'와 '누가 후속 학습을 했는가'라는 서로 다른 층위의 질문에 답하려다 보니 결론이 엇갈린 것으로 보인다. 이번 사례는 앞서 알려진 stealth/pony-alpha, DeepSWE 같은 이름 미상 모델들이 OpenRouter를 통해 먼저 공개되고 이후 정체가 역추적되는 최근 흐름과도 맞닿아 있다.[1]

실무에서 확인할 점

개발팀 입장에서 무료·무제한으로 풀린 강력한 모델은 매력적이지만, 개발 주체가 불분명한 상태에서 프로덕션 워크로드에 연결하는 것은 신중해야 할 사안이다. 데이터 처리 정책, 장기적인 API 지속성, 라이선스 조건이 모두 확인되지 않은 상태이기 때문이다. 코딩 에이전트나 보안 관련 업무에 이런 stealth 모델을 시험적으로 붙여보는 것은 가능하지만, 실제 서비스에 채택하기 전에는 공식 발표나 명확한 출처 확인을 거치는 편이 안전하다. 벤치마크 성능이 좋다는 반응만으로 도입을 서두르기보다는, 모델명과 개발사가 공식화되는 시점까지 지켜보는 접근이 합리적이다.

불확실성

Ox Alpha의 실제 개발 주체는 현재로선 확정되지 않았다. Ananay는 Zhipu AI의 GLM-6로 추정한 반면 Kuittinen은 GLM-5.x 기반에 서구 기업, 가능성 있게는 xAI가 후속 학습을 했다고 주장해 두 견해가 정면으로 충돌한다.[1] 어느 쪽도 공식 확인을 거치지 않았으며, 모델이 실제로 GLM-6라는 이름으로 정식 출시될지, 혹은 이른바 'mythos급' 성능에 도달했다는 평가가 맞는지도 추측 단계에 머물러 있다.[1]

확인한 출처

관련 AI 뉴스

AI BRIEFING/

증류된 소형 AI, 벤치마크 점수는 같아도 '사고의 해상도'는 다르다는 주장

GeekNews에 게시된 한 글이 지식 증류로 만든 소형 'Student' 모델이 벤치마크에서 거대 'Teacher' 모델과 비슷한 점수를 받더라도, 평소 잘 나타나지 않는 롱테일 상황에 대응하는 사고 능력까지 같다고 보기는 어렵다는 주장을 폈다. 이를 MP3와 FLAC의 음질 차이에 비유하며, 문제 영역이 뚜렷한 스페셜리스트 AI에는 증류가 효율적이지만 제너럴리스트 AI에는 거대 모델의 표현 용량이 필요하다고 봤다.

AI 증류Distillation소형 AI 모델
읽기
AI BRIEFING/

Nvidia 연구, AI 에이전트 성능은 모델이 아니라 '하니스'가 좌우한다는 결과 공개

Nvidia가 공개한 연구에서 동일한 Claude Opus 5 모델이 자체 개발한 하니스와 감독 컴포넌트를 붙였을 때 ARC-AGI-3 벤치마크에서 100% 점수를 기록했지만, 하니스 없이는 30%에 그쳤다. 모델 자체의 성능 향상보다 메모리 관리·도구 접근·감독 구조 같은 소프트웨어 하니스 설계가 장기 과제 수행 능력을 더 크게 좌우한다는 뜻으로, AI 에이전트를 도입하는 기업의 투자 우선순위에 시사점을 준다.

NvidiaAI 에이전트ARC-AGI-3
읽기
AI BRIEFING/

OpenRouter에 정체불명 모델 'Ox Alpha' 등록, 강한 성능으로 화제

AI 모델 라우팅 플랫폼 OpenRouter에 개발사가 알려지지 않은 'Ox Alpha'라는 모델이 등록돼 화제를 모으고 있다. 강한 성능을 보여준다는 반응이 나오고 있지만, 누가 만들었는지와 정확한 등록 시점은 아직 공개되지 않았다.

OpenRouterOx AlphaAI 모델
읽기