본문으로 건너뛰기
ONNX RuntimeMicrosoft오픈소스머신러닝 추론

ONNX Runtime, 스타 2만1000개 넘어선 크로스플랫폼 추론·학습 가속기로 확인

마이크로소프트가 운영하는 오픈소스 프로젝트 ONNX Runtime이 GitHub에서 스타 2만1478개, 포크 4151개를 기록하며 다양한 딥러닝·전통 머신러닝 프레임워크의 모델 추론과 다중 GPU 학습을 지원하는 대표적인 크로스플랫폼 가속기로 자리 잡은 사실이 확인됐다. 2018년 공개 이후 최근까지도 활발히 업데이트가 이어지고 있어, 모델 서빙 인프라를 표준화하려는 개발팀이 참고할 만한 프로젝트다.

확인 출처 1발행 주체 빅시프트

무엇이 바뀌었나

microsoft/onnxruntime 저장소가 GitHub 지표 기준 스타 2만1478개, 포크 4151개를 기록한 것으로 확인됐다[1]. ONNX Runtime은 PyTorch, TensorFlow/Keras 같은 딥러닝 프레임워크뿐 아니라 scikit-learn, LightGBM, XGBoost 등 전통적 머신러닝 라이브러리로 만든 모델의 추론까지 지원하는 크로스플랫폼 가속기이며, 다중 노드 NVIDIA GPU 환경에서 트랜스포머 모델 학습을 가속화하는 기능도 함께 제공한다[1]. 저장소는 2018년 11월 10일 생성됐고 최근까지도 커밋이 이어지고 있어[1], 하나의 발표성 이벤트라기보다는 꾸준히 유지·확장되고 있는 인프라 프로젝트의 현재 상태를 보여주는 스냅샷에 가깝다.

기업 실무 영향

서로 다른 학습 프레임워크로 만든 모델을 하나의 런타임에서 추론하도록 묶어주는 성격 때문에, 여러 팀이 각기 다른 도구로 모델을 개발해온 조직에서는 배포 단계에서 프레임워크 종속성을 줄이는 선택지로 검토될 수 있다[1]. 특히 scikit-learn이나 LightGBM, XGBoost 같은 전통적 머신러닝 모델까지 동일한 런타임에서 추론할 수 있다는 점은 딥러닝뿐 아니라 정형 데이터 기반 모델을 함께 운영하는 데이터 사이언스·MLOps 조직에 실무적으로 의미가 있다[1]. 다중 GPU 학습 가속 기능은 대규모 트랜스포머 모델을 자체 인프라에서 학습시키는 조직의 인프라 엔지니어에게 참고 대상이 될 수 있지만, 구체적인 성능 수치나 지원 버전 범위는 이번 확인 사실만으로는 드러나지 않아 도입 전 별도 검증이 필요하다.

불확실성

저장소 메타데이터에서 확인된 게시 시각(published_at)이 저장소 생성일(created_at)과 동일한 값으로 나타나, 이 정보가 실제로 최근 새롭게 게시·갱신된 내용인지 아니면 단순히 저장소 생성 시점을 그대로 반영한 메타데이터 필드인지는 명확하지 않다[1]. 따라서 이번 확인 사실을 새로운 발표나 버전 출시로 보기보다는, ONNX Runtime이라는 프로젝트의 현재 규모와 기능 범위를 정리한 자료로 이해하는 편이 적절하다.

확인한 출처

관련 AI 뉴스

AI BRIEFING/

아파치 인큐베이터, 로컬 우선 AI 에이전트 워크스페이스 'Maka' 공개

오픈소스 프로젝트 'Apache Maka'가 GitHub 트렌딩과 GeekNews를 통해 알려졌다. 모델 메시지·도구 호출·권한 결정 등을 append-only 로그로 남겨 크래시 복구와 평가에 활용하고, 세션·설정을 로컬에 저장하는 구조가 특징이며 현재 Apache Incubator PMC 산하에서 인큐베이팅 중이다.

Apache MakaApache IncubatorAI 에이전트
읽기
AI BRIEFING/

Autolith, 실행 중인 Common Lisp 런타임을 직접 수정하는 터미널 코딩 에이전트

GitHub 사용자 luciusmagn이 터미널에서 동작하는 프로그래밍 에이전트 'Autolith'를 공개했다. 파일 편집이나 명령 실행 같은 일반적인 코딩 에이전트 기능에 더해, 자신이 구동되는 SBCL Lisp 이미지 자체의 함수와 클래스를 실행 중에 검사하고 교체할 수 있다는 점이 특징이다.

AutolithCommon LispSBCL
읽기
AI BRIEFING/

허깅페이스, 오픈소스 모델만으로 로컬 음성 에이전트 만드는 파이프라인 공개

허깅페이스가 VAD·STT·LLM·TTS 4단계를 스레드와 큐로 연결한 저지연 음성 파이프라인 'speech-to-speech'를 Apache-2.0 라이선스로 공개했다. OpenAI Realtime 호환 API를 제공해 기존 클라이언트를 그대로 붙일 수 있고, 실제로 수천 대의 Reachy Mini 로봇 대화 백엔드로 운영되고 있어 자체 호스팅 음성 에이전트를 검토하는 조직에 참고할 만한 사례다.

Hugging Facespeech-to-speech오픈소스
읽기