레드햇, 'Red Hat AI 3.5'로 GPU 멀티테넌시·격리 강화
최근 30일 조회수 — 좋아요 —핵심 요약
레드햇이 우선순위 기반 GPU 자원 배분과 격리 기능을 갖춘 'Red Hat AI 3.5'를 출시해 AI 워크로드를 미션 크리티컬 수준으로 운영할 수 있게 했다.
레드햇이 이번 주 ‘Red Hat AI 3.5’를 출시했다. 소프트웨어 엔지니어링팀이 AI 워크로드를 여느 미션 크리티컬 엔터프라이즈 애플리케이션과 같은 수준의 운영 통제 아래 돌릴 수 있게 하려는 조치다. 이번 릴리스의 핵심은 AI 서비스 제공업체를 겨냥한 멀티테넌시 기능 확장이다.1
새 플랫폼은 두 가지 축으로 움직인다. 하나는 하드웨어부터 소프트웨어까지 완전히 분리하는 격리 기능으로, 민감 데이터나 독점 모델, 규제 대상 정보를 다루는 AI 워크로드에 필요한 조건이다. 다른 하나는 우선순위 기반 서비스 요청 처리로, 공유 GPU 인프라 위에서 미션 크리티컬 워크로드가 우선 실행되고 상대적으로 덜 중요한 작업은 뒤로 밀리도록 하는 네이티브 멀티테넌시다. 우선순위가 낮은 작업을 별도로 GPU를 새로 띄우는 대신 여유 용량이나 저렴한 용량에서 돌리는 방식으로, GPU 활용을 팀·고객·애플리케이션 단위로 쪼개 쓰는 프로덕션 환경에 맞춘 설계다.1
레드햇의 AI 제품 담당 시니어 디렉터 투샤르 카타르키(Tushar Katarki)는 더뉴스택에 안전장치 없이 엔터프라이즈 AI를 운영하는 것을 “눈을 가리고 슈퍼카를 모는 것”에 비유했다. 그는 “Red Hat AI 3.5는 AI를 예측 불가능한 실험이 아니라 미션 크리티컬 서비스로 운영하는 데 필요한 운영 가드레일과 검증 가능한 신뢰, 멀티테넌트 통제를 제공한다”며, 배포 전 안전성 벤치마킹과 실시간 관측성, GPU 자원 관리를 하나로 묶어 플랫폼팀이 고립된 파일럿을 완전히 거버넌스된 엔터프라이즈 아키텍처로 전환할 수 있게 한다고 설명했다.1
외부 시각에서 보면 이번 업데이트의 무게는 다르게 읽힌다. 응용수학자이자 데이터 과학자인 조슈아 에스트린(Joshua Estrin)은 더뉴스택에 “이제 모든 GPU 요청이 우선순위 결정이 됐다”고 말했다. 개발자 한 명의 내부 실험과 재무 마감 업무를 같은 긴급도로 다룰 수 없다는 것이다. 그는 우선순위 기반 멀티테넌시가 값비싼 컴퓨팅 자원을 효율적으로 쓰게 해주지만, 격리 없는 효율화는 보안·신뢰성 위기를 더 빨리 부르는 길일 뿐이라고 지적했다. 엔비디아, 뉴타닉스, 랜처를 갖춘 수세, HPE 에즈메랄, 브로드컴 산하 VM웨어 클라우드 파운데이션 등을 이 시장의 주요 경쟁자로 꼽으면서, 결국 승자는 용량을 공유하면서도 “어디서 누구의 워크로드가 실제로 실행됐는지”를 증명할 수 있는 쪽이 될 것이라고 봤다. 어떤 작업이 실행됐는지, 누가 접근했는지, 비용은 얼마였는지, 수요가 급증했을 때 무슨 일이 벌어지는지는 인프라 다이어그램이 아니라 대개 특정 업무가 느려진 뒤 회의실에서 따져지는 문제라는 게 그의 진단이다.1
Footnotes
읽기 목록은 이 브라우저에 저장됩니다.
출처
- Red Hat AI 3.5 tackles the GPU queue that can stall AI pilots — The New Stack
이 글은 위 출처를 근거로 자동 생성된 뒤 발행됐습니다. 원문을 함께 확인해 주세요. 교차 보도 없이 단독 출처로 작성됐습니다.