GPU 클러스터 / GPU 커널 / GPU / GPU 스케줄링 / GPU 보안
17건
기사 통계를 확인하고 있습니다.
-
엔비디아, GPU 클러스터 검증 체계 AICR 1.0 공개
AICR 1.0은 GPU 쿠버네티스 구성의 호환성을 레시피와 서명된 증거로 검증·재현하는 오픈 체계다.
-
GPU 커널 검증 시스템 RESOLVE 제안
RESOLVE는 실행 테스트와 커널 축소, 형식 증명을 결합해 경쟁 상태와 계산 오류를 검증한다.
-
PyTorch·vLLM, 헬리온 백엔드 통합
헬리온이 선형 연산 알고리즘을 입력별로 자동 튜닝해 호퍼 GPU 일부 작업의 처리량을 10% 이상 높였다.
-
AWS, 세이지메이커 하이퍼팟에 쿠물로 연동 지원 발표
AWS가 데이터 복제 없이 원격 리전 GPU로 대규모 모델을 학습시키는 하이퍼팟-쿠물로 연동 구조를 공개했다.
-
NVIDIA, GPU 클러스터 검증·변경 오픈소스 도구 공개
NVIDIA가 대규모 GPU 클러스터의 사전 검증용 NVCRE와 운영 중 안전한 구성 변경용 노드라이트를 오픈소스로 공개했다.
-
NVIDIA, 클러스터 토폴로지 실시간 파악 도구 'Topograph' 공개
NVIDIA가 GPU 클러스터 네트워크 토폴로지를 실시간 수집해 Slurm·쿠버네티스 스케줄러에 전달하는 오픈소스 도구 Topograph를 공개했다.
-
vLLM, GPU 종류 안 가리는 '하드웨어 애그노스틱' 레이어 도입
vLLM이 프런티어 모델의 하드웨어별 최적화 흐름 속에서도 다양한 가속기 지원을 유지하기 위한 새 레이어를 공개했다.
-
토스증권, 쿠버네티스 GPU 클러스터를 GPU-native로 고도화
토스증권이 GPU 인식을 넘어 VRAM 관리·노드 검증까지 아우르는 GPU-native 쿠버네티스 클러스터 구축 과정을 공개했다.
-
AWS 세이지메이커 AI, GPU 인스턴스 우선순위 목록 기능 추가
AWS가 세이지메이커 AI 학습·프로세싱 작업에 최대 5개 GPU 인스턴스를 우선순위로 지정해 자동 시작하는 기능을 도입했다.
-
Together AI, GPU 반값 선점형 컴퓨트 공개 프리뷰 출시
Together AI가 온디맨드 요금의 절반 가격으로 유휴 GPU를 쓸 수 있는 선점형 컴퓨트를 쿠버네티스 클러스터에 공개 프리뷰로 도입했다.
-
레드햇, 'Red Hat AI 3.5'로 GPU 멀티테넌시·격리 강화
레드햇이 우선순위 기반 GPU 자원 배분과 격리 기능을 갖춘 'Red Hat AI 3.5'를 출시해 AI 워크로드를 미션 크리티컬 수준으로 운영할 수 있게 했다.
-
코그니션, AI 에이전트로 RSA-260 인수분해 성공
코그니션이 AI 코딩 에이전트 데빈을 활용해 GPU 기반 GNFS 최적화로 RSA-260 인수분해에 성공했다고 발표했다.
-
NVIDIA, GPU 커널용 Rust 개발 경로 'CUDA Rust' 공개
NVIDIA가 GPU 커널을 Rust로 직접 작성해 PTX로 컴파일할 수 있는 CUDA Rust를 공개했다.
-
PyTorch 2.14 출시, nccl2 백엔드·애플 실리콘 선형대수 지원
PyTorch 2.14가 NCCL 외 통신 백엔드 nccl2와 애플 실리콘용 네이티브 선형대수 연산을 추가해 정식 출시됐다.
-
신형 로우해머 공격 'GPUThor', 엔비디아 GPU ECC 방어 뚫어
토론토대 연구진이 비균일 해머링 기법으로 엔비디아 GPU의 ECC 방어를 무력화하고 루트 권한까지 탈취하는 GPUThor 공격을 공개했다.
-
CUDA 13.3과 함께 'CUDA 파이썬 1.0' 정식 출시
엔비디아가 파이썬을 CUDA C++와 대등한 정식 언어로 만드는 CUDA 파이썬 1.0을 CUDA 13.3과 함께 발표했다.
-
Mojo, 컴파일러·툴체인 아파치 2.0 오픈소스 공개
Mojo 개발사가 1.0 출시 후 컴파일러와 툴체인을 아파치 2.0 라이선스로 공개하며 GPU 특화 독립 언어로 방향을 굳혔다.