뉴스 목록 · 9페이지
9 / 29페이지
기사 통계를 확인하고 있습니다.
-
퀄컴, 2나노 스냅드래곤 8 엘리트 6세대·익스트림 공개
퀄컴이 2나노 공정의 스냅드래곤 8 엘리트 6세대와 상위 익스트림 버전을 공개했으며 두 칩은 AI·영상·게임 성능에서만 차이를 보인다.
-
질의만으로 LLM 소유권 증명하는 SimPrint 기법 제안
연구진이 가중치 접근 없이 입출력 질의만으로 미세조정·병합된 LLM의 원 소유권을 검증하는 SimPrint 기법을 제안했다.
-
NVIDIA DLSS 5, 3D 기반 신경 렌더링 공개
NVIDIA가 DLSS 5의 3D-Guided Neural Rendering과 ACE, RTX Mega Geometry 2.0 업데이트를 함께 발표했다.
-
NVIDIA, AI 에이전트로 ROS 2 노드 GPU 데이터 병목 해결
NVIDIA가 CUDA 버퍼 백엔드와 AI 코딩 에이전트로 ROS 2 노드 간 불필요한 GPU-CPU 데이터 복사를 없애는 마이그레이션 사례를 공개했다.
-
SageMaker AI, 동시성 스윕으로 GPU 인스턴스 규모 자동 산출
AWS가 SageMaker AI에 동시 요청 부하를 단계적으로 늘려 처리량·지연 시간의 포화점을 찾는 동시성 스윕 기능을 추가했다.
-
NVIDIA, Dynamo-Triton에 TensorRT 멀티 GPU 추론 통합
NVIDIA가 TensorRT 멀티 디바이스 추론을 Dynamo-Triton에 통합해 단일 gRPC 호출로 여러 GPU 분산 서빙을 지원한다.
-
NVIDIA, 기밀 컴퓨팅으로 LLM 추론 성능 손실 5% 이내 억제
NVIDIA가 TensorRT LLM과 기밀 컴퓨팅을 최적화해 DeepSeek-R1 추론에서 처리량을 96~98% 수준으로 유지했다고 밝혔다.
-
허깅페이스, 트랜스포머스에서 GGUF 양자화 모델 직접 구동 지원
허깅페이스가 트랜스포머스 라이브러리에 llama.cpp GGUF 양자화 모델을 애플 실리콘에서 변환 없이 바로 추론하는 기능을 추가했다.
-
PyTorch 팀, 텐서부터 트랜스포머까지 직접 구현하는 'TinyTorch' 공개
PyTorch 팀이 순수 파이썬으로 프레임워크 내부를 처음부터 구현하며 배우는 무료 오픈소스 교육 과정 TinyTorch를 공개했다.
-
NVIDIA, 클러스터 토폴로지 실시간 파악 도구 'Topograph' 공개
NVIDIA가 GPU 클러스터 네트워크 토폴로지를 실시간 수집해 Slurm·쿠버네티스 스케줄러에 전달하는 오픈소스 도구 Topograph를 공개했다.
-
vLLM, GPU 종류 안 가리는 '하드웨어 애그노스틱' 레이어 도입
vLLM이 프런티어 모델의 하드웨어별 최적화 흐름 속에서도 다양한 가속기 지원을 유지하기 위한 새 레이어를 공개했다.
-
래빗, 전용 하드웨어 대신 'OS3'로 재기 시도
래빗이 R1 신규 생산을 중단하고 여러 기기에서 쓸 수 있는 에이전틱 운영체제 OS3로 전환한다.