NVIDIA / Nvidia
28건
기사 통계를 확인하고 있습니다.
-
NVIDIA, 3D CT 판독 오픈소스 VLM 'NV-Reason-CT' 공개
NVIDIA가 흉부·복부 3D CT 영상을 3차원 그대로 처리해 구조화 보고서와 단계별 추론을 제공하는 오픈소스 시각언어모델 NV-Reason-CT를 공개했다.
-
NVIDIA, GPU 클러스터 검증·변경 오픈소스 도구 공개
NVIDIA가 대규모 GPU 클러스터의 사전 검증용 NVCRE와 운영 중 안전한 구성 변경용 노드라이트를 오픈소스로 공개했다.
-
NVIDIA Earth-2, 관측 데이터 실시간 반영 기능 추가
NVIDIA가 Earth-2에 점수 기반 데이터 동화(SDA) 기법을 도입해 관측값으로 AI 기상 예보를 재훈련 없이 보정하도록 했다.
-
NVIDIA DLSS 5, 3D 기반 신경 렌더링 공개
NVIDIA가 DLSS 5의 3D-Guided Neural Rendering과 ACE, RTX Mega Geometry 2.0 업데이트를 함께 발표했다.
-
NVIDIA, AI 에이전트로 ROS 2 노드 GPU 데이터 병목 해결
NVIDIA가 CUDA 버퍼 백엔드와 AI 코딩 에이전트로 ROS 2 노드 간 불필요한 GPU-CPU 데이터 복사를 없애는 마이그레이션 사례를 공개했다.
-
NVIDIA, Dynamo-Triton에 TensorRT 멀티 GPU 추론 통합
NVIDIA가 TensorRT 멀티 디바이스 추론을 Dynamo-Triton에 통합해 단일 gRPC 호출로 여러 GPU 분산 서빙을 지원한다.
-
NVIDIA, 기밀 컴퓨팅으로 LLM 추론 성능 손실 5% 이내 억제
NVIDIA가 TensorRT LLM과 기밀 컴퓨팅을 최적화해 DeepSeek-R1 추론에서 처리량을 96~98% 수준으로 유지했다고 밝혔다.
-
NVIDIA, 클러스터 토폴로지 실시간 파악 도구 'Topograph' 공개
NVIDIA가 GPU 클러스터 네트워크 토폴로지를 실시간 수집해 Slurm·쿠버네티스 스케줄러에 전달하는 오픈소스 도구 Topograph를 공개했다.
-
애플, 엔비디아와 손잡고 서버 사업 재진출 검토
애플이 M8 울트라 칩과 엔비디아 NV링크 퓨전을 활용해 2029년경 서버 시장에 재진입하는 방안을 검토 중이다.
-
NVIDIA, NVLink 6로 AI 팩토리 다층 장애 복원력 강화
NVIDIA가 물리·시스템·소프트웨어 계층을 아우르는 NVLink 6의 다층 복원력 프레임워크로 AI 팩토리 장애를 탐지·격리·복구한다고 밝혔다.
-
코넬리스, 2억 500만 달러 투자 유치...엔비디아에 도전
AI 칩 네트워킹 스타트업 코넬리스가 205억 달러 규모 투자를 유치하고 개방형 네트워킹 제품 '액티브 컴퓨트 패브릭'을 공개했다.
-
NVIDIA, JAX용 Transformer Engine으로 드롭리스 MoE 학습 10배 가속
NVIDIA가 JAX Transformer Engine 커널 최적화로 DeepSeek-V3 MoE 학습의 GPU당 처리량을 10.4배 높였다고 밝혔다.
-
NVIDIA NIM 최적화로 Nemotron 3 Ultra 동시 사용자 2.5배 증가
NVIDIA가 NIM 2.0.12 최적화 스택으로 Nemotron 3 Ultra 서빙 시 B200 GPU 환경에서 처리량을 초당 718토큰에서 1,997토큰으로 늘렸다고 밝혔다.
-
젠슨 황 "엔비디아 내년 매출 70% 성장 확신"
젠슨 황 CEO가 AI 생태계 전반에 깊이 얽힌 구조를 근거로 내년 매출 70% 성장 전망을 재확인했다.
-
엔비디아, 팔란티어와 반도체 공급망 배분 AI화
엔비디아가 넴트론과 팔란티어 파운드리로 수작업 부품 배분 결정을 데이터 기반 체계로 전환하고 있다고 밝혔다.
-
CUDA 툴킷 13.4 출시, 윈도우 온 암 지원 추가
NVIDIA가 CUDA 툴킷 13.4를 공개하며 Windows on Arm 지원과 차세대 GPU 루빈 사전 지원, MPS V3 개편을 담았다.
-
NVIDIA, GPU 커널용 Rust 개발 경로 'CUDA Rust' 공개
NVIDIA가 GPU 커널을 Rust로 직접 작성해 PTX로 컴파일할 수 있는 CUDA Rust를 공개했다.
-
엔비디아 RTX 스파크 첫 실물 노트북, IFA서 공개
레노버 요가 9n 등 RTX 스파크 탑재 노트북이 IFA 2026에서 처음 실물로 공개되며 온디바이스 AI 시대를 예고했다.
-
엔비디아, 유휴 맥·PC 묶는 로컬 추론 라우터 PAIR 베타 공개
엔비디아가 Ollama·LM Studio 요청을 여러 기기에 분산시켜 에이전트 병목을 줄이는 로컬 추론 라우터 PAIR를 베타로 출시했다.
-
NVIDIA BioNeMo NIM, 클로드 사이언스에 연동돼 단백질 구조 예측 지원
NVIDIA와 앤트로픽이 BioNeMo NIM 마이크로서비스를 클로드 사이언스에 연동해 에이전트 기반 단백질 구조 예측 워크플로를 구현했다.
-
스페이스X·엔비디아, 우주용 베라 루빈 NVL72 공개…2027년 발사
스페이스X와 엔비디아가 지상용 AI 랙 베라 루빈 NVL72를 궤도용으로 재설계해 2027년 4분기 발사를 목표로 한다고 밝혔다.
-
엔비디아, 미디어텍에 35억 달러 투자…NVLink 생태계 확장
엔비디아가 미디어텍에 35억 달러를 투자해 NVLink Fusion 기술을 제공하고 커스텀 AI 칩 생태계 표준화를 노린다.
-
엔비디아, 두 줄 명령으로 배포하는 'TensorRT Model Connect' 공개
엔비디아가 오픈 모델을 체크포인트에서 네이티브 C++ 추론 앱까지 두 명령으로 배포하는 참조 구현 도구를 발표했다.
-
엔비디아, 허깅페이스 129억 달러 인수 추진
엔비디아가 허깅페이스를 129억 달러에 인수하기로 합의했다고 디인포메이션이 보도했다.
-
신형 로우해머 공격 'GPUThor', 엔비디아 GPU ECC 방어 뚫어
토론토대 연구진이 비균일 해머링 기법으로 엔비디아 GPU의 ECC 방어를 무력화하고 루트 권한까지 탈취하는 GPUThor 공격을 공개했다.
-
CUDA 13.3과 함께 'CUDA 파이썬 1.0' 정식 출시
엔비디아가 파이썬을 CUDA C++와 대등한 정식 언어로 만드는 CUDA 파이썬 1.0을 CUDA 13.3과 함께 발표했다.
-
NVIDIA, AI 팩토리용 인프라 5종 동시 공개
NVIDIA가 네트워크·전력 병목을 겨냥한 스펙트럼-X, 블루필드-4, 베라 루빈, 베라 CPU, DSX MaxLPS를 하루에 발표했다.
-
엔비디아 AVO, 클로드 오퍼스5 감싸 ARC-AGI-3 100% 달성
엔비디아의 에이전트 아키텍처 AVO가 클로드 오퍼스 5와 결합해 단독 실행 30.2%였던 ARC-AGI-3 점수를 100%로 끌어올렸다.