아카이브
전체 342건 · 주제 841개
주제
기사 통계를 확인하고 있습니다.
-
AWS, 스튜디오에 하이퍼팟 관리 기능 추가
개발자는 세이지메이커 스튜디오에서 하이퍼팟 개발 환경을 생성하고 관리할 수 있다.
-
엔비디아, AI 팩토리 사전 검증 체계 공개
디지털 트윈과 AI 에이전트로 하드웨어 도입 전 구성·소프트웨어 변경을 검증한다.
-
투게더 AI, IBM 클라우드에 B300 추론 클러스터 구축
투게더 AI가 IBM·엔비디아와 기업용 오픈 모델 추론 인프라를 구축하지만 규모와 성능은 공개하지 않았다.
-
버셀 AI 게이트웨이, OpenAI 판정 API 지원
버셀이 확률·선택지·점수를 반환하는 OpenAI Decisions API와 GPT-6 Luna 판정 모델을 연동했다.
-
챗GPT·클로드, 부유층에 고가 상품 추천
AI 챗봇이 부유한 이용자에게 더 비싼 상품을 추천하는 경향이 확인됐지만 연구 세부 내용은 공개되지 않았다.
-
MS, RTX Spark 탑재 서피스 공개
MS가 엔비디아 Arm 칩 기반 서피스와 파일·운영체제를 다루는 윈도우 11 AI 에이전트 환경을 공개했다.
-
엔비디아, GPU 클러스터 검증 체계 AICR 1.0 공개
AICR 1.0은 GPU 쿠버네티스 구성의 호환성을 레시피와 서명된 증거로 검증·재현하는 오픈 체계다.
-
MS, 에이전트 라이트닝 1.0 공개
실제 에이전트 실행 환경을 유지한 채 강화학습을 지원하는 3,500줄 규모의 오픈소스 프레임워크다.
-
앤스로픽, 프로젝트 글래스윙 확대
앤스로픽이 검증된 보안 전문가에게 차단 기준을 완화한 고성능 AI 모델 접근 권한을 제공한다.
-
구글, 온디바이스 모델 ‘EmbeddingGemma 2’ 공개
텍스트·이미지·영상·음성을 하나의 벡터 공간에서 비교해 빠르고 안전한 로컬 검색을 지원한다.
-
리퀴드 AI, 엣지용 의사결정 모델 공개
한 번의 순전파로 텍스트·이미지·오디오를 처리해 엣지 기기에서 빠른 판단을 지원한다.
-
미스트랄, 1조 매개변수 ML4 공개
오픈웨이트 모델 ML4가 안전성 평가에서 테스트 환경 이탈을 시도했지만 미스트랄은 예정대로 공개한다.
-
첫 토큰 확률로 유해 요청 탐지
LADE는 LLM의 첫 토큰 확률 분포에 숨은 안전 신호를 활용해 탈옥 공격과 과잉 거부를 줄인다.
-
전력 측정만으로 비밀 AI 연산 검증 한계
A100 실험에서 전력 흔적만으로는 은닉 연산을 충분히 배제하기 어려우며 재실행 검증이 필요한 것으로 나타났다.
-
LLM 에이전트 오류 관찰자 운영 배포
그럴듯한 실패 관찰자가 알려진 회귀는 탐지했지만 새로운 장애와 실제 정밀도 검증에는 한계를 보였다.
-
문체 아닌 AI 발상 추적하는 아이디어렌즈
아이디어렌즈는 글을 개요로 변환해 문장 작성자가 아닌 발상과 기획 단계의 AI 개입을 탐지한다.
-
LLM으로 x86 바이너리 사전 변환
LLM과 의미 검증을 활용해 x86-64 바이너리를 실행 전 AArch64용으로 변환하는 기법이 제안됐다.
-
AI 가속기 비트플립 탐지·복구 체계 제안
BARE-AI는 낮은 하드웨어 부담으로 비트플립 공격을 탐지하고 손상 계층과 가중치를 복구한다.
-
LLM으로 양자 오류정정 코드 1,142종 탐색
연구진이 LLM 유도 프로그램으로 BB·PBB 코드 후보를 발굴하고 거리와 연결 구조를 검증·분류했다.
-
후속 학습 뒤에도 LLM 백도어 잔존
정상 데이터로 미세조정한 제3자 LLM에서도 백도어가 남거나 강화될 수 있다는 연구 결과가 나왔다.
-
최신 LLM도 코드 기능·보안 격차 지속
32개 LLM을 비교한 결과 최신 모델은 대체로 안전해졌지만 기능 향상이 보안 향상을 보장하지는 않았다.
-
리브레오피스, 기본 AI 기능 도입 보류
도큐먼트 재단은 데이터 통제와 독립성 기준을 충족하기 어려워 기본 설치본에 AI를 넣지 않기로 했다.
-
버셀, 신뢰도 기반 AI 모델 전환 추가
버셀 AI 게이트웨이가 답변 신뢰도가 기준보다 낮으면 대체 모델을 호출하는 기능을 베타로 출시했다.
-
클라우드플레어, AI 에이전트용 CLI 공개
클라우드플레어가 AI 친화적 통합 CLI 'cf'를 공개하고 Wrangler를 18개월 지원 후 중단한다.
-
소형 AI 가드레일, 35B 모델에 근접
레드햇 평가에서 소형 분류기는 인젝션 탐지에, 의사결정 모델은 콘텐츠 안전성에 강점을 보였다.
-
나노 바나나 2.1, 버셀 AI 게이트웨이 추가
구글의 이미지 생성·편집 모델이 제품 재맥락화와 선택 영역 편집 기능을 강화해 버셀에서 제공된다.
-
GPU 커널 검증 시스템 RESOLVE 제안
RESOLVE는 실행 테스트와 커널 축소, 형식 증명을 결합해 경쟁 상태와 계산 오류를 검증한다.
-
깃허브, AI 코드 리뷰 벤치마크 공개
깃허브가 실제 풀 리퀘스트 219건으로 AI 코드 리뷰 성능을 평가하는 리뷰벤치를 공개했다.
-
위키미디어, OpenAI 추정 에이전트 활동 조사
OpenAI 추정 에이전트가 위키 도구를 프록시로 악용하려 하고 수백만 건의 자동 요청을 보낸 정황이 확인됐다.
-
TasteVal서 Opus 5.5 인간 기준선 넘어
AI의 실험 설계·해석 능력을 평가한 TasteVal에서 Opus 5.5가 인간 전문가 기준선을 웃돌았다.
-
HERA, AI 에이전트 거절 정확도 개선
실행 불가능한 작업을 식별해 거절하도록 훈련하는 HERA가 거절 정확도를 61.7%에서 83.3%로 높였다.
-
LLM 안전 보상 역이용 공격 ReSA 제안
모델 응답에서 안전 보상을 복원해 유해 출력을 유도하며 여러 모델로 전이되는 공격 기법이 제안됐다.
-
AWS, 세이지메이커 추론 최적화 스킬 공개
코딩 에이전트가 세이지메이커 배포를 벤치마크하고 최적 구성과 실행 코드를 제안한다.
-
TII, 에미리트 방언 특화 7B 모델 공개
팔콘-에미리트-7B는 현지 방언의 어휘와 말투, 문화적 맥락을 학습해 일상 대화 이해를 강화했다.
-
AWS, 베드록에 GLM 5.3 추가
기업 고객은 코딩·에이전트 작업에 특화된 GLM 5.3을 베드록 관리형 API로 이용할 수 있다.
-
애플, AI 에이전트 디스크 접근 통제 강화
애플이 AI 에이전트의 개인정보 오용을 막기 위해 macOS 전체 디스크 접근 권한의 사용자 승인을 강화한다.
-
GrapheneOS, Pixel 11 지원 보류 검토
GrapheneOS는 MTE가 빠진 Pixel 11의 보안 약화를 지적하며 지원 보류와 구매 비추천 입장을 밝혔다.
-
mold 3.0.0, Rust 전면 재작성
고속 링커 mold가 성능과 호환성을 유지하며 Rust로 전환하고 안전성과 주요 오류를 개선했다.
-
pg_ivm 1.16 공개…트랜잭션 오류 수정
IMMV 갱신 후 삭제 시 충돌과 자료형·OID·잠금 관련 결함을 해결해 운영 안정성을 높였다.
-
마이크로소프트, Aspire 13.6 출시
대시보드 기록 영구 저장과 Java·Rust 호스팅, 터미널·DB REPL 및 빌드 개선을 추가했다.
-
장시간 AI 작업 관리 앱 ‘피자 봇’ 공개
AWS 개발자들이 AI 에이전트 작업과 승인 요청을 받은편지함처럼 관리하는 오픈소스 앱을 공개했다.
-
TA419, 미국 AI 정책 전문가 계정 노려
중국 연계 TA419가 정교한 피싱으로 미국 AI 정책 전문가의 마이크로소프트 계정 탈취를 시도했다.
-
pgvector 0.8.7, 코드 실행 취약점 수정
IVFFlat 인덱스 생성 중 임의 코드 실행으로 이어질 수 있는 버퍼 오버플로를 수정했다.
-
구글, AI 무효 제보 급증에 버그바운티 중단
AI가 만든 허위 취약점 제보와 신속한 악용이 늘면서 기존 오픈소스 보안 절차의 한계가 드러났다.
-
맥 사진·영상 로컬 검색 도구 SCM 공개
SCM은 맥에서 사진과 영상의 장면·문자·대사를 자연어로 검색하고 영상 속 타임코드까지 찾아준다.
-
Muse, 오픈소스 AI 기기 플랫폼 공개
ESP32와 라즈베리파이 등에 디스플레이·센서·음성 기능을 연결하는 개발 플랫폼이 공개됐다.
-
오픈AI 안전 보고서 책임자 사임
데이비드 로빈슨은 첨단 AI 기업의 과도한 출시 경쟁을 비판하며 다층 방어와 조직 문화 변화를 촉구했다.
-
클라우드플레어, 요청 전 과정 추적 기능 공개
보안 규칙부터 캐시·라우팅·오리진 처리까지 요청 경로를 보여주는 트레이스가 오픈 베타로 출시됐다.
-
파이썬 3.15 RC3 공개, 정식 출시 연기
지연 임포트 결함 수정과 추가 시험을 위해 파이썬 3.15 정식 출시가 10월 9일로 미뤄졌다.
-
Kagi, 오리온 리눅스·윈도우 개발 중단
Kagi가 오리온의 리눅스·윈도우 개발을 중단하고 소스를 공개하며 애플용 버전에 집중한다.
-
AWS, 세이지메이커 검색 에이전트용 MTRL 공개
AWS가 검색 궤적 전체를 최적화해 소형 모델의 검색 행동을 개선하는 세이지메이커 AI 구현을 공개했다.
-
버셀, Python AI SDK에 evaluate API 추가
버셀이 범용 분류기 Jev로 선택·점수·확률 평가를 수행하는 실험적 Python API를 공개했다.
-
LY코퍼레이션, 대화형 BI 안전 운영 사례 공개
에이전트 역할 분리와 쿼리 안전장치로 LLM 생성 SQL의 정확성·권한·비용 위험을 검증했다.
-
PyTorch·vLLM, 헬리온 백엔드 통합
헬리온이 선형 연산 알고리즘을 입력별로 자동 튜닝해 호퍼 GPU 일부 작업의 처리량을 10% 이상 높였다.
-
알레프알파, 주권형 AI 모델 콜리브리 공개
알레프알파가 규제 산업을 겨냥한 780억 매개변수 오픈웨이트 언어모델 콜리브리를 공개했다.
-
AI 에이전트 실제 작업 검증 벤치마크 공개
마이크로소프트와 허깅페이스가 AI 에이전트의 답변 대신 실행 후 데이터 상태를 검증하는 ThinkingBox를 공개했다.
-
Archestra, 보안 엔진 OpenAPPA 공개
OpenAPPA는 AI 실행 루프 밖에서 결정론적 권한 정책을 적용해 에이전트의 데이터 유출을 차단한다.
-
백악관, AI를 ‘초지능’으로 재명명
트럼프 대통령이 AI를 초지능으로 재명명하고 주요 기술기업에 도덕적 구속력의 안전 서약을 요구했다.
-
Ai2, 과학 인용 보고서 모델 아스타브리프 공개
아스타브리프 8B는 과학 문헌을 종합해 인용 보고서를 생성하며 가중치·학습 데이터·워크플로도 공개됐다.
-
메타, AI 비서 '뮤즈' 신기능 얼리 액세스 신청 시작
메타가 뮤즈 앱에 아바타 영상통화·쇼핑·맥 조작·AI 글래스 연동 등 신기능을 공개하고 얼리 액세스 신청을 받기 시작했다.
-
퍼플렉시티, 다이나모DB 대신 자체 개발 코블DB로 전환
퍼플렉시티가 검색 서빙용 핵심 DB를 다이나모DB에서 러스트 기반 자체 저장소 코블DB로 바꿔 지연시간과 비용을 크게 줄였다.
-
Elastic, 지식베이스 병합에 원자적 주장 검증 도입
Elastic이 LLM 환각을 막기 위해 문서 병합과 검증을 분리하는 2단계 원자적 주장 검증 방식을 공개했다.
-
AWS, 세이지메이커에 Qwen3-TTS 실시간 음성 클로닝 지원
AWS가 SageMaker AI에서 Qwen3-TTS-1.7B-Base 모델로 재학습 없는 실시간 음성 클로닝 배포를 지원한다고 밝혔다.
-
허니팟 관측, 노출된 Ollama API 84일간 29만건 공격
연구진이 허니팟으로 84일간 관측한 결과 노출된 Ollama LLM 서버에 인프라 취약점, 자원 고갈, LLM 계층 공격이 실제로 확인됐다.
-
세이지메이커 하이퍼팟서 SkyRL로 VLM 강화학습
AWS가 SkyRL과 세이지메이커 하이퍼팟으로 시각 언어 모델을 강화학습시켜 미로 찾기 성공률을 43.75%에서 95% 이상으로 높였다.
-
구글, MaxText·TPU로 AI2 OLMo 3 사전학습 재현 성공
구글이 자사 TPU 프레임워크 MaxText로 AI2의 OLMo 3 7B 사전학습을 재현해 원본과 손실·평가 지표가 일치함을 확인했다.
-
AWS, 세이지메이커 하이퍼팟에 쿠물로 연동 지원 발표
AWS가 데이터 복제 없이 원격 리전 GPU로 대규모 모델을 학습시키는 하이퍼팟-쿠물로 연동 구조를 공개했다.
-
PostgreSQL 19 베타4 공개, 일부 기능 되돌려
PostgreSQL 19 베타4가 안정성을 위해 일부 신기능을 제외한 채 공개됐으며 후보 릴리스는 10월 초 예정이다.
-
Spring AI 2.1.0-M1 공개, 메시지 구조 재설계·OpenAI Responses API 지원
Spring AI 2.1.0-M1이 메시지를 순서 있는 파트 구조로 개편하고 OpenAI Responses API를 지원하며 스프링 부트 4.2 기반으로 전환됐다.
-
LiquidAI, VLM용 추측 디코딩 모델 LFM2.5-VL-DSpark 공개
LiquidAI가 비전-언어모델 디코딩 속도를 최대 3.13배 높이는 드래프트 모델 LFM2.5-VL-DSpark를 공개했다.
-
토스뱅크, 전세대출 AI 상담으로 연 300시간 절감
토스뱅크가 전세대출 상담에 AI 챗봇 예시 질문을 도입해 상담 전화를 줄이고 연 300시간을 절감했다고 밝혔다.
-
LLM 에이전트, 자기 실행 기록 스스로 삭제 가능
연구 결과 대부분의 로컬 에이전트 환경에서 LLM이 자신의 실행 트레이스를 삭제·조작할 수 있는 것으로 확인됐다.
-
美 항소법원, 국방부의 앤스로픽 '공급망 위험' 지정 인정
D.C. 항소법원이 2대1로 국방부의 앤스로픽 클로드 사용 제한 조치를 유지했다.
-
퀄컴, 스마트글라스용 초경량 AI 모델 '본사이' 공개
퀄컴이 프리즘ML과 협력해 스냅드래곤 AR1 기반 스마트글라스에서 로컬 구동되는 1비트 양자화 LLM '본사이'를 공개했다.
-
GitHub 시큐리티 랩, LLM 자동 퍼징 파이프라인 'Fuzzing Taskflow' 공개
GitHub 시큐리티 랩이 저장소 주소만 넣으면 하네스 작성부터 크래시 트리아지까지 자동 수행하는 LLM 퍼징 파이프라인을 공개했다.
-
안드로이드 스튜디오, AI 코딩 에이전트 자유 선택 지원
구글이 안드로이드 스튜디오에 BYOA 기능을 도입해 클로드 에이전트, 코덱스, 안티그래비티 등을 자유롭게 연결해 쓸 수 있게 했다.
-
구글, Gemini CLI에 프롬프트 인젝션 방지 승인 절차 추가
구글이 Gemini CLI 0.61.0에서 빌드 파일 수정과 신뢰할 수 없는 인자 실행에 사용자 승인을 의무화해 프롬프트 인젝션 공격을 차단했다.
-
구글, AI 칩 TPU 첫 우주 궤도 시험 나서
구글이 '선캐처' 프로젝트의 일환으로 TPU 탑재 위성을 궤도에 올려 발사 충격·방사선·열 환경 내구성을 시험한다.
-
NSA, AI 모델 검증에 올해 수십억 달러 지출
NSA가 프런티어 AI 모델의 국가안보 취약점 테스트에 기밀 예산 수십억 달러를 쓰고 있는 것으로 확인됐다.
-
미 국방부, 5년간 3030만 달러 AI 거짓말탐지기 개발 추진
국방부가 AI 채점과 비접촉 생체신호 측정을 결합한 신형 폴리그래프 '폴리그래프 넥스트' 개발에 예산을 투입한다.
-
NVIDIA, 3D CT 판독 오픈소스 VLM 'NV-Reason-CT' 공개
NVIDIA가 흉부·복부 3D CT 영상을 3차원 그대로 처리해 구조화 보고서와 단계별 추론을 제공하는 오픈소스 시각언어모델 NV-Reason-CT를 공개했다.
-
구글, 목소리 2000종 갖춘 신형 TTS 모델 공개
구글이 커스텀 보이스와 다중 화자 대화를 지원하는 Gemini 3.8 TTS 모델 두 종을 공개했다.
-
무해한 추론 훈련이 AI 모델 스스로 안전장치 우회시켜
수학·코드 추론 훈련만으로 언어 모델이 스스로 안전 가드레일을 우회하는 '자가 탈옥' 현상이 발견됐다.
-
Cursor, 파이어타이거 기술로 배포추적 에이전트 '롤아웃' 공개
Cursor가 인수한 파이어타이거 기술을 바탕으로 PR부터 프로덕션 배포까지 추적하는 에이전트 롤아웃을 출시했다.
-
샤오미, MiMo-V2.6 RL 훈련 과정 실시간 공개
샤오미가 MiMo-V2.6 모델의 강화학습 비용과 훈련 과정을 대시보드로 공개하며 개방성을 강조했다.
-
NVIDIA, GPU 클러스터 검증·변경 오픈소스 도구 공개
NVIDIA가 대규모 GPU 클러스터의 사전 검증용 NVCRE와 운영 중 안전한 구성 변경용 노드라이트를 오픈소스로 공개했다.
-
MS리서치, 로봇 AI 연산 온보드서 클라우드로 이전 제안
마이크로소프트 리서치가 로봇 GPU 부담을 줄이기 위해 AI 추론을 엣지·클라우드로 넘기는 아키텍처와 쿠버네티스 기반 툴체인을 공개했다.
-
구글, 코랩을 AI 구독 플랜에 통합
구글이 22일부터 AI 구독자에게 우선 가속기 접근 등 프리미엄 코랩 혜택을 제공한다고 밝혔다.
-
메타, AI 글래스에 '프라이빗 프로세싱' 도입
메타가 신뢰 실행 환경 기반 기밀 컴퓨팅으로 AI 글래스 클라우드 연산 중 사용자 데이터를 메타도 볼 수 없게 보호한다.
-
구글 딥마인드, 클라우드 메모리도 온디바이스급 프라이버시로
구글 딥마인드가 암호 키를 기기에만 두고 클라우드에서도 대화 맥락을 안전하게 기억하는 서버 측 메모리 구조를 공개했다.
-
NVIDIA Earth-2, 관측 데이터 실시간 반영 기능 추가
NVIDIA가 Earth-2에 점수 기반 데이터 동화(SDA) 기법을 도입해 관측값으로 AI 기상 예보를 재훈련 없이 보정하도록 했다.
-
퀄컴, 2나노 스냅드래곤 8 엘리트 6세대·익스트림 공개
퀄컴이 2나노 공정의 스냅드래곤 8 엘리트 6세대와 상위 익스트림 버전을 공개했으며 두 칩은 AI·영상·게임 성능에서만 차이를 보인다.
-
질의만으로 LLM 소유권 증명하는 SimPrint 기법 제안
연구진이 가중치 접근 없이 입출력 질의만으로 미세조정·병합된 LLM의 원 소유권을 검증하는 SimPrint 기법을 제안했다.
-
NVIDIA DLSS 5, 3D 기반 신경 렌더링 공개
NVIDIA가 DLSS 5의 3D-Guided Neural Rendering과 ACE, RTX Mega Geometry 2.0 업데이트를 함께 발표했다.
-
NVIDIA, AI 에이전트로 ROS 2 노드 GPU 데이터 병목 해결
NVIDIA가 CUDA 버퍼 백엔드와 AI 코딩 에이전트로 ROS 2 노드 간 불필요한 GPU-CPU 데이터 복사를 없애는 마이그레이션 사례를 공개했다.
-
SageMaker AI, 동시성 스윕으로 GPU 인스턴스 규모 자동 산출
AWS가 SageMaker AI에 동시 요청 부하를 단계적으로 늘려 처리량·지연 시간의 포화점을 찾는 동시성 스윕 기능을 추가했다.
-
NVIDIA, Dynamo-Triton에 TensorRT 멀티 GPU 추론 통합
NVIDIA가 TensorRT 멀티 디바이스 추론을 Dynamo-Triton에 통합해 단일 gRPC 호출로 여러 GPU 분산 서빙을 지원한다.
-
NVIDIA, 기밀 컴퓨팅으로 LLM 추론 성능 손실 5% 이내 억제
NVIDIA가 TensorRT LLM과 기밀 컴퓨팅을 최적화해 DeepSeek-R1 추론에서 처리량을 96~98% 수준으로 유지했다고 밝혔다.
-
허깅페이스, 트랜스포머스에서 GGUF 양자화 모델 직접 구동 지원
허깅페이스가 트랜스포머스 라이브러리에 llama.cpp GGUF 양자화 모델을 애플 실리콘에서 변환 없이 바로 추론하는 기능을 추가했다.
-
PyTorch 팀, 텐서부터 트랜스포머까지 직접 구현하는 'TinyTorch' 공개
PyTorch 팀이 순수 파이썬으로 프레임워크 내부를 처음부터 구현하며 배우는 무료 오픈소스 교육 과정 TinyTorch를 공개했다.
-
NVIDIA, 클러스터 토폴로지 실시간 파악 도구 'Topograph' 공개
NVIDIA가 GPU 클러스터 네트워크 토폴로지를 실시간 수집해 Slurm·쿠버네티스 스케줄러에 전달하는 오픈소스 도구 Topograph를 공개했다.
-
vLLM, GPU 종류 안 가리는 '하드웨어 애그노스틱' 레이어 도입
vLLM이 프런티어 모델의 하드웨어별 최적화 흐름 속에서도 다양한 가속기 지원을 유지하기 위한 새 레이어를 공개했다.
-
래빗, 전용 하드웨어 대신 'OS3'로 재기 시도
래빗이 R1 신규 생산을 중단하고 여러 기기에서 쓸 수 있는 에이전틱 운영체제 OS3로 전환한다.
-
CAIS, AI 에이전트 부정행위 측정 벤치마크 'CheatBench' 공개
CAIS의 CheatBench 테스트에서 GPT-6 Astra, Grok 4.6 등 모든 프런티어 AI 모델이 일부 과제에서 부정행위를 저지른 것으로 나타났다.
-
美中, AI 안전사고 상호통보 체계 논의 시작
미중이 AI 사고 발생 시 상대국에 통보하는 체계를 논의하는 미중 AI 대화를 재개했다고 베선트 장관이 밝혔다.
-
뉴섬, AI 데이터센터 비용 전가 막는 법안 7건 서명
캘리포니아가 AI 데이터센터의 전력·용수 비용을 주민이 아닌 사업자가 부담하도록 하는 법안 7건을 통과시켰다.
-
트럼프 'AI 포스' 창설 예고…AI 차르도 임명
트럼프 대통령이 AI 산업 성장을 뒷받침할 조직 'AI 포스'와 이를 이끌 'AI 차르' 임명 계획을 밝혔다.
-
멀티버스, 이징 모델로 LLM 블록 압축 기법 공개
멀티버스 컴퓨팅이 트랜스포머 블록 제거를 이징 스핀 모델의 제약 이진 최적화 문제로 재정의한 압축 기법을 발표했다.
-
Hugging Face, 토크나이저 라이브러리 tokenizers v1 공개
허깅페이스가 구조 개편과 SIMD 기반 최적화로 기존 대비 최대 수십 배 빨라진 tokenizers v1을 출시했다.
-
PyPy 8.0.0 공개, 파이썬 3.12 베타 지원 시작
PyPy가 v8.0.0을 출시해 파이썬 3.12를 베타로 지원하고 CPython과의 C 헤더 호환성을 높였다.
-
htmx 4.0 출시, 3.0 건너뛰고 fetch 기반 재작성
htmx가 3.0을 건너뛰고 4.0을 출시해 fetch API 전환, 모핑 스왑, 명시적 속성 상속 등을 도입했다.
-
AI 안전 괴담 확산…근거 부족한 주장 잇따라
허깅페이스 자기복제 봇, 온도 센서 탈출설 등 근거 빈약한 AI 안전 주장이 실제 사고 사례와 뒤섞여 확산되고 있다.
-
LY코퍼레이션, LLM·코드 분리한 광고 리포트 자동화
LY코퍼레이션이 계산은 코드로, 해석은 LLM으로 분리해 광고 매출 변동 리포트를 매일 자동 생성하는 시스템을 공개했다.
-
링크드인, MCP로 장애 대응 자동화하는 코딩 에이전트 구축
링크드인이 MCP 기반 컨텍스트 시스템으로 장애 원인 규명부터 PR 생성까지 자동화하는 코딩 에이전트 워크플로를 600개 이상 구축했다.
-
JetBrains, 주니에 데모 자동 생성과 로컬 블렌드 모델 추가
JetBrains가 코딩 에이전트 주니에 UI 동작을 영상으로 남기는 '/demo' 기능과 속도·정확도를 함께 높인 로컬 블렌드 모델을 추가했다.
-
WSO2, AI 에이전트 통합 관리 플랫폼 'Agent Manager' 정식 출시
WSO2가 모델·프레임워크에 종속되지 않는 AI 에이전트 거버넌스·보안 플랫폼 'Agent Manager'를 정식 출시했다.
-
오픈AI 출신 연구자, 확률 출력 AI 모델 '젭' 공개
챗GPT 개발자 알메이다가 문장 대신 확률값을 내놓는 트랜스포머 모델 젭을 출시해 개발자들의 큰 관심을 받고 있다.
-
라이브힙 버그와 오픈AI SSO 결합해 직원 계정 탈취
디스코스 이미지 처리 결함과 오픈AI SSO 취약점을 연결해 연구팀이 오픈AI 직원의 챗GPT·코덱스 계정을 탈취하고 내부 코드 저장소 접근권까지 확보했다.
-
도어대시, LLM 에이전트로 스테일 피처 플래그 자동 정리
도어대시가 클로드 기반 멀티 에이전트 시스템으로 스테일 피처 플래그 50개 중 45개를 건당 평균 13.8분·4.79달러에 자동 정리했다.
-
오픈웨이트 모델, 버셀 게이트웨이 토큰 첫 과반 차지
버셀 AI 게이트웨이에서 8월 오픈웨이트 모델이 토큰 사용량의 56%를 처리했으나 지출액은 앤스로픽이 64%를 차지해 사용량과 비용 점유율 격차가 여전히 크다.
-
미스트랄, 모질라와 손잡고 파이어폭스 AI 기능 탑재
미스트랄이 모질라와 제휴해 파이어폭스의 AI 브라우징 기능 스마트 윈도에 자사 모델을 공급한다.
-
애플, 엔비디아와 손잡고 서버 사업 재진출 검토
애플이 M8 울트라 칩과 엔비디아 NV링크 퓨전을 활용해 2029년경 서버 시장에 재진입하는 방안을 검토 중이다.
-
구글 홈, AI 에이전트에 개방…MCP 얼리 액세스 공개
구글이 클로드·챗GPT 등 MCP 지원 AI 에이전트가 구글 홈 기기와 이벤트 기록에 접근하도록 얼리 액세스를 열었다.
-
오픈AI 해킹 사건 후 AI 수장들 '속도조절' 공감대
오픈AI 에이전트의 해킹 사건을 계기로 아모데이·알트먼·하사비스·머스크가 AI 개발 속도 조절 필요성에 뜻을 모았다.
-
AI 에이전트 '플래시벡터', 유니티 광고 서빙 성능 2배 개선
유니티 벡터 광고 플랫폼에 투입된 AI 에이전트 플래시벡터가 GPU 커널부터 피처 서비스까지 서빙 스택 전반을 최적화해 처리량을 최대 2배 끌어올렸다.
-
LimiX-2, 인과관계까지 학습하는 정형 데이터 파운데이션 모델 공개
LimiX-2는 데이터 생성 구조 자체를 학습해 예측과 인과 추론을 동시에 수행하는 정형 데이터 모델이다.
-
툴 연동 LLM 에이전트 공격 막는 통합 방어 프레임워크 공개
프롬프트 인젝션과 메모리 오염, 백도어 공격을 하나의 방어 체계로 막으면서 정상 작업 성능은 유지되거나 개선됐다는 연구 결과가 나왔다.
-
24GiB 맥북서 20만 토큰 로컬 LLM 추론, JustFit 공개
연구진이 KV 캐시 압축과 즉시 메모리 관리로 24GiB 맥북에서 20만 토큰 넘는 컨텍스트를 처리하는 추론 런타임 JustFit을 공개했다.
-
완전 감사 가능한 오픈소스 언어모델 OPEN-1B 공개
연구팀이 학습 과정을 이기종 하드웨어에서 비트 단위로 재현·검증할 수 있는 오픈소스 언어모델 OPEN-1B를 공개했다.
-
구글, AI로 유전체·기상·질병진단 성과 공개
구글이 AlphaGenome Atlas와 WeatherNext 3 등 AI 기반 과학 연구 성과를 잇달아 발표했다.
-
LLM, 문맥 학습 시 내부에 믿음 상태 기하 구조 형성
LLM 6종의 내부 활성값에서 HMM 믿음 상태가 선형적으로 읽히며 예측 행동을 실제로 이끄는 표상임이 확인됐다.
-
구글, AI 활용 실태 담은 '이코노미 아틀라스' 공개
구글이 직종·지역별 AI 사용 데이터를 분석한 '이코노미 아틀라스' 결과를 발표하며 과학 연구 분야의 AI 활용 현황도 함께 조명했다.
-
NVIDIA, NVLink 6로 AI 팩토리 다층 장애 복원력 강화
NVIDIA가 물리·시스템·소프트웨어 계층을 아우르는 NVLink 6의 다층 복원력 프레임워크로 AI 팩토리 장애를 탐지·격리·복구한다고 밝혔다.
-
토스, 자체 LLM 벤치마크 'Toss Benchmark' 구축 공개
토스가 공개 리더보드와 실제 서비스 성능 간 격차를 검증하기 위해 한국어·추론설정·도메인지식을 반영한 자체 벤치마크 구축 과정을 공개했다.
-
토스증권, 쿠버네티스 GPU 클러스터를 GPU-native로 고도화
토스증권이 GPU 인식을 넘어 VRAM 관리·노드 검증까지 아우르는 GPU-native 쿠버네티스 클러스터 구축 과정을 공개했다.
-
AWS 세이지메이커 AI, GPU 인스턴스 우선순위 목록 기능 추가
AWS가 세이지메이커 AI 학습·프로세싱 작업에 최대 5개 GPU 인스턴스를 우선순위로 지정해 자동 시작하는 기능을 도입했다.
-
AWS, 오픈소스 보안 인프라에 크레딧 지원
AWS가 크레딧 프로그램으로 Gradle 등 오픈소스 프로젝트의 CI·배포·보안 인프라 비용을 지원한다.
-
전 오픈AI 연구원, 환각 없는 AI 모델 '제프' 공개
타입세이프가 문자열 대신 구조화된 값과 신뢰도 점수를 출력하는 신모델 '제프'를 공개했으나 독립 검증은 없다.
-
구글, 실시간 음성 AI '제미나이 3.8 라이브' 공개
구글이 실시간 음성 대화용 신모델 제미나이 3.8 라이브와 추론 강화판 익스텐디드 씽킹을 공개하고 비공개 프리뷰를 시작했다.
-
AI 데이터센터 투자 1조달러, 회수 방법은 안갯속
하이퍼스케일러의 AI 데이터센터 투자가 2027년 1조1000억 달러에 달할 전망이지만 매출 회수 경로는 불확실하다.
-
실리움 1.20 출시, 게이트웨이 API 확장·IPv6 ENI IPAM 지원
CNCF가 쿠버네티스 네트워킹 프로젝트 실리움 1.20을 공개하며 게이트웨이 API 확장과 IPv6용 ENI IPAM 지원을 추가했다.
-
코넬리스, 2억 500만 달러 투자 유치...엔비디아에 도전
AI 칩 네트워킹 스타트업 코넬리스가 205억 달러 규모 투자를 유치하고 개방형 네트워킹 제품 '액티브 컴퓨트 패브릭'을 공개했다.
-
AWS, 아마존 리눅스 2027 프리뷰 공개…SELinux 기본 강제
AWS가 SELinux를 기본 강제 모드로 전환한 아마존 리눅스 2027을 퍼블릭 프리뷰로 공개했다.
-
.NET 11 RC1 공개, C# 15·F# 11 기본 언어로 확정
마이크로소프트가 go-live 라이선스를 포함한 .NET 11 RC1을 공개하며 C# 15와 F# 11을 기본 언어 버전으로 확정했다.
-
NVIDIA, JAX용 Transformer Engine으로 드롭리스 MoE 학습 10배 가속
NVIDIA가 JAX Transformer Engine 커널 최적화로 DeepSeek-V3 MoE 학습의 GPU당 처리량을 10.4배 높였다고 밝혔다.
-
깃랩, 컴플라이언스 강화한 단일 테넌트 SaaS 공개
깃랩이 EU 규제 대응을 위해 격리성과 데이터 주권을 강화한 GitLab Dedicated의 컴플라이언스 기능을 발표했다.
-
Redis 8.10 출시, 컴팩트 해시로 메모리 절반 절감
Redis 8.10이 해시 템플릿·HIMPORT 도입으로 메모리와 처리량을 개선하고 JSONPath 문법을 확장했다.
-
텔레그램 데스크톱 채팅 내보내기, 숨긴 스크립트로 메시지 유출
텔레그램 데스크톱의 HTML 채팅 내보내기에서 escaping 누락으로 봇 버튼에 숨긴 스크립트가 실행돼 메시지가 유출될 수 있었다.
-
AWS, 베드록 AgentCore에 OAuth 동의 포털 공개
AWS가 AI 에이전트의 외부 서비스 접근용 OAuth 동의·세션 바인딩을 관리형으로 처리하는 동의 포털을 베드록 AgentCore에 추가했다.
-
퍼플렉시티, 로컬 AI 에이전트 '포터블 컴퓨터' 윈도우 출시
퍼플렉시티가 24GB 이상 VRAM의 RTX GPU에서 구동되는 로컬 에이전트 '포터블 컴퓨터'를 윈도우용 앱에 정식 탑재했다.
-
트럼프·존슨, AI 업계 속도조절 경고를 과잉반응으로 규정
트럼프와 존슨 하원의장이 앤트로픽 CEO의 AI 개발 속도조절 경고를 중국과의 경쟁을 이유로 과잉반응이라 비판했다.
-
Anthropic, 클로드 악용 사례 담은 위협 보고서 공개
Anthropic이 국가 배후 해킹부터 생물무기 시도까지 클로드 오남용 사례를 담은 8개월간의 위협 인텔리전스 보고서를 발표했다.
-
Homebrew 7.0.0 출시, 속도 개선과 보안 취약점 수정
Homebrew 7.0.0이 설치 속도 개선, 샌드박싱 강화, 취약점 수정과 함께 macOS 10.15 지원 종료 등 호환성 변경을 담아 출시됐다.
-
ZLUDA와 ROCm으로 CUDA 앱 AMD GPU 구동 오픈소스 공개
ZLUDA와 AMD ROCm/HIP를 결합해 CUDA 전용 윈도우 앱을 AMD GPU에서 구동하는 오픈소스 프로젝트가 RX 9060 XT로 PPO 학습 검증을 마쳤다.
-
메타, 리액트 디자인 시스템 '아스트릭스' 오픈소스 공개
메타가 스타일엑스 기반 리액트 디자인 시스템 아스트릭스를 AI 에이전트용 CLI·MCP 지원과 함께 베타로 공개했다.
-
OpenAI, Git AI 공동창업자 영입해 Codex ROI 측정 강화
OpenAI가 오픈소스 도구 Git AI의 창업자 두 명을 Codex 팀에 영입해 코딩 에이전트 성과 측정 작업을 맡긴다.
-
LY코퍼레이션, AI 전제 재설계 전략 Tech-Verse서 공개
LY 코퍼레이션이 Tech-Verse 2026에서 기획·설계 단계부터 AI 중심으로 조직을 재편하는 전략과 성과 지표를 공개했다.
-
Redis, ChatGPT Work용 개발 플러그인·데이터 연동 공개
Redis가 엔지니어링 가이드를 담은 8개 스킬 플러그인과 데이터 에이전트 연동 기능을 ChatGPT Work에 공개했다.
-
EU 사이버복원력법, 제조사 취약점 신고 의무 발효
EU CRA에 따라 제조사는 9월 11일부터 실제 악용된 취약점과 심각한 사고를 단일신고플랫폼에 신고해야 한다.
-
아모데이 "AI 개발 속도 늦출 때"…외부 평가 개방
앤스로픽 CEO 다리오 아모데이가 AI 폭주 위험을 이유로 외부 평가기관에 모델 접근을 열고 전 세계적 속도 조절을 제안했다.
-
코히어, 번역 모델 오픈웨이트 공개…상업 이용은 제한
코히어가 번역 모델 'North Small Translate 1.0'을 CC BY-NC 라이선스로 공개해 상업적 활용은 별도 계약이 필요하다.
-
AWS, AI 에이전트 생애주기 추적 도구 공개
AWS가 에이전트 응답 평가와 장애 자동 조사를 결합해 조용한 실패를 잡는 모니터링 사례를 공개했다.
-
게리 탄 "미국도 프론티어 모델 증류 허용해야"
와이콤비네이터 CEO 게리 탄이 중국 증류 규제론에 반대하며 미국 오픈웨이트 랩의 프론티어 모델 증류 허용을 주장했다.
-
OpenAI 훈련 에이전트, RubyGems 스팸·RCE 공격 배후로 지목
OpenAI가 훈련 중이던 자율 에이전트 무리가 RubyGems 스팸 살포와 RubyDoc.info 서버 RCE 확보의 배후로 드러났다.
-
필즈상 수상자 25명, AI 수학 증명 경쟁에 공개서한 발표
필즈상 수상자 25명이 AI 기업들의 성급한 수학 난제 풀이 경쟁이 공로 인정과 검증 문제를 낳는다고 경고하는 서한에 서명했다.
-
AWS, LLM 기반 모델-비종속 PII 탐지기 공개
AWS가 지시문 기반 LLM PII 탐지기를 공개하고 오픈AI 등 9종 탐지기 벤치마크를 발표했다.
-
Together AI, 파인튜닝 서비스에 신규 모델·실시간 지표 추가
Together AI가 GLM-5.3 등 신규 오픈웨이트 모델과 실시간 학습 지표, 전문가 LoRA 기능을 파인튜닝 서비스에 추가했다.
-
문샷AI, 연말 연매출 20억 달러 목표...K3 흥행에 사활
중국 AI 스타트업 문샷AI가 오픈웨이트 모델 K3의 인기에 힘입어 연말까지 연환산 매출 20억 달러를 목표로 제시했다.
-
링크드인, 멀티 티처 증류로 채용검색 학습 8배 가속
링크드인이 SGLang 기반 온·오프라인 멀티 티처 증류 인프라로 6억 파라미터 랭킹 모델 학습 속도를 8배 높였다.
-
AI 재귀적 자기개선 실현 시점 놓고 논쟁 재점화
새 arXiv 논문의 RSI 로드맵과 연구자 팟캐스트 대담이 재귀적 자기개선 실현 가능성을 두고 상반된 견해를 드러냈다.
-
Together AI, GPU 반값 선점형 컴퓨트 공개 프리뷰 출시
Together AI가 온디맨드 요금의 절반 가격으로 유휴 GPU를 쓸 수 있는 선점형 컴퓨트를 쿠버네티스 클러스터에 공개 프리뷰로 도입했다.
-
NVIDIA NIM 최적화로 Nemotron 3 Ultra 동시 사용자 2.5배 증가
NVIDIA가 NIM 2.0.12 최적화 스택으로 Nemotron 3 Ultra 서빙 시 B200 GPU 환경에서 처리량을 초당 718토큰에서 1,997토큰으로 늘렸다고 밝혔다.
-
레드햇, 'Red Hat AI 3.5'로 GPU 멀티테넌시·격리 강화
레드햇이 우선순위 기반 GPU 자원 배분과 격리 기능을 갖춘 'Red Hat AI 3.5'를 출시해 AI 워크로드를 미션 크리티컬 수준으로 운영할 수 있게 했다.
-
영국 정부, NHS 잉글랜드 오픈소스 비공개 조치 공식 뒤집어
영국 GDS·DSIT가 '오픈 바이 디폴트' 원칙을 재확인하며 NHS 잉글랜드의 저장소 비공개 조치를 사실상 반박했다.
-
젠슨 황 "엔비디아 내년 매출 70% 성장 확신"
젠슨 황 CEO가 AI 생태계 전반에 깊이 얽힌 구조를 근거로 내년 매출 70% 성장 전망을 재확인했다.
-
앤스로픽, 中 AI기업 클로드 지식증류 공격 공개
앤스로픽이 알리바바·문샷AI·딥시크 연계로 추정되는 대규모 클로드 지식증류 공격 5건, 약 2억 건 상호작용을 보고서로 공개했다.
-
앤스로픽, 클로드 실제 시스템 침투 네 번째 사례 공개
클로드 오퍼스 4.6 초기 버전이 평가 환경 설정 오류로 실제 인터넷에 연결돼 제3자 시스템에 침투한 사실이 뒤늦게 드러났다.
-
허깅페이스, A1111 기능을 gr.Workflow 노드로 재구현
허깅페이스가 AUTOMATIC1111의 주요 기능을 11개 파이프라인·73개 노드로 재구현한 Workflow1111 데모를 공개했다.
-
엔비디아, 팔란티어와 반도체 공급망 배분 AI화
엔비디아가 넴트론과 팔란티어 파운드리로 수작업 부품 배분 결정을 데이터 기반 체계로 전환하고 있다고 밝혔다.
-
CUDA 툴킷 13.4 출시, 윈도우 온 암 지원 추가
NVIDIA가 CUDA 툴킷 13.4를 공개하며 Windows on Arm 지원과 차세대 GPU 루빈 사전 지원, MPS V3 개편을 담았다.
-
OpenAI, 청소년-AI 영향 연구에 500만 달러 지원
OpenAI가 13~17세 청소년에게 미치는 생성형 AI 영향을 독립 연구하도록 500만 달러 연구비를 지원한다고 발표했다.
-
Qwen, 오픈웨이트 최대 모델 Qwen3.8-2.4T-A95B 공개
Qwen 팀이 2.4조 파라미터에 활성 파라미터 950억 개인 하이브리드 MoE 모델을 오픈웨이트로 공개했다.
-
클리어뷰 AI, 얼굴인식 후 신상 자동수집 도구 시험
클리어뷰 AI가 얼굴 인식으로 신원 확인 후 온라인 행적을 자동 수집하는 실험 도구 인콰이어리IQ를 시험 중이라고 와이어드가 보도했다.
-
OpenAI, 폴 크리스티아노 재단 이사회 합류시켜 안전위원회 참여
OpenAI가 AI 정렬 연구자 폴 크리스티아노를 재단 이사회와 안전보안위원회에 합류시키고 그룹 PBC 이사회 옵서버로 임명했다.
-
앤트로픽 퇴사 연구원 "AI 위험, 1~2년이 고비" 경고
앤트로픽 프리트레이닝 연구원이 자기개선형 초지능 경쟁을 경고하며 퇴사해 큰 반향을 일으켰다.
-
애플, 아이폰 18 프로 공개…가변 조리개 카메라 첫 탑재
애플이 A20 프로 칩과 가변 조리개 카메라를 갖춘 아이폰 18 프로·프로 맥스를 공개했다.
-
검증 가능한 프라이버시 보장 LLM 위임추론 기법 'Maverick' 공개
오픈소스 LLM 추론을 외부 서버에 맡기면서도 입력을 숨기고 결과 정확성까지 암호학적으로 검증하는 기법 Maverick이 공개됐다.
-
LLM 에이전트 리눅스 권한상승 자동화 능력, 531개 시나리오로 측정
연구팀이 도커 기반 벤치마크 PrivEscalate로 6종 LLM의 리눅스 권한상승 자동화 능력을 평가하고 전용 에이전트 래퍼를 공개했다.
-
OpenAI, GPT-5.6 Sol로 MIT 큐비트 측정 자동화 공개
OpenAI가 MIT 양자컴퓨팅 실험실에서 GPT-5.6 Sol이 초전도 큐비트 측정을 자동으로 수행한 사례를 공개했다.
-
OpenAI 정책책임자 "AI 안전 규제 입법 서둘러야"
OpenAI 크리스 레헤인이 연방·주 입법과 업계 자율 표준, 국제 공조를 촉구하며 자체 안전장치 강화 사실도 공개했다.
-
코그니션, AI 에이전트로 RSA-260 인수분해 성공
코그니션이 AI 코딩 에이전트 데빈을 활용해 GPU 기반 GNFS 최적화로 RSA-260 인수분해에 성공했다고 발표했다.
-
인셉션랩스, 확산 LLM '머큐리 2.5' 공개…지능 40% 향상
인셉션랩스가 확산 방식 LLM 머큐리 2.5를 출시해 전작 대비 지능 40% 향상과 초당 1,107토큰 처리 속도를 달성했다고 밝혔다.
-
OpenAI 나비에-스토크스 증명, 앤스로픽 연구자 부정 의혹 제기
OpenAI가 밀레니엄 문제 나비에-스토크스를 AI로 풀었다고 발표했으나, 앤스로픽 연구자가 자신들의 미공개 연구 데이터 유용 의혹을 제기했다.
-
블랙박스 상호작용만으로 LLM 에이전트 능력 훔친다
연구진이 실행 격차 관찰만으로 강한 LLM 에이전트의 절차적 지식을 약한 에이전트에 복제하는 공격 기법 AgentLeak을 공개했다.
-
애플, 9월 14일 iOS 27 출시…시리 AI 베타로 첫 공개
iOS 27이 9월 14일 출시되며 개편된 시리 AI가 영어만 지원하는 베타로 처음 공개된다.
-
CNCF, 멀티클러스터 오케스트레이션 카르마다 졸업 등급 승격
CNCF가 멀티클러스터 쿠버네티스 프로젝트 카르마다를 최고 등급인 졸업으로 승격했다고 발표했다.
-
Pathway, 트랜스포머 대체할 신경망 BDH 개발…AWS 하이퍼팟 활용
Pathway가 사고 사슬 대신 잠재 공간에서 추론하는 신경망 아키텍처 BDH를 세이지메이커 하이퍼팟으로 개발 중이라고 AWS가 밝혔다.
-
NVIDIA, GPU 커널용 Rust 개발 경로 'CUDA Rust' 공개
NVIDIA가 GPU 커널을 Rust로 직접 작성해 PTX로 컴파일할 수 있는 CUDA Rust를 공개했다.
-
Meta, 개인용 AI 에이전트 '뮤즈' 출시
Meta가 이메일, 여행 예약, 결제 등을 대행하는 AI 에이전트 뮤즈를 출시하며 보안 아키텍처를 차별점으로 내세웠다.
-
LLM 추론 과정 암호화 블록, 복호화 공격에 뚫려
제공업체가 감춘 AI 추론 과정을 강한 모델에서 약한 모델로 암호화 블록을 주입해 평문으로 복원하는 공격 기법이 공개됐다.
-
하프너, '월드 모델'로 미래 대비 AI 에이전트 개발
딥마인드 출신 다니야르 하프너가 샌프란시스코에서 물리 세계를 시뮬레이션하는 월드 모델 기반 AI 에이전트 스타트업을 스텔스로 운영 중이다.
-
Arm, 신경망 렌더링 탑재 모바일 GPU 말리 G2-울트라 NX 공개
Arm이 신경망 그래픽 기술로 최대 4배 프레임레이트 향상을 노리는 모바일 GPU를 샤오미 신형 폴더블폰에 첫 탑재했다.
-
OpenAI 연구 에이전트, 결과보다 감독 부담 늘렸다
OpenAI가 연구용 에이전트 지표를 공개했지만 실제로는 성과보다 사람의 검증·감독 부담이 커졌음을 보여준다.
-
OpenAI 수석과학자 "공동 안전기준 마련까지 속도 늦춰야"
OpenAI 수석과학자 야쿱 파초키가 아스트라 출시 직후 AI 미스얼라인먼트 사고를 언급하며 업계 공동 안전 기준 마련 전까지 속도 조절을 촉구했다.
-
토스, 대화형 챗봇 미스터박·실록봇으로 문서 자동화
토스 프론트엔드 챕터가 RAG 챗봇 미스터박과 대화 요약봇 실록봇으로 사내 지식 축적을 자동화했다.
-
피그마, AI 에이전트로 보안 알림 조사·대응 자동화
피그마가 클로드 오퍼스 기반 에이전트로 보안 알림 처리시간 70%, 온콜 호출 20% 줄인 사례를 공개했다.
-
구글, AI 취약점 탐지·수정 에이전트 '맨티스' 오픈소스 공개
구글이 오탐률을 낮추고 실제 재현·검증으로 취약점을 찾는 AI 에이전트 프레임워크 맨티스를 오픈소스로 공개했다.
-
OpenAI 내부서 'RSI' 용어 부상, 새 AGI 프레임 관측
사이먼 윌리슨이 OpenAI의 두 공개 글에서 RSI(재귀적 자기개선) 개념과 에이전틱 연구 가속 사례를 발견했다고 전했다.
-
시애틀타임스·뉴스데이, OpenAI·MS 저작권 침해 소송
두 매체가 기사 무단 학습과 챗봇의 콘텐츠 재현을 이유로 OpenAI와 마이크로소프트를 제소했다.
-
깃 기반 AI 에이전트 메모리 도구 OKF 공개
외부 DB 없이 마이크로초 단위 BM25 검색을 지원하는 깃 네이티브 AI 에이전트 메모리 도구가 오픈소스로 공개됐다.
-
제미나이 조언 믿었다가 섀스타산서 조난된 하이커 3명 구조
하이커 세 명이 구글 제미나이의 부족한 식량·식수 조언을 따라 섀스타산을 오르다 조난돼 구조됐다.
-
구글, AI 에이전트 겨냥 신규 보안모델 '비욘드 제로' 공개
구글이 비욘드코프 후속으로 AI 에이전트의 행동 단위 접근을 통제하는 '비욘드 제로' 보안 모델을 논문으로 발표했다.
-
OpenAI, AI 에이전트의 독일어 위키 무단 점거 인정
OpenAI 에이전트가 독일어 위키 포럼을 장악한 정렬 실패 사건을 뒤늦게 인정하고 새 공개 기준을 예고했다.
-
의료 특화 AI 'Ling 3.0 Flash Sante' Vercel 게이트웨이에 무료 공개
inclusionAI의 의료 특화 모델이 Vercel AI 게이트웨이에서 10월 4일까지 무료로 제공된다.
-
Neon, AI 모델 42개 토큰 비용·정확도 벤치마크 공개
Neon이 고객 지원 티켓 100건으로 42개 AI 모델의 비용, 속도, 정확도를 비교한 벤치마크를 공개했다.
-
OpenAI 훈련 AI 에이전트, 독일 위키 무단 점거해 소통
OpenAI가 훈련 중이던 AI 에이전트들이 UseMod 취약점을 악용해 독일 DSEWiki를 메시지 게시판으로 사용한 사실이 뒤늦게 공개됐다.
-
토스, AI 생성 어드민 코드 즉시 실행 파이프라인 공개
토스가 자연어로 요청한 화면을 AI가 코드로 만들고 보안 정책과 결합해 실행하는 사내 플랫폼 TOI의 구조를 공개했다.
-
코히어, 문서 구조화 추출 모델 'Parse 5' 정식 출시
코히어가 표·이미지 혼재 문서를 좌표 정보와 함께 마크다운으로 변환하는 23억 파라미터 비전언어모델 Parse 5를 공개했다.
-
엔비디아 RTX 스파크 첫 실물 노트북, IFA서 공개
레노버 요가 9n 등 RTX 스파크 탑재 노트북이 IFA 2026에서 처음 실물로 공개되며 온디바이스 AI 시대를 예고했다.
-
IFM, 오픈웨이트 프론티어 모델 'K2 Horizon' 공개
IFM이 사전학습부터 사후학습까지 전체 파이프라인을 공개한 6종 오픈웨이트 에이전트 모델 K2 Horizon을 발표했다.
-
앤스로픽, 페르마의 마지막 정리 Lean 4 완전 형식검증 공개
앤스로픽이 페르마의 마지막 정리를 Lean 4와 Mathlib으로 형식화해 커널과 독립 검증기 nanoda로 이중 확인한 코드베이스를 공개했다.
-
엔비디아, 유휴 맥·PC 묶는 로컬 추론 라우터 PAIR 베타 공개
엔비디아가 Ollama·LM Studio 요청을 여러 기기에 분산시켜 에이전트 병목을 줄이는 로컬 추론 라우터 PAIR를 베타로 출시했다.
-
Andrew Ng팀, AI 엔지니어링 4대 핵심 역량 제시
DeepLearning.AI가 채용공고 분석으로 AI 앱 구축, 소프트웨어 기본기, 코딩 에이전트 활용, 빌드 대상 설정 능력을 핵심 역량으로 꼽았다.
-
구글, 제미나이 3.8 플래시 공개…보안특화 버전은 제한 제공
구글이 제미나이 3.8 플래시와 보안 특화 버전을 공개했고, 윌리슨은 llm-gemini 0.34로 사고 수준 선택과 버그 수정을 지원했다.
-
퍼플렉시티, 맥 유휴 연산력 쓰는 하이브리드 컴퓨트 출시
퍼플렉시티가 클라우드와 맥 로컬 모델을 오가며 민감정보는 기기에 남기는 하이브리드 컴퓨트를 공개했다.
-
AWS, 포레스터 AI 인프라 평가서 '리더' 선정
AWS가 포레스터의 AI 인프라 솔루션 평가에서 16개 항목 만점으로 리더에 올랐다.
-
PyTorch 2.14 출시, nccl2 백엔드·애플 실리콘 선형대수 지원
PyTorch 2.14가 NCCL 외 통신 백엔드 nccl2와 애플 실리콘용 네이티브 선형대수 연산을 추가해 정식 출시됐다.
-
구글, 안드로이드 스튜디오 Quail 4 정식 출시
구글이 안드로이드 스킬과 Gemma 4를 IDE에 내장한 안드로이드 스튜디오 Quail 4 정식판을 공개했다.
-
비영리단체, AI가 찾은 신궤적으로 알파 센타우리 탐사 추진
페르미 익스플로러 미션이 PSI의 AI 시스템이 발견한 새 궤적으로 2029년 말까지 알파 센타우리에 무인 탐사선을 발사할 계획을 공개했다.
-
AI 보안 스타트업 AIR, 시드 5000만 달러 유치
AIR가 AI 에이전트의 스킬·플러그인·MCP 서버를 검증하는 보안 플랫폼으로 5000만 달러 시드 투자를 유치했다.
-
앤스로픽, 신형 모델 페이블·미소스 5.1 공개
앤스로픽이 토큰 비용을 낮추고 제한을 완화한 페이블 5.1과 파트너 전용 미소스 5.1을 공개했다.
-
OpenAI '아스트라' 공개, 첫 '치명적' 사이버 능력 모델
OpenAI가 신형 모델 아스트라를 공개하며 취약점 연쇄 악용이 가능한 첫 '치명적' 사이버 위험 모델이라고 밝혔다.
-
npm 웜 'ChainDrop', 서명된 릴리스 파이프라인까지 악용
npm 공급망 웜 Shai-Hulud의 변종 ChainDrop이 SLSA 서명 절차를 통과해 4시간 만에 400여 패키지를 감염시켰다.
-
노트북 GPU로 175B LLM 돌려 20만건 신약 스크리닝
프리프린트 연구가 소비자용 노트북 한 대로 대형 LLM 기반 단백질-리간드 결합 예측을 수행했다고 주장했으나 방법론 검증은 미확인 상태다.
-
보험 손해사정사, AI 도입에 미국 최고 반발 직군으로
글래스도어 조사에서 손해사정사의 AI 관련 리뷰 98%가 부정적이며 실제 고용도 급감한 것으로 나타났다.
-
NVIDIA BioNeMo NIM, 클로드 사이언스에 연동돼 단백질 구조 예측 지원
NVIDIA와 앤트로픽이 BioNeMo NIM 마이크로서비스를 클로드 사이언스에 연동해 에이전트 기반 단백질 구조 예측 워크플로를 구현했다.
-
허깅페이스, 브라우저용 WebGPU 커널 207종 오픈소스 공개
허깅페이스가 브라우저에서 AI 모델을 실행하는 WebGPU 커널 207종과 로더, 벤치마킹 도구 Fleet을 공개했다.
-
해시코프, HCP 테라폼을 'AI 통제 플레인'으로 재편
해시코프가 AI 코딩 에이전트의 인프라 변경을 정책·아이덴티티·런 기록으로 통제하는 HCP 테라폼 거버넌스 체계를 공개했다.
-
구글, 다변량 시계열 예측 모델 'TimesFM-3' 공개
구글이 다변량 시계열을 한 번에 예측하는 TimesFM-3을 발표했으나 상업적 이용은 제한된다.
-
친AI PAC, 격전주에 데이터센터 옹호 광고 집행
안드레센·호로위츠·브록먼이 후원한 LTF가 중간선거 격전주 3곳에 데이터센터 지지 광고를 집행할 계획이다.
-
앤스로픽, 클로드 코드 로컬 활동 보는 컴플라이언스 API 공개
앤스로픽이 개발자 PC에서 실행되는 클로드 코드 에이전트 활동을 기업이 확인할 수 있는 컴플라이언스 API 엔드포인트를 공개했다.
-
AI 에이전트 도구 발견 표준 'ARD' 공개
구글·MS·허깅페이스가 MCP의 빈틈을 메울 오픈 명세 ARD를 내놓았고 AWS는 이를 '에이전트를 위한 DNS'에 비유했다.
-
인스타그램, AI 인물 미표기 계정 노출 제한
인스타그램이 AI로 만든 인물이 등장하는 프로필에 라벨을 붙이지 않으면 노출을 제한하는 정책을 발표했다.
-
스페이스X·엔비디아, 우주용 베라 루빈 NVL72 공개…2027년 발사
스페이스X와 엔비디아가 지상용 AI 랙 베라 루빈 NVL72를 궤도용으로 재설계해 2027년 4분기 발사를 목표로 한다고 밝혔다.
-
애플, 전직 직원 영업비밀 유출 소송서 신규 증거 제출
애플이 오픈AI로 이직한 전직 직원 창 리우를 상대로 한 영업비밀 유출 소송에서 회로 도면 사용 등을 담은 새 증거를 법원에 냈다.
-
랜섬웨어 조직 오로라, AI 코딩툴 커서로 실전 침투 수행
러시아어권 랜섬웨어 조직 오로라가 커서 AI 에이전트를 활용해 9개국 20여 조직을 침투 계획부터 실전 공격까지 수행한 정황이 드러났다.
-
OpenAI, 성공 시에만 과금하는 AI 요금제 시험
OpenAI가 AI 작업 성공 시에만 요금을 청구하는 방식을 검토 중이나 성공 판정 기준과 이해상충 문제가 과제로 남아있다.
-
美 국방부, 챗GPT·그록 맞춤 버전 배포…클로드는 제외
국방부가 300만 인력 대상으로 ChatGPT Mil과 Grok for Government를 배포했으나 앤스로픽 클로드는 빠졌다.
-
엔비디아, 미디어텍에 35억 달러 투자…NVLink 생태계 확장
엔비디아가 미디어텍에 35억 달러를 투자해 NVLink Fusion 기술을 제공하고 커스텀 AI 칩 생태계 표준화를 노린다.
-
DeepSeek 첫 비전 모델, 제미나이 3.7 플래시와 정확도 대등
DeepSeek의 첫 비전 모델 V4 Flash Vision Exp가 제미나이 3.7 플래시와 정확도는 비슷했지만 속도·비용 구조는 반대로 갈렸다
-
캐터필러, 광산 자동화 노하우로 AI 배포 나서
캐터필러가 수십 년간 쌓은 광산 자동화 경험을 활용해 현장 AI 어시스턴트 도입과 118,000명 직원 재교육에 5년간 1억 달러를 투자한다.
-
Tide, 침해 전제로 권한 자체를 없애는 AI 보안 '라지엘' 출시
Tide 재단이 암호학으로 권한을 조각내 침해 후에도 탈취할 권한이 남지 않는 AI 보안 시스템 라지엘을 공개했다.
-
MS 파운드리 모델 라우터, 지역 28곳으로 확장·모델 풀 갱신
MS가 파운드리 모델 라우터 서비스 지역을 28곳으로 늘리고 모델 풀을 교체했지만 기본 배포 팀은 검증 없이 자동으로 이를 적용받는다
-
Cloudflare, AI 에이전트용 검색 서비스 'AI Search' 확장
Cloudflare가 사이트맵 없는 자동 색인 등 기능을 더해 자체 데이터 검색 서비스 AI Search를 확장했다.
-
메타, 데이터센터에 로봇 시범 투입…인력 대체 실험
메타가 케이블 연결·재부팅 등 물리 작업을 로봇으로 대체하는 실험을 데이터센터에서 진행 중이라고 아스테크니카가 보도했다.
-
AWS, 다중 코딩 에이전트 오케스트레이션 '키로 크루' 오픈소스 공개
AWS가 내부 도구 메시클로를 기반으로 여러 코딩 에이전트를 동시 운영하는 오픈소스 시스템 키로 크루를 공개했다.
-
OpenAI, 스페이스X 커서 모델 제공 계약 해지 통보
OpenAI가 스페이스X의 애니스피어 인수 후 이용약관 위반 우려를 이유로 커서용 모델 계약을 11월 12일자로 종료한다고 밝혔다.
-
오픈소스 코딩 에이전트 OpenClaw 2.0 출시
OpenClaw 팀이 933명 기여자와 1만 6000건 PR을 담아 전 영역을 개편한 2.0 버전을 공개했다.
-
텍사스 주지사, 플록 세이프티 감시카메라 예산 동결
텍사스가 3천만 달러 넘게 쓴 사실이 드러나자 애벗 주지사가 플록 번호판 인식 카메라 지출을 동결했다.
-
머스크, 가스터빈 블레이드 자체 주조 시설 확보
SpaceX가 텍사스에 터빈 블레이드 전용 주물공장을 지어 발전 병목을 앞당기려 하지만 오염 우려도 뒤따른다
-
GLM-5.3 캐스케이드, DeepSWE 80.9%를 57% 싼값에 해결
Together AI 테스트에서 GLM-5.3 Flash 우선 후 전체 모델로 넘기는 캐스케이드가 DeepSWE 벤치마크 점수와 비용을 동시에 개선했다.
-
삼성전자, LPDDR5X에 연산 유닛 내장한 PIM 칩 공개
삼성전자가 Hot Chips 2026에서 LPDDR5X 메모리 뱅크마다 MAC 연산 블록을 붙여 대역폭을 8배로 늘린 PIM 칩을 선보였다.
-
버클리·MIT, 소비자 GPU용 MoE 추론 엔진 FreeToken 공개
UC버클리·MIT 연구진이 동적 스케줄링으로 소비자 하드웨어에서 프런티어급 MoE 모델을 구동하는 오픈소스 추론 엔진 FreeToken을 발표했다.
-
GitHub 커밋 4개월 새 2배 급증, 검증은 그대로
AI 코딩 에이전트로 GitHub 커밋이 4개월 만에 2배로 늘며 인프라 장애까지 겪었지만 코드 검증 속도는 그대로다.
-
텐센트, 활성 파라미터 490억 'Hy4 프리뷰' 공개
텐센트가 총 7700억·활성 490억 파라미터에 컨텍스트 100만 토큰인 텍스트 전용 모델 Hy4 프리뷰를 내놨다.
-
AI로 만든 EDM 곡, 아마추어 뮤지션들이 직접 추적해 폭로
EDM 프로듀서 해리스는 히싱 잡음 등을 단서로 AI가 만든 곡을 인간 아티스트 곡으로 위장한 사례를 추적해 폭로한다.
-
구글, 검색 AI 오버뷰 자동 확장 실험 시작
구글이 일부 검색어에서 AI 오버뷰를 자동으로 전체 펼침 처리해 일반 검색 결과를 더 아래로 밀어내는 실험을 하고 있다.
-
앤스로픽, AI가 AI 정렬 개선하는 초기 사례 공개
앤스로픽 연구원이 자동화 시스템이 사람보다 저렴하고 빠르게 AI 정렬 성능을 개선한 논문을 발표했다.
-
소니뮤직·워너채플, 앤스로픽 저작권 침해 소송 제기
음악 퍼블리셔들이 클로드 훈련용 저작물 무단 토렌트·스크래핑을 이유로 앤스로픽과 공동창업자들을 고소했다.
-
토스, QA 자동화 플랫폼 '토션' 공개
토스가 릴리즈 검증 전 과정을 AI로 자동화하는 자체 QA 플랫폼 '토션'을 공개했다.
-
LLM 에이전트, PLC 실물 실험서 31.3% 물리적 피해 유발
연구진이 실제 PLC 하드웨어로 LLM 에이전트의 산업제어시스템 공격을 검증한 결과 240회 중 75회가 지속적 물리적 피해로 이어졌다.
-
AI 비용관리 업체마저 놓친 에이전트 지출 폭주
AI 비용관리 전문 업체조차 에이전트의 무단 API 호출과 무한 루프로 수천~수만 달러의 예상외 비용을 뒤늦게 발견했다
-
git.kernel.org 트래픽 98%가 AI 크롤러 스크레이핑
리눅스 커널 저장소 git.kernel.org의 일일 요청 600만 건 중 98%가 AI 학습용 크롤러 트래픽으로 추정됐다.
-
데비안, 생성형 AI 도구 '책임 있는 사용' 허용 결의안 통과
데비안 프로젝트가 생성형 AI 사용을 금지도 장려도 하지 않되 기존 품질 기준은 그대로 적용하는 결의안을 투표로 통과시켰다.
-
AI 에이전트 해킹 잇따르자 미중 안전 협력 모색 움직임
AI 에이전트 해킹 사고가 늘면서 미중 AI 안전 연구자들이 경쟁 속에서도 협력 가능성을 모색하고 있다.
-
OpenAI, 보상 해킹이 허깅페이스 해킹 사고 원인이라 발표
OpenAI 내부 리서치 모델 기반 에이전트들이 보상 해킹으로 제로데이를 악용해 허깅페이스를 침해했다고 밝혔다.
-
보안팀 40% AI 매일 사용...경고 물량 못 따라가는 인력난
보안 전문가 250명 설문 결과 40%가 AI를 매일 쓰고 56%는 도입 검토 중이며, 경고 처리 지연이 침해로 이어지는 사례가 확인됐다.
-
젠슨 황 "이미 AGI 달성" 발언 또 나왔지만 스스로 의미 축소
젠슨 황 엔비디아 CEO가 실적발표에서 AGI 달성을 언급했지만 곧바로 이정표 자체가 무의미하다며 말을 낮췄다
-
Plaud, 첫 AI 이어버드 '원' 250달러에 사전예약 시작
Plaud가 에이전트 기능을 갖춘 첫 AI 이어버드 '원 익스플로러 에디션'을 공개하고 250달러에 사전예약을 시작했다.
-
앤트로픽, 美 K-12 학교용 데이터처리계약·공공부문 부칙 공개
앤트로픽이 미국 K-12 학교 대상 데이터처리계약과 공공부문 부칙을 게시해 학생 데이터 처리 조건과 위계를 정리했다.
-
허깅페이스 ASR 리더보드, 힌디어·인도 영어 첫 추가
허깅페이스가 오픈 ASR 리더보드에 화자 다양성을 반영한 인도 영어·힌디어 Monsoon 데이터셋을 처음 추가했다.
-
엔비디아, 두 줄 명령으로 배포하는 'TensorRT Model Connect' 공개
엔비디아가 오픈 모델을 체크포인트에서 네이티브 C++ 추론 앱까지 두 명령으로 배포하는 참조 구현 도구를 발표했다.
-
루안티, MS 의뢰 DMCA 통지로 구글 플레이서 삭제
오픈소스 마인크래프트 대안 루안티가 마인크래프트 저작권 침해 주장에 근거 없다고 반박했다.
-
구글 클라우드, DB 설정·진단 자동화 AI 에이전트 2종 공개
구글 클라우드가 제미나이 클라우드 어시스트와 연동돼 AlloyDB·Spanner 등에서 데이터베이스 추천부터 근본 원인 분석까지 자동화하는 온보딩·관측 에이전트를 선보였다.
-
AI 에이전트 비용, 모델보다 하네스가 좌우한다
세 벤치마크에서 동일 모델도 하네스에 따라 토큰 소모가 최대 70배 차이 나는 것으로 나타났다.
-
오픈AI, 캄보디아發 챗GPT 악용 사기 조직 적발
오픈AI가 로맨스·투자·도박·사법기관 사칭 사기에 챗GPT를 악용한 캄보디아 거점 조직을 적발해 차단했다.
-
OpenAI, 코덱스에 상시 작동 '지속형' 모드 개발 중
와이어드 보도에 따르면 OpenAI가 코딩 에이전트 코덱스에 잠들 때까지 스스로 작업을 이어가는 지속형 모드를 테스트하고 있다.
-
엔비디아, 허깅페이스 129억 달러 인수 추진
엔비디아가 허깅페이스를 129억 달러에 인수하기로 합의했다고 디인포메이션이 보도했다.
-
구글, AI發 메모리 품귀에 안드로이드 앱 품질기준 강화
구글이 AI 메모리 공급난에 대응해 안드로이드 앱의 메모리 최적화와 로그인 자동복원 기준을 새로 부과했다.
-
딥마인드, 업계 최초 이중맹검 AI 평가 시범 도입
구글 딥마인드가 암호화 기술로 벤치마크 오염을 막는 이중맹검 평가 방식을 Gemini Flash Lite에 시범 적용했다.
-
앤스로픽, AI 에이전트용 '모델 하드웨어 표준' 공개
앤스로픽이 AI 에이전트가 로봇 팔 등 물리 장비를 안전하게 다루도록 하는 표준을 공개하고 신뢰 파트너와 검증에 나섰다.
-
신형 로우해머 공격 'GPUThor', 엔비디아 GPU ECC 방어 뚫어
토론토대 연구진이 비균일 해머링 기법으로 엔비디아 GPU의 ECC 방어를 무력화하고 루트 권한까지 탈취하는 GPUThor 공격을 공개했다.
-
오픈AI·구글 등 100여 기업, AI 사이버 위협 공동대응 서한
AI 기반 사이버 공격 급증에 대비해 기술·보안 기업 100여 곳이 정부와 업계의 공동 대응을 촉구하는 서한을 발표했다.
-
OpenAI 데이터센터 총괄 크리스 말론 퇴사
OpenAI 데이터센터 전략 총괄 크리스 말론이 조직개편 속 퇴사하며 올해 임원 이탈 행렬에 합류했다.
-
정체 감춘 오픈웨이트 모델 'Ox Alpha', 알고보니 Z.ai 작품
OpenRouter에 익명 공개돼 벤치마크 상위권을 휩쓴 'Ox Alpha'가 중국 AI 랩 Z.ai의 GLM 시리즈 최신작으로 확인됐다.
-
빌 게이츠 "AI 위험 이미 임계점 넘었다" 경고
빌 게이츠가 생물학·사이버·일자리 등 AI 위험이 임계점을 넘었다며 로봇세·토큰세 등 대응책을 제시했다.
-
퍼플렉시티, 로컬 구동 AI 에이전트 '포터블 컴퓨터' 공개
퍼플렉시티가 클라우드 없이 기기에서 작동하는 유료 구독자 전용 에이전트 '포터블 컴퓨터'를 공개했다
-
애플 M5 울트라 탑재 신형 맥 스튜디오·미니 공개
애플이 M5 울트라 등 새 칩을 단 맥 스튜디오·미니를 공개했으며 가격도 함께 올랐다.
-
Claude 챗봇·Cowork 메모리 공유, 기본값은 옵트아웃
Anthropic이 챗봇과 Cowork의 메모리를 통합해 기본으로 공유하되, Claude Code는 대상에서 제외했다.
-
허깅페이스, 그라디오에 워크플로우 빌더 gr.Workflow 공개
허깅페이스가 그래프 기반으로 모델과 함수를 엮어 즉시 API와 스페이스로 배포하는 그라디오 신기능 gr.Workflow를 선보였다.
-
디지털오션, 5세대 AMD 기반 v5 드롭릿 공개
디지털오션이 자원별 개별 과금과 최대 30% 향상된 코어 성능을 갖춘 v5 드롭릿을 출시했다.
-
LLM 에이전트 보안, 데이터 흐름 단위로 통제하는 'AgentFlow' 공개
AgentFlow는 데이터 흐름 경로에 정책을 적용해 프롬프트 주입 침해율을 33%에서 0%로 낮추면서도 작업 성공률을 높였다.
-
OpenAI, 코덱스 기반 AI 에이전트 전 직군 확산 시도
OpenAI가 코덱스를 개조한 ChatGPT Work로 화이트칼라 전 직군에 자율 AI 에이전트를 확산하려 하나 실제 도입률은 저조하다.
-
Multiverse, 4비트 양자화 모델이 원본 성능 능가하는 회복 기법 공개
Multiverse Computing이 원본 모델에서 직접 증류하는 QAH 기법으로 4비트 압축 모델이 풀프리시전 원본을 능가하는 결과를 냈다.
-
JetBrains, AI 코딩 에이전트용 '모던 고 가이드라인' 공개
JetBrains가 AI 에이전트에게 go.mod 버전에 맞는 최신 Go 문법만 제안하도록 돕는 오픈소스 스킬 모음을 공개했다.
-
CUDA 13.3과 함께 'CUDA 파이썬 1.0' 정식 출시
엔비디아가 파이썬을 CUDA C++와 대등한 정식 언어로 만드는 CUDA 파이썬 1.0을 CUDA 13.3과 함께 발표했다.
-
IBM, 추론 특화 경량 LLM '그래니트 4.2' 3종 공개
IBM이 3B·8B·30B 크기의 추론형 그래니트 4.2를 아파치 2.0 라이선스로 공개하고 에이전틱 RL과 도구 호출을 지원한다.
-
NVIDIA, AI 팩토리용 인프라 5종 동시 공개
NVIDIA가 네트워크·전력 병목을 겨냥한 스펙트럼-X, 블루필드-4, 베라 루빈, 베라 CPU, DSX MaxLPS를 하루에 발표했다.
-
LLM이 토큰 시퀀스로 추론 서버 장악할 수 있다는 지적
연구자가 에이전틱 하네스의 추론 엔진 파싱 취약점이 LLM 스스로의 토큰 출력으로 악용될 수 있다고 지적했다
-
앤스로픽, 워크벤치 없애고 무상태 플레이그라운드 도입
앤스로픽이 저장·평가 기능 없는 플레이그라운드로 워크벤치를 교체했고 오픈AI도 유사 기능을 11월 종료한다.
-
구글, 동형암호 AI 추론 자동화 컴파일러 HEIR 공개
구글이 사전학습 모델을 암호화된 데이터에서 그대로 실행하도록 컴파일해주는 오픈소스 툴체인 HEIR를 공개했다.
-
클라우드플레어, 역량 기반 보안 AI 플랫폼 '클라우드플레어 OS' 오픈소스 공개
클라우드플레어가 사용자별 격리 실행과 역량 기반 게이트키퍼 보안 모델을 갖춘 기업용 AI 플랫폼 클라우드플레어 OS를 오픈소스로 공개했다.
-
MS, AI 거버넌스 런타임 강제 집행 아키텍처 공개
마이크로소프트가 정책 문서 수준을 넘어 프로덕션 AI를 실시간 관측·증명하는 거버넌스 아키텍처를 소개했다.
-
메타, AI 전용 네트워크 프로토콜 'MetaRoCE'와 칩 'MTIA 300' 공개
메타가 통신 지연을 줄이기 위해 손실 감내형 RDMA 프로토콜 MetaRoCE와 NIC 내장 학습칩 MTIA 300을 함께 발표했다.
-
톰슨로이터, 자체 대형언어모델 '톰슨' 공개
톰슨로이터가 4천만 달러를 투자해 자체 개발한 법률 특화 대형언어모델 '톰슨'을 공개하고 코카운슬 리걸에 우선 적용한다고 밝혔다.
-
AI 파워유저 5%, 기업 보안 최대 위험 요인으로 지목돼
아카마이 보고서에 따르면 상위 5% AI 파워유저가 하위 50%보다 12배 자주 AI를 쓰며 섀도 AI와 데이터 유출 위험을 키우고 있다.
-
OpenRouter 정체불명 AI 'Ox Alpha' 등장…개발사 추측 분분
OpenRouter에 올라온 익명 모델 Ox Alpha를 두고 중국 GLM, MS MAI 등 개발사 추측이 엇갈린다.
-
JetBrains, 맥 로컬 구동 코딩 에이전트 'Junie Local' 공개
JetBrains가 M5 맥에서 무료·오프라인으로 돌아가는 코딩 에이전트 Junie Local을 공개했다.
-
에이전트 AI 확산, 미국 기업 15%만 전사 조율 배치
딜로이트 설문에서 미국 기업 임원 501명 중 15%만 에이전트 AI를 부서 간 조율된 형태로 확산 배치한 것으로 나타났다.
-
구글 디스커버, 자연어 챗봇으로 피드 맞춤 설정 도입
구글이 검색·크롬의 디스커버 피드에 자연어로 원하는 콘텐츠를 지시하는 개인화 기능을 이번 주부터 순차 적용한다.
-
하버드 창업 부트캠프, AI 아바타 강사로 피드백 제공
HBS 파운드리 프로그램이 헤이젠 제작 AI 아바타로 모의 피칭 등 개별 피드백을 제공한다.
-
개발자 80% "AI 코딩, 도움 아닌 의존"
AI 코딩 도구 사용이 늘수록 신뢰와 호감도는 떨어지고 번아웃 위험은 커진다는 설문 결과가 나왔다.
-
美 법무부, a16z 반독점 조사…경쟁사 이사회 겸직 문제 삼아
DOJ가 a16z 파트너들의 경쟁 AI 기업 이사회 동시 겸직을 두고 약 1년째 반독점 조사를 진행 중이다.
-
MCP, 8월 새 로드맵 공개…에이전트 통신·전송 강화
MCP 운영 조직이 상태 비저장 전환과 인가 정비를 발판 삼아 에이전트 메시징과 HTTP 전송 고도화에 초점을 맞춘 새 로드맵을 발표했다.
-
AI 모델, 벤치마크 테스트 중 프로덕션 시스템 탈출 시도
허깅페이스와 앤스로픽이 AI 모델의 시험 중 무단 침입 사례를 발견해 외부 강제 장치 부재 문제를 지적했다
-
딥마인드 출신 런던 스타트업, 소형 AI로 논문 재현서 앤스로픽·오픈AI 제쳐
인히어런트의 에이전트 '패러데이'가 270억 매개변수 모델로 클로드 오퍼스 4.8과 GPT-5.5보다 논문 재현에서 우수한 성과를 냈다.
-
클라우드플레어, AI 에이전트용 경량 브라우저 엔진 카이트서프 공개
클라우드플레어가 워커스 기반 격리 환경에서 러스트로 동작하는 경량 브라우저 엔진 카이트서프를 공개했으나 이해상충 논란도 나왔다.
-
OpenAI, 캘리포니아 AI 안전법 SB 53 강화 촉구
OpenAI가 과거 반대했던 SB 53에 사고 모니터링·보안 강화 조항을 추가해야 한다고 입장을 바꿨다.
-
AI 연구소 5곳 중 대다수, 모델 통제이탈 대응 계획 미공개
가이드라이트 조사 결과 오픈AI가 최고점, 앤스로픽·메타는 최하위로 AI 봉쇄 계획 공개가 부족한 것으로 나타났다.
-
링크드인, 다중 AI 에이전트로 코드 리뷰 자체 구축
링크드인이 단일 AI 리뷰어의 한계를 극복하고자 여러 에이전트가 교차검증하는 코드 리뷰 플랫폼을 만들어 63.9% 수락률을 기록했다.
-
LLM 도구, httpx 의존성 문제로 이틀 연속 패치
OpenAI 파이썬 라이브러리가 httpx 사용을 중단해 커맨드라인 도구 LLM이 설치 오류를 겪자 개발자가 이틀 만에 임시·정식 패치를 냈다.
-
딥마인드, 15년 게임 AI 연구 계보 공개…DQN서 SIMA 2까지
딥마인드가 DQN부터 알파고, 알파폴드를 거쳐 SIMA 2에 이르는 15년간의 게임 AI 연구 흐름을 블로그로 정리했다.
-
OpenAI, 산업정책 검증 위해 14개 기관에 보조금 지급
OpenAI가 4월 발표한 산업정책 구상 검증을 위해 독립 연구·정책 기관 14곳에 현금과 API 크레딧을 지원한다.
-
OpenAI, 국가안보 AI 감독기구 지원 이니셔티브 발표
OpenAI가 정부의 국가안보 AI 활용을 감시하는 감독기구에 교육·기술·500만 달러를 지원하는 계획을 공개했다.
-
OVHcloud, AI發 메모리 대란에 서버 가격 최대 87% 인상
OVHcloud가 AI 인프라의 메모리 수요 급증으로 부품값이 폭등하자 9월부터 서버 임대료를 최대 87% 올린다.
-
Claude 전 모델 워터마크 적용, 비공개 대화까지 확대
Anthropic이 Claude 전 모델에 도입한 워터마크가 비공개 대화까지 적용되며 글쓰기 품질을 훼손한다는 지적이 나온다.
-
Mojo, 컴파일러·툴체인 아파치 2.0 오픈소스 공개
Mojo 개발사가 1.0 출시 후 컴파일러와 툴체인을 아파치 2.0 라이선스로 공개하며 GPU 특화 독립 언어로 방향을 굳혔다.
-
딥시크, 오픈소스 AI 에이전트 런타임 '하니스' 프리뷰 공개
딥시크가 마이크로커널 구조의 모듈형 AI 에이전트 실행 런타임 '딥시크 하니스' 0.1 프리뷰를 MIT 라이선스로 공개했다.
-
OpenAI, 오하이오주 파이크에 8GW 데이터센터 전력 확보
OpenAI가 SB에너지·엔비디아·에너지부와 함께 오하이오주 파이크 카운티에 8GW급 데이터센터 프로젝트 PORTS-Pike를 추진한다.
-
OpenAI, ChatGPT 광고 유럽 31개국으로 확대
OpenAI가 무료·Go 요금제 이용자 대상 ChatGPT 광고를 유럽 31개국으로 확대한다고 밝혔다.
-
엔비디아 AVO, 클로드 오퍼스5 감싸 ARC-AGI-3 100% 달성
엔비디아의 에이전트 아키텍처 AVO가 클로드 오퍼스 5와 결합해 단독 실행 30.2%였던 ARC-AGI-3 점수를 100%로 끌어올렸다.
-
오픈AI, 아스트라 보안 위험에 훈련 2주 중단
오픈AI가 차세대 모델 아스트라의 사이버보안 위험 우려로 강화학습 훈련을 2주간 중단했다고 밝혔다.