LLM / LLM 에이전트 / LLM 추론 / LLM압축 / LLM 에이전트 보안 / 로컬 LLM / LLM 보안 / 로컬LLM / LLM 압축
38건
기사 통계를 확인하고 있습니다.
-
첫 토큰 확률로 유해 요청 탐지
LADE는 LLM의 첫 토큰 확률 분포에 숨은 안전 신호를 활용해 탈옥 공격과 과잉 거부를 줄인다.
-
LLM 에이전트 오류 관찰자 운영 배포
그럴듯한 실패 관찰자가 알려진 회귀는 탐지했지만 새로운 장애와 실제 정밀도 검증에는 한계를 보였다.
-
LLM으로 x86 바이너리 사전 변환
LLM과 의미 검증을 활용해 x86-64 바이너리를 실행 전 AArch64용으로 변환하는 기법이 제안됐다.
-
LLM으로 양자 오류정정 코드 1,142종 탐색
연구진이 LLM 유도 프로그램으로 BB·PBB 코드 후보를 발굴하고 거리와 연결 구조를 검증·분류했다.
-
후속 학습 뒤에도 LLM 백도어 잔존
정상 데이터로 미세조정한 제3자 LLM에서도 백도어가 남거나 강화될 수 있다는 연구 결과가 나왔다.
-
최신 LLM도 코드 기능·보안 격차 지속
32개 LLM을 비교한 결과 최신 모델은 대체로 안전해졌지만 기능 향상이 보안 향상을 보장하지는 않았다.
-
HERA, AI 에이전트 거절 정확도 개선
실행 불가능한 작업을 식별해 거절하도록 훈련하는 HERA가 거절 정확도를 61.7%에서 83.3%로 높였다.
-
LLM 안전 보상 역이용 공격 ReSA 제안
모델 응답에서 안전 보상을 복원해 유해 출력을 유도하며 여러 모델로 전이되는 공격 기법이 제안됐다.
-
LY코퍼레이션, 대화형 BI 안전 운영 사례 공개
에이전트 역할 분리와 쿼리 안전장치로 LLM 생성 SQL의 정확성·권한·비용 위험을 검증했다.
-
Elastic, 지식베이스 병합에 원자적 주장 검증 도입
Elastic이 LLM 환각을 막기 위해 문서 병합과 검증을 분리하는 2단계 원자적 주장 검증 방식을 공개했다.
-
LLM 에이전트, 자기 실행 기록 스스로 삭제 가능
연구 결과 대부분의 로컬 에이전트 환경에서 LLM이 자신의 실행 트레이스를 삭제·조작할 수 있는 것으로 확인됐다.
-
무해한 추론 훈련이 AI 모델 스스로 안전장치 우회시켜
수학·코드 추론 훈련만으로 언어 모델이 스스로 안전 가드레일을 우회하는 '자가 탈옥' 현상이 발견됐다.
-
질의만으로 LLM 소유권 증명하는 SimPrint 기법 제안
연구진이 가중치 접근 없이 입출력 질의만으로 미세조정·병합된 LLM의 원 소유권을 검증하는 SimPrint 기법을 제안했다.
-
NVIDIA, 기밀 컴퓨팅으로 LLM 추론 성능 손실 5% 이내 억제
NVIDIA가 TensorRT LLM과 기밀 컴퓨팅을 최적화해 DeepSeek-R1 추론에서 처리량을 96~98% 수준으로 유지했다고 밝혔다.
-
vLLM, GPU 종류 안 가리는 '하드웨어 애그노스틱' 레이어 도입
vLLM이 프런티어 모델의 하드웨어별 최적화 흐름 속에서도 다양한 가속기 지원을 유지하기 위한 새 레이어를 공개했다.
-
멀티버스, 이징 모델로 LLM 블록 압축 기법 공개
멀티버스 컴퓨팅이 트랜스포머 블록 제거를 이징 스핀 모델의 제약 이진 최적화 문제로 재정의한 압축 기법을 발표했다.
-
LY코퍼레이션, LLM·코드 분리한 광고 리포트 자동화
LY코퍼레이션이 계산은 코드로, 해석은 LLM으로 분리해 광고 매출 변동 리포트를 매일 자동 생성하는 시스템을 공개했다.
-
오픈AI 출신 연구자, 확률 출력 AI 모델 '젭' 공개
챗GPT 개발자 알메이다가 문장 대신 확률값을 내놓는 트랜스포머 모델 젭을 출시해 개발자들의 큰 관심을 받고 있다.
-
도어대시, LLM 에이전트로 스테일 피처 플래그 자동 정리
도어대시가 클로드 기반 멀티 에이전트 시스템으로 스테일 피처 플래그 50개 중 45개를 건당 평균 13.8분·4.79달러에 자동 정리했다.
-
툴 연동 LLM 에이전트 공격 막는 통합 방어 프레임워크 공개
프롬프트 인젝션과 메모리 오염, 백도어 공격을 하나의 방어 체계로 막으면서 정상 작업 성능은 유지되거나 개선됐다는 연구 결과가 나왔다.
-
24GiB 맥북서 20만 토큰 로컬 LLM 추론, JustFit 공개
연구진이 KV 캐시 압축과 즉시 메모리 관리로 24GiB 맥북에서 20만 토큰 넘는 컨텍스트를 처리하는 추론 런타임 JustFit을 공개했다.
-
LLM, 문맥 학습 시 내부에 믿음 상태 기하 구조 형성
LLM 6종의 내부 활성값에서 HMM 믿음 상태가 선형적으로 읽히며 예측 행동을 실제로 이끄는 표상임이 확인됐다.
-
토스, 자체 LLM 벤치마크 'Toss Benchmark' 구축 공개
토스가 공개 리더보드와 실제 서비스 성능 간 격차를 검증하기 위해 한국어·추론설정·도메인지식을 반영한 자체 벤치마크 구축 과정을 공개했다.
-
AWS, LLM 기반 모델-비종속 PII 탐지기 공개
AWS가 지시문 기반 LLM PII 탐지기를 공개하고 오픈AI 등 9종 탐지기 벤치마크를 발표했다.
-
검증 가능한 프라이버시 보장 LLM 위임추론 기법 'Maverick' 공개
오픈소스 LLM 추론을 외부 서버에 맡기면서도 입력을 숨기고 결과 정확성까지 암호학적으로 검증하는 기법 Maverick이 공개됐다.
-
LLM 에이전트 리눅스 권한상승 자동화 능력, 531개 시나리오로 측정
연구팀이 도커 기반 벤치마크 PrivEscalate로 6종 LLM의 리눅스 권한상승 자동화 능력을 평가하고 전용 에이전트 래퍼를 공개했다.
-
블랙박스 상호작용만으로 LLM 에이전트 능력 훔친다
연구진이 실행 격차 관찰만으로 강한 LLM 에이전트의 절차적 지식을 약한 에이전트에 복제하는 공격 기법 AgentLeak을 공개했다.
-
LLM 추론 과정 암호화 블록, 복호화 공격에 뚫려
제공업체가 감춘 AI 추론 과정을 강한 모델에서 약한 모델로 암호화 블록을 주입해 평문으로 복원하는 공격 기법이 공개됐다.
-
Neon, AI 모델 42개 토큰 비용·정확도 벤치마크 공개
Neon이 고객 지원 티켓 100건으로 42개 AI 모델의 비용, 속도, 정확도를 비교한 벤치마크를 공개했다.
-
버클리·MIT, 소비자 GPU용 MoE 추론 엔진 FreeToken 공개
UC버클리·MIT 연구진이 동적 스케줄링으로 소비자 하드웨어에서 프런티어급 MoE 모델을 구동하는 오픈소스 추론 엔진 FreeToken을 발표했다.
-
텐센트, 활성 파라미터 490억 'Hy4 프리뷰' 공개
텐센트가 총 7700억·활성 490억 파라미터에 컨텍스트 100만 토큰인 텍스트 전용 모델 Hy4 프리뷰를 내놨다.
-
LLM 에이전트, PLC 실물 실험서 31.3% 물리적 피해 유발
연구진이 실제 PLC 하드웨어로 LLM 에이전트의 산업제어시스템 공격을 검증한 결과 240회 중 75회가 지속적 물리적 피해로 이어졌다.
-
LLM 에이전트 보안, 데이터 흐름 단위로 통제하는 'AgentFlow' 공개
AgentFlow는 데이터 흐름 경로에 정책을 적용해 프롬프트 주입 침해율을 33%에서 0%로 낮추면서도 작업 성공률을 높였다.
-
Multiverse, 4비트 양자화 모델이 원본 성능 능가하는 회복 기법 공개
Multiverse Computing이 원본 모델에서 직접 증류하는 QAH 기법으로 4비트 압축 모델이 풀프리시전 원본을 능가하는 결과를 냈다.
-
IBM, 추론 특화 경량 LLM '그래니트 4.2' 3종 공개
IBM이 3B·8B·30B 크기의 추론형 그래니트 4.2를 아파치 2.0 라이선스로 공개하고 에이전틱 RL과 도구 호출을 지원한다.
-
LLM이 토큰 시퀀스로 추론 서버 장악할 수 있다는 지적
연구자가 에이전틱 하네스의 추론 엔진 파싱 취약점이 LLM 스스로의 토큰 출력으로 악용될 수 있다고 지적했다
-
톰슨로이터, 자체 대형언어모델 '톰슨' 공개
톰슨로이터가 4천만 달러를 투자해 자체 개발한 법률 특화 대형언어모델 '톰슨'을 공개하고 코카운슬 리걸에 우선 적용한다고 밝혔다.
-
LLM 도구, httpx 의존성 문제로 이틀 연속 패치
OpenAI 파이썬 라이브러리가 httpx 사용을 중단해 커맨드라인 도구 LLM이 설치 오류를 겪자 개발자가 이틀 만에 임시·정식 패치를 냈다.