뉴스 목록 · 2페이지
2 / 29페이지
기사 통계를 확인하고 있습니다.
-
첫 토큰 확률로 유해 요청 탐지
LADE는 LLM의 첫 토큰 확률 분포에 숨은 안전 신호를 활용해 탈옥 공격과 과잉 거부를 줄인다.
-
전력 측정만으로 비밀 AI 연산 검증 한계
A100 실험에서 전력 흔적만으로는 은닉 연산을 충분히 배제하기 어려우며 재실행 검증이 필요한 것으로 나타났다.
-
LLM 에이전트 오류 관찰자 운영 배포
그럴듯한 실패 관찰자가 알려진 회귀는 탐지했지만 새로운 장애와 실제 정밀도 검증에는 한계를 보였다.
-
문체 아닌 AI 발상 추적하는 아이디어렌즈
아이디어렌즈는 글을 개요로 변환해 문장 작성자가 아닌 발상과 기획 단계의 AI 개입을 탐지한다.
-
LLM으로 x86 바이너리 사전 변환
LLM과 의미 검증을 활용해 x86-64 바이너리를 실행 전 AArch64용으로 변환하는 기법이 제안됐다.
-
AI 가속기 비트플립 탐지·복구 체계 제안
BARE-AI는 낮은 하드웨어 부담으로 비트플립 공격을 탐지하고 손상 계층과 가중치를 복구한다.
-
LLM으로 양자 오류정정 코드 1,142종 탐색
연구진이 LLM 유도 프로그램으로 BB·PBB 코드 후보를 발굴하고 거리와 연결 구조를 검증·분류했다.
-
후속 학습 뒤에도 LLM 백도어 잔존
정상 데이터로 미세조정한 제3자 LLM에서도 백도어가 남거나 강화될 수 있다는 연구 결과가 나왔다.
-
최신 LLM도 코드 기능·보안 격차 지속
32개 LLM을 비교한 결과 최신 모델은 대체로 안전해졌지만 기능 향상이 보안 향상을 보장하지는 않았다.
-
리브레오피스, 기본 AI 기능 도입 보류
도큐먼트 재단은 데이터 통제와 독립성 기준을 충족하기 어려워 기본 설치본에 AI를 넣지 않기로 했다.
-
버셀, 신뢰도 기반 AI 모델 전환 추가
버셀 AI 게이트웨이가 답변 신뢰도가 기준보다 낮으면 대체 모델을 호출하는 기능을 베타로 출시했다.
-
클라우드플레어, AI 에이전트용 CLI 공개
클라우드플레어가 AI 친화적 통합 CLI 'cf'를 공개하고 Wrangler를 18개월 지원 후 중단한다.