ChatGPT, AI가 여는 미래의 시작

  • 홈
  • 태그
  • 방명록

OpenAI 1

똑똑한 AI는 안전한가: AX-Ray가 찾아낸 인과누설

AX-Ray: 성능 벤치마크 이후의 AI 안전진단 계층요약AI 모델 평가는 지금까지 주로 "얼마나 잘 맞히는가"에 집중해 왔다. 그러나 실제 배포 환경에서는 정답률만으로 충분하지 않다. 모델의 내부 계산 경로가 인과적으로 올바른지, serving 경로가 일관적인지, 장문·캐시·양자화·agentic 실행 환경에서 안전하게 동작하는지까지 확인해야 한다.VIDRAFT의 AX-Ray는 이 문제를 다루기 위한 AI/AX 안전진단 프레임워크다. AX-Ray는 FINAL-Bench Diagnostics 기반으로 모델 자체, serving 인프라, 운영·규제·에이전트 리스크를 함께 평가한다.핵심 성과는 명확하다. AX-Ray는 범용 공개 모델 2종에서 인과누설(causal leakage) 결함을 진단·재현·실증한 공개..

카테고리 없음 2026.08.14
이전
1
다음
더보기
프로필사진

ChatGPT, AI가 여는 미래의 시작

AI TECH에 대한 자유롭고 전문적인 글을을 게재하고자 합니다

  • 분류 전체보기 (25) N

Tag

양자컴퓨터, qpu, 파운데이션, agi, 허깅페이스, 비드래프트, AI, OpenAI, 소버린ai, GPT, 피지컬ai, 리더보드, VIDRAFT, 그록, LLM, 챗gpt, 오픈LLM, 앤트로픽, 프롬스크래치, 양자암호,

최근글과 인기글

  • 최근글
  • 인기글

최근댓글

공지사항

페이스북 트위터 플러그인

  • Facebook
  • Twitter

Archives

Calendar

«   2026/08   »
일 월 화 수 목 금 토
1
2 3 4 5 6 7 8
9 10 11 12 13 14 15
16 17 18 19 20 21 22
23 24 25 26 27 28 29
30 31

방문자수Total

  • Today :
  • Yesterday :

Copyright © Daum Corp. All rights reserved.

티스토리툴바