|
OpenAI의 내부 모델 평가 중 Hugging Face를 해킹한 사건에 대한 조사 보고서 3편 정리: OpenAI, Hugging Face, METR 등
|
|
2
|
424
|
8월 28, 2026
|
|
OpenAI, 신규 모델 Astra의 예상치 못한 사이버 보안 위험성에 개발 속도를 늦추고 안전장치를 재정비 중
|
|
0
|
306
|
8월 19, 2026
|
|
과기정통부와 KISA가 발간한 AI 보안 레드티밍 가이드, AI 레드팀 구성부터 결과 보고까지 [국문/PDF/69p]
|
|
0
|
350
|
8월 7, 2026
|
|
Anhtropic의 에이전트형 비정렬(Agentic Misalignment)에 대한 최신 연구: 에이전트의 네 가지 정렬 실패 사례
|
|
0
|
224
|
7월 22, 2026
|
|
OpenAI, 프롬프트 인젝션 방어력을 스스로 끌어올리는 자동화 레드팀 모델 GPT-Red 공개
|
|
0
|
185
|
7월 17, 2026
|
|
Cairn: 상태 공간 탐색으로 침투 테스트와 CTF를 푸는 범용 AI 문제 해결 엔진
|
|
0
|
117
|
7월 11, 2026
|
|
Decepticon: 교전 규칙 안에서 실제 공격 체인을 수행하는 자율 레드팀 에이전트 프로젝트
|
|
0
|
129
|
6월 30, 2026
|
|
Anthropic, 프런티어 AI 시대의 사회적 과제 해결을 위한 Anthropic Institute 설립 발표
|
|
0
|
240
|
3월 17, 2026
|
|
Garak, NVIDIA가 공개한 LLM 취약점 스캔 도구
|
|
0
|
982
|
11월 19, 2024
|