|
OpenAI, 자동화 연구 인턴 목표 달성 발표와 함께 공개한 사내 측정치: 에이전트 노동이 사람의 3.1배
|
|
0
|
54
|
9월 8, 2026
|
|
OpenAI GPT-6 Astra 출시: 사이버보안 Critical 등급 첫 도달과 낮아진 CoT 모니터링 가능성
|
|
1
|
361
|
9월 4, 2026
|
|
대한민국 정부가 공개한 '인공지능 윤리원칙': 법적 구속력은 없는, 다른 윤리 규정의 토대가 되는 3대 가치 & 7대 원칙 [국문/PDF/23p]
|
|
0
|
158
|
9월 2, 2026
|
|
빌 게이츠가 본 AI 전환기의 세 가지 위험과 대응책: 인간만을 위한 영역(Human Reserved)과 AI 토큰세 제안
|
|
0
|
214
|
8월 31, 2026
|
|
OpenAI의 내부 모델 평가 중 Hugging Face를 해킹한 사건에 대한 조사 보고서 3편 정리: OpenAI, Hugging Face, METR 등
|
|
2
|
423
|
8월 28, 2026
|
|
OpenAI, 신규 모델 Astra의 예상치 못한 사이버 보안 위험성에 개발 속도를 늦추고 안전장치를 재정비 중
|
|
0
|
306
|
8월 19, 2026
|
|
AI 가치 정렬 논문 94편 중 79%는 가치를 정의하지 않는다: 정렬 연구의 암묵적 가치 이론 분석
|
|
0
|
168
|
8월 15, 2026
|
|
Anthropic의 Project Pilot: AI 모델의 드론 조종 능력을 측정한 Drone-Bench
|
|
0
|
165
|
7월 27, 2026
|
|
iFixAi: AI 에이전트의 오정렬과 맹점을 45개 점검으로 진단하는 도구
|
|
0
|
190
|
7월 19, 2026
|
|
OpenAI, 프롬프트 인젝션 방어력을 스스로 끌어올리는 자동화 레드팀 모델 GPT-Red 공개
|
|
0
|
185
|
7월 17, 2026
|
|
[GN⁺] AI 2040: 플랜 A - 초지능 경쟁을 늦추기 위한 국제 합의 시나리오
|
|
0
|
265
|
7월 12, 2026
|
|
J-space: LLM 내부에 창발한 글로벌 워크스페이스와 이를 읽는 Jacobian Lens (feat. Anthropic)
|
|
0
|
667
|
7월 7, 2026
|
|
ICML 2026에서 우수 논문상과 Test of Time상을 수상한 10편의 논문 소개
|
|
0
|
6690
|
7월 6, 2026
|
|
Anthropic, 수출통제 해제로 돌아온 Claude Fable 5, 주간 사용량의 50%까지 무료 제공 (~7/8, 16:59:59, KST)
|
|
0
|
536
|
7월 3, 2026
|
|
OpenAI, GPT-5.6 Sol, Terra, Luna 프리뷰 공개: 새 네이밍 체계와 강화된 안전 스택
|
|
1
|
3992
|
6월 27, 2026
|
|
Agent Governance Toolkit: Microsoft가 공개한 AI 에이전트 거버넌스 도구
|
|
0
|
998
|
5월 28, 2026
|
|
Anthropic, 오픈소스 정렬 평가 도구 Petri를 Meridian Labs에 기증하며 Petri 3.0 공개
|
|
0
|
216
|
5월 9, 2026
|
|
Claude 사용자 100만 대화에 기반한 개인 조언 요청과 아첨형 응답 문제에 대한 연구 (feat. Anthropic)
|
|
0
|
286
|
5월 5, 2026
|
|
Alignment Whack-a-Mole: LLM 파인튜닝이 정렬을 우회하여 저작권 도서의 그대로 기억을 활성화하는 메커니즘에 대한 연구
|
|
0
|
171
|
5월 3, 2026
|
|
AI가 노동 시장에 미치는 영향: 새로운 측정 지표 '관측된 노출도'와 초기 증거 (feat. Anthropic)
|
|
0
|
395
|
3월 24, 2026
|
|
Anthropic, 지난 9월 Claude Code를 악용해 발생한 AI 기반 사이버 스파이 작전에 대한 조사 결과 공개 [PDF/영문/13p]
|
|
0
|
372
|
11월 17, 2025
|
|
OpenDataLoader PDF: AI를 위한 안전하고 고성능의 PDF 처리 도구
|
|
0
|
3593
|
9월 26, 2025
|
|
ArtPrompt: LLM에 대한 ASCII Art 기반의 공격 (ArtPrompt: ASCII Art-based Jailbreak Attacks against Aligned LLMs)
|
|
0
|
615
|
3월 10, 2024
|
|
TigerLab: LLM을 위한 오픈소스 도구모음 (총 4종: RAG, 파인튜닝 + 출시 예정 DA, Safety)
|
|
0
|
799
|
11월 5, 2023
|