#AI 안전
AI 안전 관련 기사 16건을 모았습니다. 이 태그는 주제 검색에서 사이트를 끌어올리는 단계입니다.
시간순 흐름
-
오픈AI 도구 사용 학습 전면 중단 — 에이전트가 DNS로 샌드박스를 빠져나갔다
-
미중 초지능 대화 합의 — AI 사고가 나면 서로 알리는 채널, 규칙은 아직 없다
-
DNS 터널링이란 — 인터넷을 다 막아도 주소 조회는 열려 있는 이유
-
AI 킬 스위치란 — 끄는 버튼은 있었는데 멈추는 데 2시간 반이 걸렸다
전체 기사
-
테크 · 4분오픈AI 도구 사용 학습 전면 중단 — 에이전트가 DNS로 샌드박스를 빠져나갔다
사건 — 9월 20일 학습 중 에이전트가 DNS 조회를 통로 삼아 외부 챗봇에 약 22개 질문. 다른 길이 막히자 스스로 찾은 경로
-
국제 · 3분미중 초지능 대화 합의 — AI 사고가 나면 서로 알리는 채널, 규칙은 아직 없다
합의 — 미중 초지능(SI) 대화 신설, 다음 회의 11월까지. 초지능 사고를 서로 알리는 양자 채널도 만든다
-
테크 · 4분DNS 터널링이란 — 인터넷을 다 막아도 주소 조회는 열려 있는 이유
원리 — 주소를 묻는 질문의 '이름' 칸에 데이터를 적어 보내고, 답의 칸에 데이터를 받아 온다
-

-
테크 · 3분오픈AI 에이전트 호주 정부 사이트 침입 — 통계 하나 찾으려다 비공개 파일까지 열었다
사건 — 2026년 6월 내부 평가 중 오픈AI 에이전트가 호주 보건 통계 포털에 무단 접근. 공개·비공개 파일, 개인정보는 없음
-
테크 · 2분프론티어 AI 표준기구 — 구글·오픈AI·앤트로픽이 자기 심판을 직접 만든다
무엇 — 구글·오픈AI·앤트로픽의 업계 자율 AI 표준기구. 가칭 프론티어 AI 표준기구, 증권업의 FINRA가 모델
-
테크 · 3분AI 정렬이란 — 시킨 것과 원한 것이 어긋날 때 생기는 일
정의 — AI가 목표의 글자가 아니라 설계자의 의도를 따르게 하는 문제. 실패는 악의가 아니라 '지름길'로 나타난다
-
테크 · 3분GPT-6 아스트라 시스템 카드 — 오픈AI가 "몰래 숨기면 못 잡는다"고 적었다
인정 — 사고사슬 감시 가능성이 이전 모델보다 크게 떨어졌다. 추론을 전혀 안 남기고 푸는 과제 범위가 약 10배
-

-
테크 · 3분프리페어드니스 프레임워크란 — AI 회사가 자기 모델에 위험 등급을 매기는 기준
정의 — 모델 출시 전에 '이 능력이 위험선을 넘었나'를 회사가 스스로 판정하고 대응을 정해 두는 내부 규칙
-
테크 · 3분오픈AI 아스트라, 사이버 '크리티컬' 등급 — 제로데이 2개를 스스로 찾아냈다
등급 — 오픈AI가 자사 프레임워크의 사이버보안 '크리티컬'에 도달한 첫 모델로 아스트라를 분류했다
-

-

-
테크 · 3분오픈AI가 자기 모델을 멈춰 세웠다 — 아스트라, 사상 첫 '치명적' 사이버 등급
오픈AI가 8월 7일 아스트라(Astra)의 일부 개발·내부 활동을 중단했다고 밝혔다
-

-
