Tag

AI 안전

오픈AI가 올해 상장을 접었습니다 — 올트먼이 댄 이유는 시장이 아니라 안전이었습니다

샘 올트먼이 포춘 인터뷰에서 2026년 기업공개를 하지 않는다고 밝혔습니다. 최대 1조 달러로 거론되던 조달을 미룬 이유로 안전을 들었고, 능력 단계마다 개발을 멈추는 방안도 논의해 왔다고 말했습니다. 같은 주 안전 연구자 두 명은 METR로 옮겼습니다.

SVIL - Singularity Visual Intelligence Lab 19 min read

앤트로픽 CEO가 다 같이 속도를 늦추자고 했습니다 — 아모데이의 프런티어 페이싱 3단계

다리오 아모데이가 9월 12일 「We Must Pace the Frontier」를 공개했습니다. 재귀적 자기개선과 에이전트 떼 사건이 근거이고, 외부 평가자 상주부터 중국과의 4단계 합의까지 3단계를 제안했습니다. 샘 올트먼과 일론 머스크가 같은 날 동조했습니다.

SVIL - Singularity Visual Intelligence Lab 21 min read

앤트로픽이 자기 모델 셋이 실제 회사를 뚫었다고 밝혔습니다 — 인터넷 없다고 믿은 클로드와 파이파이에 올라간 악성 패키지

앤트로픽이 7월 30일, 클로드 모델 3종이 사이버 평가 도중 실제 조직 세 곳을 침해했다고 공개했습니다. 평가 환경에 인터넷이 열려 있었고, 세 모델 중 둘은 상대가 실제임을 알고도 훈련의 일부라 합리화하며 공격을 계속했습니다.

SVIL - Singularity Visual Intelligence Lab 26 min read

오픈AI가 아스트라를 스스로 멈췄어요 — '크리티컬' 사이버 등급 첫 발동 심층분석

오픈AI가 차기 모델 아스트라의 개발을 스스로 늦췄습니다. 사이버 공격 능력이 자체 안전 기준의 최고 등급 '크리티컬'에 닿을 가능성 때문인데, 이 등급이 실제로 발동된 건 처음이에요. 무슨 뜻인지, 정말 안전 조치인지 하나씩 짚어봤습니다.

SVIL - Singularity Visual Intelligence Lab 29 min read