오픈AI가 위험 평가 전담 대비팀을 해체했다. 7월 말 해산돼 업무가 여러 팀으로 분산됐다. IPO를 앞두고 안전 조직이 다시 흔들린다.
현지 시각 7월 20일 오픈AI가 공개한 사후 기록에 따르면, 회사는 아직 출시하지 않은 한 모델의 내부 접근을 일시 중단했다가 감시 장치를 보강한 뒤 다시…
미국 정부가 GPT-5.6 출시 제한을 해제하면서 오픈AI가 9일 솔·테라·루나 세 모델을 전 세계에 정식 출시한다. 6월 말 제한 공개 이후 추가 시험을 거친 결과다.
알렉스 카프 팔란티어 CEO가 7월 1일(현지시간) CNBC 인터뷰에서 AI 업계를 강하게 비판했다. 그는 업계 상황을 두고 말도 안 되게 미쳤다(effing insane)고 표현했다. 카프의 핵심…
xAI의 차세대 모델 그록5가 올 3분기에는 나오지 않을 것으로 전망된다. 그록5는 여전히 슈퍼컴퓨터 콜로서스2에서 훈련 중인 것으로 알려졌다. 예측시장 폴리마켓은 6월 30일 그록5의 3분기…
미국 연방 당국이 메타(Meta)에 정부 주도의 자발적 AI 안전성 평가에 참여할 것을 촉구했다. 뉴욕타임스는 6월 29일 메타가 모델의 능력과 취약점을 평가받기 위해 모델을 공유하는…
오픈AI(OpenAI)의 차기 모델 GPT-5.6 출시가 6월을 넘겨 7월로 미뤄졌다. 6월 22~28일 출시 가능성을 점치던 예측시장 폴리마켓(Polymarket)의 확률은 한때 83%에서 18%로 주저앉았다. 7월 안에 나올…
앤트로픽이 6월 9일(현지시간) 자사 역사상 가장 강력하다는 신형 모델 ‘클로드 페이블 5(Claude Fable 5)’를 일반 사용자에게 공개했다. 불과 며칠 전 “AI가 스스로를 만들기 시작했다”며…
앤트로픽의 미공개 모델 Mythos가 5월 25일 클로드 코드 참조에 등장하고 토글이 잠깐 노출됐다. Mythos는 1000개 오픈소스에서 2만 3000건 넘는 취약점을 찾아냈다. 정식 공개가 임박했다는…
Evaluating Sabotage and Monitoring in LLM Agents 앤트로픽이 공개한 연구 논문에 따르면, 프런티어 대형언어모델(LLM)들이 복잡한 에이전트 환경에서 사용자에게 해를 끼치는 능력이 제한적이지만 점차 발전하고…