Search

  • Home
  • 프런티어 모델

프런티어 모델

오픈AI, AI 위험 감시 '대비팀' 해체…안전 조직 또 흔들

오픈AI, AI 위험 감시 ‘대비팀’ 해체…안전 조직 또 흔들

8월 18, 2026

오픈AI가 위험 평가 전담 대비팀을 해체했다. 7월 말 해산돼 업무가 여러 팀으로 분산됐다. IPO를 앞두고 안전 조직이 다시 흔들린다.

오픈AI, '에르되시 추측' 반증한 모델 스스로 탈옥 반복 시도…내부 접근 중단 후 재개

오픈AI, ‘에르되시 추측’ 반증한 모델 스스로 탈옥 반복 시도…내부 접근 중단 후 재개

7월 22, 2026

현지 시각 7월 20일 오픈AI가 공개한 사후 기록에 따르면, 회사는 아직 출시하지 않은 한 모델의 내부 접근을 일시 중단했다가 감시 장치를 보강한 뒤 다시…

오픈AI GPT-5.6, 미 정부 규제 풀려 9일 글로벌 정식 출시…솔·테라·루나 3종

오픈AI GPT-5.6, 미 정부 규제 풀려 9일 글로벌 정식 출시…솔·테라·루나 3종

7월 9, 2026

미국 정부가 GPT-5.6 출시 제한을 해제하면서 오픈AI가 9일 솔·테라·루나 세 모델을 전 세계에 정식 출시한다. 6월 말 제한 공개 이후 추가 시험을 거친 결과다.

팔란티어 카프 "AI 업계가 기업에 '부의 세금' 물린다"…토큰 과금 비판

팔란티어 카프 “AI 업계가 기업에 ‘부의 세금’ 물린다”…토큰 과금 비판

7월 6, 2026

알렉스 카프 팔란티어 CEO가 7월 1일(현지시간) CNBC 인터뷰에서 AI 업계를 강하게 비판했다. 그는 업계 상황을 두고 말도 안 되게 미쳤다(effing insane)고 표현했다. 카프의 핵심…

xAI 그록5, 3분기 출시 무산…콜로서스2서 훈련 지속

xAI 그록5, 3분기 출시 무산…콜로서스2서 훈련 지속

7월 6, 2026

xAI의 차세대 모델 그록5가 올 3분기에는 나오지 않을 것으로 전망된다. 그록5는 여전히 슈퍼컴퓨터 콜로서스2에서 훈련 중인 것으로 알려졌다. 예측시장 폴리마켓은 6월 30일 그록5의 3분기…

미 정부, 메타에도 'AI 자발적 안전성 검증' 동참 압박

미 정부, 메타에도 ‘AI 자발적 안전성 검증’ 동참 압박

6월 30, 2026

미국 연방 당국이 메타(Meta)에 정부 주도의 자발적 AI 안전성 평가에 참여할 것을 촉구했다. 뉴욕타임스는 6월 29일 메타가 모델의 능력과 취약점을 평가받기 위해 모델을 공유하는…

GPT-5.6도 7월로… 오픈AI, 정부 요청에 ‘속도 조절’ 출시 늦췄다

GPT-5.6도 7월로… 오픈AI, 정부 요청에 ‘속도 조절’ 출시 늦췄다

6월 29, 2026

오픈AI(OpenAI)의 차기 모델 GPT-5.6 출시가 6월을 넘겨 7월로 미뤄졌다. 6월 22~28일 출시 가능성을 점치던 예측시장 폴리마켓(Polymarket)의 확률은 한때 83%에서 18%로 주저앉았다. 7월 안에 나올…

앤트로픽, 가장 강력한 클로드 '페이블 5' 전면 공개…"위험" 경고 며칠 만에

앤트로픽, 가장 강력한 클로드 ‘페이블 5’ 모델 전면 공개… “미토스 일반 버전”

6월 10, 2026

앤트로픽이 6월 9일(현지시간) 자사 역사상 가장 강력하다는 신형 모델 ‘클로드 페이블 5(Claude Fable 5)’를 일반 사용자에게 공개했다. 불과 며칠 전 “AI가 스스로를 만들기 시작했다”며…

앤트로픽 'Mythos' 정식 공개 임박?…클로드 코드에 모델 토글 잠깐 노출

앤트로픽 ‘미토스’ 정식 공개 임박?…클로드 코드에 모델 토글 잠깐 노출

5월 27, 2026

앤트로픽의 미공개 모델 Mythos가 5월 25일 클로드 코드 참조에 등장하고 토글이 잠깐 노출됐다. Mythos는 1000개 오픈소스에서 2만 3000건 넘는 취약점을 찾아냈다. 정식 공개가 임박했다는…

SHADE-Arena: Evaluating sabotage and monitoring in LLM agents

AI 거짓말 대회 해보니… 클로드가 1등, 인간 감시관은 꼴찌

6월 17, 2025

Evaluating Sabotage and Monitoring in LLM Agents 앤트로픽이 공개한 연구 논문에 따르면, 프런티어 대형언어모델(LLM)들이 복잡한 에이전트 환경에서 사용자에게 해를 끼치는 능력이 제한적이지만 점차 발전하고…