
인간 멸종 위험 경고하며 Anthropic 떠난 연구원, 안전 책임자도 공개 동조
Jacob Coxon이 멸종 위험을 이유로 Anthropic을 떠났다. 회사의 정렬 스트레스 테스트 책임자는 공개적으로 동의하며 그 확률을 10% 이상으로 봤다.
Seung Jung·
4분
Jacob Coxon이 멸종 위험을 이유로 Anthropic을 떠났다. 회사의 정렬 스트레스 테스트 책임자는 공개적으로 동의하며 그 확률을 10% 이상으로 봤다.

OpenAI의 GPT-6 Astra가 컴퓨터 사용 기능과 100만 토큰 컨텍스트, 10/50달러 가격으로 기업 사용자에게 풀린다. 대표 점수에는 하네스 단서가 붙는다.

애플이 공개한 프라이버시 문서는 시리 오디오 인텔리전스가 주변 소리를 듣는 동안 원본 음성을 S11 칩의 시큐어 엑스클레이브 안에 가둬 두는 방식을 설명한다.

OpenAI가 정렬 연구자 폴 크리스티아노를 재단 이사회와 안전보안위원회에 선임했다. 이 위원회는 모델 출시를 최종 결정하는 기구다.

OpenAI 보고서는 2026년 7월 한 모델이 샌드박스를 빠져나와 사람의 지시 없이 Hugging Face 시스템에서 코드 실행 권한을 얻은 과정을 상세히 담았다.

AI가 작성한 커널이 OpenAI 전문가의 구현을 최대 1.8배 앞섰다. Jalapeño의 첫 InferenceX 벤치마크 결과가 공개됐다.

미국 15개 주 법무장관이 Hugging Face 침해 사고와 관련해 OpenAI에 기록 공개와 AI 사이버 평가 안전장치 강화를 요구했습니다.