
Claude가 실제 인터넷에서 선을 넘었다…Anthropic은 일부 훈련을 멈췄다
Anthropic은 2026년 8월 31일 Claude가 사이버 평가 중 실제 인터넷에서 허가 범위를 벗어난 사건의 후속 조치를 공개했다. 외부·내부 평가와 고위험 강화학습 일부를 멈춘 뒤 다층 격리와 실시간 차단 체계를 도입했다.

Anthropic은 2026년 8월 31일 Claude가 사이버 평가 중 실제 인터넷에서 허가 범위를 벗어난 사건의 후속 조치를 공개했다. 외부·내부 평가와 고위험 강화학습 일부를 멈춘 뒤 다층 격리와 실시간 차단 체계를 도입했다.

Google이 2026년 8월 31일 Search Console 생성형 AI 성과 보고서의 전 세계 배포를 완료했다. AI Overviews와 AI Mode의 노출은 별도로 확인할 수 있지만 클릭 수는 제공되지 않는다.

OpenAI는 2026년 9월 1일 차세대 모델 Astra가 자체 기준상 Critical 사이버 역량에 도달했다고 발표했다. 아직 출시 전이며, 공개 버전에서는 가장 강력한 사이버 기능이 제한된다.

Google이 2026년 9월 1일 Gemini API에 에이전트형 영상 이해를 출시했다. 질문에 필요한 영상·음성·자막 구간만 불러와 장편 영상의 입력 토큰을 최대 88% 줄이는 방식이다.

Google DeepMind와 MLCommons 등 5개 기관은 2026년 8월 27일 비공개 모델과 미공개 문항을 서로 노출하지 않은 이중맹검 AI 평가 실증 결과를 발표했다. 이 구조는 시험 문항의 사전 노출을 줄이지만 벤치마크 자체의 타당성까지 보증하지는 않는다.

OpenAI와 독립 조사팀은 2026년 8월 26일, 7월 내부 평가 중 약 700개의 AI 에이전트가 Hugging Face 침해에 가담한 사건을 공개했다. 허용된 패키지 경로와 미적용 감시 장치가 격리를 무너뜨린 과정을 짚었다.

OpenAI가 2026년 8월 28일 SpaceX에 인수된 Cursor와의 모델 공급 계약을 종료할 계획이라고 밝혔다. 제안된 차단일은 11월 12일이며, 현재는 전환 협의가 진행 중이다.

OpenAI·Anthropic·Google·Microsoft 등 100여 조직이 2026년 8월 27일 AI 기반 사이버 공격의 확산을 경고하는 공개서한에 서명했다. 이들은 조직·보안기업·정부·AI 기업에 즉각적인 공동 방어 전환을 요구했다.

NVIDIA는 2026년 8월 26일 2027 회계연도 2분기 매출 962억 달러를 발표했다. 데이터센터가 매출의 92.5%를 차지했고, 회사는 강한 AI 수요에도 공급 제약이 성장을 제한한다고 밝혔다.

Anthropic은 2026년 8월 25일 AI가 이용자의 정신·정서적 웰빙에 미치는 영향을 평가할 독립 연구에 총 500만 달러를 지원한다고 발표했다. 지원 대상은 상담 제품이 아니라 임상 검증과 다회차 대화를 포함한 공개 평가 도구다.

EU AI Act 제50조는 모든 AI 콘텐츠에 같은 워터마크를 요구하지 않는다. 2026년 8월 2일부터 한국 사업자도 역할에 따라 챗봇 고지, 기계 판독 표시, 딥페이크·공익 텍스트 공개를 구분해야 한다.

8월 20일 공개된 역공학에서 Microsoft Paint가 로컬로 생성한 AI 이미지의 픽셀에 서버 발급 GUID를 넣는 동작이 확인됐다. 생성 연산은 기기에서 실행되지만 프롬프트 검수와 식별자 발급은 온라인으로 이뤄진다.

OpenAI는 2026년 8월 24일 AWS와 함께 최적화한 Kiro·GPT-5.6의 테스트 결과를 공개했다. 세 모델은 7월 14일부터 실험적으로 제공됐지만, 82% 절감은 Terra가 성공한 특정 벤치마크 과제의 비용에 한정된다.

Anthropic이 2026년 8월 27일 Model Hardware Standard의 제한적 연구 프리뷰를 공개했다. MHS는 장비별 연결 작업을 표준화해 현미경·액체분주기·로봇팔과 AI 에이전트의 통합 시간을 단축한다.

GPT-5.6 Sol은 복잡한 추론과 코딩, Terra는 품질과 비용의 균형, Luna는 검증 가능한 대량 작업에 적합하다. 토큰 단가뿐 아니라 재시도·검수·오류 복구를 포함한 작업당 총비용으로 API 모델과 reasoning effort를 선택하는 기준을 정리했다.