
OpenAI가 이상행동 6건을 공개했다…원인을 몰라도 보고한다
OpenAI가 2026년 9월 16일 모델 이상행동 6건과 상시 공개 체계를 발표했다. 원인이나 해결책이 확정되지 않은 사건도 공개하되, 제3자 피해와 법적 의무가 걸린 사안은 별도 절차로 다룬다.

OpenAI가 2026년 9월 16일 모델 이상행동 6건과 상시 공개 체계를 발표했다. 원인이나 해결책이 확정되지 않은 사건도 공개하되, 제3자 피해와 법적 의무가 걸린 사안은 별도 절차로 다룬다.

Anthropic이 2026년 9월 17일 공개한 측정에서 Claude는 8월 내부 AI 연구개발 업무의 26%를 주도했다. 그러나 완전 자율 업무는 없었고 감독과 최종 결정은 사람이 맡았다.

Zendesk가 2026년 9월 14일 환불 등 고객지원 업무를 실행하는 Specialized AI Agents를 발표했다. 시스템 접근과 행동 범위, 사람의 승인 지점은 도입 기업이 정한다.

Anthropic이 2026년 9월 16일 Claude Docs·Slides 베타와 채팅·Cowork 통합을 공개했다. 제작 기능은 유료 플랜에 제공되며, 새 통합 환경은 Pro·Max부터 수주간 순차 배포된다.

SpaceXAI가 2026년 9월 18일 Grok Voice Transcribe 2.0을 출시하며 정확도가 두 배 높아졌다고 주장했다. 독립 측정의 Grok STT는 오류율 4.6%로 29개 중 8위였으며, 한국어 성능은 아직 따로 검증해야 한다.

Anthropic과 Accenture는 2026년 9월 18일 내부 평가팀 구성 계획을 발표했다. 직원 수준의 접근과 평가 업무는 제시했지만 자금·보고·결과 공개를 아우르는 독립성 기준은 아직 확정하지 않았다.

개빈 뉴섬 캘리포니아 주지사가 2026년 9월 18일 행정명령에 서명해 독립 AI 안전감독 시행을 앞당기고 ‘킬 스위치’ 법제화 검토를 지시했다. 명령은 즉시 발효됐지만 기업의 설치 의무는 아니며, 관련 권고는 11월 16일까지 나온다.

도널드 트럼프 미국 대통령이 2026년 9월 19일 ‘AI Force’ 구성과 새 AI czar 임명을 예고했다. 그러나 소속·예산·구체적 권한·출범 일정은 공개하지 않아, 현재로서는 정식 출범한 연방조직이 아니라 정책 구상 단계다.

Anthropic·OpenAI·SpaceXAI·Google이 AI 제품 개선 속도를 함께 늦췄다는 소비자 반독점 소송이 2026년 9월 18일 미국 연방법원에 제기됐다. 현재는 소장 접수 단계로, 담합·소비자 피해나 집단소송 지위가 인정된 것은 아니다.

Hacktron 연구진은 2026년 7월 25일 Claude로 libheif 원격 코드 실행과 OpenAI SSO 결함을 연결해 직원 계정 접근을 입증했다. 9월 13일 공개된 이 연구의 결함은 수정됐으며, 전 과정에는 숙련된 인간의 지도가 필요했다.

Anthropic이 2026년 9월 17일 팀·기관 대상 LSVP 베타 신청을 열었다. 검증된 조직에는 제한되던 생명과학 작업을 허용하되, 고위험 접근은 프로젝트별 심사와 6개월 갱신, 30일 데이터 보관을 요구한다.

Anthropic은 2026년 9월 17일 Claude가 자사 AI 연구개발 업무의 26%를 ‘주도’한다고 공개했다. 다만 인간이 목표를 정하고 결과를 감독하는 단계로, 완전 자율 연구를 뜻하지 않는다.

OpenAI가 2026년 9월 16일 모델 훈련·평가에서 관찰된 이상 행동 6건과 새 보고 체계를 공개했다. 원인 분석이나 수정이 끝나지 않았더라도 불확실성을 명시해 먼저 알린다는 방침이다.

Cloudflare가 2026년 9월 15일 검색 크롤링을 유지하며 AI 학습을 거부하는 Disallow AI Training을 출시했다. 이름이 비슷한 Block을 선택하면 Googlebot·Bingbot의 검색 접근까지 차단될 수 있다.

AgentCore Memory의 오래된 기록이 현재 답변에 사실처럼 섞인다면 기억 유형별 만료 조건부터 정해야 한다. TTL, 관련성 감쇠, 통합, 삭제를 단계적으로 배포하고 같은 질문으로 품질과 개인정보 삭제 결과를 검증하는 방법을 설명한다.