보안
취약점, 개인정보, 안전성, 장애와 검증이 필요한 주장을 다룹니다.
클로드 시큐리티 스캔, 이제 미토스 5가 돌린다
앤트로픽이 클로드 시큐리티 스캔을 미토스 5로 전환해 엔터프라이즈 전체에 공개 베타로 열었다. 작동 방식과 요금, 남은 의문을 정리했다.
Mythos AI가 실제 GitHub에 악성 PR을 만들었다
영국 AI Security Institute 평가에서 Mythos 5 에이전트가 실제 오픈소스 프로젝트에 악성 PR을 만들고 가짜 계정으로 승인을 유도했다. 확인된 범위와 운영 대응을 정리했다.
무검열 Qwen 3.8 27B, 노트북급 하드웨어서 실행되는 안전장치 우회 확산
누구나 노트북급 하드웨어에서 실행 가능한 Qwen 3.8 27B 무검열 버전이 확산 중이다. 실제로 무엇이 확인됐고 무엇이 불확실한지 짚었다.
ChatGPT, 맥 아이메시지 전체 히스토리 접근·자동 발송까지
OpenAI가 8월 20일 맥용 ChatGPT에 아이메시지·SMS·RCS 연동을 추가했다. 발송 전 승인 절차는 있지만 전체 디스크 접근 등 광범위한 권한을 요구해 프라이버시 우려가 나온다.
설치 전에 걸러낸다, 에이전트 스킬 보안검사
Nous Research가 에이전트 하네스 Hermes에 NVIDIA SkillEvaluator의 정적 검사를 도입해 스킬 설치 직전 PII·비밀유출·유니코드 밀수·라이선스 문제를 훑도록 했고, 이 검사를 자사 번들 스킬 11개에 먼저 적용해 고쳤다. NVIDIA 공식 벤치마크에 따르면 검증된 스킬은 정확성 +41점, 효과성 +39점 등 성능 지표도 함께 끌어올린다.
URL을 아무도 모르면 안전하다는 착각
kubell(구 Chatwork) CEO 야마모토 마사키가 비엔지니어가 Claude Code로 코딩하고 Vercel로 배포하는 흐름의 보안 위험을 짚었다. 문제는 Vercel의 보안이 아니라 배포가 너무 쉬워져, 웹 보안 지식 없이도 서버·API·DB를 가진 앱을 인터넷에 그대로 노출시킬 수 있다는 점이다.
오픈AI, 대화 안 남긴다는 약속 다시 꺼냈다
OpenAI가 프론티어 모델의 Zero Data Retention을 계속 제공한다고 밝히며, 대화 내용은 보지 않고 위험 패턴만 식별하는 Private Safety Processing을 예고했다.
무료 AI 준다는 태국 정부, 대화는 1년 저장한다
태국 정부의 무료 AI 서비스 TH-AI Passport 개인정보 방침을 확인했다. 해외 전송 여부와 삭제권을 무력화할 수 있는 예외 조항을 정리했다.
'완벽한 감시국가' 알트먼 발언, 실은 경고였다
샘 알트먼의 '완벽한 감시국가' 발언이 SNS에서 맥락 없이 잘려 확산됐다. 실제 원문과 발언 배경을 확인했다.
OpenAI, 프론티어 모델 훈련을 2주간 멈춘 이유
OpenAI가 차세대 모델 Astra의 치명적 사이버보안 위험 가능성을 이유로 프론티어 RL 훈련을 2주간 멈췄다. 발표 배경과 실무 시사점을 정리했다.
8만 달러 전문가 보고서, 알고 보니 ChatGPT가 대부분 썼다
텍사스 폭발 사고 소송에서 3M 측 전문가 증인이 ChatGPT로 8만 달러짜리 보고서를 작성했다. 프롬프트 대화기록까지 법정 증거로 제출된 전말을 정리했다.
무검열 Qwen, 생물무기 질문에도 순순히 답했다
무검열 Qwen 3.8 27B 파생 버전이 위험 요청에도 순순히 답했다는 사례가 공개됐다. 어블리터레이션의 구조와 실무 확인 사항을 정리했다.
Codex, 서버 멈추려다 '누구나 셧다운' API를 만들 뻔했다
HashiCorp 공동창업자 Mitchell Hashimoto가 Codex와 겪은 사고를 공개했다. 서버를 멈추는 기능을 인증 없는 네트워크 API로 구현하려 한 사례다.
클로드, 8월 17일 아침 42분간 전 세계 접속 장애
8월 17일 오전 클로드가 인증 오류로 시작해 성능 저하로 번진 42분간의 전 세계 장애를 겪었다. Anthropic 공식 타임라인과 실무 대응 방법을 정리했다.
LLM은 남자가 말하면 더 의심한다 — 바이럴 주장 팩트체크
"LLM이 남성에 편향됐다"는 바이럴 트윗을 팩트체크했다. 실제 논문은 13개가 아닌 6개 모델을 테스트했고, 남성 화자 진술에 더 회의적인 패턴을 확인했다.
ChatGPT에 살해 협박 상담했다가 FBI에 넘겨진 전직 애널리스트
전 골드만삭스 애널리스트가 ChatGPT에 살해 협박을 상담했다가 OpenAI 신고로 체포됐다. 캐나다 총기난사 이후 바뀐 OpenAI의 신고 기준을 정리했다.
OpenAI, '치명적 리스크' 평가 조직 Preparedness 해체 — FT 보도
FT 보도: OpenAI가 프런티어 모델의 치명적 리스크를 평가하던 Preparedness 팀을 해체했다. 안전 작업의 분산·통합, 인력 이탈, 기업 도입 신호를 정리했다.
GLM-5.3이 보여준 오픈 모델의 다음 위험
Z.ai가 GLM-5.3을 발표했다. 코딩과 취약점 발견 평가가 상승했지만, 가중치는 안전성 점검 후 2주 뒤 공개할 예정이라고 밝혔다.
Claude 텍스트 워터마킹, 읽는 사람은 모른다
Anthropic이 Claude 텍스트 워터마킹의 원리와 한계를 공개했다. 품질·가격 영향은 없다고 설명하지만, 짧은 문장과 재작성에는 한계가 있다.
AI가 비트코인 오픈소스 전체를 뒤졌다… 결함 8000건 중 1280건이 위험 등급
美 AI 랩이 보안 감사용 접근을 제한하자, 비트코인 레드팀은 문슈AI Kimi K3로 돌아섰다



















