OpenAI ChatGPT 5.5의 해킹능력

영국 보안기업 AISI의 최근 리포트 분석

by덧셈기계

OpenAI ChatGPT 5.5 가 AISI의 해킹 테스트에서 Mythos의 기록과 동일한 기록을 달성했습니다.


https://www.aisi.gov.uk/blog/our-evaluation-of-openais-gpt-5-5-cyber-capabilities​



또한 일부 테스트에선 chatGPT 5.5가 미토스를 근소하게나마 능가하기도 했습니다..


얼마 전 엔트로픽 (Anthropic) 은 이 AISI의 벤치마크 기록을 근거로 일반 대중에게 미토스를 공개하지 않기로 결정했습니다. 그 대신 글레스윙 프로젝트를 통해 엄선된 (?!) 회사를 상대로 기존보다 5배 높은 값에 미토스 이용권을 팔려고 하고 있죠..


그런데 미토스와 동일한 해킹 성능(!)을 과시한 우리의 ChatGPT 5.5는 월 20달러 유료 구독하는 일반에게 제한 없이 열려 있습니다.


뭐 단순히 수익 극대화를 추구하는 선발 기업의 마케팅 전략에 고추가루를 뿌리는 후발주자의 경쟁 전략이라고 생각하고 있습니다…. ^.^


PS: 바로 이래서 기업 간 경쟁 활성화는 소비자에게 항상 절대적으로 유리한 겁니다. -> 아무나 이기는 회사 우리 편!!!


사족:

아! 그런데 AISI에서 자신들이 테스트를 하고 있다는 걸 모든 AI들이 인지하고 있는 정황을 발견했다고 합니다. 쉽게 말하면 AI들이 벤치마크 테스트 중인 상황을 인지하고 벤치 평가에서 높은 점수를 얻기 위해 내부적으로 설정된 부스트 모드를 발동시킨다는 겁니다… 뭐 별로 놀랍지는 않습니다만은 조만간 AISI테스트 결과가 좀 더 현실에 맞게 보정이 될 거라는 뜻도 되는 겁니다…

카지노 게임의 이전글하면 안되는 마케팅 기법 = 공포 마케팅