앤트로픽에서 드디어 사고를 쳤네요. 클로드의 신규 모델인 페이블 5와 미토스 5가 정식으로
세상에 나왔습니다. 기존에 소프트웨어 보안 취약점을 찾아내는 능력으로 난리가 났던 모델이
이제 프리뷰를 벗어나 본격적으로 풀린 셈이라 기대가 큽니다.
이번 발표에서 흥미로운 점은 모델을 두 가지 버전으로 나눴다는 거예요. 미토스 5는 회사가
신뢰할 수 있는 기업이나 기관에만 제한적으로 제공하던 모델의 업그레이드 버전입니다. 반면에
페이블 5는 우리 같은 일반 사용자들이 써볼 수 있게 공개된 버전이라고 이해하면 됩니다.
성능 자체는 지금까지 앤트로픽이 일반에 공개했던 그 어떤 모델보다 강력하다고 자신하고
있습니다. 특히 작업이 길어지고 복잡해질수록 기존 모델들과의 격차가 눈에 띄게 벌어지는
수준이라니 정말 궁금해지네요. 복잡한 추론을 시킬 때 체감이 확 올 것 같습니다.
다만 일반 공개용인 페이블 5에는 확실한 안전장치가 걸려 있습니다. 사이버 보안이나
생물학, 화학 분야처럼 위험할 수 있는 질문을 던지면 새로운 안전 분류기가 작동해서 답변을
제한해요. 이럴 때는 페이블 대신 차상위 모델인 오퍼스 4.8이 대신 응답하도록 설계됐다고
합니다.
반대로 이런 제한이 해제된 미토스 5는 그야말로 괴물 같은 성능을 자랑하나 봅니다.
앤트로픽 설명에 따르면 전 세계 어떤 모델보다도 강력한 사이버 보안 역량을 갖췄다고
하니까요. 특정 프로젝트에 참여하는 기업들에게는 엄청난 도구가 될 듯합니다.
실제 수치로 봐도 실력이 대단하다는 게 느껴집니다. 소프트웨어 엔지니어링 능력을 측정하는
SWE-Bench Pro에서 80.3%라는 놀라운 점수를 기록했거든요. 인공지능이 코드를
직접 짜고 시스템을 이해하는 수준이 어디까지 진화할지 참 대단하다는 생각밖에 안 듭니다.
세상에 나왔습니다. 기존에 소프트웨어 보안 취약점을 찾아내는 능력으로 난리가 났던 모델이
이제 프리뷰를 벗어나 본격적으로 풀린 셈이라 기대가 큽니다.
이번 발표에서 흥미로운 점은 모델을 두 가지 버전으로 나눴다는 거예요. 미토스 5는 회사가
신뢰할 수 있는 기업이나 기관에만 제한적으로 제공하던 모델의 업그레이드 버전입니다. 반면에
페이블 5는 우리 같은 일반 사용자들이 써볼 수 있게 공개된 버전이라고 이해하면 됩니다.

성능 자체는 지금까지 앤트로픽이 일반에 공개했던 그 어떤 모델보다 강력하다고 자신하고
있습니다. 특히 작업이 길어지고 복잡해질수록 기존 모델들과의 격차가 눈에 띄게 벌어지는
수준이라니 정말 궁금해지네요. 복잡한 추론을 시킬 때 체감이 확 올 것 같습니다.
다만 일반 공개용인 페이블 5에는 확실한 안전장치가 걸려 있습니다. 사이버 보안이나
생물학, 화학 분야처럼 위험할 수 있는 질문을 던지면 새로운 안전 분류기가 작동해서 답변을
제한해요. 이럴 때는 페이블 대신 차상위 모델인 오퍼스 4.8이 대신 응답하도록 설계됐다고
합니다.
반대로 이런 제한이 해제된 미토스 5는 그야말로 괴물 같은 성능을 자랑하나 봅니다.
앤트로픽 설명에 따르면 전 세계 어떤 모델보다도 강력한 사이버 보안 역량을 갖췄다고
하니까요. 특정 프로젝트에 참여하는 기업들에게는 엄청난 도구가 될 듯합니다.
실제 수치로 봐도 실력이 대단하다는 게 느껴집니다. 소프트웨어 엔지니어링 능력을 측정하는
SWE-Bench Pro에서 80.3%라는 놀라운 점수를 기록했거든요. 인공지능이 코드를
직접 짜고 시스템을 이해하는 수준이 어디까지 진화할지 참 대단하다는 생각밖에 안 듭니다.
