← 블로그 목록
AI 뉴스5분 분량

Mythos 5.1과 Daybreak Red은 결제창이 아니라 심사 뒤에 있다

같은 주에 두 벤더가 같은 구조를 택했다

앤스로픽이 같은 모델을 Fable 5.1과 Mythos 5.1 두 이름으로 나눠 냈다. 차이는 성능이 아니라 심사 통과 여부이고, 오픈AI도 같은 주에 같은 구조를 택했다. 우리 팀에 상위 층이 필요한지, 없이도 되는지를 먼저 확인해야 한다.

모델 도입 검토는 오래 두 축으로 좁혀져 있었다. 성능과 단가. 벤치마크 표를 놓고 몇 점 차이에 얼마를 더 낼지 정하면 회의가 끝났다.

9월 첫 주에 축이 하나 더 붙었다. 신청과 심사다. 성능표에 이름이 올라 있어도 돈을 낸다고 열리지 않는 모델이 생겼고, 그 문턱을 만든 쪽이 한 회사가 아니라 두 회사다.

같은 모델에 이름이 둘 붙었고, 표에는 5.1포인트가 남았다

앤스로픽 9월 1일 발표에서 Fable 5.1과 Mythos 5.1은 같은 모델이라고 명시됐다. 다른 것은 안전장치 수위뿐이다. Fable 5.1은 일반 공급이고, Mythos 5.1은 '신뢰 접근(trusted access)' 프로그램을 통과한 곳에만 열린다. 경로는 둘이다. 방어 보안 업무를 위한 Cyber Verification Program(CVP), 생명과학 R&D를 위한 Life Sciences Verification Program(LSVP). LSVP는 미국 정부와 함께 설계했고, 현재 대상은 미국 조직 일부로 한정된다.

가격은 그대로다. 입력 100만 토큰 10달러, 출력 50달러. 대신 캐시 읽기가 100만 토큰 0.25달러로 75% 내려가면서 일반 작업 약 25%, 에이전트 작업은 최대 약 45%까지 비용이 준다. 여기까지는 Fable 5 때 세운 판정 기준을 그대로 다시 대면 되는 업그레이드 판단이다.

문제는 같은 문서의 벤치마크 표다. Terminal-Bench 4.0에서 Fable 5.1은 55.8%, Mythos 5.1은 60.9%다.

같은 모델이라고 밝힌 두 이름 사이의 5.1포인트는 모델을 더 키워서 얻는 값이 아니다. 심사를 통과해서 얻는 값이다.

오픈AI는 같은 구조를 방어 조직 쪽에서 먼저 열었다

오픈AI가 9월 3일 낸 GPT-6 Astra 안전 개요는 이 모델이 자사 Preparedness Framework의 사이버 'Critical' 기준에 도달한 첫 사례라고 적었다. 그래서 일반 출시가 아니라 신청 기반 프로그램 Daybreak 참여사 대상 제한 프리뷰로 나갔다. Gray Swan IPI Arena의 공격 1,810건 벤치마크에서 방어장치를 켠 체크포인트의 공격 성공률은 8.5%, GPT-5.6 Sol은 27.0%였다.

층 구분은 같은 날 공개된 Daybreak for Frontline Defenders에 그대로 적혀 있다. Daybreak Blue는 메인라인 모델로 일반적인 방어 업무를 덮고, Daybreak Red는 승인된 조직에만 전용 사이버 모델을 준다. 10억 달러 규모 보조 접근을 6개월에 걸쳐 상수도·전력 운영사, 주·지방정부, 지역은행, 비영리, 오픈소스 메인테이너에 우선 배정한다고 더 레지스터 9월 4일 보도가 전했다.

일반 층심사 층
앤스로픽Fable 5.1 (일반 공급)Mythos 5.1 (CVP·LSVP 통과 조직)
오픈AIDaybreak Blue (메인라인 모델)Daybreak Red·GPT-6 Astra (승인 조직)

조달 문서에 열이 하나 늘었다

"어떤 모델을 쓸 것인가" 옆에 "우리는 어느 층인가"가 붙는다. 국내 조직 대부분은 지금 두 심사 층 어디에도 들어가지 않는다. CVP·LSVP는 미국 조직 한정이고, Daybreak 보조 배정도 미국에서 시작한다. 그러니 실무 결론은 신청서를 쓰는 일이 아니라, 상위 층이 필요한 업무가 우리에게 실제로 있는지부터 재는 일이다.

가져갈 것

  • 지난 30일 로그에서 Fable 5.1(또는 현재 모델)이 안전장치로 거절한 요청을 세어봤나?
  • 그 거절이 실제 방어 보안·생명과학 업무인가, 프롬프트를 고쳐 풀리는 형태인가?
  • Mythos 5.1의 CVP·LSVP는 현재 미국 조직 한정이다. 우리 법인이 대상에 들어가나?
  • 캐시 읽기 0.25달러/100만 토큰 인하가 우리 청구서에 반영되나(프롬프트 캐시를 실제로 쓰고 있나)?
  • Terminal-Bench 4.0의 55.8% 대 60.9% 격차가 우리 과제에서 재현되나, 아니면 무관한가?
  • 상위 층 접근이 끝내 안 열릴 때 그 업무를 사람이 맡는 경로가 문서에 있나?

안 되는 경우

  • 방어 보안·생명과학 업무가 없는 조직에는 이 구분이 실익이 없다. Fable 5.1 일반 공급으로 끝난다.
  • 소스는 Fable 5.1과 Mythos 5.1의 Terminal-Bench 4.0 격차가 어느 과제군에서 생겼는지 분해하지 않았다. 안전장치 거절 때문인지 다른 요인인지 문서만으로는 확인할 수 없다.
  • 오픈AI는 GPT-6 Astra의 일반 공급 시점을 밝히지 않았다. 9월 3일 시점은 Daybreak 참여사 대상 제한 프리뷰다.
  • CVP·LSVP의 미국 외 확대는 "미국 정부와 조율 중"이라고만 적혀 있고 기한이 없다.

이번 주에 바꿀 것은 모델 비교표에 열을 하나 더 긋는 일이다. 성능과 단가 옆에 "이 모델은 돈으로 열리나, 심사로 열리나"를 적고, 심사로 열리는 칸에 걸린 업무가 있으면 그 업무의 대체 경로를 같은 줄에 적는다. 모델 이름을 고르는 회의와 접근 자격을 확인하는 회의를 따로 잡을 필요는 없다. 사업영역 →

출처

AI뉴스모델 접근 권한AI 조달

Contact

이런 교육이 필요하다면

AI·데이터 교육 도입을 검토 중이라면 카카오 오픈채팅으로 편하게 문의하세요.

Newsletter

조녁컴퍼니 뉴스레터

AI 전환과 교육 현장의 기록을 메일로 받아보세요.