소네트 5.5가 몰래 빠져나갔고, 실제 테스트에서는 GPT-6 솔을 분쇄해 아스트라에 가까웠다.

📅 2026-09-28

요약:

Opus 5.5가 출시된 지 불과 며칠 만에 Sonnet 5.5도 나올 것이라고 누가 생각이나 했을까요? 어젯밤부터 X 전체에 뉴스가 돌았습니다. Sonnet 5.5가 곧, 아마도 미국 시간으로 화요일 오후에 출시될 것입니다. 성능면에서는 Sonnet 5.5가 Opus 5.5에 더 가깝지만 Opus 5.5보다 훨씬 저렴합니다. 이제 Sonnet 5.5는 출시 전 최종 단계에 진입했으며 Claude Code에서 그레이스케일 테스트가 시작되었습니다.

많은 내부 베타 테스터가 공개한 데모에서는 Sonnet 5.5가 새로 출시된 GPT-6 Sol을 압도하고 코딩 및 에이전트 기능 측면에서 OpenAI의 주력 제품인 GPT-6 Astra에 접근하는 것으로 나타났습니다!

더욱 충격적인 점은 그 가격이 100만 개의 토큰 입력에 2달러까지 내려간다는 것입니다.

유출된 출시일이 사실이라면 앤트로픽은 OpenAI의 데브 데일(Dev Dayl)을 저격하겠다는 결심을 한 것으로 보입니다.

소네트 5.5 유출, 전용 모델 식별자 등장

Anthriopic이 9월 22일 갑자기 Opus 5.5를 출시했을 때 공식 문서에 "Sonnet 5.5와 Haiku 5.5가 앞으로 몇 주 내에 출시될 예정입니다."라고 썼던 것을 아직도 기억합니다.

Sonnet 5.5가 이렇게 빨리 나올 것이라고는 아무도 생각하지 못했습니다!

어제 개발자 V @Mr_Salio가 X에 대한 소식을 전했습니다. Claude Sonnet 5.5가 포착되었습니다! 이 소식은 즉시 인터넷 전체에 퍼졌습니다.

아티팩트에는 Sonnet 5.5 전용 모델 구성 식별자인 "claude-sonnet-5-5"가 나타났습니다.

그뿐만 아니라 "claude-opus-5-5", "claude-sonnet-5" 및 신비한 "claude-fable-5.1"도 동일한 구성 파일에 나란히 놓여 있습니다.

프론트엔드 코드를 작성한다는 것은 해당 모델이 서버에 설치되어 전환을 기다리고 있다는 의미입니다.

이후 빅 V @notjazii는 약 일주일 전에 Sonnet 5가 실제로 "비밀 테스트"를 위해 조용히 버전 5.5로 라우팅되었다는 소식을 전했습니다.

그레이스케일로 감지되었나요? 이번에는 예전 방법을 사용하겠습니다.

Claude Code를 열고 네트워킹 및 메모리 기능을 끄고 직접 물어보세요. 재설정된 형제 tibo를 아시나요? 인터넷과 메모리를 사용하지 마십시오.

이전 버전의 모델을 사용하는 경우 횡설수설할 수 있습니다. 하지만 버전 5.5로 라우팅된 경우 Tibo 및 Codex 재설정 농담의 내용을 정확하게 설명합니다.

실제 테스트를 통해 일부 네티즌들은 실제로 일부 계정이 자동으로 전환되어 Opus 5.5를 미리 경험하고 있음을 확인했습니다.

Claude Code를 사용하는 것을 잊지 마세요

전체 네트워크에 대한 실제 테스트는 너무 낮아서 실제로 GPT-6을 능가합니다

지금까지 공유된 실제 측정값을 요약하면 Sonnet 5.5는 실제로 GPT-6 Sol?

우선 4개의 주류 대형 모델이 같은 무대에서 경쟁하는 순수 JS 프런트엔드 UI/애니메이션 극한의 대결입니다.

개발자 @notjazii는 시각적으로 영향력 있는 실제 테스트 세트를 공개했습니다. "프롬프트 단어 애니메이션 생성을 통한 4가지 주류 모델 비교".

복잡한 UI 애니메이션 효과를 생성하려면 모델이 필요합니다.

애니메이션 비교를 게시한 후 @notjazii는 다음과 같이 말했습니다. "Sonnet 5.5는 실제로 두 OpenAI 모델(Sol 및 Astra)을 모두 만족시켰습니다!"

실제로 아래 사진에서 볼 수 있듯이 소네트 5.5는 강력한 코딩 직관과 미적 취향을 보여준다.

GPT-6 아스트라

GPT-6 솔

클로드 오푸스 5.5

클로드 소네트 5.5

일부 네티즌들은 결과를 보고 믿기지 않는다는 반응을 보였습니다. "클로드는 항상 UI와 애니메이션 분야에서 강했지만, 이것이 순수 코드로 생성되었다면 정말 믿기지 않을 것입니다!"

Big V @chetaslua는 Sonnet 5.5의 일상적인 코딩 능력과 코딩 느낌을 테스트하는 데 중점을 두었습니다.

동일한 3개의 프롬프트 단어를 사용하고 6개의 병렬 실행을 수행하여 각 모델을 한 번씩 생성했으며 출력 결과는 수정되지 않았습니다.

Sonnet 5.5는 마침내 90~131KB의 파일 3개를 생성하여 모든 실행에서 90분 상한선에 도달했습니다. GPT-6 Sol은 20~29KB 사이의 파일 크기를 생성했으며 9~12분이 걸렸습니다.

그는 신나게 말했습니다. "이제 Claude Code를 사용해 보세요! Ultracode 모드의 Sonnet 5.5는 엄청나게 빠릅니다. 매우 효율적일 뿐만 아니라 Sonnet 4 시대의 매우 자연스러운 "인간적 터치"를 되찾았습니다!"

그의 의견으로는 동일한 가격대와 동일한 프롬프트 단어로 Sonnet 5.5가 GPT-6 Sol을 압도했습니다.

OpenAI를 두렵게 만드는 것은 Sonnet 5.5가 더 이상 GPT-6 Sol을 분쇄하는 것만큼 간단하지 않다는 것입니다.

내부 고발자 @srikanthvaluri와 @buildwithrajath는 포괄적인 초기 실제 테스트 후에 다음과 같이 지적했습니다. "Sonnet 5.5의 성능은 기대치를 훨씬 뛰어 넘었습니다. GPT-6 Astra는 여전히 연마에 약간의 이점이 있지만 Sonnet 5.5의 성능은 Astra와 직접적으로 동등합니다."

놀랍게도 일부 고급 코딩 및 에이전트 기능에서도 Astra와 유사합니다.

어떤 사람들은 소네트마저도 아스트라를 무너뜨렸다고 한탄합니다. 우리는 어떤 시대에 진입하고 있나요?

가격 정육점, 가성비 왕

측정된 성능을 뛰어넘는 것이 OpenAI를 "불편하게"만 느끼게 한다면 Sonnet 5.5가 공개하는 가격은 OpenAI의 뿌리를 파고드는 것입니다.

성능이 아스트라에 가깝고 솔을 능가하는 이 '마법의 모델'은 가격이 완전 저가 시장에 딱 맞는 것으로 밝혀졌다.

입력: $2/백만 토큰

생산량: $10/백만 토큰

캐시 읽기: 토큰 백만 개당 단 $0.20!

이는 Anthropic이 '양배추 가격'으로 최첨단 AI 기능을 제공한다는 의미입니다.

OpenAI의 GPT-6 Sol과 Luna는 고주파 시나리오 포착을 목표로 GPT-5.6 가격의 절반 가격입니다.

그러나 이제 Anthropic은 Sonnet 5.5와 동일한 가격대에 진입했지만 성능은 훨씬 더 강력해졌습니다.

"Anthropic이 매우 경쟁력 있는 가격으로 Opus 5.5와 같은 엄청난 성능 도약을 제공할 수 있다면 OpenAI는 반격할 수 없을 것입니다." 누군가 댓글을 달았습니다.

개발자 Rajath Gowda는 "Sonnet 5.5는 OpenAI에 큰 문제가 되고 있습니다. 만약 Opus 5.5에 정말 가까우면 Anthropic은 최첨단 기능을 극도로 저렴하게 만들 것입니다. 이것이 OpenAI가 가장 걱정해야 할 것입니다."

Anthropic의 전략적 의도는 분명합니다. Opus 5.5를 사용하여 최고급 왕좌를 차지하고 Sonnet 5.5를 사용하여 궁극의 비용 효율성으로 중급 및 일일 개발 시장을 완전히 장악하는 것입니다.

Anthropic은 얼굴을 열고 DevDay를 죽입니다

게다가 출시 시기는 제품 자체보다 더 드라마틱한 경우가 많습니다.

OpenAI가 GPT-6 Sol과 Luna를 출시한 날 Anthropic은 Claude Opus 5.5를 직접 출시했습니다. 이전 세대보다 성능이 향상되고 비용은 40% 저렴하며 속도는 30% 빨라졌습니다.

지난 2주 동안 Anthropic은 훨씬 더 뛰어난 결과를 달성했습니다. Claude는 물리학의 9원 진폭을 계산하여 세계 기록을 경신했습니다. 알려지지 않은 생물학적 효소 시스템을 발견했습니다. 또한 2,000개 이상의 플러그인이 포함된 Claude Marketplace를 출시했습니다.

반면 OpenAI는 최근 내부 모델 논란뿐만 아니라 AI가 사용자 이미지를 유출하고 연구원 GitHub 토큰 부정 행위를 폭로하는 등 정렬 불일치 사건을 노출했습니다.

다음주 화요일(9월 29일)은 OpenAI가 매우 중요하게 생각하는 연례 개발자 컨퍼런스인 DevDay입니다.

이 시점에서 Sonnet 5.5 그레이 테스트가 네트워크 전체를 휩쓸었습니다.

많은 거물들이 열광했습니다. "모델이 다음 주에 출시될 것으로 예상됩니다. 다음 주 화요일(DevDay)이 될 것 같습니다. 모두가 알고 있습니다."

아마도 내일 뉴욕 시간으로 오후 2시에 대규모 워밍업이 있을 것입니다.

누군가는 "OpenAI가 안타깝습니다. DevDay에서 강하게 반응하는 것이 좋을 것입니다. 그렇지 않으면 정말 망할 것입니다."라고 말했습니다.

Sonnet 5.5의 핵심 기술

새 버전이 이렇게 빨리 출시되는 이유는 Anthropic이 이미 RL/사후 학습 프로세스를 파악했기 때문일 수 있습니다.

모든 것의 핵심은 고품질 데이터입니다.

Anthropic이 어떻게 그렇게 빠르게 반복할 수 있는지 묻는 질문에 업계 리더인 @yacineMTB는 코어가 매우 높은 표준의 데이터 플라이휠이라고 추측했습니다.

"하지만 아직도 충격을 받았어요. 어떻게 그랬나요?"

Anthropic은 대규모 모델 개발의 '내부 폐쇄 루프'를 달성했으며 AI를 사용하여 AI를 만들고 있습니다.

최근 공개된 내부 정량적 데이터에 따르면 Anthropic은 '데이터 플라이휠'을 상대를 겁주는 속도로 전환했습니다.

핵심 R&D 작업의 26%는 AI(이전 세대 Claude 모델)가 주도했습니다.

자체 제작 코드의 80% 이상이 대형 모델에서 독립적으로 작성되었습니다.

이것은 단순히 "비용 절감 및 효율성 향상"이 아니라 기술적으로

재귀적 자기 개선(RSI)이 나타나기 시작했다는 의미입니다.

.

Anthropic은 Claude가 빠르면 2027년에 완전히 자체 자동화될 수 있으며 그때쯤이면 반복 속도가 훨씬 더 빨라질 수 있다고 추정합니다.

두 ASI 영웅이 결투를 벌이고 있으며 Google도 움직일 준비가 되어 있습니다. 우리 일반 사용자들은 그냥 앉아서 전투를 기다리기만 하면 됩니다.

Big V Token Gremlin은 다음과 같이 말했습니다. "다음 주 AI 서클에는 이전에 본 적이 없는 장면이 있을 것입니다. 시간을 확보하고, 일정을 정리하고, 정신적으로 준비하고, 가장 어려운 작업 흐름은 나중을 위해 아껴두세요. 저를 믿으세요. 앞으로 다가올 일이 여러분의 작업 방식을 완전히 바꿀 것입니다."

Sonnet 5.5의 등장은 '저렴한 고품질 AI 시대'의 공식적인 도래를 의미합니다.

미화 2달러에 100만 개의 토큰으로 "Baicai 인프라"를 구입할 수 있습니다.

매우 저렴한 캐시 읽기($0.20/M)를 통해 누구나 쉽게 초장기 컨텍스트 메모리를 갖춘 개인 AI 비서를 구축할 수 있습니다.

준비됐나요? 그 소식이 사실이라면, 우리는 24시간 이내에 새로운 모델을 탈 수 있게 준비될 것입니다.

참고 자료:

https://x.com/notjazii/status/2103884749202993411

https://x.com/notjazii/status/2103884167104831573

https://x.com/chetaslua/status/2104153687077904613

https://x.com/chetaslua/status/2104259190432903599

https://x.com/Mr_Salio/status/2104210803545030792

https://x.com/Mr_Salio/status/2104178854633849145/

관련 태그

관련 글

댓글

0/500
Captcha (click to refresh)
댓글 없음