본문 바로가기
DDUDI AI LAB

AI 도구, 선택부터 활용까지.

새로운 기능의 변화부터 요금 비교, 이미지·영상 제작과 업무 자동화까지.
공식 자료를 확인하고, 필요한 선택 기준을 정리합니다.

AI 비교·요금제

Claude Sonnet 5.5로 충분할까? Opus 5.5를 선택해야 하는 작업

by Sin_ 2026. 10. 6.
728x90

Claude로 문서나 코드를 만들면서 Sonnet과 Opus 중 무엇을 골라야 할지 고민하는 분을 위한 글입니다. 요구사항과 합격 기준이 분명한 작업은 Sonnet 5.5부터 비교해볼 만합니다. 여러 조건을 오래 판단해야 하는 작업은 Opus 5.5도 함께 검토하세요. 토큰 단가가 낮다고 재작업까지 포함한 비용이 항상 낮아지는 것은 아닙니다.

새 모델보다 먼저, 맡길 일이 얼마나 분명한지 봅니다

Anthropic은 9월 28일 Sonnet 5.5를 발표하며, 범위가 정해진 일상 업무와 버그 수정에 강점을 둔다고 설명했습니다. 반면 복잡하고 열린 문제에서 판단을 지속하는 작업은 Opus 5.5가 더 강하다고 밝혔습니다. 공식 발표

예를 들어 “날짜 입력이 비어 있으면 저장하지 않도록 고쳐줘”는 수정 위치와 확인 방법을 적기 쉽습니다. “이 서비스를 앞으로 어떻게 설계할까?”는 비용, 기존 구조, 운영 조건을 함께 판단해야 합니다. 같은 코딩이어도 두 요청이 요구하는 일이 다릅니다.

정해진 수정을 구현하는 일과 여러 조건을 판단하는 일은 다릅니다.

내가 맡길 일 시작할 방법
검사 기준이 있는 작은 수정 Sonnet 결과를 테스트로 확인
보고서 문장·표 다듬기 Sonnet에 원문과 수정 범위 제공
여러 파일·조건을 엮는 설계 Opus와 비교하고 판단 근거 검토
결과가 자꾸 되돌아오는 작업 모델 변경 전 요구사항·자료부터 보완

API 단가와 구독 사용량은 따로 봐야 합니다

공식 모델 표의 표준 API 단가는 아래와 같습니다. 입력은 모델에 보내는 내용, 출력은 모델이 생성하는 내용입니다. 단위는 각각 100만 토큰이며 Claude 구독료나 구독 사용량을 뜻하지 않습니다. 공식 모델·가격 비교

100만 토큰당 Sonnet 5.5 Opus 5.5
입력 $2 $4
출력 $10 $20

설명용으로 입력 1만·출력 2천 토큰만 계산하면 Sonnet은 $0.04, Opus는 $0.08입니다. 같은 토큰 수에 표준 단가를 적용한 산술 예제이며 실제 실행 결과는 아닙니다. 캐시·Batch·외부 도구 등의 조건은 제외했습니다. 한 번에 끝나는지, 수정 요청이 얼마나 붙는지에 따라 작업 총액은 달라집니다.

effort는 모델이 문제를 풀 때 투입하는 사고 수준입니다. 높은 설정을 늘 켜두기보다, 현재 결과가 어느 기준을 못 맞추는지 확인한 뒤 조정하는 편이 낫습니다. 앱과 API의 기본 설정이 같다고 가정하지 말고 사용하는 화면의 설정을 확인하세요.

후기는 갈립니다. 그래서 작업 조건을 같이 읽었습니다

9월 29일 Reddit의 한 사용자는 코드 리뷰·Git 작업·문서 작성용 세 가지 Skill을 주고 각 모델을 세 번씩 실행했습니다. Skill을 적용한 결과에서 두 모델을 구분하기 어렵다고 평가했습니다. 다만 답을 다른 모델이 채점한 개인 실험이어서, 업무 전체의 품질 순위로 확대할 수는 없습니다. 실험 조건과 결과 원문

같은 날 다른 사용자는 자신의 프로젝트에서 Sonnet이 반복 수정을 요구해 Opus로 돌아갔다고 썼습니다. 이 역시 통제된 비교가 아니며, 게시물에 인용된 타인의 토큰 증가 수치는 독립적으로 확인하지 않아 가져오지 않았습니다. 상반된 경험 원문

두 사례에서 읽을 수 있는 것은 “누가 승리했다”보다 명세, 평가 방법, 재작업 횟수가 비용 판단을 바꾼다는 점입니다. 우리 블로그에서는 모델 이름보다 결과를 통과시킬 기준을 먼저 적는 쪽을 권합니다.

내 작업 세 개로 고르는 간단한 비교 방법

  1. 반복하는 작업 세 개를 고릅니다. 짧은 문서 수정, 작은 버그 수정, 복잡한 검토처럼 성격이 다른 작업이면 좋습니다. 회사 자료 대신 공개·가상 자료부터 사용하세요.
  2. 같은 자료와 요청을 줍니다. 합격 기준, 변경하면 안 되는 부분, 필요한 출력 길이를 먼저 적고 모델·effort 설정을 기록합니다.
  3. 첫 답보다 끝난 결과를 봅니다. 테스트 통과 여부, 누락, 추가 수정 횟수, 소요 시간, 확인 가능한 비용을 남기세요.
  4. 부족한 이유를 나눕니다. 자료 부족이면 입력을 보완하고, 판단이 부족하면 Opus와 비교합니다. 단순 업무는 기존 도구나 스크립트로 처리해도 됩니다.

Sonnet으로 구현하고 Opus로 어려운 설계를 검토하는 조합도 선택지입니다. 다만 모든 결과를 다시 다른 모델에 보내면 비용과 시간이 늘어납니다. 검토할 위험이 큰 부분부터 좁혀 적용하세요.

확인한 자료

Anthropic: Sonnet 5.5 발표

Anthropic: 현재 모델과 표준 API 단가

Reddit: 동일 Skill·세 번 실행한 사용자 비교

Reddit: 재작업 때문에 Opus로 돌아간 사용자 경험

확인 기준: 2026년 10월 5일 KST. 기능과 요금제는 공식 안내를 기준으로 정리했습니다. 실제 제공 상태는 사용하는 계정에서 확인하세요.

728x90