블로그로 돌아가기

GPT-6 Sol·Luna와 Claude Opus 5.5, 업무에서는 무엇을 비교해야 할까?

OpenAI, Claude and MuseWork marks in three equally sized square tiles for a model comparison article.

경쟁사 분석 문서를 저렴하게 만들었더라도 숫자의 출처를 다시 찾느라 한 시간을 썼다면 실제 비용은 달라집니다. 9월 22일 나온 세 모델을 볼 때도 토큰 가격표보다 팀이 받아들일 만한 결과물 한 건에 드는 비용이 중요합니다.

같은 날 발표된 세 모델

OpenAI는 복잡한 코딩과 여러 단계의 작업을 겨냥한 GPT-6 Sol, 명확한 목표의 대량 작업에 적합한 Luna를 발표했습니다. OpenAI는 API 가격이 GPT-5.6의 프로모션 가격보다 50% 낮다고 설명합니다. 확인 당시 입력·출력 100만 토큰당 Sol은 각각 2·10달러, Luna는 0.10·0.50달러입니다. 같은 날 Anthropic이 공개한 Claude Opus 5.5는 4·20달러로 Opus 5 정가보다 20% 낮고, 캐시 읽기는 0.20달러입니다. Anthropic의 ‘일반적인 작업에서 약 40% 저렴’하다는 수치는 자체 추정치이지, 표시된 가격에서 다시 40%를 할인한다는 뜻이 아닙니다.

같은 양의 토큰이라도 완성 비용은 다르다

입력 10만 토큰과 출력 1만 토큰을 쓰는 가상의 업무를 생각해 봅시다. 캐시와 도구 사용을 제외하면 9월 24일 확인한 표준 API 요금으로 모델 호출 비용은 Sol 약 0.30달러, Luna 약 0.015달러, Opus 5.5 약 0.60달러입니다. 가정한 사용량의 계산 예시이지 실측 성능이나 동일한 품질을 전제로 한 비교가 아닙니다. 저렴한 모델에서 재시도가 늘거나 다른 모델이 검토 시간을 줄이면 결과는 달라집니다.

OpenAI 문서에 따르면 Sol과 Luna는 입력이 27만 2,000토큰을 넘으면 초과분만이 아니라 요청 전체에 더 높은 요금이 적용됩니다. 빠른 처리 및 일부 지역 처리에도 별도 요금이 있습니다. Opus 5.5의 캐시 읽기 비용은 낮아졌지만, 같은 배경 자료를 반복 사용하는 업무인지에 따라 효과가 다릅니다. 최대 입력 길이와 기본 단가만 보고 예산을 정하지 마세요.

평가 점수는 팀의 합격 기준이 아니다

Artificial Analysis는 최대 추론 설정에서 Opus 5.5의 Intelligence Index를 58로 측정해 당시 최고 점수라고 밝혔습니다. 독립적인 참고 자료지만 자사 고객 보고서까지 가장 잘 작성한다는 보장은 아닙니다. 서로 다른 추론 설정이나 도구로 측정한 점수를 같은 실험처럼 나란히 놓을 수도 없습니다. 긴 자료를 입력할 수 있다는 점과 그 안의 모든 수치를 정확히 인용한다는 점도 다릅니다.

예를 들어 제품 웹페이지 세 개, PDF 두 개, 가격표로 경영진용 한 장짜리 업데이트를 만든다고 해봅시다. 문장이 좋아도 새 가격 조건을 놓치면 제출할 수 없습니다. 개인정보를 제거한 실제 업무 3~5건을 골라 같은 자료와 출력 형식을 주고, 수치 정확도·출처·필수 항목·편집 가능성을 확인해 보세요. 재시도, 수정, 사람의 검토 시간까지 기록해야 승인된 결과물 한 건당 비용이 보입니다.

세 가지 업무를 따로 비교하기

여러 자료를 종합한 주간 보고서는 서로 다른 수치와 출처를 얼마나 잘 정리하는지, 대량 필드 추출은 항목별 오류와 재시도 횟수를 봅니다. 발표 자료의 개요라면 제안이 데이터에 근거하고 담당자가 바로 수정할 수 있는지 확인합니다. 입력 자료, 합격 기준, 첫 시도 통과율, 검토 시간과 비용을 한 표로 정리하면 기본 모델과 예외적인 업무에 쓸 모델을 나눠 결정하기 쉬워집니다.

작은 시범 운영으로 결론 내리기

예외가 많은 작업에는 강한 모델을, 규칙적인 추출에는 비용 효율적인 모델을 쓰는 결론도 가능합니다. 평균 점수 하나보다 합격률, 잘못된 인용 사례, 수정 시간과 추가 확인이 필요한 조건을 함께 적는 편이 의사결정에 도움이 됩니다.

공식 발표와 사용 승인을 받은 익명 업무 자료, 팀의 검수 기준을 MuseWork에 제공하면 근거를 정리하고 시험 계획 및 검토 가능한 선정 보고서를 만들 수 있습니다. “이 자료와 익명 업무 사례 세 건으로 출처 정확도, 수정 시간, 합격 결과물의 총비용을 비교할 시험 계획을 작성해 줘”라고 시작할 수 있습니다.

API 단가만 보면 될까요? 캐시, 도구 호출, 재시도와 사람의 검토 비용도 포함해야 합니다. MuseWork에서 세 모델을 모두 제공한다는 뜻인가요? 이 글은 그런 제공을 주장하지 않습니다.

소식에서 실제 업무로 이어가기

직접 준비한 문서와 출처를 MuseWork에 제공해 팀이 확인할 수 있는 보고서로 정리하세요. 리서치 작업 시작하기 또는 Deep Research 살펴보기.

밖에서도 작업을 이어 확인할 수 있습니다. MuseWork iPhone·Android 버전 받기. PC 파일을 활용하려면 허용한 범위에서 작업하는 데스크톱 버전 다운로드.

출처

MuseWork 데스크톱 다운로드

권한을 허용하면 MuseWork Desktop이 브라우저와 로컬 파일 전반에서 작업하여 업무를 완료할 수 있습니다.

MuseWork 데스크톱 작업 공간 미리보기