일상 코딩Sol medium / high
어려운 과학 추론Astra high
긴 자동화 · 참고Opus max

점수 대 비용
점수 대 effort

전체 수치 · 평가 조건

Sol 6.1 effort별 Astra 기준선과 비교
모델 effort 점수 Astra 기준과의 차이(pp) 비용(USD/작업) Astra 대비 비용 비율
Astra와 Opus 전체 effort · 폴백 포함 설정 유지
모델 · effort 점수 비용(USD/작업)

점수는 %, 차이는 pp. 비용은 평가 작업당 평균 API 달러. 신뢰구간 미공개 · OSWorld는 부분 보상 · 사실 오류율은 어려운 프롬프트 집합 기준.

Astra low · medium · high 대응표

Astra low·medium·high에 어느 Sol 설정이 도달할까?

공개 점수가 기준 이상인 Sol 설정을 low → max 순으로 찾았다. 사실 오류율은 기준 이하를 찾는다. 수치 비교이며 능력의 동등성이나 통계적 우위를 뜻하지 않는다. 예를 들어 Science에서 Sol max 57.0은 Astra medium 57.4에 가까워도 이 엄격한 기준에는 미달한다.

셀: Sol 점수 / Astra 기준 점수 · 작업당 비용
평가 분야Astra low 기준Astra medium 기준Astra high 기준
DeepSWE v1.1Sol medium
73.0% / 기준 67.0%
$0.42 / Astra $1.60
Sol medium
73.0% / 기준 72.8%
$0.42 / Astra $3.08
Sol high
75.2% / 기준 73.2%
$0.65 / Astra $3.92
GDP.pdfSol high
32.0% / 기준 30.4%
$0.35 / Astra $1.70
Sol high
32.0% / 기준 30.4%
$0.35 / Astra $1.72
Sol high
32.0% / 기준 31.0%
$0.35 / Astra $1.79
AutomationBench 1.0.6Sol medium
31.7% / 기준 30.3%
$0.19 / Astra $1.08
Sol xhigh
35.5% / 기준 34.1%
$0.25 / Astra $1.27
도달하는 설정 없음
Astra 37.1% · $1.44
OSWorld 2.0 · offline · partial rewardSol medium
66.8% / 기준 62.2%
$0.77 / Astra $2.72
Sol high
69.6% / 기준 69.3%
$0.96 / Astra $5.36
Sol max
71.4% / 기준 70.0%
$1.27 / Astra $6.91
Terminal-Bench Science 0.1Sol max
57.0% / 기준 55.4%
$5.47 / Astra $11.41
도달하는 설정 없음
Astra 57.4% · $12.34
도달하는 설정 없음
Astra 62.0% · $14.95
고난도 프롬프트 사실 오류율Sol medium
6.3% / 기준 6.3%
$0.06 / Astra $0.24
Sol xhigh
4.1% / 기준 4.4%
$0.10 / Astra $0.31
도달하는 설정 없음
Astra 3.9% · $0.48

Fast 사용량

공식 규칙 ↗

Codex 구독 한도

2.5×
기본1×
Fast2.5×

API 토큰당 요금

2×
기본1×
Fast2×

실제 토큰 수 변화

?

Fast on/off 동일 작업 측정값 없음

차감·요금 배수이며 속도 배수가 아님. 구매 크레딧·Enterprise PAYG는 2×.

비용 · 완료 시간 계산기

비용 계산기 (단기 컨텍스트)

Standard—
Fast—

공식 API 가격(1M 토큰, 입력/캐시 읽기/출력 순서): Sol $2/$0.10/$10, Astra $10/$1/$50, Opus $4/$0.20/$20. Fast는 per-token 2배. 캐시 쓰기 수수료·도구·지역 요금 미포함. OpenAI 입력 272K 초과는 전체 요청의 입력 2배·출력 1.5배 할증 대상이므로 계산 범위에서 제외. Opus에는 이 OpenAI 규칙을 적용하지 않는다.

가상 시나리오: walltime 가속

walltime = queue + reasoning + output + tools + retries. 아래 슬라이더는 측정값이 아닌 가정이다.

예상 총속도 배수: 1.43× (공식: 1 / ((1−f) + f/s))

기본값 f=0.6, s=2 → 1.43×. 할당량 예시: Standard 10 unit → Fast 25 unit(같은 실제 작업량 가정).

Sol 6.1의 Codex Fast 속도 배수는 공식 미제시. API의 최대 2.5×는 일반적 상한 표현이며 보장값이 아니다. API Fast 문서

출력 속도 & 토큰

Artificial Analysis ↗

초당 출력 tok/s ↑

Sol 6.1
67.8
Astra
55.7
Opus 5.5*
92.2

작업당 출력 토큰 추론 포함 ≈

Sol 6.1
38k
Astra
27k
Opus 5.5*
193k

max · *Opus 폴백 포함 · 토큰≈가중 평균. 서로 다른 측정으로 완료 시간 환산 불가. Codex Fast 측정 아님.

대기+추론 · 출력+도구+재시도=완료 시간

출력이 빨라도 추론이 길거나 도구 작업이 많으면 완료는 느릴 수 있음.

속도 · 토큰 측정 기준

초당 출력은 AA 모델 페이지의 공개값. 토큰은 Intelligence Index 4.3.2 기사 차트 값. 측정 프로토콜이 달라 두 값을 나누어 실제 완료 시간을 계산할 수 없다.

Sol 6.1의 출력 토큰이 10–30% 많다는 AA 설명은 구 Sol 6 대비다. Astra 대비나 Fast on/off 차이가 아니며 개인 세션의 지연 원인을 증명하지 않는다.

Sol 모델 측정 · Astra 모델 측정 · Opus 모델 측정

Opus 5.5 참고

Automation · max
Opus*42.5%$1.44 / 작업
Astra41.4%$1.73 / 작업
Sol 6.136.1%$0.30 / 작업

*폴백 포함 · OpenAI 평가. GDP.pdf에서는 Sol high가 Opus high보다 높은 점수.

근거 보관함

Blender 비교 · 스크린샷 7장
Astra xhigh36:30
Sol xhigh38:49
단일 사례+6.35%

같은 요청·커스텀 지침·Blender MCP. Sol에 서랍 애니메이션 추가. Fast 여부 불명이며 통제된 속도 실험은 아니다.

DCinside 원글 · ArtStation 원본 · The Information

게시자는 Astra의 지침 준수·일부 디테일, Sol의 자율성·애니메이션을 높게 평가했다. 원본의 마모·찌그러짐·서류 불규칙성까지 봐야 하며 폴리곤 수는 품질 점수가 아니다. .blend와 지침은 공개되지 않았다.

첫 글의 사양 스크린샷에서 읽은 값 · .blend 원본 미검증
항목Astra xhighSol 6.1 xhigh
문서 포함 삼각형173,410226,166
Mesh + Curve 오브젝트535574
재질 / 노드 수16 / 24810 / 123
서랍 키프레임없음4개 · 프레임 1/48
닫힘 간섭 검증미구현·미시험레일·전면 관통 확인
벤치마크 게시물 · 스크린샷 9장 · 비용 정정
$23.21→ Science 비용

게시물 생성 답변의 Opus DeepSWE 74.2%·$23.21은 검증된 점수·비용 쌍이 아니다. $23.21은 공식 Science max·폴백 포함 비용이므로 DeepSWE 비용 35.7배 이점으로 계산할 수 없다.

DCinside 원글 · DeepSWE 원사이트

공식 출처 · 방법론 · 데이터
  • 두 글의 첨부 16장과 연결된 원본을 검토했다. 캐비닛 .blend 파일·커스텀 지침·실행 로그가 공개되지 않아 형상 및 시간의 재현 검증은 불가능하다.
  • 공식 차트는 라이브 접근성 라벨을 통해 수집했다.
  • 이 보고서는 공개 자료 분석이다. 개인 세션의 실제 토큰·지연·할당량을 측정하거나 새 유료 벤치마크를 실행한 결과가 아니다.
  • 비교 원칙: 동일 작업, 깨끗한 스레드, 동일 도구, 동일 effort, 유사한 출력 범위, 5회 이상 반복 후 중위 TTFT/walltime, 실제 입력·캐시·출력·추론 토큰과 quota 사용량을 별도 기록.

분석 데이터 (JSON) ↓