DeepSeek V4 Pro 0813

5 hours ago 2

OpenRouter에서 단일 공급자가 호스팅하며, 별도 라우팅 결정 없이 모든 요청을 해당 공급자에게 직접 전달함 실제 고객의 가중 평균 가격은 100만 토큰당 입력 $0.03508, 출력 $0.8697이며, 캐싱과 할인에 따라 게시 가격보다 낮아질 수 있음 중앙값 기준 처리량은 59토큰/초, 왕복 지연시간은 1.30초이며 최근 3일간 공급자 평균 가동률은 100%임 GPQA Diamond 88.8%, τ²-Bench Telecom 96.2%, SciCode 50.0%를 기록했지만, 오답 중 환각을 피한 비율인 AA-Omniscience Non-Hallucination Rate는 5.9% 에 그침 OpenAI 호환 API에서 deepseek/deepseek-v4-pro-0813을 지정해 스트리밍·추론·도구 호출을 사용할 수 있으며, 대화를 계속하려면 전체 reasoning_details를 다시 전달해야 함 공급자와 가격 한 공급자가 모델을 호스팅하며 OpenRouter는 모든 요청을 해당 공급자에게 직접 전달함 공급자 성능 표에는 입력 $0.435, 출력 $0.87, 별도 가격 항목 $0.003625와 함께 지연시간 1.30초, 처리량 59tps, 가동률 100.00%가 표시됨 고객의 실제 가중 평균 지불 가격은 다음과 같음 입력: 100만 토큰당 $0.03508 출력: 100만 토큰당 $0.8697 캐싱과 할인에 따라 실제 지불 가격이 공급자의 게시 가격보다 크게 낮아질 수 있음 속도와 가동률 토큰 생성 처리량은 공급자 중 최고 P50 기준 59토큰/초임 전체 왕복 지연시간은 최고 공급자 P50 기준 1.30초임 최초 토큰 시간(TTFT)은 응답 내용이 처음 나타날 때까지 걸리는 시간으로, 낮을수록 좋음 최근 3일간 모든 엔드포인트의 공급자 평균 가동률은 100.00% 임 OpenRouter는 최근 30일간 성공한 요청 비율을 계속 감시함 상위 공급자에서 오류가 발생하면 요청 필터가 허용하는 범위에서 다음으로 정상인 공급자에 재시도할 수 있음 가동률은 Endpoints API로 조회할 수 있으며, 공급자 라우팅 문서에서 부하 분산과 맞춤 설정을 확인할 수 있음 표준 벤치마크 벤치마크 수치는 Artificial Analysis에서 가져왔으며, 비율이 높을수록 좋음 추론 평가 GPQA Diamond — 대학원 수준 과학 추론: 88.8% HLE(Humanity's Last Exam): 37.5% IFBench —...

Read Entire Article