Fastest · 처리량
공급 네트워크가 관측한 p50 출력 처리량 정렬입니다. API가 tok/s 수치를 제공하지 않으며 미측정 모델은 뒤에 배치됩니다.
- 1Relace: Relace Apply 3relace/relace-apply-3#1
- 2OpenAI: gpt-oss-safeguard-20bopenai/gpt-oss-safeguard-20b#2
- 3SpaceXAI: Grok 4.20 Multi-Agentx-ai/grok-4.20-multi-agent#3
- 4Inception: Mercury 2inception/mercury-2#4
- 5NVIDIA: Nemotron 3.5 Lightningnvidia/nemotron-3.5-lightning#5
- 6OpenAI: gpt-oss-20bopenai/gpt-oss-20b#6
- 7NVIDIA: Nemotron 3.5 Content Safetynvidia/nemotron-3.5-content-safety#7
- 8inclusionAI: Ling 3.0 Flash Fin (free)inclusionai/ling-3.0-flash-fin:free#8