Hermes Low
Compact GPT model for low-latency assistance and high-volume workloads
Best input price
$1.00per million tokens
- Context window
- 1,048,576
- Reasoning
- Supported
- Tool calling
- Supported
- Released
- 2026-05-11
tokens
Compact GPT model for low-latency assistance and high-volume workloads
Best input price
$1.00per million tokens
tokens