Skip to content
Free
ModelsHermesclosed weights1 provider

Hermes Low

Compact GPT model for low-latency assistance and high-volume workloads

Best input price

$1.00

per million tokens

Context window
1,048,576

tokens

Reasoning
Supported
Tool calling
Supported
Released
2026-05-11

Inference providers1 hosting Hermes Low

  • NanoGPT

    hermes-low

    1,048,576 context$3.20 out / 1M
    $1.00

    in / 1M