Every model here trains on your agent's own data, benchmarks against your production model, and serves through one OpenAI-compatible API. The weights are yours.
4B params · 128K context
4B params · 256K context
3B params · 128K context
2B params · 256K context
1.8B params · 128K context
1.7B params · 128K context
1.2B params · 32K context
1B params · 128K context
0.8B params · 256K context
0.6B params · 128K context
0.5B params · 32K context
350M params · 32K context
230M params · 32K context
9B params · 256K context
8B params · 128K context
E4B (~8B) params · 128K context
7B params · 128K context
E2B (~5.1B) params · 128K context
30B MoE (3B active) params · 256K context
27B params · 256K context
20B MoE params · 128K context
14B params · 128K context
12B params · 256K context
72B params · 128K context
70B params · 128K context
35B MoE (3B active) params · 256K context
32B params · 128K context
31B params · 256K context
30B-A3B params · 256K context
30B params · 128K context
26B (4B active) params · 256K context