Together AI

Together AI

InferenceFREE TIER

Open-source model inference — Llama, Mixtral, FLUX

Operational

All systems responding normally

Last checked 30/07/2026, 6:22:34 am

671ms response

Uptime History100.00% uptime
2026-07-25Today

Uptime

100.00%

Avg Latency

898ms

P95 Latency

1145ms

Fastest

508ms

Checks

150

Response Time

Last 60 checks
508ms min898ms avg1410ms max

💰 Pricing

llama-3.3-70b-turbo
Input: $0.88/1MOutput: $0.88/1M

Free $1 credit on signup

⚡ Rate Limits

standard
RPM: 60

Limits vary by model and account tier.

🤖 Models (1)

ModelTaskContextVisionToolsJSON
Llama 3.3 70B Turbo

Open-source model inference. Fast and reliable.

llm128k

Recent Checks

Showing last 15
Operational
671ms30 July, 06:22 am
Operational
682ms30 July, 05:50 am
Operational
945ms30 July, 05:16 am
Operational
1172ms30 July, 04:40 am
Operational
620ms30 July, 04:14 am
Operational
1058ms30 July, 03:48 am
Operational
1046ms30 July, 03:16 am
Operational
1019ms30 July, 02:41 am
Operational
670ms30 July, 02:09 am
Operational
1198ms30 July, 01:32 am
Operational
987ms30 July, 12:47 am
Operational
980ms29 July, 11:53 pm
Operational
920ms29 July, 11:08 pm
Operational
1172ms29 July, 10:23 pm
Operational
760ms29 July, 09:36 pm