Skip to content
Sovyron

NEAR AI Cloud

32 modelsProvider docs

As of Oct 4, 2026, NEAR AI Cloud lists 32 supported models in the Sovyron catalog, including Gemini 3.5 Flash, Gemini 3.1 Flash Lite, GPT-5.5, Qwen 3.6 35B A3B FP8 and Claude Opus 4.7 — gemini-flash, gemini-flash-lite, gpt, qwen, claude-opus and glm families. Its metered rates span $0.01–$11.25 per 1M tokens on a 3:1 input:output blend, and every price in the table is NEAR AI Cloud's own, normalized to USD — open a model to compare it with the cheapest offer across all providers.

Supported models and pricing

32 of 32 models
NEAR AI Cloud model prices in USD per 1M tokens, updated Oct 4, 2026
Model1M input1M output1M cache readContextReleased
Gemini 3.5 Flash$1.5$9$0.151.0MMay 19, 2026
Gemini 3.1 Flash Lite$0.25$1.5$0.0251.0MMay 7, 2026
GPT-5.5$5$30$0.51.1MApr 23, 2026
Qwen 3.6 35B A3B FP8$0.17$1.1$0.056262kApr 17, 2026
Claude Opus 4.7$5$25$0.51.0MApr 16, 2026
GLM-5.1 FP8$1.4$4.4—203kMar 27, 2026
GPT-5.4 mini$0.75$4.5$0.075400kMar 17, 2026
GPT-5.4 nano$0.2$1.25$0.02400kMar 17, 2026
GPT-5.4$2.5$15$0.251.1MMar 5, 2026
Claude Sonnet 4.6$3$15$0.31.0MFeb 17, 2026
Claude Opus 4.6$5$25$0.5200kFeb 5, 2026
FLUX.2 Klein 4B$1$1—128kJan 14, 2026
GPT-5.2$1.75$14$0.175400kDec 11, 2025
GPT-5.1$1.25$10$0.125400kNov 13, 2025
Claude Haiku 4.5$1$5$0.1200kOct 15, 2025
Claude Sonnet 4.5$3$15$0.3200kSep 29, 2025
Qwen3 VL 30B A3B Instruct$0.15$0.55—16kSep 23, 2025
GPT-5$1.25$10$0.125400kAug 7, 2025
GPT-5 Mini$0.25$2$0.025400kAug 7, 2025
GPT-5 Nano$0.05$0.4$0.005400kAug 7, 2025
Gemini 2.5 Flash$0.3$2.5$0.031.0MJun 17, 2025
Gemini 2.5 Flash-Lite$0.1$0.4$0.011.0MJun 17, 2025
Gemini 2.5 Pro$1.25$10$0.1251.0MJun 17, 2025
Qwen3 Embedding 0.6B$0.01$0.01—33kJun 3, 2025
Qwen3 Reranker 0.6B$0.01$0.01—41kJun 3, 2025
o3$2$8$0.5200kApr 16, 2025
o4-mini$1.1$4.4$0.275200kApr 16, 2025
GPT-4.1$2$8$0.51.0MApr 14, 2025
GPT-4.1 mini$0.4$1.6$0.11.0MApr 14, 2025
GPT-4.1 nano$0.1$0.4$0.0251.0MApr 14, 2025
o3-mini$1.1$4.4$0.55200kDec 20, 2024
Whisper Large v3$0.01$0.01—448Nov 6, 2023