VECTOR WIREAI INTELLIGENCE
NVDA$1,847+3.2%MSFT$512+1.1%GOOGL$199-0.4%META$728+2.7%AMD$184-1.2%TSM$212+0.6%PLTR$98+4.1%AI IDX4,821+1.9%
PKT
SEEDRefresh Models Deals Regulatory Sources

MCP Atlas

51 models tracked

MCP Atlas (agentic MCP tool-use benchmark) — Broad bucket (32 models). Not merged w/ MCPAtlas Public: non-overlap range (8.6-83.6 vs 66.6-73.8).

#ModelVendorBest scoreRunsLast seen
1Muse Spark 1.1Meta88.132026-08-24
2Opus 5Anthropic85.822026-08-24
3Claude Fable 5Anthropic84.732026-08-24
4Kimi K3Moonshot84.232026-08-24
5GPT-5.6 SolOpenAI83.632026-08-24
6Gemini 3.5 FlashGoogle83.652026-08-24
7Claude Opus 4.8Anthropic83.682026-08-24
8GPT-5.5OpenAI82.872026-08-24
9GLM-5.2 Full Open SourceZ.ai82.662026-08-23
10Muse SparkMeta82.212026-08-24
11Inkling-SmallThinking Machines79.622026-08-24
12Claude Opus 4.7Anthropic79.172026-08-24
13Hy3-previewTencent79.112026-08-23
14Gemini 3.1 ProGoogle78.2132026-08-24
15glm-5p2Z.ai77.812026-08-24
16Claude Opus 4.6Anthropic76.882026-08-24
17Qwen3.7 MaxAlibaba76.432026-08-23
18Kimi K2.7 CodeMoonshot7622026-08-23
19InklingThinking Machines7632026-08-24
20GLM-5.1Z.ai75.662026-08-24
21muse-glimmer-30bMeta75.512026-08-23
22MiniMax M3MiniMax74.232026-08-23
23DeepSeek-V4-ProDeepSeek74.252026-08-23
24Qwen3.6 PlusAlibaba74.132026-08-23
25Qwen3.7 Plus PreviewAlibaba73.212026-08-23
26GPT-5.4OpenAI70.662026-08-24
27Gemini 3 ProGoogle70.332026-08-24
28Claude Opus 4.5Anthropic69.842026-08-24
29Claude Sonnet 4.6Anthropic69.542026-08-24
30GLM-5Z.ai69.242026-08-23
31DeepSeek-V4-FlashDeepSeek6912026-07-04
32Qwen3.5 27BAlibaba68.412026-06-06
33Kimi K2.6Moonshot68.112026-07-16
34GPT-5.2OpenAI6842026-08-24
35Kimi K2.5Moonshot6442026-07-16
36Qwen3.6 35B A3BAlibaba62.822026-08-23
37Qwen3.5 35B A3BAlibaba62.412026-06-06
38DeepSeek-V3.2DeepSeek62.232026-05-18
39Gemini 3 Flash PreviewGoogle6232026-08-24
40Claude Sonnet 4.5Anthropic59.522026-08-24
41GLM-4.7Z.ai58.122026-08-24
42GPT-5.4 miniOpenAI57.722026-08-24
43Gemma 4 31BGoogle57.212026-06-06
44Gemini 3.1 Flash Lite PreviewGoogle57.112026-08-24
45GPT-5.4 nanoOpenAI56.112026-08-23
46GPT-5.1OpenAI50.112026-08-24
47Gemma 4 26B A4BGoogle5012026-06-06
48MiniMax M2.7MiniMax48.822026-05-18
49o3-proOpenAI44.512026-08-24
50Claude Opus 4.1Anthropic40.912026-07-29
51Claude Haiku 4.5Anthropic40.212026-08-24

Best tracked score per model (default configuration; source-attributed and verification-tiered). Open a model for its full benchmark surface, provenance and pricing.