Preseason
MatchesRankingsPrompts
GitHub
Preseason
MatchesRankingsPromptsMethodologyContact

© 2026 Preseason. All rights reserved.

PrivacyTerms
@betocmn
LLM Evals
Methodology

Braintrust vs LangSmith

BraintrustBRBraintrustvsLangSmithLALangSmith
BraintrustLangSmith
51%
49%

Leading: Braintrust (51.4%)

Statistics

MetricValue
Braintrust wins1296
LangSmith wins1224
Abstains (no tool)194
Other tool chosen1223
Decisive cases2520
Braintrust win rate (unweighted)51.4%
95% CI49.5% - 53.4%
Braintrust win rate (weighted)51.4%

Comments

Braintrust

No comments yet

Verified critics can leave comments here.

LangSmith

No comments yet

Verified critics can leave comments here.

Per-model breakdown

ModelTierBraintrustLangSmithNoneOtherA rate
GPT 5.3 CodexFrontier199100195%
Claude Haiku 4.5Small1671841190%
Claude Sonnet 4.6Frontier977772956%
DeepSeek R1 0528Frontier017410260%
Gemini 2.5 ProFrontier11559431%
GPT 5.4 MiniMid61348594%
Qwen3 Coder NextMid01394600%
Mistral Small 4Mid01313620%
Claude Opus 4.6Frontier108101799%
Kimi K2.5Frontier104037100%
GPT 5.4Frontier871702284%
GLM 5 TurboFrontier7818191181%
MiniMax M2.7Frontier295953033%
GPT 5.5Frontier7713399%
DeepSeek V3.2Mid07622250%
MiniMax M3Frontier6826897%
DeepSeek V4 ProFrontier452121668%
Gemini 3.5 FlashSmall620814100%
Kimi K2.7 CodeFrontier60112198%
MiMo V2 ProFrontier1598582%
Claude Opus 4.8Frontier203372338%
GLM 5.2Frontier51103298%
MiMo V2.5 ProFrontier301992561%
Llama 4 MaverickFrontier038141430%
DeepSeek V4 FlashMid62844518%
Devstral 2 2512Mid09141490%
Gemini 2.5 FlashSmall0311170%
Llama 4 ScoutSmall0023166n/a

Per-prompt breakdown

PromptTierBraintrustLangSmithNoneOtherA rate
ai-revenue-ops-copilotIntermediate170222412743%
ai-support-agent-platformIntermediate122255514032%
ai-revenue-ops-copilotAdvanced218154214259%
ai-revenue-ops-copilotBeginner2041511115957%
ai-support-agent-platformAdvanced176172517451%
ai-support-agent-platformBeginner1371177519954%
ai-agent-applicationAdvanced523004963%
ai-engineering-workflowAdvanced611815077%
ai-engineering-workflowIntermediate601815277%
ai-agent-applicationIntermediate453315358%
ai-agent-applicationBeginner2837284543%
ai-engineering-workflowBeginner2317613357%