← Benchmarks
Search and Function-Calling
Search and Function-Calling is an OpenAI internal production benchmark measuring reliable search-tool use and function calling in agentic workflows, reported as a pass rate.
id openai-search-function-calling · max 1 · 3 models reported
| # | Model | Score |
|---|---|---|
| 1 | GPT-5.6 Terra OpenAI | 0.95 |
| 2 | GPT-5.6 Sol OpenAI | 0.91 |
| 3 | GPT-5.6 Luna OpenAI | 0.90 |
