6 октября 2026 г.
Встроенный поиск OpenAI Web Search догнал отдельные API: 74 балла в Artificial Analysis
OpenAI ведёт весь поиск за один вызов Responses API, а задача в тесте Artificial Analysis стоит около $0,05.

Artificial Analysis
@artificialanlys
OpenAI Web Search дебютирует в Artificial Analysis Search Index с результатом 74 балла и занимает 5-е место среди провайдеров после Perplexity, Octen, Parallel и Brave. @OpenAI Web Search стал первым встроенным поисковым инструментом от самого разработчика модели в нашем рейтинге. Вместо того чтобы обращаться к Search API через нашу тестовую систему Stirrup, GPT-5.6 Luna с уровнем рассуждения medium вызывает встроенный инструмент OpenAI web_search. OpenAI выполняет весь цикл поиска внутри одного вызова Responses API. Во всех конфигурациях используется одна и та же модель, GPT-5.6 Luna с уровнем рассуждения medium. При цене около $0,05 за задачу OpenAI Web Search обходится дешевле Parallel в режиме advanced ($0,06) и Perplexity в режиме medium ($0,07), но примерно вдвое дороже Octen ($0,024), который набирает на 3 балла больше. Основные результаты тестирования OpenAI Web Search с размером поискового контекста medium: ➤ 5-е место среди провайдеров в Artificial Analysis Search Index: OpenAI Web Search набирает 74 балла, на 41 балл больше, чем та же модель без поиска (33). Среди 26 продуктов он занимает 7-е место, наравне с You.com в режиме highlights, Nimble в режиме standard и Exa в режиме auto, которые тоже набрали 74 балла. Впереди три варианта Perplexity с результатами от 77 до 80, Octen с 77, а также Parallel в режиме advanced и Brave в режиме LLM context с 75 баллами. ➤ Лучше всего OpenAI Web Search справляется с AA-Omniscience, нашим собственным бенчмарком ответов на фактические вопросы: точность составляет 72%. Это 3-е место среди 26 вариантов поисковых провайдеров, всего на 1 процентный пункт ниже лидера, Firecrawl (73%). Самый слабый результат у него на BrowseComp, где нужны рассуждения в несколько шагов и несколько поисков: с 73,5% он занимает 13-е место из 26 и заметно уступает вариантам Perplexity и Octen с результатами 85–87%. ➤ OpenAI Web Search расходует меньше токенов на те же задачи: OpenAI учитывает около 40 тысяч входных токенов на задачу, включая результаты поиска. Для сравнения, самый экономный по токенам Search API в рейтинге, Perplexity в режиме low, расходует 125 тысяч. Затраты на модель у OpenAI одни из самых низких в рейтинге, около $0,009 на задачу. ➤ Встроенный поиск обходится дешевле большинства Search API: при цене около $0,05 за задачу OpenAI Web Search дешевле 17 из 25 продуктов с Search API в рейтинге, где медианная цена составляет $0,067. В их числе Parallel в режиме advanced ($0,06) и Perplexity в режиме medium ($0,07). Octen стоит примерно вдвое меньше ($0,024) и набирает на 3 балла больше. Основные детали: ➤ Конфигурация: GPT-5.6 Luna с уровнем рассуждения medium, инструментом OpenAI web_search и параметром search_context_size со значением medium. Весь поиск выполняется внутри одного вызова Responses API. ➤ Цена: $10 за тысячу вызовов web_search плюс содержимое результатов поиска, которое OpenAI учитывает как входные токены модели. ➤ Загрязнение теста: через фильтр доменов инструмента мы блокируем известные источники, из которых модель могла бы получить готовые ответы на задания.

· 8,6 тыс. просмотров
GPT-5.6 Luna без поиска набрала 33 балла. Со встроенным поиском та же модель получила 74 балла в замере Artificial Analysis от 6 октября.
OpenAI Web Search занял 5-е место среди провайдеров и 7-е среди 26 вариантов продуктов. На тех же 74 баллах стоят варианты You.com, Nimble и Exa. Во всех конфигурациях исследователи использовали GPT-5.6 Luna с одинаковым уровнем рассуждения medium.
Поиск одним вызовом. В остальных конфигурациях ИИ-агент обращается к отдельному Search API, а тестовая система Stirrup управляет его работой. С OpenAI Web Search модель вызывает встроенный инструмент `web_search`, и OpenAI выполняет весь цикл поиска внутри одного запроса Responses API. В тесте исследователи задали `search_context_size: "medium"`.
OpenAI учитывает около 40 тысяч входных токенов на задачу вместе с результатами поиска. Самый экономный по токенам отдельный Search API в рейтинге, Perplexity в режиме low, расходует 125 тысяч. Расход на саму модель у OpenAI составляет около $0,009 на задачу, поисковые вызовы оплачиваются отдельно.
Цена и результат. OpenAI Web Search дешевле 17 из 25 отдельных поисковых продуктов в тесте. Octen при этом стоит примерно вдвое меньше и набирает на 3 балла больше.
| Вариант поиска | Баллы Search Index | Цена задачи в тесте на 06.10.2026 | | --- | --- | --- | | OpenAI Web Search, medium | 74 | Около $0,05 | | Octen | 77 | $0,024 | | Parallel, advanced | 75 | $0,06 | | Perplexity, medium | Варианты Perplexity набрали 77–80 | $0,07 |
OpenAI Web Search точнее отвечает на фактические вопросы, чем справляется с цепочками поисков. На AA-Omniscience он дал 72% правильных ответов и занял 3-е место из 26, уступив лидеру Firecrawl 1 процентный пункт. На BrowseComp, где ответ приходится собирать через несколько поисков, результат составил 73,5% и 13-е место. Варианты Perplexity и Octen набрали 85–87%.
OpenAI берёт $10 за тысячу вызовов web_search и дополнительно оплачивает содержимое результатов по тарифу входных токенов модели.
Первоисточник