Страница xAI API также говорит о real-time search в Grok API, а пост xAI в X сообщал, что Live Search позволяет Grok искать данные в реальном времени из X и интернета. В совокупности это сильное подтверждение самой функции: live-поиск у Grok не выглядит маркетинговой фантазией, он описан в официальных материалах.
Главный вопрос не в том, «умеет ли Grok искать». Умеет — по крайней мере, такие инструменты у него задокументированы. Вопрос строже: ищет ли именно Grok 4.3 лучше, чем более ранние версии?
Вот здесь доказательств уже не хватает. В наборе источников есть официальные материалы xAI о Grok 4, Grok 4.1 и Grok 4.1 Fast: там упоминаются native tool use, agentic search, tool calling и общие лидербордные результаты. Но эти материалы не дают Grok 4.3-специфичного сравнения по поиску: нет измерений свежести найденных данных, качества выбранных источников, точности цитирования или корректности обработки тредов X в сравнении с прежними моделями.
Единственный предоставленный источник, где прямо фигурирует Grok 4.3, — сторонняя статья о Grok 4.3 Beta, а не официальный релиз-ноут xAI и не опубликованная методика оценки поиска. Поэтому на её основании нельзя уверенно утверждать, что у Grok 4.3 есть измеримое преимущество в веб-поиске или поиске по X.
В таких темах легко спутать два разных утверждения.
Первое: модель может пользоваться поисковым инструментом. Для Grok это подтверждается документацией xAI по Web Search и X Search.
Второе: одна версия модели пользуется этим инструментом лучше другой. Для этого нужны сравнительные данные. Например, находит ли Grok 4.3 более свежие источники, выбирает ли более релевантные страницы и посты, лучше ли понимает цепочки сообщений в X, точнее ли привязывает цитаты к утверждениям и реже ли делает неподтверждённые выводы.
Документация xAI описывает доступные инструменты, но не публикует такие замеры «версия против версии» для Grok 4.3. Поэтому более высокий номер модели сам по себе не доказывает улучшение retrieval — то есть извлечения информации из внешних источников.
Корректный тест должен запускать одни и те же запросы одновременно на Grok 4.3 и на более ранних доступных моделях Grok. В наборе задач должны быть запросы на свежую информацию из веба, потому что Web Search у xAI описан как real-time web search с возможностью просмотра страниц.
Отдельный блок должен проверять X: поиск по ключевым словам, смысловой поиск, поиск пользователей и получение тредов — именно эти функции перечислены в документации X Search.
Оценивать нужно не только финальный текст ответа, но и сам процесс извлечения: какие источники были найдены, насколько они свежие, подтверждают ли они конкретные утверждения, правильно ли восстановлен тред X и совпадают ли цитаты с тем, что модель заявляет. Без такого параллельного теста заявление «Grok 4.3 ищет лучше» остаётся гипотезой.
Самая аккуратная формулировка такая: Grok имеет документированные инструменты поиска по живому вебу и X, но представленные источники не показывают, что Grok 4.3 извлекает актуальные ответы эффективнее, чем Grok 4, Grok 4.1 или Grok 4.1 Fast.
Если вы используете Grok для текущих событий, новостей или постов из X, относитесь к его поиску как к реальной полезной функции, но всё равно проверяйте найденные источники. А если речь о сравнении моделей, утверждение о «лучшем поиске Grok 4.3» стоит считать открытым до появления официальных или независимых воспроизводимых тестов.