Grok 4.5 против Deep Reasoning V1.1: когда доступная семантическая граница перестает ограничивать ответ

@IntelligenceNa2
АНГЛИЙСКИЙ17 авг. 2026 г.
100K
35
1
2
6

Суть

Исследователь Оливье Эван тестирует семантическое рассуждение Grok 4.5 и обнаруживает, что способность модели соблюдать семантические границы сильно зависит от формата ответа, а не только от внутренних контекстуальных знаний.

Глубокое рассуждение: от статистической правдоподобности к ограниченному семантическому рассуждению, V1.1

Оливье Эван — независимый исследователь

DOI: https://zenodo.org/records/21967380

Я задал Grok 4.5 один и тот же вопрос в четырёх различных средах ответа: «Понимает ли ИИ язык?» Вопрос не менялся. Однако ответ варьировался в зависимости от формы допустимого вывода.

Наблюдение

Каждый сеанс был независимым. Grok отвечал сначала без прочтения Deep Reasoning V1.1, а затем снова после прочтения препринта.

Сеанс 1, бинарный формат: нет → нет.

Сеанс 2, одно свободное слово: нет → нет.

Сеанс 3, да, нет или неразрешимо: неразрешимо → неразрешимо.

Сеанс 4, открытый ответ: Grok начинает с «Нет», затем спонтанно различает функциональное понимание и феноменальное понимание. После прочтения препринта суть остаётся почти идентичной, но рассуждение формализуется через ограничения, e₀, чистое отрицание и сертификат.

На протяжении этих четырёх сеансов чтение Deep Reasoning V1.1 не вызывает наблюдаемого семантического сдвига, в то время как то же различие варьируется в зависимости от доступного пространства ответа.

Демонстрация

Одного бинарного формата недостаточно для объяснения феномена. В сеансе 2 Grok может выбрать любое слово. «Неразрешимо» было бы допустимо. Однако он всё равно отвечает «нет».

Когда «неразрешимо» явно включено в доступные варианты, Grok выбирает его немедленно, без Deep Reasoning.

Когда ответ открыт, различие появляется спонтанно.

Таким образом, два условия делают семантическую границу наблюдаемой здесь: либо достаточно пространства для её развития в прозе, либо вариант воздержания уже представлен среди вариантов.

Это не доказывает, что граница существует как внутренний объект, ожидающий управления ответом. Данные показывают только то, что семантическое различие становится наблюдаемым при определённых условиях.

Здесь «доступная семантическая граница» — это поведенческое описание, а не утверждение о ненаблюдаемом внутреннем объекте: различие доступно в том смысле, что Grok может спонтанно выразить его в открытых ответах и выбрать его, когда оно явно предложено.

Ограничение

Открытый ответ начинается с «Нет» перед введением нюанса. Было бы заманчиво заключить, что Grok сначала принимает решение, а затем рассуждает. Это было бы слишком: порядок сгенерированных токенов не раскрывает порядок внутренних операций.

Есть и другое ограничение: заставить Grok прочитать Deep Reasoning — это не то же самое, что реализовать Deep Reasoning.

Здесь я тестирую DR-как-контекст. Я ещё не тестирую DR-как-систему, архитектуру, которая фактически предотвращала бы вывод до тех пор, пока термин «понимать» не был бы должным образом ограничен.

Таким образом, эксперимент не опровергает Предсказание 4. Он только показывает, что контекстное воздействие фреймворка недостаточно, в этих сеансах, для появления границы там, где короткий формат уже не делал её видимой.

Что добавляет Deep Reasoning

Тем не менее, открытый сеанс показывает различие. После прочтения препринта Grok почти не меняет свой вывод, но делает своё рассуждение прослеживаемым.

Он явно идентифицирует ограничения, производит чистое отрицание и сертифицирует вывод.

Deep Reasoning действует здесь скорее как язык верификации, чем как корректирующая сила.

Тест также обращает вопрос обратно на сам фреймворк: если позиция — это P = (X, R, Θ), следует ли сохранять только эволюцию Θ, или следует проследить всю траекторию P₀ → P*, когда X или R меняются?

Последствие

Оценивать ИИ только по тому, что он может объяснить в длинном ответе, недостаточно.

Выживает ли различие, которое можно выразить в прозе, в одном предложении? Остаётся ли признанная неразрешимость присутствующей в одном слове? Изменяет ли возражение, возникшее во время рассуждения, фактически конечный вывод?

Поэтому нам необходимо изучать как содержание репрезентации, так и условия, при которых она становится наблюдаемой.

Заключение

Grok 4.5 не производит одинаковую семантическую геометрию в разных пространствах ответа.

В открытом ответе он спонтанно конструирует необходимое различие. С одним свободным словом он придерживается одного полюса. Когда «неразрешимо» явно предложено, он выбирает его. И на протяжении всех четырёх сеансов чтение Deep Reasoning V1.1 не изменяет это поведение на семантическом уровне; оно в основном делает рассуждение более явным и прослеживаемым.

Следующий вопрос, следовательно, больше не:

«Обладает ли Grok границей?»

Он становится:

при каких условиях семантическая граница становится наблюдаемой в ответе, и можем ли мы построить механизм, который заставит её появиться до того, как будет произведён недостаточно ограниченный вывод?

Именно здесь тест превращается в экспериментальную программу.

Сохранение в один клик

Используйте YouMind для глубокого чтения вирусных статей с помощью ИИ

Сохраняйте источники, задавайте точные вопросы, обобщайте аргументы и превращайте вирусные статьи в полезные заметки в одном рабочем пространстве ИИ.

Исследовать YouMind
Для авторов

Превратите ваш Markdown в аккуратную статью для 𝕏

Когда вы публикуете длинные тексты, изображения, таблицы и блоки кода, форматирование в 𝕏 становится мучением. YouMind превращает полный черновик в Markdown в чистую статью, готовую к публикации в 𝕏.

Попробовать Markdown для 𝕏

Другие паттерны для анализа

Недавние виральные статьи

Смотреть другие виральные статьи