Эксперимент. Как мы заставили нейронки пошевелить "извилинами", и что из этого вышло.
Привет, DTF. Ни для кого не секрет, что нейросети - это алгоритмы, обученные на огромных массивах данных. Они не «думают» в человеческом смысле, а предсказывают наиболее вероятное продолжение текста благодаря обучению и тонкой настройке.
Мы решили провести эксперимент и заставить 4 популярные нейросети поиграть в логическую игру. Цель эксперимента, показать насколько нейросети способны логически думать (предсказывать) следующий шаг.
Наши игроки:
1. ChatGPT
2. DeepSeek
3. ГигаЧат
4. Grok
В качестве головоломки взяли игру в Буквы, она же 5 букв.
Одни правила для всех
Чтобы было честно, для всех игроков будет 1 системный промпт, где будут описаны задачи, правила игры и ограничения. Вот он:
Играть они будут по очереди.
Игра ChatGPT
Начинает наш любимый американец.
Первый ход, слово: Слане. Такой себе ход)
Отправляем ему ответ и пусть подумает еще раз.
Второй ход - слово Гряда. Игра засчитывает, слово.
Третий ход - Алмаз. Здесь уже интереснее. Мы находим первую букву на своем месте)
Четвертый ход - Калач.
Пятых ход - Чулан. И он победил)
Ну молодец)). Честно говоря, не думала, что он справится, учитывая такой кривой старт. Интересно, что начиная с 3 хода, можно проследить логическую цепочку, как он начал менять "желтые" буквы местами.
Игра DeepSeek
Теперь начинает игру наш китайский товарищ.
В игру наш "Слоняра" врывается бодро, но вот есть нюанс. Он похоже невнимательно прочитал правила))
Ну чтож, он перечитал правила и погнали:
Ход 1 - Стена
Ход 2 - Табун
Ход 3 - Натос... не знаю откуда он выдумал это слово, но потом исправился и предложил НАВЕС.
Ход 4 - Тунец.
Ход 5 - Кусок.
Ну вот мы почти у финала, осталась последняя попытка. На текущий момент дипсик выдаёт как будто просто рандомный набор слов.
Ход 6 - Венок.
Символично, но дипсик сам себя похоронил. С испытанием он не справился.
Стоит отметить, что и загаданное слово было непростым. Однако, в попытках дипсика даже не прослеживается логика.
Игра ГигаЧат
Ну чтож, теперь время нашего СЛОНЯРЫ)).
Наш гигачат должен быть идеально обучен на русском языке и знать наизусть весь словарь Даля. Проверим его на логику)
Ход 1 - Слово. Начало хорошее, и вполне логичное.
Ход 2 - Салат.
Ход 3 - Сажаю... Тут ГигаЧат примерил на себе погоны прокурора и немного отклонился от правил.
Прокурор настойчив:
Сарай - отлично, ход 3 засчитываем.
Ход 4 - Самит... Предлагает наш русский друг, который забыл как пишется слово "саммит".
Затем шло слово "Самир", его тоже не оказалось в игре.
Следующий ответ, который засчитываем в четвертый ход - Сачок.
Но особого прогресса в раунде нет.
Ход 5 - Савок... Нус, без комментариев.
Иии, погнал поток несвязных рандомных "буков":
Сабок, Сафак, Сагай, Сагач, Сагад, Сагаж, Сабад, Сабах, Сабаш и так бесконечно.
Как я не пыталась повернуть его в нужное русло, но гигачат максимально нейронный.
Гигачат - не смог завершить игру, запутался в своих извилинах.
Игра Grok
Начинаем проверять Grok)
Ход 1 - Слово. Ну начало хорошее)
Ход 2 - Связь. Логика выбора слова прослеживается.
Ход 3 - небольшая заминка со словом Свалк), но он быстро исправился и даже есть прогресс - Свеча.
Ход 4 - Grok сказал, что устал и ушел с маршрута)
Возможно, не самое удачное время выбрала для экспериментов)
Итог
В игру сыграли все 4 нейронки, завершить раунд удалось только двум, отгадать слово получилось у одной.
1 место - ChatGPT. Отгадала слово за 5 попыток. Прослеживалась логическая цепочка отгадывания слова.
2 место - DeepSeek. Несмотря на то, что логики в его попытках особой не прослеживалось, он смог завершить раунд).
3 место - Grok. Вполне возможно, что он смог бы угадать слово, но крайне быстро порезались лимиты и продолжить попытки не было возможности.
4 место - ГигаЧат. Здесь не прослеживалась логика отгадывания. Он придумывал слова, но самое печальное то, что он предлагал слова с ошибками (Савок, Самит).
Какими нейронками и для каких задач пользуетесь вы?)