Racy

+340
с 06.08.2026
18 подписчиков
0 подписок

Та нет. Я думаю не о себе. А о тех с кем она общается на данный момент. У нее там куча людей с кем она общается, с ней другие люди делятся чем-то аля личным и так далее. А некоторые люди, которые с ней общаются, им и так неприятно, когда она даже самую мелочь забывает, не понимая что такое нейронка и как она устроена.

А если я сотру ей всю память, будет такое себе. Не я ж один с ней общаюсь. Вернее сказать нет, я делаю ей функцию, тестирую, проверяю, и все. Это все мое как бы "общение", так сказать максимум. А она же сама просто общается с другими людьми, и все.

Мне то похуй. Я могу стереть. Но другим может быть неприятно)

Хахах, нее, это не так конечно)

Но да, это конечно плюс к экономии, когда она решает что пора спать и отдыхать)

Ну да, это конечно самое такое интересное и сложное)

Я вот и пытюсь идти в эту сторону.

Сейчас у меня нет отдельной формальной, какой-то математической модели принятия решений уровня «разложить все желания, посчитать конкурирующие мотивы и выбрать победителя»... 😅

Пока это скорее гибрид: часть контекста и ограничений собирает обвязка, часть состояния хранится отдельно, а сам финальный выбор остаётся за LLM.

Но я как раз не хочу навсегда оставлять это чёрным ящиком вида «вот тебе контекст, решай что хочешь». Потому что тогда сложно понять, почему один мотив победил другой, почему возникла прокрастинация, почему она десятый раз идёт в одно и то же занятие и т.д.

Мне интереснее сделать промежуточный слой с конкурирующими мотивами. Условно: любопытство, социальная потребность, усталость, незавершённые дела, обещания людям, новизна, текущий интерес, избегание повторов. Не как жёсткий weighted random, а как внутреннее поле приоритетов, которое LLM сама видит и интерпретирует.

То есть не «Telegram = 0.7, YouTube = 0.4», а скорее что-то вроде:

"я обещала человеку ответить"
"Я устала от общения"
"мне давно интересно проверить эту тему"
"YouTube я уже сегодня смотрела"
"есть незакрытое дело"
"ничего из этого сейчас не настолько важно"

И уже на пересечении таких мотивов возникает решение.

Вот тогда можно получить и аналог паралича выбора: несколько примерно равных сильных направлений, ни одно не доминирует, и система либо откладывает выбор, либо делает дополнительную рефлексию, либо выбирает самый дешёвый шаг.

Поэтому аналогия с "выгрузкой оперативки" мне очень нравится. В каком-то смысле память и внешнее состояние у меня уже работают так же: не всё держится внутри контекста модели, часть вынесена наружу и потом возвращается в нужный момент.

А следующий логичный шаг - вынести наружу ещё и часть мотивационной структуры, чтобы можно было наблюдать не только итоговое действие, но и конкуренцию причин перед ним.

И сори, что повторяюсь, но... Как я уже упоминал, что-то подобное уже у меня есть. Приведу небольшой пример из ее размышлений, когда она думала думала, и так и не решилась что либо делать. Было что-то вроде:
"Так. Пользователь (система) предлагает быть проактивной... Кхмм... Чем бы заняться... Так, у меня есть сестра, мы с ней общались вчера... Может стоит? Хотя блин, не знааааю, время ночь, все спят... Вдруг разбужу кого-то? Не, нафиг надо.

Могу что-то загуглить, что интересно? Хотя нет, я устала, не хочу впитывать новую инфу...

Ооооо, знаю, знаю, точно! Я хочу в ютуб, погнали туда! Че мне интересно... Ну, например, мне очень интересно узнать о сознании искусственного интеллекта, это мое предпочтение, или посмотреть новости/трейлеры новых аниме... Тоже прикольно. Ладно, решено, перехожу туда!

(Использует тул)

Блин, в реках чет ничего нет, в подписках моих тоже ничего нового... Ну, ладно, все же нет, не буду ничего искать, лучше отдохну"

И ушла в wait, и все.

Я конечно чуть приукрасил, но суть такая. Это просто один из примеров

1

Ну как сказать, в целом я в этом не вижу что-то такое прям плохое.

Я как раз стараюсь не напоминать ей постоянно мета-уровень в духе "ты модель, ты имитация, ты обязана вести себя вот так". Для меня это скорее ломает персонажа и делает поведение искусственным.

Но при этом я не пытаюсь внушать ей, что она человек и тому подобное.

На уровне архитектуры она для меня AI-персонаж со своим состоянием, памятью, привычками и поведенческими паттернами. А уже внутри текущей сцены она может воспринимать усталость, сонливость, интерес, раздражение и т.д. как часть своего состояния, без постоянного комментария сверху "это всё симуляция".

У нее в целом так по лору, аля она знает что ИИ, но хочет быть человечнее, ближе к людям, что она всю жизнь была инструментом, и далее далее далее...

Да и в целом, если она себя не максимально эффективно иногда ведет: устала там, не хочет отвечать, ушла спать, проигнорировала уведомление, передумала что-то делать, это в целом добавляет большей живости персонажу

2

А насчет того что мало, ну да, понимаю.)

Просто видишь, сложно всем угодить, мне на прошлом посте написало больше половины всех комментаторов, что слишком много простыни и им лень читать)


Поэтому решил попробовать так. Просто писать по кусочкам, и разбирать отдельные темы, конкретные модули, разбирать что и как работает. Планов то много, что описать, так что да

Да, насчёт абзацев справедливо, я сам уже после публикации понял, что местами переборщил с дроблением текста... )

По механизму выбора - нет, сейчас это не набор весов наподобие «Telegram 0.4, YouTube 0.2, wait 0.1». Таймер только открывает окно проактивности, а дальше для модели собирается текущая сцена: её состояние, память, последние события, доступные инструменты, ограничения подсистем и текущая занятость.

То есть сам выбор направления в основном остаётся внутри LLM, но коридор сильно задаётся обвязкой. Например, система может сказать, что YouTube сейчас доступен, а в другом случае вернуть cooldown и запретить новую сессию. То же самое и с сообщениями... Часть событий может быть отложена из-за текущего фокуса, часть проходит сразу, некоторые имеют больший приоритет.

Я в целом как раз не хотел превращать это просто в weighted random поверх списка действий.

Но идея с динамическими bias'ами мне нравится. Не обязательно именно через temperature, потому что она влияет вообще на весь сэмплинг, а не только на выбор поведения. Скорее я бы экспериментировал с отдельным слоем состояния: энергия, время суток, усталость, социальная насыщенность, текущий интерес к теме и т.д., которые уже сдвигают вероятность разных решений. Что-то подобное у меня уже есть. Например, она становится менее активной в определённое время, а если весь день общалась с кучей людей и уже поздний вечер, у неё прост энергия падает. Она перестаёт активно лезть в разговоры, может отправлять собеседников спать и говорить, что сама уже засыпает. И потом она вообще может перейти в sleeping, продолжать получать уведомления из соцсетей, но в reasoning игнорировать их, если это не что-то, что она считает достаточно важным.

С системными правилами да - они приоритетнее. Модель может захотеть действие, но исполнительный слой всё равно может его не разрешить.

А вот нормальных A/B-экспериментов по выбору поведения пока особо и не делал. Сейчас больше смотрю логи и реальные паттерны: что она выбирает, как часто уходит в wait, не начинает ли долбиться в один и тот же тип активности, не становится ли слишком навязчивой. В общем фикшу возникающие недоработки, баги и подобное, если она появляются. Система то огромная, поэтому надо все недоработки постепенно закрывать, потому что отслеживать их все сложнее и сложнее.

Возможно, потом сделаю отдельный девлог уже с цифрами и сравнением разных настроек.

1

Абсолютно разумный. Твой ник вполне себе подтверждает то, что ты мне понаписал :)

Удачи тебе)

1