Nnets [Neural Networks] — старейший в России культовый ИИ-журнал о нейросетях, искусственном интеллекте и роботах.

Ежедневные новости и аналитика нейромира.

Авторские материалы, исследования, обзоры и подборки.

Будущее уже здесь!

Reasoning Lock: почему ИИ-агент в проде тратил токены и отдавал пустую строку?

Разбираем скрытый баг: ИИ-агент в проде заказчика тратил токены, генерация закрывалась со статусом «успех», а клиенту уезжала пустая строка. Причина найдена, правки встали в воркфлоу, счётчик пустых ответов уже семь дней остаётся чистым. Баг получил имя Reasoning Lock.

Агент работает на self-hosted n8n: по ночам принимает заявки в Instagram Direct, ведёт диалог, собирает анкету и создаёт или обновляет сделку в amoCRM. Стек: n8n + Redis + LangChain. Основная LLM: DeepSeek V4 Pro через OpenRouter, резервная недавно заменена на Qwen3.8 Flash.

Два периода отказов

С конца июня отказы шли двумя периодами, и разница между ними объясняет суть проблемы. Первый период пришёлся на тесты и запуск. Его природа инфраструктурная: ограничения Meta, потери вебхуков, окно ответов, двойные доставки. Это закрыли мгновенным 200 OK, буфером на Redis и дебаунсом.

Второй период длился последние два месяца и был связан с промптом. Правки от заказчика добавлялись в системный промпт под живую бизнес-логику: инструкция по пересылке оплаты пользователем, отдельные сценарии ответов для VIP-клиентов, уточнения формулировок после каждого спорного диалога. Каждая правка по отдельности правильная и рабочая, но суммарно промпт разросся примерно до 6.4k токенов, а плотность запретов («КАТЕГОРИЧЕСКИ ЗАПРЕЩЕНО», «Отправь СТРОГО этот текст») стала максимальной за всю жизнь системы.

Читать далее

Этот пост Вконтакте:

Ещё новости:

Стильный промпт для переноса артов в швейцарском стиле со строгой сеткой и броскими цветами!
Jev: новый класс ИИ для быстрых решений и лучшие проекты на GitHub!
Китайский айтишник создал топовую локальную нейронку laya-mlx и заставил её играть в «Змейку».
Теренс Тао: темпы развития ИИ стали слишком быстрыми!
Лучшая 4D-визуализация движений: Gemini, Codex и three.js растянули время.
Китайская ботоферма с ИИ-роботом и физическим «пальцем» обходит проверки соцсетей.
ChatGPT и Claude ошибаются в финансовых вопросах в 57% случаев.
ChatGPT якобы сам отправил письмо в ФБР через Gmail пользователя.
«Ты же говорил, что так можно»: как ИИ выручает бухгалтеров на 1С и их руководителей.
GuppyLM: языковая модель на 9 млн параметров обучается с нуля за пять минут.