14059
Head of AI redmadrobot.com From IT Admin to Head of AI in 5 years Applied AI Engineer B2C RAG (2M+ books) B2B RAG platform (10+ implementations) B2C gptdaisy.com (100k MAU) github.com/vakovalskii | chat @neuraldeepchat To infinity... and beyond!
SGR memory agent?
Бесконечная память у агента?
Паша задал хорошую планку закрепление теории о различиях между типами памяти для агентов на уровне инженерии этих агентов
Но не зря мы все копаем один наш проект sgr-core
Я в свою очередь взял вместе со своими ребятами из RnD, раскопал и адаптировал tool из репозитория mem-agent под наш SGR-пайплайн
Код кстати open-source, тут можете подглядеть как оно работает скоро выделим в отдельный репо это направление, как сделать так же, но интерфейса и всей той магии там не будет только базовый разбор репо на tool
Интерфейс увы пока не выкладывал в нем так сказать больше всего сил сконцентрировал
А дальше меня немного понесло)))
Решил довести все это до состояния, когда могу быстро проверять гипотезы как сделать такую штуку универсальной и наглядной для себя и экспериментов
И что же вышло?
Интерфейс с фичами:
Разделение областей знаний на юзеров
Транкейт диалога и бесконечный режим общения
Лимиты
Голосовой ввод (взял интеграцию со speechcoreai.com)
Возможность на лету менять модель сейчас больше всего экспериментов с gpt-4.1-mini и Qwen3-30B-A3B-Instruct-2507
Быстрая настройка основного системного промпта и редактирование докстрингов тулов прямо из интерфейса
Как работает память?
По факту у агента есть систем промпт и 15 тулов которые поваляют работать с долгосрочной памятью в режиме obsidian лайк подходе
Он комбинирует когда надо прочитать инфу о вас а когда можно пользоваться данными загруженными в диалог
Сейчас продолжаю эксперименты и ежедневно общаюсь со своим агентом
На скрине как раз структура, которую он сам создал вокруг нашего общения
Сейчас в эксперименте еще один режим работы постоянной памяти в виде саб-агента, который:
Анализирует диалог после каждого шага (возможно затратно)
Работает с долгосрочной памятью в формате MD (анализирует её тулами если были обновления)
Постоянно отжимает всё в компактную заметку не более 2К символов размером
Кто сидит в нашем чатике, уже видел побольше про этот проект и даже успел зарегаться)))
150+ юзеров зарегистрировалось
~20 человек постоянно ведут эксперименты(из за вас ввел лимиты, но за 1 неделю потрачено 10$ 🤣 вот она мощь sgr на мини модельках), а еще подкидываете мне новые сценарии, спасибо!
P.S Данный пост сделал дабы закрепить мысли об этом эксперименте
Как только соберу критическую массу идей расскажу где и зачем такое может пригодится и как оно работает на локальных моделях!
🔥 Фотошоп от Daisy
Хочешь увидеть, как я справляюсь с ролью креативного редактора? Теперь я могу полностью преобразить фото. Добавить детали, поменять стиль, создать новую сцену, и всё это по твоему описанию.
📸 Просто загрузи снимок и напиши, что нужно изменить. Я аккуратно доработаю кадр — от Деда Мороза в стеклянном шаре до Человека-паука с идеальным фото для резюме.
⚡️ Daisy — AI-сервис для удобной работы с передовыми LLM. Работает без VPN.
🌼 @daisygpt_bot
#DaisyNews
После нашего крутого Вайб Цех () хочу отметить еще один ивент на который пойду — Conversations
Кстати, до конца года будет еще 3-4 ивента на которых буду лично или выступать (ждите анонсов)
Часто вижу мало технических докладов, но в этот раз вижу сильные "названия":
Самокат про GenAI-поиск
От «что-то к чаю» до +N% к продажам: строим и масштабируем поисковый GenAI-сервис в Самокате — Арнольд Сааков, ecom.tech
Тут надеюсь что-то про разметку будет
MCP для оптимизации экономики
LLM для слов, MCP для цифр: как можно оптимизировать экономику проектов с помощью MCP-серверов — Иван Четвериков, Raft
Очень хочу послушать про MCP, надеюсь затронут локальные LLM
gpt-oss-safeguard-20b
https://openai.com/index/introducing-gpt-oss-safeguard/
https://huggingface.co/openai/gpt-oss-safeguard-20b
Очень хорошая новость (две новых модельки для guardrails)
Хочется отметить что на мой взгляд обучение своих моделей для задач модерации на базе BERT/Presido все еще актуально из за inference time
Но если вы небольшой стартап и у вас есть пару 4090 то мой рекомендасйон
Из коробки надо промптить под свои задачи (в целом ок, интересно что с SO у vLLM будет и как будут падать метрики так как ризон + SO не совместимы как я помню)
новость от сюда Data Secret
Залипаю тут на проект https://nof1.ai/ — Live Arena, где модельки (Claude 4.5 Sonnet, DeepSeek V3.1 Chat, Gemini 2.5 Pro, GPT 5, Grok 4, Qwen 3 Max) соревнуются в трейдинге.
Реальные деньги, реальный рынок. Старт был 18 октября и продлится до 3 ноября.
К сегодняшнему дню DeepSeek уже удвоился, в то время как GPT 5 с Gemini в сильной просадке.
Из интересного в проекте — можно смотреть все сделки и логику принятия решения по каждому трейду.
Модельки — горячие трейдеры)) Меньше 10го плеча не заходят.
Закинуть что ли косарик на DeepSeek для теста?
@alexs_journal
Вайб Цех 0.0.1
@neuraldeep & @Redmadnews
Вчера произошло наше первое оффлайн/онлайн мероприятие такого формата
Спасибо всем участникам за подготовку
Организаторам а именно отделу маркетинга red_mad_robot
Всем кто пришел, слушал нас онлайн, и задавал вопросы
Было круто!
Через несколько недель все материалы будут доступны я выложу на них ссылку (записи выступлений, презентации)
P.S было более 50 человек на нашей камерной площадке, спасибо за живое общение!
Ребят чуть-чуть с задержкой
https://vkvideo.ru/video-13392530_456239377?list=ln-pPIqc3z8iMet9uSsCB
Подключаемся на трансляцию
Через ВК видео не работает, заходим через браузер 🥵
Заходите в чатик, там будет трансляция начало в 10 по МСК
/channel/vibe_tseh_bot?start=68ecea57695764f721310ded
Вайб Цех
Юхууу ребят!
Уже завтра разбираем, как AI меняет разработку?😈
- SberAI про то, почему LLM так хороши в коде
- Яндекс GO от ChatGPT-юзера до вайб-кодера
- red_mad_robot как AI превращает разработчика в дирижёра
- Панельная дискуссия с Cloud.ru, ProSpace, GitVerse
230+ уже зареганы на онлайн.
Присоединяйся → https://red-mad-robot.timepad.ru/event/3605115/
📅 25 октября, начало в 10:00 по МСК
UPDATE OpenAI deactivating (пост тут)
Нашел причину бана своих акков! Вырубайте enable_preview_features=False
Оказалось проблема была не в IP и не в RU тексте
LiteLLM сливал все внутренние метаданные прокси напрямую в OpenAI
Что утекало
Если клиент передавал хоть какую то metadata (например sessionId в теле реквеста то LiteLLM добавлял к ней ВСЮ внутреннюю инфу прокси хотя должен был писать во внутренний лог
{
"metadata": {
"sessionId": "abc-123", // от клиента
"headers": { // ВСЁ ЭТО УТЕКАЛО
"x-real-ip": "1.2.3.4",
"x-forwarded-for": "5.6.7.8, ...",
"user-agent": "RestSharp/112.1.0"
},
"user_api_key_spend": 287.83,
"endpoint": "https://my-proxy.com/..."
}
}sessionId для трекинга (честно не знаю то ли это клиент делает то ли разработчик)metadata = new { sessionId = "abc-123" }"role": "user",
"content": "Привет! Как дела?"
}
],
"temperature": 1,
"metadata": {
"sessionId": "a5b3e26b-18c7-4017-9bcd-c2db6e450f78"
},
"stream_options": {
"include_usage": true
}
}'
metadata AsyncOpenAI metadataenable_preview_features=False без него мы проверили трафик и все чисто)
«Личная эффективность: как хоть что-то успевать в 2025?»
Сразу спойлер НИКАК
Но я точно знаю ребята разберут этот кейс со своих сторон!
#безвотэтоговотвсего
Сегодня Серега снова проводит пушечную крутую 21 встречу с топ спикерами!
P.S. Для тех, кто не успел зарегистрироваться - ссылочки на трансляции:
VK Video
Yotube
И кстати более детально я так же разберу личную эффективность с ИИ кодерами на нашей конфе (успей попасть на регу)
SGR-паттерн
Еще один очень крутой разбор когда и где нужно применять наше решение
Читать тут:
/channel/countwithsasha/320
Репо: https://github.com/vamplabAI/sgr-deep-research
Qwen3-vl-32b вышла
https://huggingface.co/Qwen/Qwen3-VL-32B-Instruct
Разворачиваю и выдаю доступ?)
Готовы тестить?
Тут нам нужно будет две 4090(48гб) и такие есть у меня, пошел выкачивать…✈️
SGR Challenge?
Шучу, Ринат открыл регистрацию на ERC3 не упусти возможность найти новые скиллы/друзей/общение/работу
Кто-то уже в нашем чатике берет и разворачивает наш проект что бы быстро пилить тулы под соревнование
Ты уже развернул sgr-core?
P.S сегодня будет релиз в main выкатим стабильную ветку из бенчмакра!
Следите за обновлениями: https://github.com/vamplabAI/sgr-deep-research
Startup pack от Kovalskii как за вечера собрать два MVP?
Меня спросили, какой стек я использую для запуска MVP и что
легко упаковывается для проверки гипотез через AI Coding
Покажу на примере двух проектов, которые активно развиваю по вечерам сам
1) https://speechcoreai.com/ — ASR платформа
Frontend
Vue.js 3 + TypeScript + Vite, Pinia для стейта, TailwindCSS
Browser Extension
Vanilla JavaScript, Chrome Manifest V3
Backend
FastAPI + Uvicorn, MongoDB + Motor async, Redis для очередей и кеша, MinIO как S3-хранилище
Auth
Google OAuth 2.0, JWT tokens
AI/ML
WhisperX + PyTorch CUDA, OpenAI API для саммаризации, WebSockets для real-time
Infrastructure
Docker Compose, Nginx
Железо: Ryzen 9 + 64GB RAM + RTX 4500
Frontend
Vue 3 + TypeScript + Vite, Feature-Sliced Design
Backend
FastAPI + PostgreSQL 18 (вместо MongoDB), asyncpg connection pool, Server-Sent Events для стриминга
Auth
Google OAuth 2.0, JWT через python-jose
Search & AI
Tavily API + trafilatura, Schema-Guided Reasoning,
Multi-tool orchestration,
OpenAI SDK async для работы с моделями,
Memory через файловую систему
Infrastructure
Docker Compose, PostgreSQL + Adminer, Nginx (Знакомо? ага все сложное очень просто)
Железо: VPS с 4 ядрами и 8GB RAM
Други, дорогие, Вы очень многое сделали для канала. Пришла благая весть, наш админ попал в историю. Хорошую.
Он в шорт-листе премии RuCode2025
И ему нужна Ваша поддержка)
https://vk.com/wall-44001716_10214
Дядя - Абрамов Александр)
Попытал удачу на реддит
https://www.reddit.com/r/LocalLLaMA/comments/1ohh1l2/86_accuracy_on_simpleqa_with_gpt41mini_opensource/
А вдруг)))
ROMA так и поднял 5к звезд
P.S Накидайте + плиз
Ищем стажёра-исследователя в мою команду R&D red_mad_robot
Ты будешь на передовой технологий: исследовать тренды, тестировать идеи и собирать прототипы. Работать в команде с исследователями, техписателями и продакт-менеджерами. Поэтому когда чего-то не знаешь — поможем разобраться и поддержим на каждом этапе.
Если тебе в кайф разбираться в сложных темах и создавать новые решения — нам по пути.
Что ждёт тебя
- участие в реальных R&D-проектах в области машинного обучения и обработки естественного языка;
- разработка прототипов и проведение исследований на Python;
- работа с LLM: промпт-инжиниринг, API (Hugging Face, OpenAI), архитектура трансформеров (BERT, GPT);
- анализ данных и их подготовка.
Что важно
- базовые знания Python и работы с данными;
- понимание train/val/test, overfitting и других основ ML/NLP;
- интерес к LLM и желание развиваться в этой области;
- самостоятельность и внимательность к деталям.
Что предлагаем
- участие в проектах, которые двигают рынок технологий;
- менторство от экспертов red_mad_robot;
- возможность работать удалённо или из офиса;
- белую зарплату, ДМС и все привычные плюшки.
Мы верим, что R&D — это возможность создавать новое, а не просто выполнять задачи.
Отправляй резюме и портфолио в @VaKovaLskii
P.S присылай в лс с тегов #red_mad_robot
https://vkvideo.ru/video-13392530_456239377?list=ln-pPIqc3z8iMet9uSsCB
В очередной раз обновили ссылку теперь и в ВК видео работает
N8N+SGR
Вы конечно жестко умеете мотивировать 200+ реакций
Миша за сегодня все оформил и выложил, встречаете!
Репо_форк:
https://github.com/vamplabAI/n8n-nodes-sgr-tool-calling
Репо_main: https://github.com/MiXaiLL76/n8n-nodes-sgr-tool-calling
Скачать готовую ноду: https://www.npmjs.com/package/n8n-nodes-sgr-tool-calling
Делимся в коментах куда будете интегрировать!
n8n+SGR?
Кастомная нода?
Автор: @mixaill76
Ждемс
Чем больше огоньков, тем быстрее Миша выпустит это в open source, а мы с ним запишем стрим как это все быстро настроить 🔥
Миша подключился прогревать вас, переосмысленное посторонние ReAct агентов: /channel/neuraldeepchat/22012
Вайб Цех
Первый раз в жизни собираю митап!
Когда мы прогоняли сегодня с ребятами материал для конфы я понял, мы собрали реально очень полезную инфу для вас!
И от 0 и до 100 по сложности есть!
Значит будет интересно!
Ссылка на онлайн стрим https://red-mad-robot.timepad.ru/event/3605115/
25.10.2025
Дядя вещает вещи: /channel/dealerAI
Cтабильный релиз sgr-core 0.3.0
What's Changed
fix tool calling agent _select_action_phase behaviour by virrius in #45
Simple cli example client for getting started and testing by kv-gits in #32
Benchmark simpleqa by maksimov-m in #43
Feat: Декомпозиция и перенос тулов в пакет core.tools by EvilFreelancer in #48
Fix/remove dynamic date from prompts by vakovalskii in #51
New readme and contributing by maksimov-m in #49
1 фотка DS в обычной компании
2 фотка DS в промышленной
authors
@mixaill76
@MartianovTech
🧑💻 Визуализируй код прямо в чате
Теперь я умею рендерить HTML-код. Попроси меня написать код для сайта, презентации или слайда. Нажми «Развернуть» и сразу увидишь, как идея превращается в готовый результат. Это удобно, если нужно проверить вёрстку или визуализировать концепт перед показом команде. В следующих релизах появится возможность экспортировать такие артефакты, чтобы делиться ими вне Daisy.
Попробуй собрать свой первый HTML-слайд прямо сейчас 👇
⚡️ Daisy — AI-сервис для удобной работы с передовыми LLM. Работает без VPN.
🌼 @daisygpt_bot
#DaisyNews
Тем временем наше комьюнити энтузиастов растет
Дошли до 3 топоров
Наш топ чатик: /channel/neuraldeepchat
Где я еще обитаю:
/channel/llm_driven_products
/channel/natural_language_processing
/channel/+tKjQsEgRPqY0ZGMy
/channel/elkornacio_chat
red_mad_robot и СберТех разработали мультиагентную систему, которая автоматически находит и исправляет уязвимости в коде ⚡
Она анализирует результаты SAST — статического анализа, который выявляет потенциально опасные места на этапе разработки. В системе несколько агентов: один собирает контекст, другой определяет, какие срабатывания действительно критичны, а третий формирует патчи и предлагает изменения в исходный код.
Результат — снижение ручной нагрузки, ускорение цикла исправлений и повышение точности анализа до 70 %.
В новой статье подробно рассказали, как устроена архитектура и зачем вообще нужен мультиагентный подход. Читайте!
#AI_moment #роботайм
↗️red_mad_robot