neuraldeep | Unsorted

Telegram-канал neuraldeep - Валера Ковальский

14059

Head of AI redmadrobot.com From IT Admin to Head of AI in 5 years Applied AI Engineer B2C RAG (2M+ books) B2B RAG platform (10+ implementations) B2C gptdaisy.com (100k MAU) github.com/vakovalskii | chat @neuraldeepchat To infinity... and beyond!

Subscribe to a channel

Валера Ковальский

SGR memory agent?
Бесконечная память у агента?

Паша задал хорошую планку закрепление теории о различиях между типами памяти для агентов на уровне инженерии этих агентов

Но не зря мы все копаем один наш проект sgr-core
Я в свою очередь взял вместе со своими ребятами из RnD, раскопал и адаптировал tool из репозитория mem-agent под наш SGR-пайплайн

Код кстати open-source, тут можете подглядеть как оно работает скоро выделим в отдельный репо это направление, как сделать так же, но интерфейса и всей той магии там не будет только базовый разбор репо на tool

Интерфейс увы пока не выкладывал в нем так сказать больше всего сил сконцентрировал

А дальше меня немного понесло)))
Решил довести все это до состояния, когда могу быстро проверять гипотезы как сделать такую штуку универсальной и наглядной для себя и экспериментов

И что же вышло?

Интерфейс с фичами:
Разделение областей знаний на юзеров
Транкейт диалога и бесконечный режим общения
Лимиты
Голосовой ввод (взял интеграцию со speechcoreai.com)
Возможность на лету менять модель сейчас больше всего экспериментов с gpt-4.1-mini и Qwen3-30B-A3B-Instruct-2507
Быстрая настройка основного системного промпта и редактирование докстрингов тулов прямо из интерфейса

Как работает память?

По факту у агента есть систем промпт и 15 тулов которые поваляют работать с долгосрочной памятью в режиме obsidian лайк подходе
Он комбинирует когда надо прочитать инфу о вас а когда можно пользоваться данными загруженными в диалог

Сейчас продолжаю эксперименты и ежедневно общаюсь со своим агентом
На скрине как раз структура, которую он сам создал вокруг нашего общения

Сейчас в эксперименте еще один режим работы постоянной памяти в виде саб-агента, который:
Анализирует диалог после каждого шага (возможно затратно)
Работает с долгосрочной памятью в формате MD (анализирует её тулами если были обновления)
Постоянно отжимает всё в компактную заметку не более 2К символов размером


Кто сидит в нашем чатике, уже видел побольше про этот проект и даже успел зарегаться)))
150+ юзеров зарегистрировалось
~20 человек постоянно ведут эксперименты(из за вас ввел лимиты, но за 1 неделю потрачено 10$ 🤣 вот она мощь sgr на мини модельках), а еще подкидываете мне новые сценарии, спасибо!


P.S Данный пост сделал дабы закрепить мысли об этом эксперименте

Как только соберу критическую массу идей расскажу где и зачем такое может пригодится и как оно работает на локальных моделях!

Читать полностью…

Валера Ковальский

🔥 Фотошоп от Daisy

Хочешь увидеть, как я справляюсь с ролью креативного редактора? Теперь я могу полностью преобразить фото. Добавить детали, поменять стиль, создать новую сцену, и всё это по твоему описанию.

📸 Просто загрузи снимок и напиши, что нужно изменить. Я аккуратно доработаю кадр — от Деда Мороза в стеклянном шаре до Человека-паука с идеальным фото для резюме.

⚡️ Daisy — AI-сервис для удобной работы с передовыми LLM. Работает без VPN.
🌼 @daisygpt_bot

#DaisyNews

Читать полностью…

Валера Ковальский

После нашего крутого Вайб Цех () хочу отметить еще один ивент на который пойду — Conversations

Кстати, до конца года будет еще 3-4 ивента на которых буду лично или выступать (ждите анонсов)

Часто вижу мало технических докладов, но в этот раз вижу сильные "названия":

Самокат про GenAI-поиск
От «что-то к чаю» до +N% к продажам: строим и масштабируем поисковый GenAI-сервис в Самокате — Арнольд Сааков, ecom.tech
Тут надеюсь что-то про разметку будет


MCP для оптимизации экономики
LLM для слов, MCP для цифр: как можно оптимизировать экономику проектов с помощью MCP-серверов — Иван Четвериков, Raft
Очень хочу послушать про MCP, надеюсь затронут локальные LLM


Conversations пройдет в Москве 5 декабря. Буду там в роли слушателя!

P.S. Полную программу можно посмотреть на сайте

Читать полностью…

Валера Ковальский

gpt-oss-safeguard-20b

https://openai.com/index/introducing-gpt-oss-safeguard/

https://huggingface.co/openai/gpt-oss-safeguard-20b


Очень хорошая новость (две новых модельки для guardrails)

Хочется отметить что на мой взгляд обучение своих моделей для задач модерации на базе BERT/Presido все еще актуально из за inference time

Но если вы небольшой стартап и у вас есть пару 4090 то мой рекомендасйон

Из коробки надо промптить под свои задачи (в целом ок, интересно что с SO у vLLM будет и как будут падать метрики так как ризон + SO не совместимы как я помню)

новость от сюда Data Secret

Читать полностью…

Валера Ковальский

Залипаю тут на проект https://nof1.ai/ — Live Arena, где модельки (Claude 4.5 Sonnet, DeepSeek V3.1 Chat, Gemini 2.5 Pro, GPT 5, Grok 4, Qwen 3 Max) соревнуются в трейдинге.

Реальные деньги, реальный рынок. Старт был 18 октября и продлится до 3 ноября.

К сегодняшнему дню DeepSeek уже удвоился, в то время как GPT 5 с Gemini в сильной просадке.

Из интересного в проекте — можно смотреть все сделки и логику принятия решения по каждому трейду.

Модельки — горячие трейдеры)) Меньше 10го плеча не заходят.

Закинуть что ли косарик на DeepSeek для теста?

@alexs_journal

Читать полностью…

Валера Ковальский

Вайб Цех 0.0.1

@neuraldeep & @Redmadnews

Вчера произошло наше первое оффлайн/онлайн мероприятие такого формата


Спасибо всем участникам за подготовку

Организаторам а именно отделу маркетинга red_mad_robot

Всем кто пришел, слушал нас онлайн, и задавал вопросы

Было круто!

Через несколько недель все материалы будут доступны я выложу на них ссылку (записи выступлений, презентации)

P.S было более 50 человек на нашей камерной площадке, спасибо за живое общение!

Читать полностью…

Валера Ковальский

Ребят чуть-чуть с задержкой

https://vkvideo.ru/video-13392530_456239377?list=ln-pPIqc3z8iMet9uSsCB


Подключаемся на трансляцию

Через ВК видео не работает, заходим через браузер 🥵

Читать полностью…

Валера Ковальский

Заходите в чатик, там будет трансляция начало в 10 по МСК


/channel/vibe_tseh_bot?start=68ecea57695764f721310ded

Читать полностью…

Валера Ковальский

Вайб Цех


Юхууу ребят!
Уже завтра разбираем, как AI меняет разработку
?😈


- SberAI про то, почему LLM так хороши в коде
- Яндекс GO от ChatGPT-юзера до вайб-кодера
- red_mad_robot как AI превращает разработчика в дирижёра
- Панельная дискуссия с Cloud.ru, ProSpace, GitVerse

230+ уже зареганы на онлайн.

Присоединяйся →
https://red-mad-robot.timepad.ru/event/3605115/

📅 25 октября, начало в 10:00 по МСК

Читать полностью…

Валера Ковальский

UPDATE OpenAI deactivating (пост тут)

Нашел причину бана своих акков! Вырубайте enable_preview_features=False

Оказалось проблема была не в IP и не в RU тексте

LiteLLM сливал все внутренние метаданные прокси напрямую в OpenAI

Что утекало

Если клиент передавал хоть какую то metadata (например sessionId в теле реквеста то LiteLLM добавлял к ней ВСЮ внутреннюю инфу прокси хотя должен был писать во внутренний лог

{
"metadata": {
"sessionId": "abc-123", // от клиента
"headers": { // ВСЁ ЭТО УТЕКАЛО
"x-real-ip": "1.2.3.4",
"x-forwarded-for": "5.6.7.8, ...",
"user-agent": "RestSharp/112.1.0"
},
"user_api_key_spend": 287.83,
"endpoint": "https://my-proxy.com/..."
}
}


OpenAI видел (лайт ллм душка прям все собирал)
Все IP адреса через x-forwarded-for
Что вы используете прокси
Информацию о расходах и ключах
User-Agent = автоматизация
Внутреннюю структуру сервиса

Бан 3 аккаунтов (одному было 2 года обидно)

Как это произошло

У меня появилось приложение клиент которого использует RestSharp для подключения к прокси (популярная C# библиотека 9.8k звезд) просто передавал sessionId для трекинга (честно не знаю то ли это клиент делает то ли разработчик)

metadata = new { sessionId = "abc-123" }

Прям внутрь реквеста к ллм
        "role": "user",
"content": "Привет! Как дела?"
}
],
"temperature": 1,
"metadata": {
"sessionId": "a5b3e26b-18c7-4017-9bcd-c2db6e450f78"
},
"stream_options": {
"include_usage": true
}
}'


И всё LiteLLM начинал сливать всю инфу в OpenAI

Код проблемы, пока нашел с курсором но передал так же людям проверить!

https://github.com/BerriAI/litellm/blob/main/litellm/proxy/litellm_pre_call_utils.py#L892

https://github.com/BerriAI/litellm/blob/main/litellm/proxy/proxy_server.py#L7855

https://github.com/BerriAI/litellm/blob/main/litellm/proxy/route_llm_request.py#L122

https://github.com/BerriAI/litellm/blob/main/litellm/llms/openai/chat/gpt_transformation.py#L436


Вы в зоне риска если
Используете LiteLLM Proxy
Клиенты передают metadata
Используете nginx перед LiteLLM
В РФ + VPS за рубежом

Большинство клиентов не передают metadata вообще и юзают обычные клиенты на питоне типа AsyncOpenAI
Но если хоть один клиент начинает использовать metadata утечка уже началась....


Кто на LiteLLM и ходит к openai напрямую проверьте это по списку

1 Проверьте логи что реально уходит к провайдеру (сделайте тест с передачей метадаты)
2 Временно запретите клиентам передавать metadata


UPDATE: необходимо вырубать enable_preview_features=False без него мы проверили трафик и все чисто)

Далее буду осторожнее
Со мной такое в первый раз (за один акк прям обидно 2 года ему было)

Читать полностью…

Валера Ковальский

«Личная эффективность: как хоть что-то успевать в 2025?»


Сразу спойлер НИКАК

Но я точно знаю ребята разберут этот кейс со своих сторон!

#безвотэтоговотвсего

Сегодня Серега снова проводит пушечную крутую 21 встречу с топ спикерами!


P.S. Для тех, кто не успел зарегистрироваться - ссылочки на трансляции:

VK Video
Yotube


И кстати более детально я так же разберу личную эффективность с ИИ кодерами на нашей конфе (успей попасть на регу)

Читать полностью…

Валера Ковальский

SGR-паттерн

Еще один очень крутой разбор когда и где нужно применять наше решение


Читать тут:
/channel/countwithsasha/320


Репо: https://github.com/vamplabAI/sgr-deep-research

Читать полностью…

Валера Ковальский

Qwen3-vl-32b вышла

https://huggingface.co/Qwen/Qwen3-VL-32B-Instruct


Разворачиваю и выдаю доступ?)
Готовы тестить?

Тут нам нужно будет две 4090(48гб) и такие есть у меня, пошел выкачивать…✈️

Читать полностью…

Валера Ковальский

Я дождался мы завезли Артефакты!

Читать полностью…

Валера Ковальский

SGR Challenge?

Шучу, Ринат открыл регистрацию на ERC3 не упусти возможность найти новые скиллы/друзей/общение/работу

Кто-то уже в нашем чатике берет и разворачивает наш проект что бы быстро пилить тулы под соревнование

Ты уже развернул sgr-core?

P.S сегодня будет релиз в main выкатим стабильную ветку из бенчмакра!

Следите за обновлениями: https://github.com/vamplabAI/sgr-deep-research

Читать полностью…

Валера Ковальский

На сегодня хватит интернетов 🤣

Читать полностью…

Валера Ковальский

Startup pack от Kovalskii как за вечера собрать два MVP?

Меня спросили, какой стек я использую для запуска MVP и что
легко упаковывается для проверки гипотез через AI Coding

Покажу на примере двух проектов, которые активно развиваю по вечерам сам

1) https://speechcoreai.com/ — ASR платформа

Frontend

Vue.js 3 + TypeScript + Vite, Pinia для стейта, TailwindCSS

Browser Extension

Vanilla JavaScript, Chrome Manifest V3

Backend

FastAPI + Uvicorn, MongoDB + Motor async, Redis для очередей и кеша, MinIO как S3-хранилище

Auth

Google OAuth 2.0, JWT tokens

AI/ML

WhisperX + PyTorch CUDA, OpenAI API для саммаризации, WebSockets для real-time

Infrastructure

Docker Compose, Nginx

Железо: Ryzen 9 + 64GB RAM + RTX 4500


Время разработки: 4 недели по вечерам + помощь Артема


2) https://chat.sgr-core.com/ — Research AI агент

Второй MVP собрал за 3 дня, переиспользуя наработки из первого

Frontend

Vue 3 + TypeScript + Vite, Feature-Sliced Design

Backend

FastAPI + PostgreSQL 18 (вместо MongoDB), asyncpg connection pool, Server-Sent Events для стриминга

Auth

Google OAuth 2.0, JWT через python-jose

Search & AI

Tavily API + trafilatura, Schema-Guided Reasoning,
Multi-tool orchestration,
OpenAI SDK async для работы с моделями,
Memory через файловую систему

Infrastructure

Docker Compose, PostgreSQL + Adminer, Nginx (Знакомо? ага все сложное очень просто)

Железо: VPS с 4 ядрами и 8GB RAM

Тут уже справился почти в одиночку (первый драфт фронта собирал senior фронт далее я его забрал на ai код доработки)


Что переиспользуется между проектами

Frontend Vue 3 + Vite + Pinia проверенный стек
FastAPI + Pydantic быстро и типобезопасно
Auth Google OAuth + JWT без переписывания
Работа с моделями OpenAI SDK async паттерны
Docker Compose одна команда запуска
Nginx знакомая конфигурация (быстрый конфиг и upstream)


Моя рекомендация

Не обвязывайся на старте Vercel/Supabase/AWS сервисами


Первый проект живет на обычном сервере: Ryzen 7 + 32GB RAM + RTX 4070
Второй на простой виртуалке: 4 ядра + 8GB RAM

Зачем оверкилл? (Увидел у ребят в одном видосе как они на k8s собирают проект шаблонизатор с кол-во юзеров ну максимум 1rps обеспечат в пик)

Не стоит упарываться в k8s или федеративное масштабирование для MVP!
Если не уверен, что обеспечишь прирост пользователей x100-x1000 от друзей и комьюнити не борщи

Могу привести в пример несколько проектов которые знаю что ребята живут на 1-2 виртуалках чуть ли не через screen запуская свой продукт и делают ставку на привлечение пользователей а не на ублажение арх паттернов, оставьте эти решения до 1 млн MAU и 100 rps к базе

Как я вижу чаще продукты решают масштабирование по мере роста, а не заранее (только если не уверены в том что знают как дотянутся до аудитории)


Держи базовый стек знакомым Vue + FastAPI + Docker (пример)
Переиспользуй auth и работу с моделями
Меняй только критичное под задачу
Валидируй гипотезу, а не архитектуру

От идеи до рабочего MVP: 3-6 недели по вечерам (при моей загрузке)

Стек выше самодостаточен для проверки идей и может быть переиспользован (сохраняй!)

P.S Не истина в последней инстанции, делитесь и вашими паками в комментариях!

Читать полностью…

Валера Ковальский

Други, дорогие, Вы очень многое сделали для канала. Пришла благая весть, наш админ попал в историю. Хорошую.

Он в шорт-листе премии RuCode2025

И ему нужна Ваша поддержка)

https://vk.com/wall-44001716_10214

Дядя - Абрамов Александр)

Читать полностью…

Валера Ковальский

Попытал удачу на реддит

https://www.reddit.com/r/LocalLLaMA/comments/1ohh1l2/86_accuracy_on_simpleqa_with_gpt41mini_opensource/

А вдруг)))

ROMA так и поднял 5к звезд


P.S Накидайте + плиз

Читать полностью…

Валера Ковальский

Ищем стажёра-исследователя в мою команду R&D red_mad_robot

Ты будешь на передовой технологий: исследовать тренды, тестировать идеи и собирать прототипы. Работать в команде с исследователями, техписателями и продакт-менеджерами. Поэтому когда чего-то не знаешь — поможем разобраться и поддержим на каждом этапе.

Если тебе в кайф разбираться в сложных темах и создавать новые решения — нам по пути.

Что ждёт тебя
- участие в реальных R&D-проектах в области машинного обучения и обработки естественного языка;
- разработка прототипов и проведение исследований на Python;
- работа с LLM: промпт-инжиниринг, API (Hugging Face, OpenAI), архитектура трансформеров (BERT, GPT);
- анализ данных и их подготовка.

Что важно
- базовые знания Python и работы с данными;
- понимание train/val/test, overfitting и других основ ML/NLP;
- интерес к LLM и желание развиваться в этой области;
- самостоятельность и внимательность к деталям.

Что предлагаем
- участие в проектах, которые двигают рынок технологий;
- менторство от экспертов red_mad_robot;
- возможность работать удалённо или из офиса;
- белую зарплату, ДМС и все привычные плюшки.

Мы верим, что R&D — это возможность создавать новое, а не просто выполнять задачи.

Отправляй резюме и портфолио в @VaKovaLskii

P.S присылай в лс с тегов #red_mad_robot

Читать полностью…

Валера Ковальский

https://vkvideo.ru/video-13392530_456239377?list=ln-pPIqc3z8iMet9uSsCB

В очередной раз обновили ссылку теперь и в ВК видео работает

Читать полностью…

Валера Ковальский

Пост для вопросов к митапу

Читать полностью…

Валера Ковальский

N8N+SGR

Вы конечно жестко умеете мотивировать 200+ реакций

Миша за сегодня все оформил и выложил, встречаете!

Репо_форк:
https://github.com/vamplabAI/n8n-nodes-sgr-tool-calling


Репо_main: https://github.com/MiXaiLL76/n8n-nodes-sgr-tool-calling


Скачать готовую ноду: https://www.npmjs.com/package/n8n-nodes-sgr-tool-calling

Делимся в коментах куда будете интегрировать!

Читать полностью…

Валера Ковальский

n8n+SGR?

Кастомная нода?

Автор: @mixaill76

Ждемс

Чем больше огоньков, тем быстрее Миша выпустит это в open source, а мы с ним запишем стрим как это все быстро настроить 🔥

Миша подключился прогревать вас, переосмысленное посторонние ReAct агентов: /channel/neuraldeepchat/22012

Читать полностью…

Валера Ковальский

Вайб Цех

Первый раз в жизни собираю митап!

Когда мы прогоняли сегодня с ребятами материал для конфы я понял, мы собрали реально очень полезную инфу для вас!

И от 0 и до 100 по сложности есть!

Значит будет интересно!

Ссылка на онлайн стрим https://red-mad-robot.timepad.ru/event/3605115/

25.10.2025


Дядя вещает вещи: /channel/dealerAI

Читать полностью…

Валера Ковальский

Cтабильный релиз sgr-core 0.3.0

What's Changed

fix tool calling agent _select_action_phase behaviour by virrius in #45
Simple cli example client for getting started and testing by kv-gits in #32
Benchmark simpleqa by maksimov-m in #43
Feat: Декомпозиция и перенос тулов в пакет core.tools by EvilFreelancer in #48
Fix/remove dynamic date from prompts by vakovalskii in #51
New readme and contributing by maksimov-m in #49



Навели красоту в README и с логикой агента в цеом
Закрепили результаты бенчмарка

Продолжаем улучшать!

Всем причастным огромное спасибо!


Релиз: https://github.com/vamplabAI/sgr-deep-research/releases/tag/0.3.0

Читать полностью…

Валера Ковальский

1 фотка DS в обычной компании
2 фотка DS в промышленной

authors

@mixaill76
@MartianovTech

Читать полностью…

Валера Ковальский

🧑‍💻 Визуализируй код прямо в чате

Теперь я умею рендерить HTML-код. Попроси меня написать код для сайта, презентации или слайда. Нажми «Развернуть» и сразу увидишь, как идея превращается в готовый результат. Это удобно, если нужно проверить вёрстку или визуализировать концепт перед показом команде. В следующих релизах появится возможность экспортировать такие артефакты, чтобы делиться ими вне Daisy.

Попробуй собрать свой первый HTML-слайд прямо сейчас 👇

⚡️ Daisy — AI-сервис для удобной работы с передовыми LLM. Работает без VPN.
🌼 @daisygpt_bot

#DaisyNews

Читать полностью…

Валера Ковальский

Тем временем наше комьюнити энтузиастов растет


Дошли до 3 топоров


Наш топ чатик: /channel/neuraldeepchat

Где я еще обитаю:

/channel/llm_driven_products
/channel/natural_language_processing
/channel/+tKjQsEgRPqY0ZGMy
/channel/elkornacio_chat

Читать полностью…

Валера Ковальский

red_mad_robot и СберТех разработали мультиагентную систему, которая автоматически находит и исправляет уязвимости в коде

Она анализирует результаты SAST — статического анализа, который выявляет потенциально опасные места на этапе разработки. В системе несколько агентов: один собирает контекст, другой определяет, какие срабатывания действительно критичны, а третий формирует патчи и предлагает изменения в исходный код.

Результат — снижение ручной нагрузки, ускорение цикла исправлений и повышение точности анализа до 70 %.

В новой статье подробно рассказали, как устроена архитектура и зачем вообще нужен мультиагентный подход. Читайте!

#AI_moment #роботайм

↗️red_mad_robot

Читать полностью…
Subscribe to a channel