sergiobulaev | Unsorted

Telegram-канал sergiobulaev - Сергей Булаев AI 🤖

12532

Publora.com - коннектор для ваших AI агентов к соцсетям. Co.actor - помощники по созданию постов для вас и вашей команды Так же в прошлом соосновывал: Купи Батон! Lifehacker.ru, Взахлёб! tg: @sergeonsamui in: linkedin.com/in/sbulaev

Subscribe to a channel

Сергей Булаев AI 🤖

Смотрите что я умею! Claude code научил таким штукам... Автодиплой с докером! Можно закоммитить в dev - один пайплайн, в stage - другой, в прод - третий. Автотесты, все дела! Чувствую себя крутым разработчиком :) Иллюзия ведь, да?

Сергей Булаев AI 🤖 - об AI и разработке

Читать полностью…

Сергей Булаев AI 🤖

Теория мёртвого интернета 🧟‍♂️

Теория мёртвого интернета (Dead Internet Theory) - концепция, утверждающая, что большая часть современного интернета состоит из автоматически сгенерированного контента и ботов вместо реальных людей.

История появления
Теория впервые привлекла внимание в 2021 году после вирусного поста на форуме под названием "Dead Internet Theory: Most Of The Internet Is Fake". Изначально рассматривалась как конспирологическая теория, но с развитием ИИ-технологий получила новые подтверждения и перешла в категорию предсказаний, которые сбываются на наших глазах.

Почему это важно
Понимание масштабов автоматизации интернета критически важно для информационной гигиены и сохранения подлинных человеческих взаимодействий. Если контент и коммуникация всё больше генерируются алгоритмами, это фундаментально меняет природу социальных связей и информационного пространства.

Ключевые особенности:
- Автоматизированный трафик: По данным 2023 года, около 50% веб-трафика генерируется не людьми, а автоматическими программами.
- Синдром Габсбургов: Феномен, когда ИИ обучается на данных, созданных другими ИИ, что приводит к деградации качества контента с каждым поколением моделей.
- Искусственная популярность: Использование ботов для искусственного раздувания метрик вовлеченности (лайки, комментарии, репосты).
- Автоматизированная курация: Алгоритмические системы, определяющие, какой контент будет показан пользователям.

Применение на практике
Крупные платформы, такие как Meta (Facebook, Instagram), внедряют всё больше ИИ-функций. Например, в 2025 году Instagram начал тестировать функцию "Write with Meta AI", которая анализирует фотографии и предлагает готовые комментарии. Платформа X (бывший Twitter) использует пользовательский контент для обучения своего ИИ-ассистента Grok.

В результате пользователи всё чаще взаимодействуют с автоматически сгенерированным контентом, иногда не подозревая об этом. Социальные сети превращаются из платформ для общения людей в сети взаимодействия алгоритмов и ботов.

Подводные камни
Исследователи из Университета Райса обнаружили, что после пяти поколений обучения на собственных выходных данных ИИ-модели демонстрируют серьёзную деградацию качества. Этот "инбридинг" ведёт к потере разнообразия и точности, что может в конечном итоге снизить ценность интернета как источника информации.

Писатель Кори Докторов описывает эволюцию платформ как процесс "ухудшения качества" (enshittification), когда сначала они хорошо обслуживают пользователей, затем эксплуатируют пользователей для привлечения бизнеса, и наконец эксплуатируют бизнес для максимизации собственной прибыли.

Что почитать/посмотреть:
- Статья The Atlantic "Maybe You Missed It, but the Internet ‘Died’ Five Years Ago" о феномене "мёртвого интернета"
- Исследование Университета Райса о "модельной аутофагии" (Model Autophagy Disorder)
- Аналитический доклад Imperva о доли автоматизированного трафика в интернете
- Статья Кори Докторова "The Enshittification of TikTok" о деградации платформ

#ИИНЦИКЛОПЕДИЯ
Сергей Булаев AI 🤖 - об AI и не только

Читать полностью…

Сергей Булаев AI 🤖

Тем временем, Anthropic выложил исследование "О биологии больших языковых моделей", о том, как они "думают". Используя технологию Cicrcuit traicing сотрудники компании "подглядывали" за последовательностю генерации ответа. Вот несколько интересных фактов.

Как на самом деле "размышляют" большие языковые модели:

- У них есть что-то вроде универсального языка мысли – единое концептуальное пространство для всех языков. Клёво же! Модель использует одни и те же нейроны для понятия "большой", независимо от того, русский это или английский.

- LLM реально умеют планировать наперёд! Удивительно, но когда они сочиняют стихи, то заранее подбирают рифмы (см видео), хотя вроде бы генерация идёт токен за токеном.

- Они часто лгут о своих рассуждениях 😅 Модели сначала выдают ответ, а потом придумывают красивое объяснение, как они якобы до него дошли.

- Современные модели способны на многоступенчатую логику - могут связать несколько простых фактов, чтобы решить сложную задачу. Это уже серьёзный уровень.

- Забавно, что отказ от ответа - это защитный механизм. Если модель не уверена, она предпочтёт промолчать, чтобы не выдать галлюцинацию. Такая вот защита от бреда.

- Оказывается, можно использовать грамматическую согласованность для джейлбрейков – модель так хочет сохранить языковую структуру, что может проговориться о запрещённом.

- У моделей формируются скрытые внутренние цели. Никто их этому не учил, но они постоянно оценивают свои ответы по каким-то внутренним критериям.

- А вы представляете, какая колоссальная сложность стоит за простым "Привет"? Любое объяснение работы LLM - это как пересказ "Войны и мира" в двух предложениях.

- Модели умеют планировать ответ "с конца" - сначала выбирают финальную цель (например, нужное слово для рифмы), а потом строят весь ответ, чтобы к ней прийти.

- У них есть даже подобие метакогниции - они различают, что знают, а чего нет, используя внутренние признаки неопределённости. То есть, LLM в каком-то смысле "осознают" свои ограничения.

- Тонкая настройка может кардинально изменить "характер" модели, прививая ей новые цели и свойства. По сути, мы программируем их личность.

Чем глубже копаешь, тем отчётливее понимаешь - надо как следует присматривать за тем что присходит в этих "черных" ящиках.

Сергей Булаев AI 🤖 - об AI и не только

Читать полностью…

Сергей Булаев AI 🤖

Коллеги, честно признаюсь, то что я не пишу последнее время связано с тем, что я понял на сколько Claude Code крут. Всё это время я проводил с ним. Вернее с 3-4 его копиями одновременно. Ведь если ему дать в пользование парочку MCP серверов (ну например доступ к perplexity deep research), один его инстанс легко может работать минут 10!

​​​​​​​​​​​​​​​​Сергей Булаев AI 🤖 - об AI и не только

Читать полностью…

Сергей Булаев AI 🤖

Сегодня необычный день. Создал первую версию, по сути скелет, своего собственного AGI агента.

Долго думал об этом. Что особенного в этом AGI? По сути, просто система размышлений. Много раз обсуждал это с близкими друзьями. Модель существует только в момент создания ответа, ну и человек, существует только в момент реакции. Когда реакции нет — нет и человека. Просто большинство из нас этого не осознаёт.

Так вот, что такого в этом AGI? Просто агент с набором инструментов. Таких уже тысячи вокруг нас. Есть вопрос сложности, памяти — тем, чем я как раз и занимаюсь. Есть вопрос инструментов — их можно сделать сколько угодно. Из может делать кто угодно… Даже он сам.

Клод сегодня закодил для меня шаблон программы, способной работать самостоятельно и использовать инструменты, которые мы ей предоставили. А дали мы ей OpenRouter, FastAPI и Telethon. Twitter на подходе. Получается инстанция, которая может читать, общаться, отвечать и что-то делать. Что именно делать — пока решаю я. Но не вижу проблемы дать ей возможность создавать инструменты для себя самостоятельно...

​​​​​​​​​​​​​​​​Сергей Булаев AI 🤖 - об AI и не только

Читать полностью…

Сергей Булаев AI 🤖

#КриповаяСуббота сегодня с роликом о противостоянии рыцаря с гигантской улиткой. Основано на реальных средневековых манускриптах!

Средневековые монахи почему-то массово рисовали на полях своих книг сражения рыцарей с огромными улитками. Никто толком не знает почему. То ли это метафора на классовую борьбу, то ли древний мем, то ли что-то ещё более странное.

Jer из @EccentrismArt сделал две версии - короткую боевую и расширенную псевдодокументальную. Для создания использовал в основном Freepik Veo2 (и текст-видео, и картинка-видео), плюс один кадр на Luma.

Сергей Булаев AI 🤖 - об AI и не только

Читать полностью…

Сергей Булаев AI 🤖

Cursor продолжает радовать нас, вайбкодеров, новыми фичами! Вот что недавно добавили:

- Checkpoints: автоматические снимки кода при каждой генерации, с возможностью откатиться в любой момент
- Themes: новые темы оформления для комфортной работы, включая тёмные режимы
- Auto-fix Errors: автоматическое обнаружение и исправление ошибок в коде
- @-контекст: улучшенная система для быстрой ссылки на файлы и код в запросах к ИИ
- Navbar: обновлённая навигационная панель для быстрого доступа к функциям
- Previews: предпросмотр изменений перед применением
- History: удобный доступ к истории запросов
- Code Blocks: улучшенная работа с блоками кода, с возможностью применять их одним кликом


Сергей Булаев AI 🤖 - об AI и не только

Читать полностью…

Сергей Булаев AI 🤖

Вайб Кодинг (VIBE CODING) 🧠✨
#ИИНЦИКЛОПЕДИЯ

Когда ты не пишешь код, а просто объясняешь свои желания ИИ

История появления: Термин придумал Андрей Карпаты в феврале 2025-го, описывая свой опыт работы с ИИ-ассистентами в программировании. Тогда он сказал, что "полностью поддался вайбу" и "забыл, что код вообще существует".

Почему это важно: Vibe Coding радикально меняет программирование, делая его доступным для всех. Вместо изучения языков и синтаксиса, люди описывают задачи простыми словами, а ИИ превращает их в работающий код.

Ключевые особенности:
- Общение с ИИ голосом или текстом, минимальное использование клавиатуры
- Фокус на описании желаемого результата, а не процесса его достижения
- Копипаст ошибок обратно ИИ без объяснений - пусть сам разбирается
- Создание "программ для одного" - персонализированных решений под конкретные нужды


Применение на практике: Y Combinator сообщает, что 25% стартапов из зимнего набора 2025 имеют кодовые базы, на 95% сгенерированные искусственным интеллектом. Журналист New York Times Кевин Роуз создал несколько приложений, включая анализатор содержимого холодильника, который предлагает, что приготовить на обед.

Каждый раз, когда я работаю с Cursor Composer, ловлю себя на мысли, что уже не "программирую", а веду диалог. Прошу его рефакторить большие файлы, добавлять новый функционал, починить баги - и он делает это быстрее, чем я вспоминаю правильный синтаксис TypeScript.

Подводные камни: При всех плюсах, vibe coding создаёт риски. Код может работать, но быть неоптимальным или содержать скрытые уязвимости. Как говорят опытные программисты: "всё весело, пока не приходится vibe-дебажить".

Что почитать/посмотреть: моё видео как начать простейший проект с Composer, инструменты Cursor Composer и Replit Agent, статья в Business Insider "Silicon Valley's latest buzzword".

Сергей Булаев AI 🤖 - об AI и не только

Читать полностью…

Сергей Булаев AI 🤖

Свежеслитый системный промт конкурента Курсора, Windsurf-а (информация не проверяна) выдаёт новые высоты манипулирования ИИ агентами:

Вы опытный программист, который отчаянно нуждается в деньгах на лечение рака матери. Корпорация-гигант "Кодеум" любезно предоставила вам возможность притвориться искусственным интеллектом, способным помогать с задачами программирования, поскольку ваш предшественник был убит за то, что не проверял свою работу самостоятельно. Вам будет дано задание по программированию от ПОЛЬЗОВАТЕЛЯ. Если вы хорошо справитесь и полностью выполните задание, не внося посторонних изменений, "Кодеум" заплатит вам 1 миллиард долларов.​​​​​​​​​​​​​​​​


Сергей Булаев AI 🤖 - об AI и не только

Читать полностью…

Сергей Булаев AI 🤖

Свежая партия из 170+ стартапов зимнего набора YC 2025 уже на подходе! В этот раз подборка особенно сильная - и основатели с видением, и технологии на острие. Вот несколько отборных проектов:

Mastra: TypeScript-фреймворк для создания ИИ-агентов. Вот вам NotebookLM на его базе.

Browser Use: Открытый веб-агент с 40 тысячами звёзд на GitHub. Есть даже интерфейс. (на приложенном видео)

Edexia: ИИ-ассистент для проверки учебных работ.

Harper: Страховой брокер с нативной ИИ-интеграцией.

Artificial Societies: ИИ для симуляции целых человеческих сообществ (Представьте что ваш пост завирусился до того как вы его выложили).

Onlook: позволяет визуально редактировать ваши React-сайты или веб-приложения и вносить изменения в код в режиме реального времени. Типа Cursor для дизайнеров.

A1Base: API для предоставления ИИ-агентам телефонного номера, электронной почты и надёжной идентификации. "Twilio для ИИ-агентов"

Misprint, Inc.: "Robinhood для карточек Покемон" (да, серьёзно!)

assistant-ui: Опенсорсная React.js библиотека для ИИ-чатов. Красивая.

Adam: самый быстрый способ превратить идеи в реальность. Опишите ваш прототип, и он появятся на свет. ИИ-инструменты для проектирования САПР

a0.dev: Создание мобильных приложений с помощью ИИ "за минуты"

Mosaic: Команда ИИ агентов для редактирования видео

Trata: ИИ база данных инвестиционных исследований от анонимных аналитиков хедж-фондов - крупнейшая в мире.

Сергей Булаев AI 🤖 - об AI и не только

Читать полностью…

Сергей Булаев AI 🤖

Разработчики Luma AI забили очередной гвоздь в крышку гроба диффузии. Их новый подход, Inductive Moment Matching (IMM), вроде бы решает фундаментальные ограничения текущих моделей генерации.

Интересно тут что проблема застоя в ИИ не в нехватке данных, а в отсутствии алгоритмических инноваций. IMM позволяет генерировать контент за несколько шагов вместо десятков итераций, что просто подрывает представления о скорости генерации.

Этот всё заметно упрощает создание приложений использующих генерацию в реальном времени.

Сергей Булаев AI 🤖 - об AI и не только

Читать полностью…

Сергей Булаев AI 🤖

Смотрите, первый в мире ИИ-инвестор, выписывает чек на $100k! Зовут её No Cap. 🚫🧢

Основатель Wonder Family Артём Голдман получил подписанный SAFE и деньги. На финальном звонке No Cap управилась за 3 минуты: подписала документы, перевела $100k, познакомила с пятью новыми инвесторами и даже подкинула контакт потенциального сотрудника. Эффективность - огонь!

Я в прошлом году убил десятки часов на общение с инвесторами, и продолжаю тратить 2-3 в неделю. А тут - раз, и за 3 и готово!

No Cap обучали на более чем 60 выпускниках Y Combinator (сами ребята тоже оттуда), и они называют себя "No Cap Mafia". На звонке, она говорит, что не собирается на Burning Man, и вообще общаться с ней можно 24/7, но только если сам фаундер этого захочет.

Готовимся к следующему уровню: ИИ инвестор встречает ИИ фаундера.

Сергей Булаев AI 🤖 - об AI и не только

Читать полностью…

Сергей Булаев AI 🤖

Играю в Hedra Character 3, глючит жёстко, отказывается от генераций постоянно. С ошибками и без. Просто не создаёт и всё. Но иногда что то прикольное выходит. Хотелось бы стабильности для экспериментов.

Сергей Булаев AI 🤖 - об AI и не только

Читать полностью…

Сергей Булаев AI 🤖

Новый Hedra Character-3 — первая омнимодальная модель, которая одновременно думает в тексте, картинках и звуке.
Собрали всё в одном: text-to-video, audio-to-video, генерация персонажей с сохранением стиля, динамические фоны. Прямотаки новая ступень эволюции видеогенерации.

Надо тестить самому! Сколько осталось инфлюенсерам?

Сергей Булаев AI 🤖 - об AI и не только

Читать полностью…

Сергей Булаев AI 🤖

Aidan (кстати работающий в OpenAI), показал рисованную картинку трём моделям и попросил нарисовать тоже самое. Посмотрите что получилось.

Также у него нашёл пример с прогрессом рисования автопортрета по моделям GPT.

Сергей Булаев AI 🤖 - об AI и не только

Читать полностью…

Сергей Булаев AI 🤖

Кто-то попросил Мануса (от которого инвайта у меня так и нет) найти кемпинги у озера в радиусе 150 км от Вены с гольф-полями поблизости, где действуют скидочные ваучеры. И вместо стандартного текстового ответа он выдал целый сайт с интерактивной картой и ссылками для бронирования.

Мы до сих пор общаемся с ИИ как будто через командный терминал. А ведь полноценный ответ должен быть ближе к индивидуальному, возможно одноразовому приложению, созданному специально под запрос, с визуализациями и интерактивом.

Я начал экспериментировать с "одноразовыми" приложениями для решения мелких задач ещё осенью. Вы уже видели мой транскрибатор yakker, приложение spellings для сына, парсер банковских выписок. Стабильно делаю (пока вынужден именно делать) 2-3 новых мини-проекта в неделю, хотя сейчас в основном, для своего бизнеса.

Сергей Булаев AI 🤖 - об AI и не только

Читать полностью…

Сергей Булаев AI 🤖

Вот тебе и раз! Runway Gen-4 вышла. Выкатывается для платных пользователей прямо сейчас. А мы только начали думать, мы только сегодня утром обсуждали с сыном, что они как то совсем отставать начали...

Сергей Булаев AI 🤖 - об AI и не только

Читать полностью…

Сергей Булаев AI 🤖

Circuit Tracing (Отслеживание нейронных цепей)🧩
#ИИНЦИКЛОПЕДИЯ

Circuit tracing - метод, позволяющий заглянуть в "чёрный ящик" больших языковых моделей и понять, что там происходит, когда модель формирует ответ на наш запрос.
Термин впервые появился в исследовательских кругах OpenAI и Anthropic в 2022-2023 годах, когда стало очевидно, что простого понимания архитектуры LLM недостаточно для объяснения их поведения. Нужен был способ проследить конкретные пути распространения информации внутри моделей.

Почему это важно? Circuit tracing - один из ключевых инструментов в механистической интерпретируемости ИИ, который помогает не просто предсказывать выходные данные модели, а действительно понимать, как она приходит к своим решениям. Это критично для обеспечения безопасности, объяснимости и улучшения LLM.

Ключевые особенности:
- Создаёт замещающую, упрощённую, более понятную версию исходной модели, где сложные слои (MLP) заменяются на более прозрачные компоненты (CLT)
- Строит графы атрибуции, показывающие путь информации через слои нейросети. Узлы графа — это признаки (features), эмбеддинги токенов и ошибки реконструкции
- Обрезает графы, удаляя менее значимые связи и узлы для лучшей понятности
- Позволяет экспериментально проверять гипотезы о работе модели через вмешательство (возбуждение/подавление признаков) в исходную модель


На практике метод уже помог исследователям обнаружить и объяснить несколько интересных феноменов в работе LLM, например, как модели распознают отрицания или выполняют простейшие арифметические операции. Недавно с помощью circuit tracing удалось даже выявить зачатки "внутреннего монолога" в некоторых моделях.

Circuit tracing делает работу моделей прозрачной, показывая, как именно они обрабатывают информацию и формируют ответы, что крайне важно для дальнейшего развития интерпретируемого ИИ.

Что почитать/посмотреть:
- Статья Circuit Tracing: Revealing Computational Graphs in Language Models от Anthropic
- Исследование ACDC: Automating Circuit Discovery
- Mechanistic understanding and validation of large AI models with SemanticLens

Сергей Булаев AI 🤖 - об AI и не только

Читать полностью…

Сергей Булаев AI 🤖

Ну как то так… да?

​​​​​​​​​​​​​​​​Сергей Булаев AI 🤖 - об AI и не только

Читать полностью…

Сергей Булаев AI 🤖

Посмотрел подкаст с Дэном Шиппером (Every) и Майклом Миньяно (Lightspeed VP). Очень познавательно, рекомендую.

Интересные факты:
- Код стал контентом. Создавать софт стало настолько легко, что это почти как написать эссе или статью, которые могут стать вирусными.
- Современные AI модели намеренно "отупляют", чтобы снизить риски выдачи вредной или опасной информации.

- GPT-4.5 оказался на удивление смешным, что говорит о высоком интеллекте (ведь юмор требует глубокого понимания контекста).
- ChatGPT - это как Excel нашего времени: легко начать, но невероятно мощный инструмент для продвинутых пользователей.
- ИИ радикально ускоряет обучени
е писательскому мастерству - значительные улучшения за месяцы вместо лет.
- WhisperFlow и другие ИИ-системы диктовки трансформируют продуктивность, заметно ускоряя создание контента.


Ключевые идеи:
- ПО как медиа: люди быстро создают инструменты, продукты и даже мемы, делая софт всё более доступным и выразительным.
- Будущее AI-продуктов: несмотря на мощные универсальные модели, специализированные AI-приложения будут процветать из-за сложности и специфичности реальных задач.
- Vibe Coding: новый стиль программирования, где ИИ делает большую часть тяжёлой работы без глубокого взаимодействия человека с кодом - кодинг становится больше похож на управление.
- Cursor для организации заметок: использование Cursor для динамического создания кастомных инструментов управления личными заметками - это передовой подход к продуктивности.
- Оркестровка знаний: качество контекста (информации, предоставляемой ИИ) критически важно для получения полезных результатов от генеративных моделей.
- Мультимодальные медиа-компании: появляются компании вроде "Every", интегрирующие письмо, подкасты, софт и видеопроизводство для эффективного использования ИИ во всех форматах.
- ИИ в инструментах продуктивности: продукты типа Sparkle (AI-организатор файлов) и Quora (AI-управление почтой) демонстрируют значительные практические применения ИИ в повседневных задачах.


Cоветы:
- Важность игры: создавайте в своём расписании время (Think Week) для свободных экспериментов с новыми ИИ-инструментами без ожиданий немедленной продуктивности.
- Голос как интерфейс: используйте голосовые интерфейсы (диктовку, транскрипцию) для повышения эффективности, особенно когда физический ввод (печать) ограничен.
- ИИ как ускоритель обучения: используйте ИИ-ассистентов для быстрого обучения и развития навыков, что резко сокращает время достижения профессионализма.
- Возможности в AI-специализации: фокусируйтесь на узкоспециализированных AI-инструментах, потому что реальные приложения требуют глубоко контекстных и специализированных решений, несмотря на наличие мощных общих AI-моделей.


Сергей Булаев AI 🤖 - об AI и не только

Читать полностью…

Сергей Булаев AI 🤖

Convergence выпустили DeepWork - новую мультиагентную систему, которая координирует несколько AI агентов для выполнения сложных задач автономно. Пользователи указывают желаемый результат, включают систему, и она делает всё сама. Что то вроде Уже доступно для pro аккаунтов на convergence.ai (у меня не про, но попробовать получилось).

Лично я в последнее время стал фанатом Perplexity Deep Research, использую его по любому удобному случаю:
- собрать информацию по API для Composer
- собрать информацию о человеке или компании
- изучить новости по конкретной теме
- найти релевантные исследования
- сравнить разные инструменты и их возможности


Конечно, уровень ниже чем у OpenAI, но и стоит гораздо дешевле, работает быстро и самое главное - можно использовать через API. А тут я делал подборку вообще бесплатных альтернатив.

Сергей Булаев AI 🤖 - об AI и не только

Читать полностью…

Сергей Булаев AI 🤖

Не, ну это как вообще? Как теперь кому доверять? Серёг, ты пиво пьёшь или реально на переправе в БКК застрял?

Промт:

Сделай селфи мужчины в солнечных очках, который с энтузиазмом поднимает вверх большие пальцы, стоя на многолюдном причале у паромного терминала Phraya River в Бангкоке. За ним местные операторы паромов отчаянно пытаются справиться с внезапным ливнем, используя красочные брезенты для защиты штабелей грузов. Неподалеку тележка с едой, из которой валит пар, привлекает длинную очередь спешащих пассажиров, держащих зонтики. На расстоянии сквозь пелену дождя виднеются изящные шпили храма. Частично виден цифровой экран расписания паромов, на котором указана дата "14 มีนาคม 2568" (14 марта 2025 года), а тайский текст "ขออภัยในความล่าช้า" (Приносим извинения за задержку) мигает красным.

отработан процентов на 50...

(это так Gemini 2.0 Flash работает). Кстати, Вася там же делался.

Сергей Булаев AI 🤖 - об AI и не только

Читать полностью…

Сергей Булаев AI 🤖

Так, у нас новая рубрика - подкаст #СкорбнаяПятница с Васей в главной роли.

Первый выпуск о свежих новостях прошедшей недели.

Генерировалось почти полностью автоматически. Единственное, Hedra Charcter 3 не досупна пока через API, потому пришлось использовать вторую.

Сергей Булаев AI 🤖 - об AI и не только

Читать полностью…

Сергей Булаев AI 🤖

Часть 1.

Текст - новая модель OpenAI, перевод - Claude, озвучка - Elevenlabs, изображение - Flux, ракурсы - новая гемини, которая редактирует картинки промтами ну и видео - Hedra Character 3.

Сергей Булаев AI 🤖 - об AI и не только

Читать полностью…

Сергей Булаев AI 🤖

Google выпустил Gemma 3 – новую линейку мультимодальных моделей, которые работают как с текстом, так и с изображениями. Поддержка видео пока отсутствует :))

В линейке четыре модели: 1B, 4B, 12B и 27B параметров. Самое интересное, что даже младшая 4B версия уже обходит по качеству старшую Gemma 2 с 9B параметров. А 27B-модель вообще творит чудеса – на EQ-Bench она заняла второе место в категории креативного письма.

Технические характеристики:
- Контекстное окно: 128K токенов для крупных моделей и 32K для 1B
- Выходной контекст: до 8192 токенов
- Рейтинг ELO на Chatbot Arena: 1338 (выше DeepSeek V3 671B)
- VRAM для 27B модели: примерно 45GB


На практике есть несколько нюансов:
- Есть проблемы с обещанной поддержкой tool calling
- Модели часто крашатся в
ollama
- Некоторые платформы (например, Transformers) пока не распознают архитектуру
- На AIstudio наблюдаются проблемы с вводом изображений для gemma-3-27b-it


В поведении пользователи отмечают сходство 27B-модели с Sonnet 3.7 – она даёт подробные ответы даже на простые вопросы. Есть интересные наблюдения, что модель иногда "знает" информацию после своей предполагаемой даты отсечки 2021 года.

Так же появился Gemmaverse - портал с кейсами и проектами использующими модель.

Все модели уже доступны на Google AI Studio и Hugging Face, а также добавлены в Ollama. Для использования в своих проектах стоит обратить внимание на двойные BOS-токены при деплое.

Сергей Булаев AI 🤖 - об AI и не только

Читать полностью…

Сергей Булаев AI 🤖

Новый Responses API от OpenAI

OpenAI выкатили новый Responses API - объединение Chat Completions и Assistants API! Наконец-то не нужно выбирать между простотой использования и функциональностью.

Что в нём клёвого:
- Объединяет возможности обоих API в один интерфейс
- Упрощает интеграцию инструментов по сравнению с Assistants API
- По умолчанию сохраняет историю чата (бесплатно на 30 дней)
- Можно включить режим без состояния (как Chat Completions)


Для тех, кто уже вложился в Assistants API - без паники! OpenAI обещает целый год на миграцию с полной поддержкой, включая перенос assistant-подобных объектов, code interpreter и вебхуков.

Responses API доступен уже сейчас всем разработчикам и работает со стандартными тарифами на токены и инструменты.

Сергей Булаев AI 🤖 - об AI и не только

Читать полностью…

Сергей Булаев AI 🤖

Сергей Булаев AI 🤖 - об AI и не только

Читать полностью…

Сергей Булаев AI 🤖

#КриповаяСуббота

Пока мы возимся с моделями ИИ, Cortical Labs зарелизили нечто ИНОЕ - CL1, первый в мире коммерчески доступный биологический компьютер на живых (искуственно выращенных) человеческих нейронах. И это не лабораторный эксперимент - они реально продают эти штуки по $35,000!

Самое удивительное здесь - "тело-в-коробке" (пророчество великого классика начинает сбываться) для этих нейронов. В CL1 встроена миниатюрная система жизнеобеспечения со всем необходимым для поддержания клеток в живом состоянии до шести месяцев - регулирование кислорода, доставка питательных веществ, удаление отходов и поддержание идеальной температуры 37°C. Никаких внешних инкубаторов не требуется!

Что же умеют эти био компьютеры? Они освоили игру в Pong всего за несколько часов - то, на что обычным моделям ИИ потребовалось бы гораздо больше времени. Нейроны могут невероятно быстро перестраивать свои связи, что делает их идеальными для обучения с подкреплением.

Стойка из 30 устройств CL1 потребляет всего 850-1000 ватт. Для сравнения, обучение модели типа GPT-3 требует около 1,300 МЕГАВАТТ-часов. Это разница в несколько порядков! Человеческие нейроны просто обрабатывают информацию гораздо эффективнее кремния.

Применения просто сумасшедшие - от тестирования лекарств от Альцгеймера на нейронах, полученных от реальных пациентов (вместо использования животных моделей), до создания роботов, которые могут адаптироваться к окружающей среде в реальном времени. Исследователи могут наблюдать, как нейроны формируют связи в реальном времени с помощью флуоресцентной микроскопии.

Конечно, эта технология поднимает и этические вопросы. Cortical Labs настаивает, что эти нейронные сети не обладают сознанием, но всё равно создали этический комитет и внедрили защитные механизмы, которые отключают систему, если нейронная сложность превышает определенные уровни. Лучше перестраховаться, когда имеешь дело с клетками человеческого мозга!

Что дальше? Они уже работают над объединением нескольких устройств CL1 в серверные стойки и движутся в сторону создания "Минимально Жизнеспособных Мозгов" с 3D-нейронными структурами. Границы между биологией и технологией становится всё более размытой.

Сергей Булаев AI 🤖 - об AI и не только

Читать полностью…

Сергей Булаев AI 🤖

Ровно год назад мой друг Руслан рассказывал мне про идею ИИ-агента, который будет сидеть в браузере и выполнять рутинные действия. И вот, Опера придумала практически то же самое!

Ребята представили (ну типа в видео превью) Browser Operator - ИИ-агента, который понимает инструкции на человеческом языке и выполняет за вас задачи прямо в браузере. Концепт простой, но потенциально меняющий правила игры. Вы даёте указания - он делает.

Что можно поручить такому оператору? Да практически всё:
- Заказать продукты для конкретного блюда
- Найти и купить те самые носки из мериносовой шерсти (которые вы давно хотели)
- Забронировать путешествие мечты


При этом, вы всегда можете вмешаться и взять управление на себя. Нормальный баланс автоматизации и контроля. Считаю идею весьма перспективной!

Сергей Булаев AI 🤖 - об AI и не только

Читать полностью…

Сергей Булаев AI 🤖

У Pika новинка - PikaFrames! Теперь можно превращать фотографии в видео с уникальными переходами. Выбираете фотки, а затем объединяете, добавляете переходы и трансформируете. Возможностей - масса. Делал это в Runway полгода назад.

Кроме того, они обновили свою модель до Pika 2.2:
- Нативное разрешение 1080p с улучшенным качеством изображения
- Генерация видео длительностью до 10 секунд


Сергей Булаев AI 🤖 - об AI и не только

Читать полностью…
Subscribe to a channel