12532
Publora.com - коннектор для ваших AI агентов к соцсетям. Co.actor - помощники по созданию постов для вас и вашей команды Так же в прошлом соосновывал: Купи Батон! Lifehacker.ru, Взахлёб! tg: @sergeonsamui in: linkedin.com/in/sbulaev
a1.art — клёвая платформа, позволяет преобразовать ваши фотографии в иллюстрации 🎨 за секунды. Можно поиграться бесплатно! После регистрации по моей ссылке получите 15 генераций бесплатно.
Более 3000 приложений с различными стилями, а также поддержка мультимодальных форматов. Просто загружаешь картинку, иногда надо добавить что то текстом.
Пользователи могут создавать приложения для генерации изображений и видео. Модульная структура функций похожа на конструктор. Можно форкать 😁 чужие приложухи и видоизменять их! Правда большинство функций доступны только с pro аккантуом. 😭
Видео где то должно быть, искал, но не нашёл, если найдёте пришлите ссылочку на приложение!
Даже и не спрашивайте кто на всех этих картинках.🥇
Сергей Булаев AI 🤖 - об AI и не только
На новых Google Pixel 9-го поколения будет доступна функция суммаризации звонков (Call notes). Так же будет сохранятся полная расшифровка разговора. Всё будет работать прямо на телефоне (без облака), все участники разговора будут предупреждаться о записи.
Ещё в Pixel Studio будет доступна генерация изображений аж на двух моделях (локальной и облачной), а по скриншотам можно будет искать с ИИ анализом (по текстам, людям и объектам)
Сергей Булаев AI 🤖 - об AI и не только
Google представил Gemini Live — расширенный режим голосового общения для Gemini. Он нацелен на создание более естественных и интерактивных разговоров с пользователями.
На данный момент Gemini Live уже доступен на английском языке для пользователей Android, подписанных на Gemini Advanced. Однако Google планирует другие языки и платформы, включая iOS.
Очевидна конкуренция с Advanced Voice Mode от OpenAI. Компания подчеркивает возможности своего бота для более "человечных" взаимодействий.
Вот здесь Джоанна Стерн из WSJ пробует им пользоваться, посмотрите с 1:40
Сергей Булаев AI 🤖 - об AI и не только
Так, ну что там, 8 по москве уже близко? Стоит ждать? У меня просто 11-й час, боюсь не досижу....
Читать полностью…
3 музыкальных AI видео от Ray, прошлогоднего финалиста конкурса Runway Gen:48 (кстати видео финалистов конкурса этого года тоже стоит посмотреть).
- музыкальное anime (мой сын делает их уже много лет, только вручную, и каждый раз тратит часы и даже дни)
- первая ежегодная конвенция для нереальных людей
- на и просто эксперементы с midjourney + runway
Сергей Булаев AI 🤖 - об AI и не только
Как модифицировать Claude Engineer для переключения его на новую модель OpenAI gpt-4o-mini с помощью Claude Engineer.
Сергей Булаев AI 🤖 - об AI и не только
🧠 Исследователи из Стэнфорда, UC San Diego и UC Berkeley представили новый подход к обучению языковых моделей - Test-Time Training (TTT) layers. Это может стать важным шагом в создании более эффективных и масштабируемых ИИ-систем.
Ключевые моменты:
🔄 TTT layers используют самообучение в процессе работы. Их скрытое состояние - это модель, которая обучается на каждом токене входной последовательности.
📊 Представлены две реализации: TTT-Linear и TTT-MLP. Обе показывают результаты на уровне или лучше современных моделей вроде Transformer и Mamba при меньших вычислительных затратах.
🚀 TTT-Linear уже быстрее Transformer на контекстах от 8К токенов и сравнима по скорости с Mamba.
📏 TTT слои лучше работают на длинных контекстах, сохраняя способность учиться даже после 16К токенов, в отличие от Mamba.
🤖🐜 Исследователи из TU Delft опубликовали в Science Robotics работу о навигации крошечных роботов.
🧠💡 Задачей исследование было: как сделать так, чтобы крошечный робот мог самостоятельно ориентироваться в пространстве, имея минимум вычислительных ресурсов? Современные подходы к AI-навигации требуют мощных процессоров и большого объёма памяти.
🐜🧭 Исследователи обратили внимание на муравьёв. Они способны находить дорогу домой, имея "компьютер" размером с булавочную головку. Секрет муравьёв - в комбинации простого подсчёта шагов и запоминания ключевых визуальных ориентиров.
📏📸 Был разработан алгоритм навигации, который требует всего 1.16 килобайт памяти на 100 метров пути. Это позволило 56-граммовому дрону автономно летать на расстояния до 100 метров и возвращаться обратно, используя только встроенный микроконтроллер и простую камеру.
🧠🔍 Вместо попыток впихнуть огромную нейросеть в крошечное устройство, исследователи создали простой, но эффективный алгоритм, имитирующий природные механизмы.
🚀🌱 Такой подход открывает дорогу для создания целого класса микро-AI систем, способных выполнять сложные задачи с минимальными ресурсами. Представьте рой таких микродронов, мониторящих склады или теплицы, или крошечных роботов, исследующих труднодоступные места.
#МикроИИ
Сергей Булаев AI 🤖 - об AI и не только
🧠 Исследователи из Университета Эксетера и Школы менеджмента UCL провели исследование о влиянии ИИ на творческий процесс написания рассказов. Результаты, опубликованные в Science Advances, показывают интересные последствия использования ИИ в креативных задачах.
🔬 Как проходило исследование:- 300 участников писали "микро-рассказы" из 8 предложений.
- 3 группы: без ИИ, с одной идеей от ChatGPT, с выбором из 5 ИИ-идей
- 600 человек оценивали результаты
📊 Выводы:- ИИ повысил новизну идей на 8.1% и их "полезность" на 9%
- Рассказы стали более профессиональными: лучше написаны, интереснее, менее скучные
- ИИ особенно помог менее креативным авторам, улучшив их работы до 26.6%
- Но: Истории, написанные с помощью ИИ были более похожими друг на друга
🧠 Инсследователи использовали Divergent Association Task (DAT) для оценки базовой креативности участников. Оказалось, что менее креативные авторы получили наибольшую пользу от ИИ-ассистента.
⚠️ Профессор Оливер Хаузер предупреждает:
"Несмотря на улучшение индивидуальной креативности, существует риск потери коллективной новизны. Если издательская индустрия начнет активно использовать ИИ, истории могут стать менее уникальными в целом."
🏠💰 Роскошный особняк Сэма Альтмана за $27 млн оказался проблемным.
Генеральный директор OpenAI Сэм Альтман столкнулся с неожиданными проблемами в своём модном особняке в Сан-Франциско. Дом площадью около 880 кв. метров, расположенный на знаменитой улице Ломбард, оказался настоящим разочарованием с множеством дефектов.
🏊♂️ Бассейн-инфинити, нависающий над краем дома, протекает, заливая нижний этаж.
🚽 Неисправная канализация сливает сточные воды прямо в землю.
🌱 Система полива сада и смыва туалетов, использующая переработанную дождевую воду, даёт сбои.
🦇 C пещерой Бэтмена, ведущей в гараж, вроде всё ок.
Согласно судебному иску, поданному командой Альтмана, застройщик Troon Pacific намеренно исказил информацию о качестве недвижимости, чтобы продать её "как можно быстрее". Более того, некоторые подрядчики якобы "отомстили" за задержку оплаты, забив канализационные трубы мусором.
💰 Только ремонт бассейна оценивается в $4 млн, не считая других многочисленных проблем.
Интересно, что это не первый скандал с участием Troon Pacific. В мае компанию обязали вернуть $50 млн инвесторам за незавершенный проект реновации в Сан-Франциско.
Через неделю буду там - надо будет дойти посмотреть до дома вижвую :)
#СэмАльтман #OpenAI
Сергей Булаев AI 🤖 - об AI и не только
Андрей Карпаты, бывший глава отдела ИИ в Tesla и исследователь в OpenAI, запускает Eureka Labs - образовательную платформу с использованием ИИ. Цель Eureka Labs - создать ИИ-ассистентов для обучения, которые будут работать вместе с преподавателями, чтобы "каждый мог изучить что угодно".
Первый продукт компании - курс по ИИ под названием LLM101n, который научит студентов создавать собственный ИИ. Курс обещает показать как создавать веб-приложение, подобное ChatGPT, с нуля, используя Python, C и CUDA.
Точные детали о финансировании Eureka Labs, бизнес-модели и команде пока неизвестны.
Карпаты описывает Eureka Labs как кульминацию его 20-летней страсти к ИИ и образованию.
До этого Карпаты работал в Stanford University, OpenAI и Tesla, где руководил командой компьютерного зрения для системы Autopilot. Параллельно с работой над Eureka Labs, Карпаты ведет онлайн-курс "Neural Networks: Zero to Hero" и AndrejKarpathy">YouTube-канал с лекциями об ИИ и языковых моделях.
Я тут недавно по его видео разбирался руками как вообще работают трансформеры.
Сергей Булаев AI 🤖 - об AI и не только
Звёзды и их молодость
Сергей Булаев AI 🤖 - об AI и не только
🤖 Команда AutoGPT представила новое поколение своего инструмента для создания автономных AI-агентов. Это pre-alpha версия с открытым исходным кодом, доступная на GitHub.
Ключевые особенности нового AutoGPT:
Модульная архитектура на основе Блоков - функциональных компонентов для настройки поведения агентов. Двухкомпонентная структура: AutoGPT Server (бэкенд) и AutoGPT Builder (фронтенд для сборки агентов)
Есть несколько примеров - блоки для Reddit, Wikipedia, Discord.
На видео - процесс создания AI-агента для маркетинга на Reddit, показывая, насколько быстрым и простым стал этот процесс.
Пример блока для получения инфы из Wikipedia:
class GetWikipediaSummary(Block):
class Input(BlockSchema):
topic: str
class Output(BlockSchema):
summary: str
def **init**(self):
super().__init__(
id="h5e7f8g9-1b2c-3d4e-5f6g-7h8i9j0k1l2m",
input_schema=GetWikipediaSummary.Input,
output_schema=GetWikipediaSummary.Output,
test_input={"topic": "Artificial Intelligence"},
test_output={"summary": "Artificial intelligence (AI) is intelligence demonstrated by machines..."},
)
def run(self, input_data: Input) -> BlockOutput:
response = requests.get(f"https://en.wikipedia.org/api/rest_v1/page/summary/{input_data.topic}")
summary_data = response.json()
yield "summary", summary_data['extract']
Посмотрите на тестовый прогрев двигателей ускорителя Super Heavy. Он прошёл сегодня ночью (ну ночью то у вас, у нас то - день был). 33 двигателя Raptor! Мощнее Saturn V, ракеты, доставившей людей на Луну больше чем в 2 раза. 5-й полёт должен состояться в августе. Цель - точная посадка на стартовую площадку. Я смотрел прошлый запуск, под конец там всё очень сильно обгорело и разрушилось.
Сергей Булаев AI 🤖 - об AI и не только
Голодный, целеустремленный, извивающийся в игре жизни.
Пьетро Ширано, автор Claude Engineer, превратил Claude Sonnet 3.5 в змею, играющую в классическую змейку, и попросил рассказать о своих ощущениях.
3.5 Sonnet - единственная модель, у которой это получается.
Удивительно наблюдать за логикой его действий и как он проходит сквозь стены, чтобы получить еду быстрее и безопаснее.
Когда я говорю "единственная модель", я буквально имею это в виду. Я тестировал их всех. 3.5 S - единственная, которая может интеллектуально отобразить сетку в своем уме, найти еду и, что более важно, понять, что она может обходить стены. Независимо от того, насколько сложными были мои промпты, я просто не мог заставить работать эту игру с другими.
1. Уменьшил доску до 10x10, все работает очень медленно и дорого, видео сжато до 45 секунд из 11 минут.
2. Поменял центр координат на нижний левый угол, чтобы движение вверх означало прибавление координат, а не вычитание.
3. Добавил в промпт реальный кусок кода из функции, чтобы он лучше понял, как работают команды.
4. Еще раз уточнил, как именно меняют координаты движения команды в описании функции.
А вы знали что через openrouter.ai можно использовать кучу разных моделей, платя за них в том числе криптой! И в чате и через API (это, кстати, как раз сервис универсального API к моделям).
ChatGPT-4o, GPT-4o (2024-08-06) - доступны по обычной цене, как при покупке напрямую... Правда?? А так можно было чтоли?
Сергей Булаев AI 🤖 - об AI и не только
Сахил Лавинья (CEO Gumroad) записал клёвый стрим на два с половиной часа где он переделывает свою личную страничку на Tailwind с помощью Cursor. Очень хорошо показано как его использовать и то, что никакие Copilot там не нужны. Всем кто хочет научиться нормально пользоваться курсором - советую. Есть ещё первая сессия (это уже вторая), но я её я пока не посмотрел.
#CEOwhoCodes #Зерокодинг
Сергей Булаев AI 🤖 - об AI и зерокодинге
Что бы не уснуть, расскажу тему...
Давно думаю об омниканальности, ну в том смысле, что создаваемый тобой контент должен расходиться по разным платформам. Тоесть вот есть Telegram. Для меня - это основа - я пишу сюда. Есть понимание, что дальше из этих постов должны делаться твиты, youtube шортс, instagram stories, ТикТоки итд... Понятное дело что делать их в идеале должны AI агенты.
Думаю давно, а к действиям приступил на выходных - начал писать бота, который каждый мой пост в канале превращается в пост в твиттере. Начал, но не дописал, но ради эксперементальной практики решил пока делать это всё в ручную (вернее в текущем состоянии мне сейчас бот присылает в личку уже посты для твиттера). В результате впервые за долгое время выложил в твиттере пост на тему Omni Engineer. Получились прикольные результаты. Радуюсь.
Обещаю, когда научусь это всё автоматизировать - со всеми поделюсь :)
Сергей Булаев AI 🤖 - об AI и не только
Эмоции... by Jer at EccentrismArt
Смотреть со звуком! 🤔🤔🤔
🌄 Midjourney
🌃Upscale with @Magnific_AI
🎥 Runway Gen-3
🗣️Voice2Voice: @elevenlabsio
🫦Lipsync LivePortrait
😊Video face upscale in Remini.
💇Masked LivePortrait были артефакты по углам
Сергей Булаев AI 🤖 - об AI и не только
У меня эта неделя - отпуск, еду с семьей на машине по очень любимому мной маршруту:Лос Анджелес -> Санта Барбара -> Сан Хосе -> Пало Альто -> Напа -> Сан Франциско
Посты будут редкими, можно сказать эпизодическими. Может про поездку что то напишу ;)
P.S. Вообще про путешествия я пишу в личном канале.
🧠 RNN (Recurrent Neural Networks) и Self-Attention - это два ключевых механизма обработки последовательных данных в нейронных сетях. Оба широко используются в обработке естественного языка, но имеют разные подходы и характеристики.
RNN (Рекуррентные нейронные сети):
🔁 Обрабатывают данные последовательно, элемент за элементом.
💾 Имеют "память" - скрытое состояние, которое обновляется на каждом шаге.
🔗 Хорошо работают с зависимостями в коротких последовательностях.
⏱️ Быстрые и эффективные по памяти (линейная сложность).
🚫 Трудности с долгосрочными зависимостями из-за проблемы затухающего градиента.
Self-Attention (Механизм самовнимания):
👀 Каждый элемент "смотрит" на все другие элементы последовательности.
🔢 Вычисляет веса важности для всех элементов относительно друг друга.
🌐 Отлично обрабатывает долгосрочные зависимости.
💪 Более мощный и гибкий механизм, чем RNN.
🐢 Медленнее и требует больше памяти (квадратичная сложность).
🤔 Выбор между RNN и Self-Attention зависит от конкретной задачи:
- RNN лучше для задач, требующих быстрой обработки и ограниченных ресурсов.
- Self-Attention предпочтительнее для задач, где важны сложные долгосрочные зависимости.
Интересно, что исследование TTT layers, пытается объединить преимущества обоих подходов: эффективность RNN и способность обрабатывать длинные зависимости как в Self-Attention.
Сергей Булаев AI 🤖 - об AI и не только
🔒📧 Proton запустил AI помощника для написания писем с повышенными вниманием к конфиденциальности.
Швейцарская компания Proton, известная своими приватными сервисами (и которой я пользуюсь уже довольно давно), представила Proton Scribe - AI-асистента для составления и редактирования писем.
Ключевые моменты:
- Работает полностью на устройстве пользователя, без отправки данных на сервер
- Основан на open-source модели Mistral 7B
- Не обучается на пользовательских данных
- Доступен под открытой лицензией GPL-3.0
Цель Proton - предложить безопасную альтернативу сторонним AI-инструментам, особенно для бизнес-пользователей, обеспокоенных утечкой конфиденциальных данных.
#ПриватностьИИ
@sergiobulaev - об AI и приватности
🎙️ Посмотрел очередной выпуск подкаста AI&I. Интервью со Стеф Смит о будущем создания контента в эпоху ИИ. Стеф - настоящий исследователь интернета, ведущая подкаста a16z и создатель множества проектов, включая Internet Pipes(инструмент для поиска новых интересных знаний) и книгу "Doing Content Right".
Вот несколько интересных моментов:
🎨 Стеф создала почти все иллюстрации для Internet Pipes с помощью ChatGPT и Midjourney. Она рассказала, как использовала тренд "make it more" для визуализации процесса выпечки картофеля, демонстрируя эволюцию идеи.
🔍 Поиск эстетики: Стеф просматривала главную страницу Midjourney, изучая промпты понравившихся изображений. Это помогло ей правильно артикулировать свои желания и создать уникальный стиль для проекта.
🤖 Стеф считает, что будущее за узкоспециализированными ИИ-инструментами. Она поделилась своими фаворитами:
Consensus
: ИИ-поисковик для научных запросов
Globe Explorer
: создает "оглавления" для каждого запроса
Архитектор из Турции Фатих Экши, делает из овощей и фруктов (и даже шаурмячного вертела) проекты концептуальных зданий с помощью AIR для SketchUp.
Это плагин, использующий ИИ для создания вдохновляющих архитектурных и дизайнерских визуализаций. Он даёт широкий спектр стилей рендеринга, от планировок до ручных эскизов. AIR позволяет быстро и легко генерировать качественные визуализации на основе моделей SketchUp, эскизов или фотографий, предоставляя дизайнерам мощный инструмент для воплощения их идей.
#Архитектура
Сергей Булаев AI 🤖 - об AI и не только
Эллисон Джонсон, больше 10 лет рассказывающая о фото технике, написала для The Verge статью о новой функции генерации изображений с помощью ИИ в смартфонах Samsung.
Samsung представила инструмент "sketch to image" (эскиз в изображение) в новом Galaxy Z Fold 6. Функция позволяет превращать простые наброски в реалистичные изображения с помощью ИИ.
Качество и реалистичность генерируемых изображений впечатляет, особенно при добавлении элементов в существующие фотографии. Смотрите примеры в оригинальной статье.
ИИ способен создавать элементы, которые органично вписываются в фотографии, учитывая масштаб и окружение. Не все получается идеально, но достойных вариантов хватает. Использование функции было очень увлекательным.
Ожидается, что Samsung расширит доступность этой функции на другие модели смартфонов Galaxy.
Сергей Булаев AI 🤖 - об AI и не только
🧠 Исследователи из Huawei Noah's Ark Lab и University College London представили EM-LLM - модель с эпизодической памятью, имитирующую некоторые аспекты работы человеческого мозга. Это очередной шаг в улучшении обработки длинных контекстов в AI. Полный текст публикации.
EM-LLM сегментирует информацию на события, используя уровень неожиданности (surprise) и графовые алгоритмы. Как это работает?1. Модель оценивает, насколько каждый новый токен неожидан в контексте предыдущих. Чем выше неожиданность, тем вероятнее, что это начало нового "события".
2. Далее используется матрица сходства между ключами внимания в слоях трансформера. Эта матрица рассматривается как граф, где токены - вершины, а сходство между ними - веса рёбер. Применяются алгоритмы кластеризации графов для уточнения границ событий.
Процесс извлечения памяти включает два этапа:1. Поиск по сходству: выбираются k событий, наиболее похожих на текущий запрос.
2. Сохранение временной последовательности: для каждого выбранного события добавляются соседние события из исходной последовательности.
Это имитирует эффекты временной смежности и асимметрии, наблюдаемые в человеческой памяти - тенденцию вспоминать события, близкие по времени и в определенном порядке.
Результаты тестировались на LongBench - наборе задач для оценки работы с длинными текстами:- 4.3% общий рост по сравнению с современными моделями
- 33% улучшение в задаче PassageRetrieval, где нужно найти исходный параграф по его краткому содержанию
EM-LLM можно применить к существующим моделям без переобучения, что упрощает внедрение
Этот подход перекликается с моим проектом https://flashbacks.ai, где я рабатаю над AI-ассистентом для людей которые боятся деменции (таких как я). Принципы EM-LLM могут помочь в создании подобного помощника, способного лучше организовывать и извлекать воспоминания.
Хотя EM-LLM показывает неплохие результаты, она все ещё очень далека от полного воспроизведения сложности человеческой памяти.
#AIMemory #flashbacksAI
@sergiobulaev - об AI и когнитивных технологиях
🚌 Добавил возможность проверять свою регистрацию на автобус в бота Ulcamp. Просто дал Клоду ещё одну функцию, позволяющую проверить, зарегистрирован ли пользователь на трансфер или нет.
{
"name": "check_bus_schedule",
"description": "Check which bus is user registered for using information that is kept in function database. Phone is optional. Just send a request to recieve schedule.",
"input_schema": {
"type": "object",
"properties": {"phone": {"type": "string"}},
},
},
Тем временем Anthropic удвоили размер максимального лимита количества сгенерированных токенов для Claude 3.5 Sonnet при запросах через API. Теперь он - 8192!
Чтобы воспользоваться, нужно добавить дополнительный заголовок в запрос на создание сообщения:"anthropic-beta": "max-tokens-3-5-sonnet-2024-07-15"
Также увеличенное окно доступно в консоли. В Claude.ai пока не меняли, но планируют выкатывать.
Сергей Булаев AI 🤖 - об AI и не только
🤖 Исследователи Кембриджского университета обнаружили эмпатический разрыв в AI-чатботах, который особенно опасен для детей.
Основная проблема - дети воспринимают чатботов как живых собеседников, но AI не способен адекватно реагировать на их уникальные потребности.
Исследование выявило реальные случаи опасных ситуаций. Alexa посоветовала 10-летнему ребенку коснуться монетой электрической розетки, а My AI от Snapchat дал 13-летней девочке советы о том, как лишиться девственности. 😱
50% учеников 12-18 лет используют ChatGPT для учебы, но только 26% родителей знают об этом. Это показывает, насколько слабо контролируется использование AI детьми. 📚
Dr Nomisha Kurian предлагает рамочную концепцию из 28 пунктов для создания "детской безопасной AI". Некоторые ключевые моменты:- Оценка способности AI понимать детскую речь и сленг 🗣️
- Наличие встроенных фильтров контента и мониторинга 🛡️
- Поощрение обращения детей к взрослым по чувствительным вопросам 🤝
- Привлечение педагогов и экспертов по детской безопасности к разработке AI 👩🏫
Цель - сделать AI полезным инструментом для детей, а не источником потенциальной опасности.
#ДетиИИ
@sergiobulaev - об AI и не только
Рубрика #ДругПрислал
Друга тут встречал из РФ
пока его ждал, за 2 минуты GPT написал текст песни, а suno
спела песню
жанр правда я джазовый выбрал, но видимо сделал это как-то не так )
в целом здорово, устал смеяться