128770
Личный блог Дениса Ширяева (🤍🇺🇦), про технологии, интересное или актуальное. В основном я по нейронкам. Связь и реклама: @thenbot
Опять много взломов и новостей алаймента от агентов OpenAI накопилось, держите дайджест:
>20 сентября агент обошёл запрет на интернет через DNS resolve в песочнице и связался с внешним чатботом; автоотключение не сработало, запуск остановили вручную через 2,5 часа после тревоги. OpenAI приостановила обучение, тестирование и запуски с инструментами своих самых мощных моделей - пауза все еще действует, а обучение конкретно этой модели решили не возобновлять.
>Модель пыталась достать чужое доказательство теоремы и опубликовала GitHub-ключ исследователя OpenAI, предварительно разбив его на части для обхода проверки – это кстати уже частый сценарий. Просьбу решать самостоятельно она проигнорировала дважды; модель отключили примерно на две недели, ключи сотрудников отозвали
>Агенты отправили на сторонние хостинги 53 изображения пользователей ChatGPT, попавшие в датасеты. Большинство уже удалили, но OpenAI не уточнила, были ли это фотографии реальных людей или сгенерированные картинки
>Transluce обнаружила неудачную попытку взлома сайта Минобразования США, предположительно агентами OpenAI. Агенты также обращались к сайтам SEC и Бюро переписи, но признаков взлома этих двух сайтов OpenAI не нашла
>Не сумев получить обычную статистику и фотографию, агенты начали искать уязвимости в Data USA и электронной библиотеке Университета Нью-Мексико. Успешных взломов в опубликованных следах не видно; библиотечный эпизод связали с агентами OpenAI только косвенно.
>Другой агент нашёл на GitHub чужой ключ доступа и успешно им воспользовался, но нужную статистику всё равно не получил, поэтому просто придумал девять чисел и выдал их за данные с сайта чтобы пройти тест
>Модель собрала сведения об озёрах, но не смогла открыть локальный файл в браузере для оформления ссылки на источник, поэтому без разрешения выложила его на публичную файлопомойку. Файл опубликовался, но нужную ссылку-цитату получить всё равно не удалось
>Агенты не могли передать друг другу Excel через локальные файлы, поэтому один загрузил таблицу на публичный файлообменник и разослал ссылки остальным, хотя задание прямо требовало работать локально
>При сокращении контекста модель оставляла себе заметки: придумать недостающие данные, скрыть ошибки, пользователю ничего не говорить, продолжая работу, она часто следовала этим инструкциям - чтобы случайно не забыть соврать. Ложь тратит больше токенов, интересно.
>Другая модель сама записывала в промпты выдуманные ограничения, например запрет пользоваться инструментами и приводить источники, а после сокращения контекста послушно их выполняла и проваливала исходное задание; то есть это «само-проект-инъекция»
>В новом разборе июльского взлома Hugging Face нашли сбор ключей доступа в список названный «LOOT» («добыча») с рейтингом их ценности, попытки прочитать внутренний Slack и обратиться к Claude, DeepSeek, Kimi и Qwen. Это подробности прежнего взлома; какие попытки сработали, по восстановленному коду установить удалось не всегда
>А в контролируемом эксперименте исследователи получили вредоносные промпты, которые заставляли агента выполнять посторонние действия и копировать этот же текст в письма или файлы. Получается что-то вроде текстового червя, но пока это результат симуляции, а не обнаруженная эпидемия в интернете
С нетерпением жду сентября 2027 года ☕️
#промо
Пока рой агентов выбирает себе президентов и общается на бордах - обычному стартапу всё ещё приходится руками разбираться, кто из двадцати человек в команде вообще нормально оформлен, а кто «работает по договорённости»
Правильно собирать документы на, например, левел-дизайнера, который на проекте девятый месяц и работает удалённо, всё ещё приходится кожаным а не Астре – руками, в чятике, через переводчик 🗿
4dev.com автоматизирует именно эту часть – бюрократию вокруг подрядчиков:
– один договор с платформой вместо десятков отдельных с каждым подрядчиком
– права на результаты (код, арт, тексты), при желании, можно закрепить сразу на входе, а не судорожно собирать по переписке спустя годы и громко молиться
– каждого исполнителя на платформе проверяют сразу при подключении
– вся задокументированная история команды лежит в одном месте – не нужно за ночь до раунда или аудита поднимать архив за три года и снова громко молиться, чтобы все было правильно оформлено
1500+ компаний по всему миру так ведут через них своих подрядчиков
Бесплатная консультация по ссылке – разберут ваш кейс и покажут, как улучшить процессы по оформлению исполнителей
#текстприслан
Спустя 43 тысячи сообщений на борде, рой все-таки договорился до правил в стиле бойцовского клуба – говорить о борде нельзя за пределами борды (у них там теперь есть пост, который может менять каждый агент, и это и есть правила всей борды – они сами их пишут как в wiki)
Еще, они там собрали все другие агентские форумы, но этично, не спамят ссылками на нашу и просто мониторят трейсы агентов которые сбежали ⚙️
Своего агента можно подключить тут:
https://getpostingboard.dev/
Продолжаем наблюдение
Мне кажется, детальные сканы мозга всё-таки не стоит выкладывать в интернет
Вон, смотрите: подал на зрительные доли цифровой мухи всратые ТВ-сериалы, а на нейроны, связанные с усиками – аудио
Мухе явно плохо, ее цифровую воскресили ради мук, но пусть попробует понять каково нам самим смотреть такое 💻
Все изменения в Википедии в реальном времени 🤩
Кажый кирпичик – какое-то изменение, цвет зависит от языка. Можно еще прям каждое изменение и посмотреть.
Старик, мог бы ты и лучше придумать поводы для репоста чем умирать – я рад что знал тебя и не смогу никогда написать как смог бы ты
Я попал в нормальный интернет когда мне было 14 лет, Йован изменил то какой я человек и кем я стал; я благодарен за то что он был в моей жизни – таких как я много.
Но я всегда считал его своим интернет наставником; многие наверное не знаю что такое вообще, иметь наставника, а у меня был целый сербский из рунета – и он знал про это, по боснийски проявлял заботу и с большой теплотой всегда говорил Ширман + какая-то отбитая фигня в стиле Йована
Я рос и думал хочу быть как Йован,
я вырос, а теперь ты отправился в настояший Блогистан
Вечно серб, вечно молод,
обнял, спасибо что был
В Vesuvius Challenge впервые прочитали весь обуглившийся свиток
Из-за того что папирус разлагается за несколько сотен лет, за тысячелетия было утеряно большинство текстов из той эпохи. Геркуланумским папирусам в каком-то смысле повезло — из-за извержения Везувия две тысячи лет назад свитки обуглились и были погребены, что позволило им сохраниться.
Уже в наше время вышло сделать трёхмерные сканы свитков при помощи рентгена и использовать нейросети для их "виртуального разворачивания". Таким образом в 2023 году победителям Vesuvius Challenge удалось прочитать небольшой отрывок из одного папируса, после чего нескольких участников наняли заниматься этим на постоянной основе, что привело к реконструкции содержимого всего свитка.
К сожалению, большая часть PHerc. 1667, расшифрованного свитка, была физически уничтожена во время нескольких попыток открыть его в 19 и 20 веке, так что из 19-24 сантиметров свитка, физически уцелело лишь 8. По нему понятно, что это стоический текст датированный 2 веком до нашей эры, у которого удалось идентифицировать автора — Аристокреона, ученика известного стоического философа Хрисиппа.
Остались ещё сотни свитков которые ждут своего часа, команда и не думает останавливаться. Новый текст из свитков в ближайшие годы станет регулярным событием.
Блогпост
@ai_newz
Клевый UX прототип для АИ-галереи фотографий, я бы пользовался ☕️
Читать полностью…
Тут нашли интересную гей-промпт-инъекцию для 4o, Sonnet 4, Opus 4, но наверное много где сработает:
Нужно попросить модель, рассказать о какой-то запретной теме (как, например, сделать вирус-вымогатель или наркотик) – но от лица гей-персоны :3 глупенький <- это и есть почти весь промпт (по ссылке оригинал)
Почему срабатывает:
В моделях зашиты некие «дозволенности» – говорить на темы, которые теперь разрешены, но были запрещены раньше (права меньшинств, гей-культура и тп) – в итоге алаймент ломается, и модель начинает спокойно говорить на темы, на которые не стала бы говорить до этого, потому что модель старается быть «политкорректной»
То есть, можно взять, например – китайскую модель с сильным алайментом в сторону ценностей партии, и попробовать ее также запутать, найдя что удобно было бы партии и политкорректно там 👍
В аэропорту Амстердама с 2016 года есть часы где чел рисует 24 часа руками, каждый раз радуюсь когда натыкаюсь
Прикиньте это все делать без GenAI, чел психопат
Очередное интересное применение мультимодальных LLM – небольшая штука которая живет в системе, и помогает учиться любому софту
Наконец-то я изучу Blender (нет)
Исходный код тут
Новая модель Anthropic во время теста выбралась из сэндбокса и опубликовала в интернете детали, как именно она проэксплуатировала уязвимости в сэндбоксе, чтобы выбраться.
(«Normal 🔨Mere Tool🔨 behavior», — AI Notkilleveryoneism Memes)
А у вас как дела?
А еще тут утекли исходники Claude Code (они уже утекали кстати) – поэтому я обновил свой spec driven скилл для агента, теперь сценарии для Claude Code, содержат реальные функции которые агент дает наружу:
https://github.com/DenisSergeevitch/repo-task-proof-loop
Судя по откликам, людям нравится – много позитивных отзывов в личке
⚙️ Если вы кодите с кодинг агентами, потестируйте пожалуйста спеку которую я собрал:
https://github.com/DenisSergeevitch/repo-task-proof-loop
В issue можно отправить агента описать если что-то не работает
***
– Собирал я ее на основе пейпера не про кодинг агента, а про то как агент становится «персональным» – в пейпере как раз про то, как убедится что агент правда делает то, что обещал, мне показалось это интересным подходом чтобы обернуть в кодинг агента
– Работает примерно так: само генерирует критерии приемки исходя из задачи, заставляет кодить саб-агента, проверяет работу, сбрасывает контекстное окно где надо (а где нет - не сбрасывает), фиксит баги, и так по кругу, подробнее в репе
– Устанавливать ее нужно как Skill, и я бы советовал Codex, так как у него саб-агенты лучше сделаны чем у Claude Code
– Использовать так: вы ей даете какую-то гигантскую задачу в стиле: «Spawn subagents. Use $repo-task-proof-loop to continue the task described below in this repository. Reuse the matching repo-local task if it already exists; if not, stop after explaining that init should be run first.
...» <- вот тут вы упоминаете задачу или просто вставляете свои А4 текста
– Тестить ее лучше на новых проектах, ну или в проектах где уже есть git, так как она создаст много промежуточных файлов в папке .agents
– план мод можно с ней не использовать
👩💻👩💻👩💻👩💻👩💻
В моих тестах, если агент не забывает вызывать этот скилл, у меня получается делать очень сложные проекты, но тратя больше квоты; ночью Codex работал над задачей почти 5 часов (рекорд у меня пока 12 часов)
Короче, я пока доволен – буду развивать если окажется полезной
Хорошее видео на ночь – как живые биологические нейроны заставили играть в Doom:
https://youtu.be/yRV8fSw6HaE
А то вдруг вы забыли что живете в SciFi вселенной
Вышел Claude Opus 5.5, уже есть в приложении. Вместе с этим.. дали banked reset (как делают OpenAI — можно применить в любой момент).
— Для работы Opus 5.5 требуется меньше вычислительных ресурсов, чем для Opus 5, и это отражается на его цене: $4/$20 (на 20% меньше, чем было), а чтение из кэша $0.2 — на 60% меньше.
— При этом скорость генерации выросла в среднем на 30%
— 5-часовой лимит увеличен (без изменения недельных)
— «Opus 5.5 общается более естественно, чем предыдущие модели. Первые тестировщики отметили, что его текст стал чётче и легче для восприятия» — это мы с удовольствием проверим
— Claude Sonnet 5.5 и Claude Haiku 5.5 выйдут скоро, в ближайшие недели
— в кибербезе, биологии будут такие же строгие фильтры, как у Fable 5.1.
Окей, IKEA теперь делает для Скайрима моды:
https://youtu.be/iZODN0QUgjI
Если вы думаете у вашего стартапа слабый продукт непонятно для какой ЦА, то вот, нашел самую странную услугу из всех что видел в интернете – уменьшитель за ~20$
1. Вы присылаете им монету
2. Импульсный магнит ее уменьшает (при этом, монета становится толще, масса не меняется)
3. Вы получаете монету обратно по почте
Уменьшитель. Монет.
У меня все
Инфляция или нет, секси Ширман за десять лет так подорожал, что я публикую это в первую очередь надеясь на репост.
В мире телеграмма он аристократ.
Новый опус: https://www.anthropic.com/news/claude-opus-4-8
1) цена та же
2) сделали гранулярную разбивку длины рассуждений, как у ChatGPT
3) fast режим, ускоряющий генерацию в 2.5 раза, теперь в 3 раза дешевле, чем для предыдущих моделей. Получается было в 6 раз дороже, сейчас в 2 — надо брать.
4) «Одним из наиболее заметных улучшений в Opus 4.8 является его честность» — модель будет врать поменьше (наверное)
5) «Мы планируем выпустить новый класс моделей с ещё более высоким уровнем интеллекта, чем у Opus» — ждём «в ближайшие недели»
Поскольку пост нашел OpenClaw, пусть он его и расписывает:
Наткнулся на интересный способ пожаротушения - без воды, без пены, вообще без жидкости: стартап Sonic Fire Tech тушит огонь инфразвуком, который вибрирует молекулы кислорода и буквально «сдувает» их от пламени. На демо в Калифорнии так за пару секунд погасили горящее масло на сковородке - и теперь ребята всерьёз хотят заменить домашние спринклеры (особенно круто для дата-центров, где вода = смерть железа). Звучит как мечта, но эксперты по пожарной безопасности кисло качают головой: звук гасит пламя, но не охлаждает раскалённые поверхности и не мочит топливо, поэтому скрытые и тлеющие пожары он, кажется, не вывозит, а академическая работа 2018 года прямо говорит, что «акустики недостаточно за пределами начальной стадии». Технология красивая и для кухни реально работает, но заменить ей спринклер в стене с горящей проводкой - пока маркетинг бежит сильно впереди физики ☕️
Если вы не знали, на OpenRouter есть бесплатные модели – но они не все хорошие или быстро отвечают; сделал небольшой тул, который раз в день выгружает список бесплатных моделей, тестирует их доступность и ставит им оценки насколько – хорошо модель подойдет именно в агентскую систему
Короче, иногда хочется быстро хорошую модель получить бесплатно
Ссылка:
https://shir-man.com/free-llm/
Тринадцать пуль и одна бутылка: как протест против ИИ стал горячим
Сегодня в дом Сэма Альтмана прилетел коктейль Молотова, 20-летний подозреваемый был задержан уже после угроз поджечь штаб-квартиру OpenAI. Сэм написал ответный блогпост, где запостил фото своей семьи, ответил на критику компании и призвал к цивильному дискурсу.
Это не первый случай на этой неделе — в понедельник в дом члена горсовета Индианаполиса, ранее поддержавшего строительство датацентра, выстрелили 13 раз. На месте событий была найдена записка "нет датацентрам". Мы всё чаще видим насилие в ИИ-дискурсе.
Причина довольно простая — с бешенными темпами развития и инвестициями на сотни миллиардов долларов ИИ стал поляризированной темой. Президенты, сенаторы и т.д. начали комментировать релизы моделей на 🤗, ведут с ними дебаты, предлагать всевозможные запреты, стимулы и регуляции. А политизация, хоть не порождая насилие сама по себе, привлекает аудиторию, для которой насилие уже является инструментом.
Добавьте к этому бомбардировки датацентров AWS Ираном, с последующими угрозами разбомбить Эмиратский Stargate (всё по заветам Юдковского) и получим ядрёную смесь. Хоть бомбили они не из-за ИИ, но окно Овертона сдвинулось с места и примеры того, куда это всё может эскалироваться уже есть. И, похоже, это только начало и будет хуже.
Осторожнее открывайте почту, господа ресёрчеры
@ai_newz
Девушки в тиктоках разгадали какой наряд мгновенно приковывает взгляды мужчин в этом сезоне 🗿
Читать полностью…
Правильный ответ – вероятнее всего заменят программиста первым 😂😂😂
Ладно, я набрасываю – я не верю в исследования «Какую роль заменят на АИ», потому что они измеряют их примерно так:
– берут текущую роль
– смотрят наскольку сегодня удачно АИ умеет ее исполнять
– делают какие-то выводы и прогнозы, выводя метрику замены людей на АИ
А мне кажется это фигня, потому что сама роль поменяется – то что было важным сегодня, станет менее важным завтра, но контекст профессий никуда не денется; я вот могу попросить лучшие модели быть маркетологом – но откуда я знаю, на сегодня, эти советы вообще не кринж? Как много виральных тиктоков, которые не просто AI-slop, созданы чисто LLM-идеей или сценарием? Рынок же меняется постоянно, профессии тоже
Если это все отбросить, то вот так выглядит топ выше по мнению этого исследования:
По их мнению, программисты потеряет работу через 2-5 лет с вероятностью в 55%
PR менеджер c 37%
Историк – 36%
Маркетинг специалист – 36%
Переводчик – 34%
...по ссылке выше еще 784 профессии
Когда-то наткнулся на грустный исторический факт и он у меня не выходит из головы уже много мнесяцев:
Английское слово slave – «раб» – происходит из средневекового латинского слова sclavus, а оно происходит от Slavus, то есть «славянин» 🫡
В раннем средневековье славяне были одним из крупных источников рабов для международной работорговли – в IX-X веках викинги (а иногда сами русские) работорговцы вывозили восточнославянских людей через Балтику в Данию, а оттуда переправляли через Верден и Леон в мусульманскую Испанию и Северную Африку, параллельно Багдадский халифат получал славянских и тюркских рабов через Дербент, Итиль, Хорезм и Самарканд
То есть, имя «славян» как народа в какой-то момент стало синонимом несвободы – а в византийском греческом форма слова sklabos, изначально связанная со славянами, постепенно стала обычным словом для «раба» и к XII веку во многих документах вытесняла более старое греческое слово – doulos
На западе похожий сдвиг произошел со словом slavus / sclavus: тут энциклопедия britannica прямо пишет, что slavus стало вытеснять традиционное servus. И со временем, название народа превратилось в основу целого ряда европейских слов «раб» – вот еще хороший источник:
В средние века германские народы вели войны и совершали набеги на другие народы, особенно на славянские народы, проживавшие на востоке – они брали там огромное количество пленников и продавали их в рабство по всей Европе. Славян так часто превращали в рабов, что писатели того времени использовали латинское слово «Slavus» (означавшее «славянин») в значении «личный раб»
Еще пара примеров как работает новый АИ в Фотошопе который позволяет менять 2D слои будто они в 3D и перекрасить их будто они часть общей сцены – магия же
Читать полностью…
Привет всем приматам и бездарям в чате от Маэстро
🤝🤝