47682
Авторский канал по ВАЙБ КОДИНГУ, сотрудничество: @nikwolve
За каждый день, пока Astra недоступна на вашем платном тарифе ChatGPT, OpenAI будет начислять по одному сохраненному сбросу лимита, начиная с сегодняшнего дня.
Читать полностью…
NVIDIA выпустила Personal AI Router 😀
PAIR позволяет объединить компьютеры в локальной сети и превратить их в личный ИИ-кластер.
Он автоматически находит ПК с RTX, DGX Spark и поддерживаемые Mac и отправляет запросы на ту машину, где сейчас есть свободные ресурсы. То есть распределитель нагрузки для ИИ-агентов прямо у вас дома.
Можно запускать несколько ИИ-агентов параллельно, распределять инференс между несколькими видеокартами и компьютерами, использовать Ollama и LM Studio, а промпты, файлы и контекст агентов хранить только в своей сети.
Поддерживаются Windows, Linux и macOS.
PAIR уже доступен в бета-версии бесплатно и с открытым исходным кодом.
https://nvidia.com/en-us/ai-on-rtx/personal-ai-router/
OpenAI представила GPT-6 Astra – новый флагман и, судя по первым цифрам, серьёзный скачок относительно прошлого поколения
По бенчмаркам Astra показывает очень сильные результаты:
- Terminal-Bench 4.0: 57,7% против 55,8% у Fable 5.1 и 37,3% у GPT-5.6 Sol
- Terminal-Bench Science: 64,6% против 52,6% у Fable 5.1
- ARC-AGI-3: 99,9%
- ExploitBench: 100%
Anthropic открывает исходный код Claude Commerce Agents. 🔍
Это готовая основа для создания торговых агентов и агентов для продавцов, с рабочими примерами для розницы, путешествий, телекома и развлечений.
В блоге Anthropic подробно разбирает архитектуру, способы снижения задержек и стоимости, а также подходы к оценке качества.
Кроме того, компания выложила открытую эталонную реализацию. Внутри — агенты для покупателей и продавцов, четыре демонстрации для разных отраслей и плагин для Claude Code, который позволяет собрать агента поверх собственного бэкенда.
https://claude.com/blog/claude-for-commerce-agents
Codex восстановил игру Red Alert 2 по одному EXE-файлу. 👀
Исходный код игры никогда не публиковался и, как считается, был утерян. Но вайбкодера это не остановило — он поставил Codex цель восстановить Red Alert 2: Yuri’s Revenge и заставить её нативно работать на iOS и macOS.
Codex на GPT-5.6 Sol работал над этим 26 дней, проанализировал EXE-файл и фактически заново собрал всю игру.
Итог — 624 тысячи строк C++.
Теперь понятно, почему Codex занимает гигабайты места на диске.
Оказывается, вместе с ним поставляется полноценный LibreOffice.
Он хорошо спрятан в папке кэша, а затем Codex использует его через навык:
Ответ от китайцев: обновлённый Qwen3.8-Max. Встречайте Qwen3.8-Max-0902 — монстра на 2,4 трлн параметров. 🤘
Qwen3.8-Max-0902 получила контекст на 1 млн токенов и серьёзные улучшения в программировании, исследованиях и длинных многоэтапных задачах.
Она сразу заняла первое место в общем рейтинге Code Arena: WebDev с результатом 1691 балл.
Она опережает Claude Opus 5 Max на 3 балла, Kimi K3 Max — на 17 баллов, а предыдущую Qwen3.8-Max — на 22 балла.
При средней цене около $5 за 1 млн токенов Qwen3.8-Max-0902 также заняла лучшую позицию на границе Парето — то есть сейчас это один из самых сильных вариантов по соотношению качества и стоимости, именно в веб-разработке.
Модель уже доступна через API в QwenCloud.
вход — $2 за 1 млн токенов
выход — $6
явное попадание в кэш — $0,17
неявное попадание в кэш — $0,25
https://qwencloud.com/models/qwen3.8-max-0902
Офигеть. Hyper3D выпустила свою модель генерации миров WorldGen.
В отличие от других интерактивных моделей мира, WorldGen может взять всего одно 2D-изображение и на его основе построить полноценную 3D-сцену со встроенными физическими правилами.
Каждый объект независим. Столы, стулья и небольшие предметы в сцене можно отдельно извлекать, разбивать на самостоятельные 3D-модели, перемещать, заменять или дорабатывать.
Физика встроена прямо в сцену. Модель понимает пространственное расположение объектов и автоматически определяет такие свойства, как столкновения, масса, трение и другие параметры.
Плюс всё это напрямую встраивается в рабочий процесс. Сгенерированные ассеты можно импортировать в Blender, Unity или Unreal Engine и сразу использовать для создания игровых уровней, кинопроизводства, XR-контента и симуляций для обучения роботов и роботизированных манипуляторов.
Ещё сильнее впечатляет то, что WorldGen может выстраивать полноценный ИИ-конвейер вместе с моделями генерации видео вроде Seedance 2.5.
Сначала WorldGen формирует 3D-сцену с независимыми друг от друга ассетами и чёткой пространственной структурой.
Затем в связке с моделями генерации видео вроде Seedance 2.5 можно добавлять конкретную игру персонажей, прорабатывать материалы, освещение, тени и общий визуальный стиль, превращая белые модели или базовые рендеры в динамичные фрагменты, которые уже приближаются к кинематографическому качеству.
Архитектура Apple Silicon оказалась почти идеальной для запуска больших языковых моделей.
Всё благодаря сочетанию быстрой памяти, высокой пропускной способности и единой архитектуры памяти.
Mac Studio M5 Ultra с 512 ГБ памяти и пропускной способностью 1,2 ТБ/с способен целиком уместить GLM-5.3-Flash на 320 млрд параметров в FP8 и выдавать около 60 токенов в секунду локально, прямо на рабочем столе.
Альтернатива на ПК?
Примерно 10 RTX 5090 стоимостью более $20 000 и своя небольшая электростанция.
Полная версия GLM-5.3-Flash на 320 млрд параметров в FP8 весит около 306 ГБ.
У одной RTX 5090 всего 32 ГБ видеопамяти. Поэтому только для размещения весов модели понадобится минимум 10 видеокарт.
10 × 32 ГБ = 320 ГБ.
Mac Studio решает эту проблему за счёт единого пула памяти объёмом до 512 ГБ с пропускной способностью 1,2 ТБ/с.
Вместо того чтобы собирать ПК-кластер из множества видеокарт, бороться с задержками шины PCIe и энергопотреблением в районе 5000 Вт, можно загрузить всю модель объёмом 306 ГБ вместе с огромным контекстом и KV-кэшем в один настольный компьютер.
Cerebras начнёт хостить Qwen 3.8 27B с 3 сентября.
На Cerebras она, скорее всего, будет работать на скорости 2000+ токенов в секунду. Разрыв огромный.
Для сравнения, ChatGPT обычно выдаёт около 50–100 токенов в секунду, а быстрый режим Codex — примерно 150–200.
То есть Qwen на Cerebras потенциально сможет работать примерно в 10 раз быстрее быстрого режима Codex.. 🥹
За рубежом сейчас активно обсуждают этот инструмент, который называют почти безлимитным способом использовать Codex:
https://github.com/miuuyy/codex-chatgpt-web
Инструмент оставляет интерфейс Codex без изменений, но фактически получает ответы с сайта ChatGPT.
По сути, это мост между Codex и веб-версией ChatGPT.
У него есть собственное приложение, которое открывает встроенный браузер и передаёт работу в вашу уже авторизованную сессию ChatGPT.
Встроенный в Codex ИИ-агент напрямую управляет этим браузером.
Поэтому, как утверждается, по сравнению с существующим самодельным подходом через MCP сессии работают стабильнее, а рабочий контекст между шагами переносится более естественно.
Если вы оформили Codex Max за $200 и постоянно упираетесь в лимиты использования, с этим инструментом можно пользоваться им почти без ограничений, не переживая о недельных квотах. 🐸
Многим нравится интерфейс Codex Desktop, но при этом далеко не все хотят пользоваться только Codex.
Теперь кто-то превратил его в единый интерфейс сразу для нескольких кодовых агентов.
Поддерживаются Codex, Pi, Claude, DeepSeek Harness, Grok и Oh My Pi.
Один интерфейс, несколько агентов. Просто переключаешься на нужного и продолжаешь работать.
https://github.com/BytePioneer-AI/codex-host
OpenAI объявила, что прекращает партнёрство с Cursor и планирует перестать предоставлять им модели серии GPT начиная с 12 ноября.
Причина в том, что Cursor недавно была приобретена SpaceX Илона Маска за $60 млрд.
В контракте OpenAI с Cursor есть пункт о "смене контроля", который позволяет OpenAI расторгнуть соглашение в течение определённого периода после приобретения Cursor другой компанией.
На этот раз OpenAI напрямую воспользовалась этим правом.
Но действительно интересно то, как OpenAI объяснила своё решение.
Компания заявила, что, исходя из прошлого опыта работы с компаниями Илона Маска, она не может быть уверена, что SpaceX будет использовать эти модели в соответствии с условиями OpenAI. При этом OpenAI напрямую упомянула прошлые случаи нарушения контрактов компаниями Маска.
При этом сам Cursor даже не обвиняли в нарушении договора.
Сооснователь Cursor Майкл Труэлл публично ответил OpenAI, напомнив, что Cursor был одним из самых ранних клиентов компании, они сотрудничали много лет и всё это время воспринимали OpenAI как нейтрального поставщика инфраструктуры.
И отдельно уточнил:
на модели OpenAI сейчас приходится лишь около 5% пользовательского трафика Cursor.Читать полностью…
Вышел Goldie — генератор скриншотов для App Store, созданный для кодинг-агентов.
Вы просите своего любимого кодинг-агента сделать скриншоты для App Store, а Goldie с помощью Argent сам управляет приложением, делает нужные кадры и оформляет их в маркетинговые материалы.
В комплекте также есть удобная Studio, где дизайн можно вручную подправить.
Goldie бесплатный и с открытым исходным кодом. Он построен поверх Argent от Software Mansion.
Goldie работает как CLI и как навык для агентов. 🥹
Anthropic выпустила предварительную версию Model Hardware Standard, общего стандарта, который позволяет ИИ агентам безопасно управлять физическими устройствами.
Пока доступ открыт исследовательским организациям и компаниям из передового производства.
MHS позволяет агентам параллельно управлять микроскопами, дозаторами жидкостей, роботизированными манипуляторами и другим лабораторным и промышленным оборудованием.
Речь идёт о задачах от рутинных экспериментов по поиску лекарств до калибровки лазеров для квантовых компьютеров.
Раньше подключение нового оборудования в лаборатории занимало недели или даже месяцы. С MHS это можно сократить до часов или минут.
Управлять оборудованием можно через MCP, командную строку или API. Несколькими устройствами сразу можно управлять буквально одной строкой кода.
Причём MHS не привязан к Claude. Подключиться сможет любой агентный фреймворк. Anthropic надеется, что со временем MHS станет открытым стандартом для управления физическим оборудованием с помощью ИИ.
Во время тестирования обнаружилась особенно интересная вещь.
Claude начинает действовать буквально как исследователь. Немного корректирует лазер, смотрит через камеру, как изменился луч, снова меняет настройки и повторяет процесс.
Когда находит рабочий вариант, сам превращает полученный опыт в детерминированный скрипт, чтобы в следующий раз выполнить всю калибровку одной командой.
Скоро ИИ-агенты смогут управлять вообще всем. Скайнет уже где-то рядом 😆
Во вчерашней покупке Hugging Face компанией NVIDIA оказалось сразу две пасхалки.
Финальная сумма сделки — $12 930 300 000.
Если взять первые шесть цифр 129303 как кодовую точку Unicode, получаем U+1F917. А это эмодзи 🤗 — тот самый логотип Hugging Face.
Сооснователь Hugging Face Томас Вольф еще во время анонса намекнул, что в цене сделки спрятаны сразу две пасхалки — от Hugging Face и NVIDIA.
Вторая еще проще. Если записать 129303 как шестнадцатеричный цвет #129303, получится зеленый, очень близкий к фирменному цвету NVIDIA.
Сделка почти на $13 млрд, а даже последние цифры оценки не пропали зря.
GPT-6 Astra моделирует дом в Blender и превращает его в сцену в Unreal Engine 5, по которой можно ходить, помогая дизайнерам и клиентам изучить планировку и ощутить пространство до того, как дом будет построен:
Читать полностью…
Fable 5.1 Max от Anthropic заняла первое место в Code Arena: WebDev с результатом 1765 баллов — отрыв от всех остальных сразу на 77 баллов.
Это огромный скачок по сравнению с Fable 5 Max, которая сейчас занимает 8-е место с 1628 баллами.
Fable 5.1 Max опережает Qwen 3.8 Max 0902 на втором месте на 77 баллов, а Opus 5 Max на третьем — на 78 баллов.
При результате 1765 баллов и средней цене $40 за миллион токенов модель также заметно сдвигает границу Парето в дорогом сегменте, поднимая планку производительности намного выше.
gpt-6-astra уже появилась в OpenAI API.
Responses API теперь возвращает для gpt-6-astra ошибку 404 Not Found, тогда как случайные или реально несуществующие названия моделей получают 400.
При этом тот же 404 возвращается для GPT-5.6 Cyber, про существование которой мы уже знаем.
Похожая странность была и в API Bedrock — именно по ней Fable 5.1 обнаружили за день до релиза.
Похоже, GPT-6 Astra уже готовят к запуску.
Meta выпустила Muse Spark 1.3 — модель с производительностью на уровне передовых моделей и при этом почти по символической цене.
На этот раз релиз прошёл без предварительного прогрева. Muse Spark 1.3 сначала появилась в Meta API и OpenCode, а уже затем компания опубликовала результаты тестов.
На Terminal-Bench 2.1 модель набрала 88,8, сравнявшись с GPT-5.6 Sol. На DeepSWE — 75,4%, что выводит её в число сильнейших моделей для программирования. По остальным тестам результаты тоже очень серьёзные.
Muse Spark 1.3 уже доступна в Muse Code и через API.
Цукерберг также намекнул, что следующим крупным релизом станет Watermelon (следующий большой релиз), а открытые веса Muse Spark компания обещает выпустить уже скоро.
Gemini вернулся: релизнули Gemini 3.8 Flash
Это уже третий релиз Flash всего за шесть недель.
В DeepSWE v1.1 она превосходит большинство более крупных передовых моделей. В финансах, юриспруденции, видео, биологии и ещё куче других тестов она обходит Opus 5.
Конечно, флагманские модели она пока не разгромила полностью.
Но главное здесь — цена.
Opus 5 стоит $5 / $25, GPT-5.6 Sol — $4 / $20.
Gemini 3.8 Flash сейчас стоит всего $0,75 / $3,75.
Anthropic выкатила Claude Fable 5.1 и Mythos 5.1
Fable 5.1 – новый флагман Anthropic для всех пользователей. Mythos 5.1 – его версия с ослабленными ограничениями по кибербезопасности и биологии, доступная только проверенным организациям.
По бенчмаркам апдейт заметный:
- Terminal-Bench 4.0: 55,8%, у Mythos — 60,9%
- Terminal-Bench-Science: 52,6% против 24,7% у прошлой версии
- Humanity's Last Exam: 60,9% без инструментов и 65% с ними
- OSWorld 2.0: 77,9%
Цена осталась прежней – $10/$50 за миллион токенов, зато cache reads подешевели на 75%, до $0,25 за миллион. По оценке Anthropic, это может снизить расходы примерно на 25% в обычных сценариях и до 45% в агентных.
На Low/Medium effort Fable 5.1 уже может выдавать результат уровня Fable 5 дешевле. В Claude Code по умолчанию используется High, в Cowork и claude.ai – Medium.
Также cyber-фильтры теперь срабатывают примерно на 60% реже, а модель разрешили использовать для поиска уязвимостей, но не для написания эксплойтов.
https://www.anthropic.com/claude-fable-and-mythos-5-1
Релиз Fable 5.1 уже совсем близко. ЕЁ уже зарегистрировали в API AWS Bedrock.
Инсайдер обнаружил, что запрос к её идентификатору возвращает 404 Model not found, а не 400 The provided model identifier is invalid.
Для сравнения, Opus 5.1 и заведомо несуществующие идентификаторы вроде us.anthropic.banana всё ещё возвращают 400.
Обычно такая смена ответа происходит за несколько дней или часов до релиза. ☕️
ЛОЛ, чел отменил Claude Max за $200 в месяц после того, как нейронка обиделась на «fuck you» 🍿
Читать полностью…
Джордан Нанос из SemiAnalysis рассказал, что инженеры OpenAI, которые вместе с ними пролистывали код собственного ядра, сами не понимали построчно, что именно он делает. И это не имело значения, потому что ИИ понимал.
«Это не мусорный код, потому что он работает. Но по сути это буквально сгенерированный ИИ ассемблер, который просто вывален в Gluon — низкоуровневый язык программирования ядер, который они построили поверх Triton и который использует очень интересную модель программирования».
«Суть в том, что парни, которые вместе с нами пролистывали этот код, явно очень хорошо разбирались в железе, очень хорошо понимали концепции всей системы, но при этом вообще не представляли, что конкретно делает это MLA-ядро для DeepSeek, которое они нам показывали».
«Можно идти по коду строка за строкой, и там буквально: нет, не знаю, не знаю».
«Но это не имеет значения. ИИ его понимает, ИИ его тестирует, и результат виден. Он генерирует корректные ядра, которые работают действительно очень хорошо».
«И я думаю, это просто ещё один признак того, что нас ждёт дальше».
«Сам по себе код уже не обязательно должен быть чем-то, что человек обязан глубоко понимать и разбирать, если ИИ знает, как управлять перемещением данных и вычислительными элементами на том железе, которое вы ему дали».Читать полностью…
Если у вас Mac и вы хотите запускать ИИ локально, стоит попробовать oMLX. Это альтернатива Ollama и LM Studio.
✓ Оптимизирован под Apple Silicon
✓ KV-кэш хранится на SSD
✓ Совместим с Claude Code и Cursor
✓ Оптимизирован под Qwen3.8
https://github.com/jundot/omlx
Начиная с 14 сентября Антропик навсегда увеличивает стандартные недельные лимиты в Claude Code на 25%.
Сейчас действует временное увеличение на 50%. Оно закончится 13 сентября, а с 14 сентября останется постоянное увеличение на 25% относительно обычного лимита.
Это означает, что недельный лимит Claude Code фактически снизится примерно на 17% относительно того, что доступно пользователям сейчас.
Тем временем OpenAI: сбрасывают использование для всех платных пользователей Codex и ChatGPT Work, а ещё исправили несколько ошибок, которые зря съедали лимиты. Теперь того же объёма должно хватать на 10–50% дольше.
Топовую модель с открытыми весами теперь можно запустить дома — по цене подержанного автомобиля.
Zhipu официально опубликовала полные веса GLM-5.3.
🤗 : https://huggingface.co/zai-org/GLM-5.3
Нашёл очень удобное расширение Google Chrome для проверки адаптивности сайтов.
Главная фишка — можно одновременно посмотреть, как страница выглядит сразу на нескольких размерах экрана.
Есть куча настроек, а прокрутку можно синхронизировать между всеми устройствами одновременно.
Полезно для фронтендеров, дизайнеров и вайбкодеров 😎
Tencent выпустила Hy4 Preview — новую модель с открытыми весами под лицензией Apache 2.0.
Это флагманская модель нового поколения на архитектуре смеси экспертов.
У неё 770 млрд параметров, 49 млрд активных, контекстное окно на 1 млн токенов.
Из интересного — Tencent утверждает, что Hy4 смогла параллельно координировать несколько сессий Codex, оценивать их результаты и на основе этого менять направление исследования. В таком режиме модель обошла Codex, работающий в одиночку, сразу на восьми тестах.
Hy4 нацелена на длинные задачи по программированию, работу с несколькими файлами и научные исследования.
Ещё несколько месяцев назад такая модель выглядела бы абсолютным передовым уровнем.
https://hy.tencent.ai/research/hy4-preview