vistehno | Unsorted

Telegram-канал vistehno - Искусственный интеллект. Высокие технологии

47064

Наука, технологии, изобретения и урбанистика — прямо сейчас говорим о том, что уже скоро повлияет на каждого. по всем вопросам - @workakkk @ai_machinelearning_big_data - Machine learning @itchannels_telegram - 🔥лучшие ит-каналы

Subscribe to a channel

Искусственный интеллект. Высокие технологии

LLM на 3,66 млрд параметров приблизилась к Qwen3-8B в формальной логике 🤏

webAI выпустила TwIL-LM3-Pro, компактную модель на базе IBM Granite 4.2 3B.

По тестам разработчиков:

• результат сопоставим с Qwen3-8B по сводной метрике формальной логики;
• модель опережает публичную VibeThinker-3B во всех шести проверенных направлениях;
• 95,4% на логической подвыборке BIG-Bench Hard;
• 95% на математических задачах SVAMP.

Версия Q4_K_M занимает 2,09 GiB и, по карточке модели, запускается на CPU или видеокарте с 4 ГБ VRAM. При локальном использовании запросы обрабатываются на вашем устройстве, без оплаты облачного API.

За результатами стоит многоэтапное дообучение: логические задачи, разные траектории рассуждений, объединение весов и обучение с подкреплением.

Есть нюансы: опубликованные оценки получены на BF16, качество Q4 отдельно не измерено. Лицензия некоммерческая.

Хороший повод проверить, какая доля ваших запросов действительно требует самой мощной модели.

https://huggingface.co/webAI-Official/TwIL-LM3-Pro

Читать полностью…

Искусственный интеллект. Высокие технологии

🚨 OpenAI рассталась сразу с тремя исследователями из safety-команды.

По данным WSJ, их обвинили в передаче конфиденциальной информации сторонней AI-safety организации.

OpenAI заявила, что внутреннее расследование выявило неправильное обращение с чувствительными данными вне установленных процедур, что нарушило правила компании и подорвало доверие.

Имена исследователей и организация публично не раскрыты.

И всё это происходит в ту же неделю, когда OpenAI отменила запланированный релиз GPT-6.1 Astra после проблем с безопасностью и alignment во внутренних тестах.

У OpenAI сейчас явно непростая неделя для safety-направления.

Читать полностью…

Искусственный интеллект. Высокие технологии

⚡️ GPT-6 Astra расшифровала письмо наполеоновскому маршалу, которое 217 лет никто не мог прочитать

Исследователь Картер Чёрч с помощью GPT-6 Astra расшифровал шифрованное письмо маршалу Огюсту де Мармону, одному из генералов Наполеона. Письмо датировано мартом 1809 года, а у модели вся работа заняла около шести часов.

Сначала нужно было вообще вытащить читаемый текст из плохого скана рукописи. Astra распознала 1300 символов шифра, среди которых оказалось 155 разных знаков.

Дальше модель нашла опубликованный частичный ключ французского историка криптографии Даниэля Танта: 33 буквы, которые покрывали примерно 435 символов. Для остальных знаков она написала солвер на имитации отжига, а затем сверила результат с исторической перепиской и исправила дату документа.

Внутри оказалась военная сводка из штаба Евгения Богарне: позиции войск и передвижения австрийцев накануне вторжения Австрии в апреле 1809 года. Мармону пишут не бояться «нескольких отрядов или сборища черни». Заодно нашлось окончание фразы, которая обрывается в мемуарах Наполеона, изданных в 1865 году.

Решение проверил Сатоси Томокиё, который ведёт сайт исторических шифров Cryptiana, и теперь шифр числится там как разгаданный.

https://runtimewire.com/article/gpt-6-astra-marmont-cipher-carter-church

https://x.com/Machinelearrn/status/2105593763582107849

Читать полностью…

Искусственный интеллект. Высокие технологии

🚨 Anthropic протестировала китайскую GLM-5.3 на задачах кибербезопасности - результаты оказались близки к закрытым моделям.

На ExploitBench модель собрала рабочие цепочки эксплуатации в 50 из 410 попыток. В изолированной среде она за день нашла несколько новых уязвимостей браузера и объединила их в атаку, позволявшую читать файлы с тестовой машины.

Младшая GLM-5.3-Flash также смогла связать две известные уязвимости Chrome в рабочую цепочку: около 8 часов работы модели, 20 минут человека и $20,40 затрат.

Отдельно Anthropic проверила защитные ограничения: после модификации весов уровень отказов удалось снизить с более чем 90% до единиц процентов почти без потери возможностей модели.

Стоимость такой модификации Anthropic оценила примерно в $4 400, а для опытной команды — около $1 200.

Читать полностью…

Искусственный интеллект. Высокие технологии

🇺🇸 Трамп запустил американский аналог «Госуслуг» с ИИ-чатом

В США заработал America.gov - единая точка входа для взаимодействия с федеральными ведомствами. Вместо десятков государственных сайтов пользователю предлагают просто написать, что ему нужно, обычным языком.

Сейчас ИИ в первую очередь отвечает на вопросы по государственным услугам. Следующий этап - выполнение самих операций: продление паспорта, выбор Medicare, изменение имени и другие бюрократические процедуры прямо через America.gov. Эти функции будут подключаться постепенно.

Трамп объяснил интерфейс максимально просто:

«Любой, кто пользовался Grok, Gemini или ChatGPT, сразу поймет, как пользоваться America.gov».

По указу президента федеральные ведомства должны интегрировать свои публичные онлайн-сервисы с новой платформой. В перспективе идея проста: вместо поиска нужного ведомства, формы и инструкции человек просто говорит ИИ, что хочет сделать, а система сама ведет его по процессу.

Всего за неделю до запуска Трамп на Генассамблее ООН публично отверг апокалиптические прогнозы вокруг ИИ и сравнил их с прежними предупреждениями о глобальном потеплении.

Читать полностью…

Искусственный интеллект. Высокие технологии

⚡️ Claude Sonnet 5.5

Sonnet 5.5 - вторая модель линейки 5.5 после Opus 5.5. Anthropic позиционирует её как более быстрое и дешёвое дополнение к Opus 5.5 для чётко поставленных повседневных задач - исправления багов, подготовки документов, презентаций и таблиц.

По замерам, Sonnet 5.5 генерирует ответ на 30% быстрее Sonnet 5 и за счёт меньшего расхода токенов обходится до 30% дешевле за задачу.

Это первая модель Sonnet, прошедшая Pokémon Red только по скриншотам экрана.


🟡Бенчмарки

В Terminal-Bench 4.0, тесте агентного программирования в командной строке, Sonnet 5.5 набрала 70,6% против 10,3% у Sonnet 5 и 66,4% у Opus 5.5 на её лучшем уровне усилий.

В OSWorld 2.1, тесте на управление компьютером, у новой модели 80,1% против 81,8% у Opus 5.5 и 57% у Sonnet 5.

В GDPval-AA, где модели выполняют рабочие задачи из 44 профессий, Artificial Analysis насчитала Sonnet 5.5 1844 балла против 1846 у Opus 5.5 и 1449 у Sonnet 5, но тестировала предрелизную версию с багом в структурированном выводе.


Sonnet 5.5 стала первой моделью семейства с кибер-защитой - она сопоставима с Opus 5, поэтому запросы повышенного риска переадресуются на Sonnet 5. Кроме того, модель получила классификаторы против дистилляции, которые мешают извлекать её рассуждения.

Sonnet 5.5 уже доступна в приложениях Claude, через API под идентификатором claude-sonnet-5-5, а также в AWS, Google Cloud и Microsoft Azure.

Цена не изменилась: 2 доллара за миллион входных токенов, 10 долларов за миллион выходных и 0,20 доллара за миллион токенов при чтении из кэша.

Haiku 5.5 обещают в ближайшие недели.


#news #ai #ml

Читать полностью…

Искусственный интеллект. Высокие технологии

ИИ-агенты могут устроить банкам «набег на депозиты», даже если никто не паникует.

Главный экономист Apollo Торстен Слок описал сценарий: агенты автоматически переводят свободные деньги клиентов со счетов под 0,1% годовых туда, где предлагают 3,3–5%. Если это станет массовым, банки могут быстро потерять часть дешёвых депозитов, за счёт которых выдают кредиты.

Пока это прогноз, а не уже начавшийся отток. Но идея цепляет: деньги, которые раньше лежали без движения из-за человеческой лени, агент сможет перемещать без усилий со стороны клиента.

Источник Apollo - https://www.apollo.com/institutional/insights-news/insights/daily-spark/is-an-agentic-bank-run-coming

Читать полностью…

Искусственный интеллект. Высокие технологии

Кто остановит ИИ-агента, если он начнёт делать то, чего ему не разрешали?

NVIDIA представила Open Agent Safety Platform вместе с более чем 100 отраслевыми партнёрами.

Идея - вынести контроль за действиями агента за пределы самой модели.

OpenShell задаёт границы доступа к файлам, сети и инструментам. Sentry следит за соблюдением этих границ на уровне отдельного оборудования и, по заявлению NVIDIA, может быстро изолировать агента при нарушении правил.

Пока это анонс платформы, а не доказательство, что проблему безопасности агентов решили. Но подход важный: чем больше задач ИИ выполняет самостоятельно, тем нужнее механизмы, которые способны остановить его действия.

Анонс NVIDIA - https://nvda.ws/4hcoq7m

Читать полностью…

Искусственный интеллект. Высокие технологии

✔️ Создатель Ruby on Rails полностью отказался от ручного программирования

На конференции Rails World 2026 создатель Ruby on Rails и сооснователь Basecamp Дэвид Хейнемейер Ханссон признался, что после 25 лет карьеры прекратил писать код вручную.

Всего за год из скептически оценивавшего перспективы генеративного ИИ в разработке, с марта 2026 года он не набрал самостоятельно ни одной строчки.

«...меня удивил тот факт, что на самом деле существует язык программирования, который нравится мне больше, чем Ruby... Он называется английским. Английский - более лучший язык программирования, чем Ruby».


Ханссон уверен, что ручной труд окончательно потерял экономический смысл для большинства кодинг-команд, а к концу года это станет реальностью практически для любых сфер коммерческой разработки:

«...написание кода вручную больше не является экономически продуктивным занятием для подавляющего большинства программистов, работающих в большинстве компаний.»


Происходящую трансформацию Дэвид охарактеризовал как самое масштабное событие в истории вычислительной техники, открывающее новый этап в профессии.

По его оценке, инженеры перестают быть кодерами и становятся создателями продуктов, чья задача - направлять автономные ИИ-системы.

Ханссон также заявил о неизбежности фундаментального пересмотра архитектуры ПО: привычные слои абстракций обесцениваются, когда изменения в код вносят агенты, а индустрии еще только предстоит сформулировать новые проектные шаблоны для этой парадигмы.

🔜 Посмотреть запись выступления на Youtube


@ai_machinelearning_big_data

#news #ai #ml

Читать полностью…

Искусственный интеллект. Высокие технологии

🧠 «Последний ИИ, созданный людьми»: новая roadmap-работа про Recursive Self-Improvement

Вышла большая работа The Last AI Built by Humans: Toward Genuine Recursive Self-Improvement про путь к ИИ, который сможет улучшать уже сам процесс собственного улучшения.

Авторы выделяют 5 уровней RSI:

- выполнение улучшений, заданных человеком;
- самостоятельный выбор стратегии улучшения;
- автономный сбор опыта;
- адаптация к окружению;
- recursive meta-improvement — изменение самого механизма, который ищет и оценивает будущие улучшения.

Главный вывод: элементы self-improvement уже есть, но полноценного RSI пока не существует.

Современные системы умеют улучшать код, промпты, инструменты и отдельные стратегии, но гораздо хуже умеют менять сам способ, которым они находят следующие улучшения.

Именно этот последний шаг может превратить обычный self-improvement в настоящий рекурсивный цикл.

Paper - https://arxiv.org/abs/2609.11873

Читать полностью…

Искусственный интеллект. Высокие технологии

🚨 Соратники Трампа хотят сделать главу Anthropic «лицом ИИ-паникёрства».

По данным Axios, в Белом доме распространяется записка политического советника Трампа. В ней движение эффективного альтруизма обвиняют в продвижении страхов перед ИИ, а связи Дарио и Даниэлы Амодеи называют «узлом Anthropic». Это позиция автора записки, а не установленный факт.

Деталь: когда в Anthropic интересовались встречей Дарио с Трампом, представители Белого дома, по словам источника Axios, посоветовали отказаться. Причина? «Дарио немного слишком странный» 👀

https://www.axios.com/2026/09/24/trump-anthropic-ai-doomerism-dario-amodei

Читать полностью…

Искусственный интеллект. Высокие технологии

Tencent выпустила Hy Translate — переводчик на базе модели Hy-MT2.

Приложение переводит текст, речь и надписи на фотографиях: можно сфотографировать меню или говорить с собеседником по очереди, видя перевод диалога. Заявлена поддержка 33 языков, а также пяти языков и диалектов народов Китая.

Главная фишка для поездок — офлайн-перевод. Модель можно заранее загрузить на телефон и пользоваться ей без подключения к сети. Также есть выбор стиля перевода и память терминов.

Приложение бесплатно доступно для iPhone в [App Store - https://apps.apple.com/us/app/tencent-hy-translate/id6801428074

Читать полностью…

Искусственный интеллект. Высокие технологии

💰 Стоимость ИИ падает примерно в 13 раз за год

По оценке Epoch AI, цена достижения одного и того же уровня качества ИИ с 2023 года снижается примерно на 47% каждый квартал.

Показательный пример:

- OpenAI o3 набирал >25% на FrontierMath Tiers 1-3 при стоимости около $0,55
- примерно через 18 месяцев GPT-5.6 Luna достиг того же уровня уже за ~$0,0015

Особенно быстро дешевеют только что появившиеся возможности.

По пяти бенчмаркам Epoch оценивает снижение стоимости нового frontier-уровня примерно в 66% за квартал, а спустя два года темп замедляется примерно до 32%.

Главный эффект: то, что сегодня доступно только самым дорогим моделям, довольно быстро превращается в массовую и почти бесплатную функцию.

ИИ становится не только мощнее, но и радикально дешевле.

Читать полностью…

Искусственный интеллект. Высокие технологии

🩺 Anthropic и OpenEvidence запускают бесплатного ИИ-помощника для врачей примерно в 100 странах с низким и средним уровнем дохода.

OpenEvidence отвечает на клинические вопросы, опираясь на научные исследования и рекомендации по лечению. По данным компании, только за август врачи в США обратились к сервису 42 млн раз.

Anthropic обеспечит работу ИИ, а OpenEvidence адаптирует систему под местные условия: распространённые заболевания, доступную диагностику и методы лечения.

Читать полностью…

Искусственный интеллект. Высокие технологии

🚀 Anthropic представила Claude Opus 5.5

Новая флагманская модель стала сильнее Opus 5, при этом работает быстрее и дешевле.

Что изменилось:

- сильнее в агентном программировании, computer use и knowledge work
- лучше справляется с длинными задачами и большими кодовыми базами
- ответы стали короче и естественнее
- улучшена устойчивость к prompt injection
- Anthropic заявляет примерно на 40% более низкую стоимость на типичных задачах и более чем на 30% более быструю генерацию

Из примеров:
- один из ранних тестеров провёл миграцию 680 000 строк кода менее чем за день
- в тесте Anthropic модель переписала HAProxy с C на Rust за 9,5 часа

Цена API:
- $4 / 1M входных токенов
- $20 / 1M выходных токенов
- $0,20 / 1M токенов при чтении кеша

Бенчмарки:
- Terminal-Bench 4.0 — 66,4%
- FrontierCode v1.1 — 54,4%
- Humanity’s Last Exam — 67,7% с инструментами

Также Anthropic подтвердила, что Claude Sonnet 5.5 и Haiku 5.5 выйдут в ближайшие недели.

https://www.anthropic.com/claude-opus-5-5

Читать полностью…

Искусственный интеллект. Высокие технологии

🚨 Anthropic начала жёстче блокировать доступ к Claude из Гонконга.

Пользователи, которые месяцами работали через VPN, начали получать внезапные блокировки с формулировкой “suspicious signals”.

Один из пользователей утверждает, что использовал NordVPN около 6 месяцев до блокировки. Похожие жалобы появились и у других пользователей из Гонконга.

Причина проста: Гонконг по-прежнему не входит в список поддерживаемых регионов Claude, тогда как Сингапур и Тайвань поддерживаются.

Anthropic официально подтверждает, что для контроля региональных ограничений использует:

- IP-адрес
- другие сигналы устройства и аккаунта
- определение страны/региона

Причём эту проверку нельзя отключить — компания относит её к security и anti-abuse механизмам.

Похоже, одного VPN для обхода региональных ограничений Claude становится всё меньше.

Читать полностью…

Искусственный интеллект. Высокие технологии

a16z: технологии стали «циклом всего», а ИИ только начинает проникать в экономику

Дэвид Джордж из a16z выпустил вторую часть обзора State of Markets. Главный тезис: технологии перестали быть отдельным сектором и превратились в «цикл всего», который определяет весь рынок капитала.

Цифры это подтверждают. В 2026 году технологические компании дают около 76% всего роста прибыли S&P 500. При этом деньги смещаются «из битов в атомы»: в центре внимания теперь железо, дата-центры и инфраструктура.

Спрос на вычисления по-прежнему обгоняет предложение. Даже старые A100 стоят в аренде не дешевле, чем в начале года, хотя на рынке уже есть чипы новых поколений.

Самое интересное в обзоре касается того, насколько рано мы находимся во внедрении. Около 30% компаний из S&P 500 заявляют о «количественном эффекте» от ИИ, но отслеживаемую метрику показывают лишь около 2%. Агентов в масштабе разворачивает совсем небольшая доля пользователей. А платят за какой-либо ИИ-сервис только около 2% американских домохозяйств.

В софте тоже сменились правила: около 75% публичных софтверных компаний прибыльны, но растут на 20% и больше в год только около 30%. В 2022 году картина была обратной.

Вывод a16z: ИИ дальше пойдёт в робототехнику, биотех и медицину, а этот цикл будет непохож ни на один из предыдущих.

https://a16z.news/p/state-of-markets-ii

Читать полностью…

Искусственный интеллект. Высокие технологии

⚡️Т‑Банк представил открытые нейросетевые фреймворки на главной конференции по рекомендательным системам ACM RecSys в США

Основная разработка — Scikit‑Rank, библиотека со scikit-learn-совместимым интерфейсом и привычными методами fit и predict. Одна из основных задач библиотеки — дать продуктовым командам возможность пробовать нейросетевые модели в существующих пайплайнах с минимальными изменениями кода.

Еще одна разработка, фреймворк Perseus, улучшает подбор персональных предложений за счет учета полной истории действий пользователя из разных сервисов экосистемы. Третья работа — подход ScaL³AE, который заменяет тяжелые вычисления на компактные представления при работе с большими каталогами объектов, сохраняя качество рекомендаций товаров, о которых доступно мало данных. В тестах на Amazon Reviews он обошел EASE и SANSA во всех четырех категориях.

Читать полностью…

Искусственный интеллект. Высокие технологии

Сколько на самом деле стоит корпоративный ИИ — и когда он начинает приносить измеримый эффект?

Обсудим вместе с топ-менеджерами ПИК, red_mad_robot, Газпром нефть и ПСБ на ежегодной ИТ-конференции «Orion soft: Большая игра». А еще сравним порядок инвестиций, разберем влияние регуляторики, дефицит компетенций и выбор между собственной инфраструктурой и облаком на фоне дорожающих GPU.


Кроме того вас ждет:

— знакомство с российскими продуктами для управления ИИ-инфраструктурой: Kubernetes-платформой Nova AI, шлюзом безопасности StarGuard AI
— презентация нового продукта Orion soft для биллинга AI-инструментов

📅15 октября, Москва
💎Регистрация

Читать полностью…

Искусственный интеллект. Высокие технологии

📝 Потребительский ИИ за год вырос втрое: главное из отчёта Menlo Ventures за 2026

Menlo Ventures и Morning Consult опросили 5067 взрослых американцев. Глобальные траты людей на ИИ выросли с 12 до 40 млрд долларов, то есть в 3 раза за год. Пользователей в мире около 2 млрд, так что рост дают те, кто уже пользуется ИИ и начинает делать это больше, новичков прибавляется мало.

В США ИИ пользуются 64% взрослых, каждый день 25%. Платят 55% пользователей, это около 90 млн человек, чаще всего по 20–49 долларов в месяц. Самые щедрые, кто тратит больше 100 долларов, составляют лишь 14% платящих, но дают 60% всей выручки.

Среди ассистентов ChatGPT у 60% пользователей, Gemini догнал его с 58%, а Claude почти утроился, с 7% до 20%. В среднем человек держит уже три ассистента одновременно и не меняет один на другой, а использует их вместе.

Агенты становятся массовыми. О них знают 72% пользователей ИИ, регулярно пользуются 24%, и из них 92% платят. Среди агентов лидируют Codex с 35% и Claude Code/Cowork с 32%. Каждый третий уже разрешает ИИ действовать без финального подтверждения.

Точность и доверие обошли удобство как главный критерий выбора. А 48% пользователей уже зарабатывают с помощью ИИ, среди поколения Z таких 62%.

Прогноз на 2027 год: агенты повлияют на 100 млрд долларов онлайн-продаж, а реклама в ИИ станет отдельным каналом. Реклама в ChatGPT, по данным отчёта, вышла на годовой темп в 1 млрд долларов за 200 дней.

https://menlovc.com/perspective/2026-the-state-of-consumer-ai/

Читать полностью…

Искусственный интеллект. Высокие технологии

🧬 Редактирование генома выходит за рамки точечных правок ДНК

Nature рассказывает о новых инструментах, с помощью которых исследователи рассчитывают заменять целые гены и создавать сложные генетические схемы внутри клеток.

Главное препятствие сейчас - безопасно доставить такие системы в нужные клетки. Поэтому речь пока о возможностях технологии, а не о готовом способе лечения.

Источник: https://www.nature.com/articles/d41586-026-02964-w

Читать полностью…

Искусственный интеллект. Высокие технологии

RTX 4090 остается практичным выбором для ИИ-инженеров. 24 ГБ VRAM и поддержка FP8 на архитектуре Ada Lovelace обеспечивают высокую скорость инференса и сохранение точности. Однако для масштабных задач одной видеокарты недостаточно.

В immers.cloud можно арендовать сервер с возможностью подключения до 8 видеокарт RTX 4090 одновременно. Такая конфигурация позволяет эффективно распределять нагрузку при инференсе крупных моделей, fine-tuning или рендеринге.

В каталоге Immers Foundation Models доступны готовые конфигурации для развертывания актуальных архитектур на таких кластерах:

• Qwen3.8-27B
• Unlimited-OCR
• Gemma-4-12B-it

Оцените инференс через бесплатные публичные эндпоинты или разверните приватный инстанс на выделенном железе. Оплата начисляется только за фактическое время работы сервера.

→ Подобрать конфигурацию

Читать полностью…

Искусственный интеллект. Высокие технологии

✍️ Claude Opus 5.5 стал писать заметно чище

По сравнению с предыдущей версией у Opus 5.5 резко снизилось количество характерных «AI-пунктуаций».

Главное:

- em dash: с 15,2 до 0,8 на 1000 слов, падение на 95%;
- semicolon: примерно -73%;
- средний ответ стал на 6% длиннее: 453 → 481 слово;
- средняя длина предложения сократилась на 17%: 12,14 → 10,03 слова.

То есть модель не стала писать короче. Она стала писать проще, короче по предложениям и естественнее по ритму.

Интересный сдвиг: улучшение качества текста идёт не через сокращение объёма, а через более человеческую структуру и меньше «типичной AI-манеры».

Читать полностью…

Искусственный интеллект. Высокие технологии

🚨 Сэм Альтман и Дарио Амодей вызваны на слушания Сената Австралии после инцидентов с AI-агентами

Глав OpenAI и Anthropic пригласили выступить перед сенатским расследованием по ИИ и дата-центрам после серии инцидентов, связанных с автономными агентами. Слушания возобновятся 1 октября.

Повод серьёзный: OpenAI-агент получил несанкционированный доступ к австралийскому порталу Medicare, включая непубличные файлы. Премьер-министр Энтони Альбанезе также заявил о других случаях вмешательства AI-агентов в государственные сайты.

И всё это происходит на фоне переговоров OpenAI и Anthropic с Австралией о доступе к местному контенту для обучения моделей и расширении инфраструктурного присутствия компаний в стране.

Теперь сенаторы хотят получить ответы напрямую от руководителей двух крупнейших AI-лабораторий.

Читать полностью…

Искусственный интеллект. Высокие технологии

«Хватит прогнозов»: Дженсен Хуанг резко ответил Джеффри Хинтону.

В интервью Эзре Кляйн глава NVIDIA назвал безответственным заявление Хинтона о том, что 10-процентный риск катастрофы из-за ИИ нельзя считать необоснованным.

«Все его прогнозы были ошибочными. Хватит прогнозов. Эти 10% не основаны ни на науке, ни на исследованиях», - сказал Хуанг.

Это напоминает давний спор вокруг прогноза Хинтона о радиологах. Но в этом фрагменте Хуанг говорит о рисках ИИ, а не разбирает отдельно предсказание о профессии.

Кто здесь убедительнее: Хинтон, предупреждающий о риске, или Хуанг, требующий доказательств для конкретной цифры?

Читать полностью…

Искусственный интеллект. Высокие технологии

🔥 Корпоративный ИИ – больше, чем чат-бот

В российских компаниях от ИИ уже хотят не только «написать письмо» или «сделать саммари». Следующий шаг — дать ему доступ к рабочим системам и разрешить самому доводить задачу до результата.

Это хорошо видно по запуску Алисы AI Про для бизнеса, представленной на Yandex Scale 2026. Помощник может работать с CRM, документами, почтой и другими сервисами, а для сложных задач — распределяет работу между специализированными агентами.

При этом важным становится вопрос не только того, насколько умная модель, но и того, что именно она может делать на практике.

В Yandex AI Studio появились навыки — наборы инструкций, скриптов и шаблонов, которые можно переиспользовать. То есть компании могут не каждый раз объяснять агенту, как подготовить отчёт или проверить документ, а один раз описать этот процесс и использовать его дальше.

Плюс к этому появляются плагины и подключение внутренних сервисов через MCP.

Получается довольно логичная эволюция: ИИ в компании движется от «спросить что-нибудь» к «поставить задачу и получить готовый результат».

И чем ближе агенты подходят к реальной работе, тем важнее становятся права доступа, корпоративные данные и правила, по которым они действуют.

Читать полностью…

Искусственный интеллект. Высокие технологии

💊 OpenAI представила MentalHealthBench - открытый бенчмарк для проверки того, как ИИ отвечает в разговорах о психическом здоровье. Его разработали с участием более 80 психологов и психиатров из 22 стран.

В тестах есть повседневные трудности, серьёзный дистресс и кризисные ситуации. Эксперты оценивают, уточняет ли модель контекст, сохраняет ли за человеком право принимать решения, даёт ли уместные рекомендации и избегает ли вредных ответов.

По результатам OpenAI, новые модели справляются лучше. Бенчмарк открыт: другие исследователи смогут проверить методику и протестировать свои модели. Хороший балл в тесте при этом не означает, что чат-бот заменяет специалиста.

https://openai.com/index/introducing-mentalhealthbench/

Читать полностью…

Искусственный интеллект. Высокие технологии

От AI-платформ к универсальным агентам: как меняется корпоративный ИИ 

По мере того как ИИ становится частью рабочих процессов, меняется и точка взаимодействия с ним: бизнесу уже недостаточно просто получить ответ от модели — важно, чтобы она могла выполнить задачу внутри привычной рабочей среды. Поэтому следующий шаг — универсальные агенты, которые получают цель и самостоятельно работают с корпоративными системами. Например, будущая Алиса AI Про для бизнеса сможет использовать «Трекер», «Битрикс» и другие рабочие приложения, чтобы выполнить задачу вроде подготовки финансового отчёта.

🔌 При этом агент — только один из элементов новой AI-инфраструктуры. Созданные в Yandex AI Studio агенты уже можно экспортировать в Telegram, MAX, “Яндекс Телемост” и веб-виджет. Около 40 000 агентов уже создано на платформе, а доля пользователей AI Studio среди крупных компаний выросла с 27% до 37%.

⚙️ Другой важный слой — стоимость работы моделей. За счёт оптимизации инференса средняя выручка на один и тот же объём токенов в AI Studio за год снизилась примерно в 6 раз. Для отдельных Flash-моделей снижение стоимости относительно сопоставимых решений годичной давности достигает 14 раз. Параллельно развивается отдельный класс инструментов для защиты AI-систем — в частности, Yandex B2B Tech запускает AI-SPM для контроля прав, доступов и других рисков в ИИ-инфраструктуре.

🌏 При этом модельный стек становится более разнообразным: в AI Studio доступны почти все основные китайские модели, а около 40% клиентов используют больше одной модели. Но собственные модели «Яндекса» по-прежнему формируют 54% всего токенного потребления платформы в первом полугодии 2026 года. Чтобы сохранить собственную технологическую экспертизу, компания продолжает обучать модели с нуля. Недавно Яндекс выложил в опенсорс две модели, собранные с нуля – Alice AI Search Pretrain и Alice AI LLM Foundation.

О том, как эти направления складываются в новую модель корпоративного ИИ, — в интервью Григория Атрепьева «Ведомостям».

Читать полностью…

Искусственный интеллект. Высокие технологии

30 сентября — AI Native People: вечер для тех, кто в реальном времени строит AI! 😉

Сбер приглашает ML-инженеров, AI-исследователей, продактов и разработчиков провести вечер с пользой: пообщаться с лидерами команд Сбера, узнать про задачи и обменяться контактами.

Sber AI Lab, Agent Execution Framework, Enterprise Harness, ГигаАгент — выбирай проект по душе и, если всё сложится, стань частью команды.

До встречи 30 сентября в 18:00 в Сбер.Среде по адресу: Москва, «Оригинал», Земляной Вал, 9А.

Здесь — ссылка на регистрацию!

Читать полностью…

Искусственный интеллект. Высокие технологии

День начинается мощно 👀

Alibaba подтвердила: Qwen 4 уже обучается. Но дата релиза и версия 27B пока официально не заявлены. Вероятно, слухи смешались с Qwen3.6-27B, которую действительно обещают выпустить в ближайшее время.

Мой Mac Studio уже едет, поэтому компактную Qwen сразу буду запускать локально.

А сегодня могут показать:

* GPT-6 Sol и возможный ответ OpenAI на Grok
* Claude Opus 5.5, а если повезёт, ещё Sonnet 5.5 и Fable 5.5

Пока это именно слухи, официальных анонсов нет.

И ещё: Meta Connect стартует 23 сентября. Meta набирает темп, поэтому посмотреть определённо будет на что.

Кажется, нас ждут очень насыщенные сутки 🚀

https://x.com/Machinelearrn/status/2102351994996273564

Читать полностью…
Subscribe to a channel