46226
First Telegram Data Science channel. Covering all technical and popular staff about anything related to Data Science: AI, Big Data, Machine Learning, Statistics, general Math and the applications of former. To reach editors contact: @malev
Привет!
Встречайте новый воскресный выпуск "Капитанского мостика" 20.09.2026. Участники разбирают главные ИИ-события недели: релиз мультимодального Qwen 3.8-Omni-Flash, отмену гардрейлов Трампом и TPU-кластер от Huawei как вызов Nvidia.
Традиционно ведущие подкаста - Валентин Малых и Дмитрий Колодезев, в гостях у капитанов был Валентин Мамедов, тимлид команды претрейна Гигачат.
Смотрите видео на каналах ⤵️
ODS VK Video
ODS YouTube
📩 Присылайте новости для обсуждения в канал "Дата-капитаны" в mattermost (авторизуйтесь через ODS.ai).
Приглашаем порешать 🌱 Alfa Connectome 🌱 — соревнование по нейронкам от HFT-фонда Wunder Fund.
В этот раз датасет гораздо больше, чем в прошлых двух соревках. Вы будете изучать исторические торговые данные для двух связанных инструментов: ордербуки, сделки и кое-что еще. По этой информации вам нужно будет предсказывать индикаторы будущей цены для одного из инструментов.
Кванты регулярно сталкиваются с такой задачей.
В соревновании используются реальные маркет-данные.
Когда
11 сентября — 15 ноября
Призовой фонд
$13,600
Победители получат денежные призы, приглашение побеседовать в Wunder Fund, а главное — большое интеллектуальное удовольствие.
Wunder Fund c 2014 года занимается HFT — высокочастотным алготрейдингом. Торгуем на многих биржах по всему миру, как традиционных, так и криптовалютных. Наш дневной торговый оборот около ~$10 млрд.
>_ Поглядеть на соревку
Большой релиз библиотеки ударений в silero-stress для русского языка
1️⃣ Переразметили список омографов;
2️⃣ 395 новых омографов, всего 2208 омографов;
3️⃣ Разметили "идеальную" валидацию из 100К предложений с тройным перекрытием;
4️⃣ Добавили в трейн ~54М новых предложений (всего стало 195М);
5️⃣ Решили проблему с "дрожанием" результатов модели;
6️⃣ Добавили регулярки и словосочетания для самых популярных омографов и добавили функционал для пользователей для добавления собственных регулярных выражений и словосочетаний.
⬆️https://habr.com/ru/article/1079674
⭐️ https://github.com/snakers4/silero-stress
Привет!
🦜 Уже на следующей неделе стартует новый сезон курсов осень 2026 г. на ODS.ai 🔥, не пропусти!
15 сентября мы вновь перезапускаем онлайн-курс Natural Language Processing & LLMs. Регистрация на курс уже открыта.
Что мы будем проходить:
▫️закон Ципфа, TF-IDF, RNN, CNN, Transformer и большой упор сделаем на LLM, агентов тоже не обойдем вниманием;
▫️основные задачи NLP: классификация текста, тегирование, генерация;
▫️еще NLP для кода, RL для LLM, и не только.
Переходи по ➡️ ссылке и становись участником курса 💪
Всех ждём!
Сегодня мы опенсорсим модель, результатом работы которой пользуются 49,5 млн пользователей ежемесячно
Наша компактная языковая модель, обученная с нуля, формирует быстрые ответы Алисы AI под поисковой строкой. Артур Петросян, Назар Погосский, Никита Семёнов, Антон Викторов и Дима Калашников разобрали на Хабре, как она устроена и как её обучали. Ниже коротко о главном.
AliceAI-T5-35B-A0.6B — Encoder–Decoder с 34,35B параметров и разреженными MoE-слоями: в каждом для токена выбираются восемь экспертов из 512. Архитектуру подбирали под поисковый сценарий — обработать найденные документы и быстро сформировать ответ. Претрейн шёл на 15 триллионах токенов на задаче UL2-денойзинга. Затем контекст растянули с восьми до 128 тысяч токенов через YaRN. Как итог претрейна: после одинаковой процедуры алаймента — у AliceAI-T5-35B-A0.6B-Base 77% винрейта против Qwen3.5-2B в слепом SbS.
Отдельный сюжет — балансировка MoE. При масштабировании обучения балансировка со вспомогательным лоссом оказалась нестабильной: роутинг в энкодере коллапсировал. Переход на aux-free routing из DeepSeek-V3 решил проблему.
В поисковом пайплайне BERT-подобный экстрактор на 80 млн параметров сокращает документы до полезных для генератора фрагментов. Для его дообучения алгоритм на основе Cross-Entropy RL подбирает варианты контекста с учётом качества ответа и штрафа за длину. Сокращение контекста дало около +40% к пропускной способности без потери качества в наших экспериментах. Для продуктовой версии — SFT на ответах, отобранных через Rejection Sampling или улучшенных через Critique & Revision; затем RLHF на GSPO. Пользовательские сигналы тоже идут в обучение: отдельная reward-модель предсказывает Профицит и даёт один из сигналов для RLHF.
У итоговой модели в онлайн-эксперименте винрейт 56,7% против Google AI Overview. Приглашаем пощупать модель, почитать статью и поделиться впечатлениями в комментариях!
ML Underhood
Доброе утро! ☀️
Встречайте воскресный выпуск подкаста "Капитанский мостик". Ведущие Валентин Малых и Дмитрий Колодезев разбирают главные ИИ-события недели: релиз Fable 5.1, выход GPT 6 с заявлениями про AGI и, с точностью до наоборот, законодательную инициативу США о запрете суперинтеллекта.
Смотрите видео на каналах ⤵️
ODS VK Video
ODS YouTube
📩 Присылайте новости для обсуждения в канал "Дата-капитаны" в mattermost (авторизуйтесь через ODS.ai).
Я успеваю отмечать как быстро эволюционирует harness для AI продуктов только по тем мелочам, как меняется мой пользовательский опыт. Вот уже есть background режим в котором Claude сам дождался смены DNS на Cloudflare и пошёл шуршать над задачей дальше.
До чего дошёл прогресс…
Сегодня мы вышли из stealth!
Про нас написали Wired (с заголовком these russian mathematicians ахах), а еще мы опубликовали блог пост с описанием технологии. Все ссылки в этом посте, буду очень рада если сможете репостнуть и прокомментировать :)
https://x.com/aimalysheva/status/2095232794792255848
🍰 Бесконечный ИИ-слоп в прямом эфире
@levelsio запустил Infinite Slop — интерактивный AI-стрим, который генерируется на лету и никогда не заканчивается 📺
• Видео создаётся в реальном времени, а зрители в чате пишут любые фразы, и ИИ вплетает их в сюжет следующего клипа, стараясь связать с предыдущим отрывком 🎬
• Идею подсказал @marcantoinefon, вдохновившись оригинальным стримом @rehan_shei
• Инфраструктуру спонсирует fal.ai, который дообучил модель Minimax H3 до версии “Max” — она стала в 50 раз быстрее базовой ⚡
• Раньше на генерацию 15 секунд видео уходило 2-5 минут, теперь ролики выходят быстрее, чем их успеваешь смотреть, то есть видео-модель обгоняет реальное время воспроизведения
Технически это первый публичный кейс, где генерация видео работает быстрее просмотра, а не наоборот. Если у вас есть доступ к API fal, стоит присмотреться к Max как к варианту для интерактивных форматов, где задержка критична: чат-боты с видео-ответами, live-реакции, генеративные вывески.
Кто первым напишет в чат стрима что-то настолько странное, что ИИ не сможет это связать с прошлым кадром? 😏
Я водил сегодня почти 7 часов и уставший залип конкретно на слоп.
https://skunkworks.levels.io/infinite-slop/
Бонус-стрим на Твиче: https://www.twitch.tv/rehanfal (уже прибили за нарушение правил Твича) Чел пробует крутить в других сервисах, его банят https://x.com/rehan_shei/status/2093570456033091595?s=46
@aizvestia
#новостИИ
Работа посвящённая созданию онтологически-ориентированных ИИ-систем для химии (технология применяется в системах Palantir)
Суть подхода — оцифровка химических знаний с помощью формальных онтологий и построенных на их основе правил вывода. Это позволяет сократить расход токенов, ускорить обработку запросов и повысить точность ответов по сравнению с классическими методами.
Разработка позиционируется как узкоспециализированный аналог Wolfram|Alpha, но исключительно для химии, и послужила теоретической основой для проекта ChemWolf.
Пока длилось рецензирование, автор уже собрал рабочий прототип. В планах — валидация, эксперименты с моделями для генерации первых перспективных молекул и последующие лабораторные испытания. Конечная цель — выход на промышленный уровень: например, создание ткани для футболки из молекулы, спроектированной с помощью ChemWolf, и её появление на рынке. Это превратило бы инструмент в полноценное промышленное ИИ-решение в области химии.
Ссылка: https://arxiv.org/abs/2608.26164
Автор исследования: @realmedoyed
OpenCode появилась загадочная модель Ox Alpha - и первые тесты выглядят очень хорошо
Новая stealth-модель Ox Alpha уже появилась у пользователей OpenCode, но её происхождение пока официально не раскрыто.
В одном из первых небольших прогонов на 10 сложных DeepSWE-задачах ей приписывают около 80% успешных решений - выше Fable 5, GLM-5.3, Grok 4.6 и GPT-5.6 Sol в том же мини-тесте.
Важно не путать это с официальным DeepSWE leaderboard: полный бенчмарк содержит 113 задач, и публичного полноценного результата Ox Alpha пока нет. Сам DeepSWE сейчас возглавляют frontier-модели примерно в районе 70+% pass@1.
По сообщениям пользователей, Ox Alpha также идёт с большим контекстом и сейчас доступна бесплатно/в промо-режиме, поэтому её активно гоняют на coding и agentic-задачах.
В сообществе уже подозревают, что под капотом может скрываться одна из новых китайских моделей, но это пока лишь догадки.
@machinelearning_interview / Папка полезного по ML.
https://x.com/Machinelearrn/status/2090758575475794270
✔️ Хакеры использовали ИИ для атаки на энергетические и государственные системы Тайваня
Тайваньское Министерство цифровых технологий и израильская ИБ-компания Dream заявили об атаке, в которой злоумышленники использовали ИИ. Инцидент произошел в июле 2026 года.
По их данным, за основу хакеры взяли открытую модель и переделали ее в агента, ведущего атаку самостоятельно. Название модели не сообщается.
Часть действий хакеры выполняли сами, а агент, по описанию исследователей, работал не как обычный скрипт, а скорее как слаженная команда специалистов, подхватывая и дополняя ручные действия.
Под удар попали Управление по ядерной безопасности и минимум семь энергетических компаний. Всего были скомпрометированы 85 учетных записей сотрудников и похищено больше 2500 записей с кадровыми данными.
Затронуты ли технологические системы ядерных объектов или только административный контур, не уточняется.
🚀 Z.ai представила GLM-5.3 - новую открытую модель с упором на код и кибербезопасность.
У GLM-5.3 та же базовая модель, что и у GLM-5.2. В Z.ai говорят, что весь прирост получили уже после pre-training - за счёт масштабирования post-training.
Больше исполняемых сред, более длинные задачи, сильнее verifiers и больше reinforcement learning.
Результат особенно заметен в кибербезопасности: на ExploitBench результат вырос с 24,4% до 54,4%, а в ExploitGym модель за два часа решила 105 задач против 29 у GLM-5.2.
То есть pre-training даёт модели знания и сырой интеллект, а post-training учит реально им пользоваться: планировать, вызывать инструменты, проверять решения, исправлять ошибки и работать на длинном горизонте.
Технический разбор:
https://z.ai/blog/glm-5.3
@data_analysis_ml Полезные мл ресурсы
👣 Google внезапно объяснила, почему Go может стать главным языком эпохи AI-кодинга
Код теперь пишется слишком быстро. Агент за несколько секунд может выдать сотни строк, переписать пакет или собрать целый сервис.
Проблема сместилась туда, где автоматизация пока не спасает: всё это нужно прочитать, проверить и потом годами поддерживать. Именно на этом Google строит свежий аргумент в пользу Go.
Go изначально проектировали для больших команд и долгоживущих кодовых баз. Поэтому здесь почти невозможно устроить соревнование по синтаксическим фокусам.gofmt приводит код к одному виду, стандартная библиотека закрывает огромный пласт задач, а компилятор быстро ловит выдуманные методы, неправильные типы и другие типичные ошибки LLM.
Сгенерировал код, запустил компилятор и тесты, получил ошибку, исправил, повторил.
Рядом уже лежат fuzzing, govulncheck, gopls, go fix, профилирование и tracing. Агенту не приходится каждый раз собирать собственный зоопарк инструментов.
Есть и менее очевидный бонус. Go-код в разных проектах обычно выглядит похоже.
Меньше вариантов выразить одну и ту же конструкцию, меньше сюрпризов при ревью, проще заметить галлюцинацию модели или странную зависимость.
Для мира, где код начинают генерировать в огромных объёмах, такая предсказуемость становится очень дорогим преимуществом.
Получается забавно: Go долго критиковали за синтаксис, жёсткие правила и отсутствие лишней магии. А теперь именно эти качества неожиданно делают его одним из самых удобных языков для работы с coding agents.
https://developers.googleblog.com/why-go-is-an-ideal-language-for-ai-assisted-software-engineering/
#Golang #Go #AI #Programming #AIAgents
@Golang_google
Доброе утро! ☀️
Представляем Вашему вниманию воскресный выпуск подкаста "Капитанский мостик". Ведущие Валентин Малых и Дмитрий Колодезев обсуждают последние новости в области ИИ, кибербезопасности и научных исследований, а также их влияние на будущее технологий и общества.
В гостях у капитанов был Игорь Кураленок, руководитель поиска в Ozon.
Смотрите видео на каналах ⤵️
ODS VK Video
ODS YouTube
📩 Присылайте новости для обсуждения в канал "Дата-капитаны" в mattermost (авторизуйтесь через ODS.ai).
Друзья! у нас последний день регистрации на офлайн Practical ML Conf — https://pmlconf.yandex.ru/2026/
Регистрируйтесь) А те, кто могут только онлайн — ждем в гости онлайн!
ODS.ai, together with IITU, has launched a coding competition for AI agents. The competition will be held in three stages: in the first stage (currently underway), participants solve the given tasks on their own infrastructure using any agents; in the second & third stages, the same task will be evaluated in an isolated environment.
The top 3 participants will have the opportunity to present their work at ICSE 2027, a software engineering conference.
Interested? Please join!
Ну всё, муху подключили к FPV-дрону, на этом можно заканчивать😅 походу пора оцифровывать мозг паука🤔🕷
Читать полностью…
Доброе утро! ☀️
Представляем Вашему вниманию новый выпуск подкаста "Капитанский мостик". Ведущие Валентин Малых и Дмитрий Колодезев разбирают главные ИИ-события недели: релизы GigaChat 3.5 Reasoning, HuggingFace Chat и Sakana Fugu Ultra, а также попытку спецслужб США ограничить дистилляцию моделей.
Смотрите видео на каналах ⤵️
ODS VK Video
ODS YouTube
📩 Присылайте новости для обсуждения в канал "Дата-капитаны" в mattermost (авторизуйтесь через ODS.ai).
Ходят слухи что OpenAI решили Уравнения Навье–Стокса - одну из 7 задач тысячелетия с призом 1млн баксов.
Слух пошёл от математика Тристана Бакмастера из New York University - Он утверждает, что ему сообщили: внутренняя исследовательская модель OpenAI получила примерно 100-страничное доказательство blow-up для 3D Navier–Stokes — то есть потенциально решила одну из главных нерешённых задач математики и одну из задач тысячелетия.
Ждём анонса 🍿
Хм ну с SVG контроллером бенч уничтожен (если конечно диванные критики не придерутся к мелким неточностям, гляньте просто что месяц назад нейронки выдавали), едем дальше 🎮
Если что SVG сверху, реальное фото снизу (как референс не давал)
просто напоминаю, дальше эти сущности будут только способнее🤖
таск съел 2% недельного лимита на very high ефорте
Major release от нашей небольшой лабы. Поддержка спекулятивного декодинга в нашем инференс движке.
Для начала Qwen3.6 27B, поддержка Qwen3.8 27B и Muse Glimmer в пути.
Мы сильно превосходим все возможные стеки для Apple Silicon по производительности. Потому что взяли и все сделали как ко-дизайн: кернелы, квантизация и спекуляция. Все с нуля, все свое.
Попробовать можно уже сегодня
M checkpoint - поменьше
L checkpoint (lossless)
Все модели которые мы поддерживаем лежат тут, будем рады если попробуете что-то еще.
Бенчи тут. Можно изучить как и что измерено и насколько лучше.
Подробнее про релиз блог пост
всем привет, я вернулся из отпуска, так что новый выпуск Капитанского мостика от меня и Дмитрия Колодезева
#КапитанскийМостик
Валентин Малих и Дмитрий Колодезев разбирают главные ИИ-события: сделку NVIDIA и Hugging Face, борьбу OpenAI и Cursor за пользователей и то, почему модели побеждают ценой и скоростью, а не интеллектом. Затем — роботы: почему гуманоидам нужен ещё десяток лет, зачем Китай роботизируется и почему телеприсутствие придёт раньше автономии. Финал — сингапурский проект, где живые человеческие нейроны работают как суперкомпьютер. Трезвый взгляд на ИИ и робототехнику без хайпа.
ODS VKVideo
ODS YouTube
мой дзен
@valuableai
✔️ Nvidia покупает Hugging Face
Сумма сделки - $12,9 млрд. По данным инсайдеров, стороны находятся на стадии оформления, официальных комментариев от обеих компаний пока нет.
Переговоры ускорились после того, как Hugging Face получила предложение о поглощении от другого неназванного игрока и привлекла банк для оценки спроса.
Для Nvidia это выход за пределы железа и прямой контроль над площадкой, через которую расходится и разрабатывается основная масса открытых моделей. Ровно поэтому сделка почти наверняка заинтересует антимонопольные органы.
theinformation.com
✔️ Бигтех подписал открытое письмо об ИИ в кибербезопасности
OpenAI, Microsoft, Google, Anthropic, AWS, Cisco, CrowdStrike и еще около сотни компаний призвали защищать критическую инфраструктуру от атак, написанных с помощью ИИ, - тем же ИИ.
Коалиция предупреждает, что сегодня модели работают скорее на защитников - они автоматизируют поиск и закрытие уязвимостей, копившихся в системах десятилетиями. Перевес этот не вечен, поэтому внедрять такие инструменты нужно сейчас, пока он есть.
Корпорациям авторы письма советуют поднять киберзащиту на уровень топ-менеджмента, государствам - усилить координацию и финансирование отрасли.
openai.com
✔️ Anthropic встроила браузер в Claude
Через боковую панель Claude сам открывает сайты, читает страницы, кликает по элементам и заполняет поля. Пригодится, когда нужно снять цифры с дашборда, у которого нет API, или заполнить форму.
Работает это в изолированной среде - вкладок, закладок и паролей пользователя Claude не видит. Авторизацию можно перенести из Chrome, Edge или Firefox, но точечно - сессия привязывается к конкретной странице, а не отдается целиком. Почтовые клиенты и банковские сайты закрыты наглухо.
Функция появится на этой неделе у подписчиков Pro, Max, Team и Enterprise. Если нужно работать с уже открытыми вкладками, Anthropic советует расширение для Chrome.
claude.com
✔️ Google обновила Gemini Omni Flash до 1.1
Видеомодель умеет как генерировать, так и редактировать. Сцену выдает длиной до 40 секунд, опираясь на 10 секунд предыдущего видеоряда. На вход принимает текст, звук, изображения и видео.
Появилось ручное задание первого и последнего кадра, плюс черновой режим - он на 60% быстрее и втрое дешевле обычного, а понравившийся результат потом поднимается до 4K.
Секунда видео стоит 3 цента в 360p и 30 центов в 4K. Все, что генерирует модель, помечается невидимым знаком SynthID.
Модель доступна в Google AI Studio и через Agent Platform API, а подписчикам AI Plus, Pro и Ultra - еще и в Google Flow и приложении Gemini.
blog.google
✔️ ИИ-агент Instinct хайпует среди инвесторов Кремниевой долины
Стартап Spear Street Technology закрывает раунд на 250 млн долларов при оценке в 2,5 млрд. Ведут раунд Benchmark и Index Ventures. Основатель - 23-летний Ноа Шинн, автор метода Reflexion, до этого работавший в Sierra.
Instinct он делает как персонального агента, которого не нужно настраивать. Чтобы тот управлял компьютером, разбирал почту, бронировал билеты и проводил платежи, достаточно написать ему сообщение или позвонить голосом.
Первые тестировщики называют его "OpenClaw для обычных людей".
При этом продукт в закрытой бете, выручку и число пользователей стартап не раскрывает.
wsj.com
@ai_machinelearning_big_data
#news #ai #ml
🧠 ICT.Moscow представил первый референс-бук аналитики об ИИ
ICT.Moscow отобрал наиболее заметную аналитику 2025 года по искусственному интеллекту от более чем 100 российских и зарубежных авторов, объединив ее в формате каталога-справочника.
Каждое исследование (а их 121) сопровождается коротким пересказом и приводится по хронологии выхода на площадках первоисточников в 7 категориях:
➝ состояние рынка
➝ технологические направления
➝ программирование и ИИ
➝ применение и эффекты в разных сферах и отраслях
➝ кадры
➝ отношение и восприятие (включая этику)
➝ прогнозы и форсайты
Такой каталог удобно распечатать, чтобы иметь под рукой как навигатор по авторитетным исследованиям за год, покрывающим разные аспекты искусственного интеллекта: от общего состояния рынка к кейсам применения и прогнозам.
🖍Вне зависимости от географии аналитики преимущественно писали о применении ИИ, а также о разных технологических направлениях. Но если отечественные материалы чаще сосредоточены на ГенИИ, ИИ-агентах и больших данных, то зарубежные — на ИИ-агентах, инфраструктуре и Open Source.
🖍Из числа авторов в России можно выделить red_mad_robot, MTS AI, Yandex B2B Tech, Just AI, АНО «Цифровая экономика», Фонд «Сколково», Ассоциацию Финтех, «Яков и Партнёры», «Технологии Доверия», Axenix, Mindsmith, ИТМО, Университет Иннополис и др., а в мире — Google, McKinsey, BCG, National Research Group, Capgemini.
Изучить каталог →
Следить за свежей аналитикой об ИИ можно здесь →
⚡️ 6 полезных репозиториев для работы с AI-агентами
1. Agency Agents
https://github.com/msitarzewski/agency-agents
Набор из 232 специализированных агентов для 16 направлений: разработка, дизайн, маркетинг, управление и другие задачи.
2. Codebase Memory MCP
https://github.com/DeusData/codebase-memory-mcp
Строит граф знаний по кодовой базе, чтобы агент быстрее находил связи между файлами, функциями и сущностями. Заявлена поддержка 158 языков.
3. OpenMontage
https://github.com/calesthio/OpenMontage
Инструмент для создания видео с помощью кодингового агента: сценарий, ассеты, монтаж и рендеринг можно собирать через промпты.
4. Agent-Reach
https://github.com/Panniantong/Agent-Reach
Дает агенту доступ к X, Reddit, YouTube, GitHub и другим источникам для поиска и сбора информации.
5. Orca
https://github.com/stablyai/orca
Позволяет запускать несколько кодинговых агентов параллельно и управлять их задачами из одного места.
6. OmniRoute
https://github.com/diegosouzapw/OmniRoute
Единый шлюз для работы с большим количеством AI-провайдеров через один endpoint.
@data_analysis_ml / Папка полезного по ML.
Сохраняй 🔖
Доброе утро! ☀️
Представляем Вашему вниманию воскресный выпуск подкаста "Капитанский мостик". Ведущие Валентин Малых и Дмитрий Колодезев обсуждают последние новости в области ИИ, кибербезопасности и научных исследований, а также их влияние на будущее технологий и общества.
Смотрите видео на каналах ⤵️
ODS VK Video
ODS YouTube
📩 Присылайте новости для обсуждения в канал "Дата-капитаны" в mattermost (авторизуйтесь через ODS.ai).
🔥 Сразу три релиза за день: Qwen 3.8, DeepSeek V4 Pro и Grok 4.6
• Qwen3.8-2.4T-A95B - Qwen открыла веса своего самого большого монстра.
2,4 трлн параметров, 95B активных, 512 экспертов и контекст до 1 млн токенов. По eval команды, Qwen3.8-Max получает 86,6 на TerminalBench 2.1 и 93,0 на PaperBench, уже вплотную заходя на территорию закрытых frontier-моделей.
• DeepSeek V4 Pro 0813 - финальная Pro-версия появилась в официальном API.
Контекст 1 млн токенов, до 384K output, Responses API и tool calling. Цена особенно агрессивная: $0,435 за 1 млн входных токенов при cache miss и $0,87 за выход, а при cache hit вход падает до $0,003625. По опубликованным DeepSeek цифрам, Terminal-Bench 2.1 вырос с 72,1% до 87,9%, CyberGym с 52,7% до 83,3%, DeepSWE с 12,8% до 62,7%.
• Релиз Grok 4.6
Модель набрала 61 на Artificial Analysis Intelligence Index, столько же, сколько GPT-5.6 Sol, и обошла его на CursorBench, FrontierCode и AA-Briefcase. При этом GPT-5.6 Sol остаётся впереди на DeepSWE и Terminal-Bench. xAI отдельно прокачивала модель через agentic RL для coding, web development, CAD и kernel optimization, а на длинных задачах стала чаще появляться самостоятельная проверка результата.
@ai_machinelearning_big_data
#AI #Qwen #DeepSeek #Grok #LLM #Agents
⚡️ Перед IPO Anthropic инвесторы хотят, чтобы Дарио Амодеи говорил об угрозах ИИ мягче. Но он, похоже, не собирается.
По данным The Information, часть акционеров Anthropic считает, что постоянные предупреждения Амодеи об экзистенциальных рисках AI могут плохо сочетаться с подготовкой компании к публичному рынку.
Проблема для инвесторов в том, что повлиять на CEO непросто.
Ключевые решения Anthropic по-прежнему сосредоточены внутри узкого круга сооснователей и близких к Амодеи людей.
В этом году один из членов совета директоров якобы предлагал использовать более привычную PR-стратегию Microsoft и Meta - больше рассказывать о позитивных сценариях вроде AI для разработки лекарств.
Амодеи идею отверг.
Его позиция: если технология потенциально создаёт риски для выживания человечества, относиться к её продвижению как к обычному технологическому маркетингу нельзя.
Инвесторам перед IPO нужен оптимизм и понятная история роста, а CEO продолжает публично говорить, что технология его собственной компании может быть опасной.
#AI #Anthropic #Claude #IPO #ArtificialIntelligence
DeepSeek предупредила разработчиков о «значительном» повышении цен на API в ближайшее время. Новые тарифы и дата перехода пока не объявлены.
Сейчас DeepSeek V4 Flash 0731 стоит всего:
Вход: $0,14 за 1 млн токенов
Выход: $0,28 за 1 млн токенов
сначала - почти бесплатный доступ
потом - массовое распространение
затем - повышение цены