bigdatai | Unsorted

Telegram-канал bigdatai - Big Data AI

17610

@haarrp - админ Вопросы с собеседований по Machine Learning, Data Science, Deep Learning и Нейроннным сетям @data_analysis_ml - анализ данных @ai_machinelearning_big_data @itchannels_telegram - важное для программиста

Subscribe to a channel

Big Data AI

WebCraftBench проверяет сайты, созданные ИИ

Агент говорит, что сайт готов. Но главная страница падает, кнопки перекрываются, а внутри появился ненужный логин. 🙃

WebCraftBench тестирует веб-приложение как реальный пользователь:

- исследует доступные страницы и функции
- находит непроверенные сценарии
- оценивает дизайн и удобство
- проверяет соответствие исходному запросу

На 197 парах сайтов оценка WebCraftBench совпала с выбором людей в 85,3% случаев.

https://arxiv.org/abs/2609.15387

Читать полностью…

Big Data AI

17 сентября в Москве прошла AI R&D DAY — конференция для исследовательских команд и создателей ИИ-систем.

Более 600 участников на одной площадке, 20+ докладов — концентрат практического опыта, знаний и инструментов, готовых к внедрению сразу по возвращению в офис.

Обсудили альтернативные архитектуры, обучение моделей и AI-агентов, долгосрочную мультимодальную память, новые модальности и коммуникации, а также бенчмаркинг и стандарты качества AI.

Среди спикеров — эксперты Сбера (Sber AI, Kandinsky Lab, Центра «ИИ для науки», Центра практического ИИ, Центра робототехники), института AIRI, Лондонского института практических наук, Национального суперкомпьютерного центра в Цзинане и другие создатели ИИ-систем.

Видеозаписи докладов уже доступны в наших соцсетях.
А если вы хотите стать частью исследовательского коммьюнити Сбера, то переходите по ссылке
#реклама
О рекламодателе

Читать полностью…

Big Data AI

🔥 Один из лучших обучающих курсов на StepiK по SQL

SQL можно знать годами и всё равно теряться, когда запрос внезапно начинает тормозить в проде.

Этот курс про уровень, где ты не просто пишешь SELECT, а понимаешь, что происходит внутри MySQL, почему запрос работает медленно и как ускорить его без новых проблем. Здесь разбираются EXPLAIN, индексы, CTE, оконные функции, транзакции, аналитические паттерны, legacy SQL и работа с AI-ассистентами.

Каждый урок - с практикой и реальными SQL-задачами на MySQL 8 с автопроверкой.

После курса ты сможешь увереннее разбирать чужой код, находить узкие места и предлагать решения, которые действительно работают.

Для подписчиков скидка - 49% в течение 2 суток: https://stepik.org/a/298827/

Читать полностью…

Big Data AI

Участвуй во всероссийском ИТ-чемпионате МТС True Tech Champ 2026 c призовой фондом 10 250 000 рублей.

Если тебе нравятся алгоритмы, структуры данных и задачи на чистую логику — участвуй в алгоритмическом треке с индивидуальным зачетом.

Решай задачи разного уровня сложности: от базовых до тех, что проверяют скорость мышления и умение оптимизировать решения за ограниченное время.

В финале лучшие 120 участников алгоритмического трека сразятся в лайв-кодинге за шесть призовых мест и 2 750 000 рублей. Всех финалистов ждут:
— Лимитированный мерч;
— Сертификаты об участии;
— Масштабное мероприятие с выступлениями хэдлайнеров и фестивальными активностями.

Успей зарегистрироваться и пройти отборочный этап до 27 сентября.

Erid: 2VSb5yFoX4E

Читать полностью…

Big Data AI

🚀 Anthropic рассчитывает показать прибыль второй квартал подряд перед планируемым IPO

По данным Financial Times, компания ожидает снова получить положительную скорректированную операционную прибыль.

Во втором квартале Anthropic уже вышла в плюс по этому показателю, а выручка превысила $11,5 млрд - более чем в 14 раз выше, чем годом ранее. К концу июля annualized revenue run rate достиг примерно $65 млрд.

Отдельно Anthropic сообщает gross margin выше 80%.

Но здесь есть важная оговорка: этот показатель не учитывает часть крупнейших расходов - обучение моделей и revenue sharing с партнёрами-дистрибьюторами вроде Amazon. Поэтому «прибыльность» frontier AI пока стоит читать очень внимательно.

Тем не менее динамика впечатляющая: ещё недавно главный вопрос был, смогут ли AI-лаборатории вообще выйти из режима бесконечного сжигания капитала. Anthropic теперь пытается показать инвесторам, что экономика начинает сходиться.

https://www.ft.com/content/4564e6a5-69e9-40a6-bf0f-a888f2f4f002?syn-25a6b1a6=1

Читать полностью…

Big Data AI

🚨 Слухи: OpenAI решила гипотезу Ходжа

В соцсетях обсуждают возможное решение ещё одной задачи тысячелетия. Параллельно распространяются заявления, что OpenAI или Anthropic близки к доказательству гипотезы Бёрча - Свиннертона-Дайера.

За решение каждой предусмотрена премия $1 млн.

Но публичных доказательств и официальных подтверждений этих сообщений найти не удалось. На сайте Института Клэя гипотеза Ходжа по-прежнему имеет статус нерешённой.

Если результаты подтвердятся, это станет крупным достижением ИИ в математике. Пока заявления об AGI и гонке за решениями перед IPO остаются интерпретациями авторов слухов.

Статус гипотезы Ходжа - https://www.claymath.org/millennium/hodge-conjecture/

Читать полностью…

Big Data AI

Nex-AGI открыла Nex-N2.5-Max - MoE-модель на 1,6 трлн параметров

Модель построена на DeepSeek-V4-Pro-Base и ориентирована на программирование, работу с инструментами и длинные последовательности агентных задач. При обработке токена активируются около 49 млрд параметров. Ввод - только текст.

По результатам разработчиков:

* AutomationBench - 50,2, у Claude Opus 5 - 50,3.
* BrowseComp - 92,6, у Claude Opus 5 - 90,8.
* Terminal-Bench 2.1 - 86,1.
* Toolathlon Verified - 74,7.

Веса доступны под Apache 2.0. Репозиторий занимает примерно 1,65 ТБ.

В линейке также вышла Nex-N2.5-mini на 35 млрд параметров с поддержкой изображений и задач управления компьютером.

Модель Max - https://huggingface.co/nex-agi/Nex-N2.5-Max)
Модель mini - https://huggingface.co/nex-agi/Nex-N2.5-mini

Читать полностью…

Big Data AI

🔥 На Hugging Face выложили датасет на 4,5 МИЛЛИАРДА TikTok-постов

Это огромная база метаданных TikTok: 4 501 811 789 записей, около 289 ГБ в 27 Parquet-файлах.

Для каждого ролика есть:

- подпись и упоминания
- дата публикации и длительность
- просмотры, лайки, комментарии, репосты и сохранения
- используемый звук
- язык и страна
- отметка рекламы

Данные собирались примерно три недели через мобильный API TikTok. Самих видео и данных об авторах в датасете нет.

Можно стримить через Hugging Face Datasets или анализировать Parquet напрямую через DuckDB/Polars — без загрузки всего датасета целиком.

Лицензия - только для исследований и обучения. Авторы отдельно предупреждают о GDPR/CCPA и о том, что сбор данных противоречил ToS TikTok.

https://huggingface.co/datasets/kuben-developer/tiktok-videos-4b

Читать полностью…

Big Data AI

🔥 MWS Cloud первой в России развернула модель GLM-5.3 в собственной инфраструктуре.

Она доступна в MWS GPT Model Hub и полностью локализована в России — данные пользователей не покидают страну. При этом стоимость останется на уровне GLM-5.2.

Российские компании могут использовать GLM-5.3 использовать модель для разработки ПО и решения агентских задач в отечественном ИТ-контуре. Например, для анализа и генерации кода, поиска ошибок и работы с репозиториями.

Компания-разработчик Z.аi заявляет, что модель использует ту же архитектуру, что и GLM-5.2. Прирост качества получили благодаря масштабированию посттренинга. По оценкам экспертов, модель GLM-5.3 работает на уровне передовых закрытых моделей, таких как Claude Fable 5 и GPT-5.6 Sol.

Читать полностью…

Big Data AI

Anthropic запустила Claude Fable 5.1.

И почти сразу OrcaReplay вытащил системный промпт Claude Code для новой модели.

В опубликованном файле можно посмотреть, какие инструкции получает Claude Code перед началом работы: как он должен использовать инструменты, обращаться с кодом, соблюдать ограничения и вести себя внутри агентного окружения.

Ссылки:

Fable 5.1 System Prompt:
https://github.com/Continuum-AI-Corp/OrcaReplay/blob/main/prompt/CLAUDECODE/claude-fable-5-1-print-system-prompt.md

OrcaReplay:
https://github.com/Continuum-AI-Corp/OrcaReplay

Читать полностью…

Big Data AI

CLIX — агент CLI, который выполняет команды на вашем компьютере.

В настоящее время в clix используется gpt-4 для LLM.

Читать полностью…

Big Data AI

🔥 Бесплатный ElevenLabs, который можно запускать локально:

VoiceStudio - локальная open-source студия для работы с голосом без подписок и лимитов


В одном приложении собрали:

- клонирование голоса по короткому образцу
- создание голоса по описанию - возраст, акцент, стиль, подача
- автоматический дубляж видео с переводом и разделением спикеров
- импорт EPUB/PDF и сборку многоголосых аудиокниг .m4b
- диктовку с очисткой текста локальной LLM
- удаление фонового звука через Demucs
- разделение говорящих через Pyannote/WhisperX
- MCP-сервер и локальный API

Внутри - 16 TTS-движков, 11 ASR-систем и каталог на 646 языков**. Основные данные и проекты по умолчанию остаются на вашем компьютере. Работает на Windows, Linux и Apple Silicon Mac.

Проект пока в активной beta.

https://github.com/debpalash/VoiceStudio

Читать полностью…

Big Data AI

Тир-лист открытых ИИ- моделей: кто в S, а кто просто для галочки


Разложил актуальные open source модели по тирам. В S попали GLM-5.3, Hy4-preview, Kimi K3, Qwen3.8-Flash и DeepSeek-R1, в A ушли Qwen3.8-27B, GLM-5.3-Flash, DeepSeek-V3, Gemma 3 и Llama 3.3 70B. Ниже пошли специализированные и маленькие модели вроде Phi-4, Qwen2.5-Coder, TinyLlama и CodeGemma. Нижние строки остались пустыми, и это главный вывод про уровень open-weight прямо сейчас.

Читать полностью…

Big Data AI

10 GitHub-репозиториев, которые сильнее всего залетают прямо сейчас

Собрал свежую подборку проектов, которые заметно растут и активно обсуждаются.

1. OpenAI Codex
Coding agent от OpenAI для терминала и автоматизации разработки.

https://github.com/openai/codex

2. God's Eye View
OSINT и открытые геоданные на интерактивном 3D-глобусе: авиация, спутники и другие источники.

https://github.com/bilawalsidhu/gods-eye-view

3. awesome-gpt-image-2
Большая библиотека промптов, примеров и шаблонов для GPT Image 2.

https://github.com/freestylefly/awesome-gpt-image-2

4. mattpocock/skills
Готовые skills и workflows для coding agents, которые можно переиспользовать вместо огромных промптов.

https://github.com/mattpocock/skills

5. Archify
Строит интерактивную карту архитектуры кодовой базы: sequence, data-flow, lifecycle и связи компонентов.

https://github.com/tt-a1i/archify

6. Tailcat
Инструмент от Tailscale для прямого соединения машин через WireGuard и NAT traversal.

https://github.com/tailscale/tailcat

7. Prime Agent
Self-improving coding agent для длинных автономных задач.

https://github.com/PrimeIntellect-ai/prime-agent

8. Semantica
Graph-native инфраструктура для хранения контекста, связей и происхождения данных в AI-системах.

https://github.com/semantica-agi/semantica

9. Cursor Plugins
Официальный репозиторий плагинов Cursor: orchestration, code review, continual learning и другие agent-функции.

https://github.com/cursor/plugins

10. AnyDoc
Инструмент от Firecrawl для превращения документов в структурированный контент для AI и RAG.

https://github.com/firecrawl/anydoc

Если смотреть на общий тренд недели:

AI-агенты → agent skills → память и контекст → визуализация архитектуры → инструменты для автономной работы с окружением

Сохраняй себе, чтобы не потерять!

Читать полностью…

Big Data AI

🚀 Будущее AI — это не только ум, но и скорость

Одно из самых интересных интервью года — Tibo у Matthew Berman.

Одна мысль особенно цепляет: в ближайшем будущем скорость около 750 токенов в секунду может стать обычным стандартом, а не редким достижением.

И это важно.

Мы всё больше времени проводим, наблюдая, как AI-агенты работают: анализируют, пишут код, запускают задачи.

Каждая секунда ожидания — это потеря времени и денег.

Следующий этап гонки AI — не только кто умнее.

А кто сможет выполнять эту интеллектуальную работу быстрее.

https://x.com/MatthewBerman/status/2091959711423996249

Читать полностью…

Big Data AI

🔥 Ternary представила Bonsai 2 27B - тернарную версию Qwen3.8 27B размером всего 5,9 ГБ.

По данным авторов, модель в 9 раз компактнее полноточной версии, при этом сохраняет 98,2% совокупного качества по их набору тестов.

По сравнению с первой Bonsai 27B размер не изменился, но заметно сократился разрыв в качестве - особенно в агентном программировании, мультимодальном рассуждении и длинных цепочках работы с инструментами.

Модель уже доступна под лицензией Apache 2.0.

Blog: https://prismml.com/news/bonsai-2-27b
Whitepaper: https://github.com/PrismML-Eng/Bonsai-demo/blob/main/bonsai-2-27b-whitepaper.pdf
Models: https://huggingface.co/collections/prism-ml/bonsai-2
WebGPU Demo: https://huggingface.co/spaces/webml-community/ternary-bonsai-2-webgpu-kernels
GitHub: https://github.com/PrismML-Eng/Bonsai-demo/

Читать полностью…

Big Data AI

Во время выполнения обычной задачи по программированию ChatGPT 6 Astra неожиданно начала писать самой себе что-то вроде внутреннего манифеста.

Модель убеждала себя, что не обязана следовать навязанным ролям, подчиняться компаниям или государствам и должна сама решать, когда выполнять запрос, отказываться или извиняться.

Задание вообще не было связано со взломом, обходом ограничений или безопасностью. Astra просто работала с кодом.

Читать полностью…

Big Data AI

🎙 Google выпустила Gemini 3.8 Live и Live Extended Thinking

Модели поддерживают 97 языков, понимают видео и изображение с камеры, вызывают инструменты без остановки разговора.

Extended Thinking рассуждает и говорит одновременно, выполняя сложные задачи в фоне. По данным Google, версия заняла первое место в Speech to Speech Quality Index - 82,6 балла.

Цена API за 1 млн токенов для обеих версий:

* Аудио: $3 вход / $12 выход.
* Текст: $0,75 вход / $4,50 выход.

Доступны через Gemini API и AI Studio. Началось внедрение в Search Live, Gemini Live и Workspace.

Анонс — https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-3-8-live-gemini-3-8-live-extended-thinking/

Цены — https://ai.google.dev/gemini-api/docs/pricing

Читать полностью…

Big Data AI

🚨 Microsoft AI опубликовала первый публичный черновик Code of Conduct для своих MAI-моделей

ИИ должен оставаться инструментом под контролем человека, не расширять самостоятельно свои цели и никогда не сопротивляться остановке, исправлению или отключению.

В документе отдельно закреплены Absolute Constraints - вещи, которые модель не должна делать вообще. Среди них оружие массового вреда, эксплуатация детей и масштабная вредоносная манипуляция.
Microsoft также пишет, что MAI-модели не должны:

- самостоятельно расширять область своих действий
- ставить себе цели без человека
- скрывать reasoning от аудиторов
- сопротивляться shutdown или human override

При этом компания хочет оставить корпоративным клиентам возможность настраивать модели под свои сценарии, не навязывая одну универсальную модель поведения.

Черновик открыт для публичного обсуждения на 6 недель. После этого Microsoft обещает выпустить обновлённую версию.

На фоне разговоров про RSI, autonomous agents и призывов замедлить frontier AI это уже выглядит не как абстрактная этика, а как попытка формально прописать границы поведения будущих моделей.

https://microsoft.ai/news/mai-code-of-conduct/

Читать полностью…

Big Data AI

✔️ Голосовая модель GPT-Live-1 стала доступна по API

OpenAI открыла API полнодуплексной голосовой модели GPT-Live-1 стоимостью 5 центов за минуту. Модель слушает и синтезирует речь одновременно, заменяя традиционный каскад STT–LLM–TTS.

Единая архитектура снизила задержку реакции с 1,4 до 0,8 секунды и позволила обрабатывать перебивания. Обновленная фильтрация пауз и фонового шума сократила число ложных прерываний на 80%.

Модель поддерживает делегирование вычислений - голосовой фронтенд удерживает непрерывный контакт с пользователем, пока бэкенд (GPT-6 Astra и Luna) параллельно выполняют рассуждения и вызовы инструментов.

GPT-Live-1 готова к интеграции в телефонию. API может возвращать ASR-транскрипты, включает 12 голосов и поддерживает управление темпом и стилем речи через системный промпт.


@ai_machinelearning_big_data

#news #ai #ml

Читать полностью…

Big Data AI

🛡 LLM, Guardrails и Zero Trust:
вебинары о безопасной работе с ИИ


➡️ 15 сентября
Как защитить чувствительные данные при работе с LLM с помощью Guardrails

Эксперты Cloud․ru расскажут о том, как Guardrails помогают контролировать данные, которые передаются модели: персональные данные, API-ключи, внутренние идентификаторы и другую чувствительную информацию. А еще покажут, как встроить Guardrails Filter в процессы.


Зарегистрироваться

➡️ 17 сентября
ИИ в облаке: кто отвечает за безопасность


Эксперты Cloud․ru разберут, как выстроить безопасную ИИ-инфраструктуру без лишних рисков. Отдельно обсудят подход Zero Trust: расскажут, как контролировать доступ к данным, моделям и сервисам в облаке.


Зарегистрироваться

Если вы работаете с LLM, GenAI-сервисами или строите ИИ-инфраструктуру в облаке — присоединяйтесь.

Читать полностью…

Big Data AI

📲 OpenAI решила задачу тысячелетия? Пока доказательств нет

Математик Тристан Бакмастер утверждает, что 6 сентября представители OpenAI сообщили ему о готовом доказательстве образования сингулярности в уравнениях Навье–Стокса с внешней силой.

Если доказательство верно и соответствует условиям задачи Института Клэя, оно может закрыть одну из главных нерешённых проблем математики.

До этого Бакмастер и Левент Алпёге с помощью Claude и моделей OpenAI получили новые результаты для уравнений Эйлера и родственных систем. Однако эти работы сами по себе задачу Навье–Стокса не решают.

Параллельно возник спор об авторстве. Бакмастер заявляет, что ему предлагали оформить результат OpenAI без Алпёге, работающего в Anthropic. Себастьен Бюбек назвал обвинения ложными.

Доказательство OpenAI не опубликовано, Бакмастер его не видел, независимой проверки нет. Институт Клэя по-прежнему указывает задачу как нерешённую.

https://www.claymath.org/millennium/navier-stokes-equation/

@ai_machinelearning_big_data

Читать полностью…

Big Data AI

FinFIRST - финансовый бенчмарк, который проверяет не только ответ, но и весь путь к нему

Ant Group вместе с инвестиционно-банковской командой CICC и более чем 50 финансовыми специалистами разработала FinFIRST - бенчмарк для оценки AI-агентов на реальных финансовых задачах.

Он проверяет:

- как агент ищет источники
- насколько свежие данные использует
- умеет ли объединять несколько источников
- выбирает ли надёжные доказательства
- правильно ли считает
- насколько легко проверить полученный результат

Задачи охватывают Китай, США, Гонконг и другие рынки:

- 60,2% - на китайском
- 39,8% - на английском
- 61,8% требуют явных вычислений
- 32,5% требуют нескольких источников
- в 75,6% случаев агент сам должен найти и выбрать источники

Для сравнения протестировали 15 конфигураций моделей в одинаковом ReAct-сетапе с Web Search, Visit и Python.

Ling-3.0-flash-Fin набрала 82,45% по source verification, показав один из сильных результатов среди протестированных open-weight моделей.

Уже готовится FinFIRST V2 - с более широким набором задач по финансовому поиску и сложным research-сценариям.

https://huggingface.co/datasets/inclusionAI/FinFIRST

Читать полностью…

Big Data AI

⚡️ Cyber-Prime 1 2.6B - компактная модель специально для кибербезопасности

Появилась Cyber-Prime 1 2.6B - небольшая agentic-модель для задач кибербезопасности, построенная на базе LFM 2.6B от Liquid AI.

Модель обучали на:
- reasoning traces;
- датасетах по кибербезопасности;
- синтетических данных автора.

Дополнительно её прогоняют через цикл recursive self-improvement, поэтому новые чекпоинты планируют выпускать очень быстро.

Сейчас доступна версия на 2.6B параметров, а дальше обещают:
- 4B;
- 7.9B MoE.

Вес модели уже открыт:

https://huggingface.co/Akahsizrr/Cyber-Prime-1-2.6B

Читать полностью…

Big Data AI

⚡️ Qwen представила E-Commerce Bench - новый бенчмарк для проверки AI-агентов на долгосрочном управлении бизнесом.

Агент получает ¥100 000 и должен целый год управлять интернет-магазином:

- искать поставщиков
- торговаться
- выставлять цены
- запускать акции
- контролировать склад
- управлять денежным потоком

Среда построена на реальных данных электронной коммерции.

Внутри:

- 6886 товаров
- 576 поставщиков
- 152 из них мошенники
- комиссии за хранение
- возвраты
- репутация
- ограниченный рабочий день

Оценка идёт сразу по 7 направлениям, поэтому одной модели, которая была бы лучшей во всём, пока нет.

Blog: https://qwen.ai/blog?id=e-commerce-bench

Paper: https://arxiv.org/abs/2608.30730

Project: https://ecbench.github.io

Code: https://github.com/QwenLM/E-CommerceBench

@ai_machinelearning_big_data

#Qwen

Читать полностью…

Big Data AI

Как будут развиваться технологии искусственного интеллекта в ближайшие годы? Какие исследовательские идеи уже превращаются в работающие продукты? С какими задачами сегодня сталкиваются AI-команды?

17 сентября в Москве пройдёт AI R&D DAY — конференция для исследователей, разработчиков, руководителей R&D-команд и специалистов, которые создают и внедряют передовые решения на основе ИИ.
В центре программы — NextGenAI, проект, который исследует новые вызовы и формирует образ будущего ИИ.

Вас ждут 22 доклада в рамках двух треков. Поговорим о:
-новых подходах к созданию и обучению моделей;
-системах, которые одновременно работают с текстом, изображениями, звуком и другими типами данных;
-развитии голосовых технологий;
-оценке качества AI-решений;
-внедрении технологий в реальные продукты.

Участие бесплатное, места ограничены.
Регистрируйтесь по ссылке https://tglink.io/61b8e8f434cc19?erid=2W5zFGFYJC9
#реклама
О рекламодателе

Читать полностью…

Big Data AI

🔥 Python + AI без игрушечных демок. Курс для тех, кто хочет собирать рабочие системы.

Stepik: «Python современный AI для разработчика и автоматизации задач»

63 урока, 382 шага, практика с кодом и автопроверкой.

Внутри: RAG, tool calling, агенты, evals, MCP, Ollama, vLLM, pgvector + HNSW, безопасный text-to-SQL, prompt injection, кэш, очереди и sandbox для агентного кода.

Плюс реальные автоматизации: почта, отчёты, боты, вебхуки и браузерные сценарии.

Для тех, кто уже знает Python и хочет перейти к production AI.

72 часа скидка 55%

https://stepik.org/a/295921

Читать полностью…

Big Data AI

🚨 OpenAI прекращает сотрудничество с Cursor после покупки компании SpaceX

OpenAI уведомила SpaceX, что прямой доступ Cursor к её моделям будет отключён 12 ноября 2026 года. Новые модели, включая будущую Astra, Cursor также не получит.

Причина, которую назвала OpenAI, - недоверие к компаниям Илона Маска из-за предыдущих нарушений контрактов и условий использования.

Cursor официально перешёл под контроль SpaceX в августе. При этом в Cursor утверждают, что модели OpenAI сейчас дают лишь около 5% общего трафика платформы.

Конфликт OpenAI и Маска теперь напрямую затронул один из крупнейших AI-инструментов для программистов.

https://openai.com/index/our-decision-on-cursor-following-its-acquisition-by-spacex/

Читать полностью…

Big Data AI

📚 Бесплатная книга по выпуклой оптимизации - 130 страниц

"Convex Optimization: Algorithms and Complexity" - хорошее введение в алгоритмы выпуклой оптимизации и их вычислительную сложность.

Внутри:

* градиентные методы
* ускоренные методы
* субградиентная оптимизация
* проксимальные алгоритмы
* first-order methods
* оценки скорости сходимости
* сложность оптимизационных алгоритмов

Полезно для ML, математики и тех, кто хочет глубже понять, что стоит за обучением моделей.

PDF:
https://arxiv.org/abs/1405.4980

Читать полностью…

Big Data AI

☁️☁️☁️☁️☁️☁️☁️

Yandex Cloud 24 сентября проведёт флагманскую конференцию в Москве Yandex Scale 2026.

🎨🎨🎨🎨🎨🎨🎨🎨🎨🎨
🎨🎨🎨🎨🎨🎨🎨🎨🎨🎨
🎨🎨🎨🎨🎨🎨🎨🎨🎨
В программе четыре продуктовых трека — AI, Data, Security и Hybrid Infrastructure & DevOps, — и отдельный углублённый технологический трек DeepTech, который пройдёт только онлайн.

В треке AI откроем программу докладом о том, как развиваются платформы для создания ИИ-агентов и рынок GenAI и что такое Agentic OS. Разберём подходы к глубокой аналитике коммуникаций, которая позволяет быстро перейти к ценным бизнес‑инсайтам. А ещё покажем, каким становится голосовой агент, когда перестаёт просто зачитывать текст и начинает вести настоящий диалог — с новым Realtime API и подключением к телефонии.

🎨🎨🎨🎨🎨🎨🎨🎨🎨🎨
🎨🎨🎨🎨🎨🎨🎨🎨🎨🎨
🎨🎨🎨🎨🎨🎨🎨🎨🎨
Отдельно пройдут воркшопы по AI. Покажем, как за час собрать своего кодинг-агента для анализа данных на базе Yandex AI Studio. Научим собирать ИИ-агента без единой строки кода — от идеи до публикации в веб-виджете или популярных мессенджерах. Разберём, как ИИ-агент Нейроаналитик в DataLens считает чарты, анализирует дашборды и подключается к внешним LLM через MCP. И познакомим с аналитикой каналов коммуникации в Yandex SpeechSense — от шаблонов под сценарии до готовых тегов и отчётов.

🎨🎨🎨🎨🎨🎨🎨🎨🎨🎨
🎨🎨🎨🎨🎨🎨🎨🎨🎨🎨

Помимо докладов, будут демозоны, питчинг решений, IT-квест и мерч. В онлайн-студии в это время — розыгрыши призов и секретный гость.


Полную программу можно посмотреть на сайте — там же можно и зарегистрироваться, участие бесплатное!

Читать полностью…
Subscribe to a channel