🦾 Современные задачи прогнозирования всё чаще выходят за рамки возможностей классических моделей. Если вы уже работаете с временными рядами, пора разобраться, какие архитектуры действительно определяют развитие машинного обучения сегодня.
24 августа в 20:00 МСК приглашаем вас на открытый урок курса «Машинное обучение. Экспертный уровень».
На занятии сравним современные модели с ARIMA, Prophet, X…
🔥 DeepSeek Harness - пример того, почему сегодня важна не только модель, но и всё окружение вокруг неё
Harness - это слой между LLM и реальной работой: инструменты, terminal, permissions, память, tool loop и правила обработки ответов.
У deepseek-harness есть Python-библиотека, CLI dsh, MCP-сервер и интеграция в формате Anthropic Skill. Проект документирует особенности протокола DeepSeek V4-Pro/V…
🌟 Cohere Labs выложила компактную зрительно-языковую модель North Micro Vision
Модель на 2,4 млрд параметров стала (https://huggingface.co/blog/CohereLabs/meet-north-micro-vision-instruct)
самой маленькой в линейке VLM компании. От большинства таких моделей она отличается тем, что работает с изображением в исходном разрешении.
Обычно картинку перед подачей в модель сжимают, и мелкий текст, разм…
✔ Хакеры использовали ИИ для атаки на энергетические и государственные системы Тайваня
Тайваньское Министерство цифровых технологий и израильская ИБ-компания Dream заявили (https://www.ft.com/content/7d2ab3e0-9085-48f6-b38a-d90260d58795)
об атаке, в которой злоумышленники использовали ИИ. Инцидент произошел в июле 2026 года.
По их данным, за основу хакеры взяли открытую модель и переделали ее в…
⚡️ Harness Engineering - полный бесплатный курс на русском
Как заставить AI-агента писать код надёжно. Не «какую модель выбрать», а как спроектировать вокруг неё рабочую систему: инструкции, инструменты, среду, состояние и верификацию.
Курс - от нуля до продвинутых тем: теоретическая база из 11 блоков, 14 модулей, 8 практических проектов, 14 лабораторных работ, диагностический протокол «как почи…
✔ Mistral обновила OCR-модель до версии 4.1
Главный упор сделали (https://x.com/MistralDevs/status/2087913398654669244)
на обработку перегруженных страницы, где текст, изображения и подписи идут плотно и наслаиваются друг на друга.
По данным Mistral, модель точнее определяет границы каждого элемента - рамки не съезжают, изображения не наезжают одно в другое по ошибке.
На нагруженных технически…
✔ Корпоративные клиенты игнорируют Fable 5
По данным (https://ramp.com/data/ai-index-august-2026)
финансовой платформы Ramp, бизнес не спешит переходить на самую мощную из доступных моделей Anthropic.
За первый месяц после релиза на Fable 5 пришлось всего 6% (https://ramp.com/data/ai-index-august-2026#:~:text=Over%20the%20last%20month%2C%20Fable%205%20has%20made%20up%20only%206%25%20of%20tokens…
🔥 DeepSeek V4 Pro официально вышел. И релиз явно заточен под агентов
DeepSeek раскатила GA-версию V4 Pro сразу в приложении, вебе и API. В интерфейсе модель доступна через Expert Mode, а API по-прежнему вызывается как deepseek-v4-pro.
Самый большой апгрейд получил agentic режим. Terminal Bench 2.1 теперь 87,9, CyberGym 83,3, DeepSWE 62,7, Toolathlon Verified 74,1. DeepSeek отдельно говорит о зам…
✔️ Kimi поймали на следах Claude: модель могла обучаться на его скрытых рассуждениях
Исследователи нашли способ восстанавливать зашифрованные reasoning-блоки закрытых моделей и решили проверить, помнят ли другие LLM эти скрытые цепочки.
Самая сильная аномалия оказалась у Kimi-K3.
Если дать Kimi начало конкретного рассуждения Claude, модель продолжает его намного точнее, чем другие LLM. В некотор…
🚀 Alibaba Cloud утверждает, что теперь может строить крупные AI-дата-центры всего за 100 дней
Для сравнения: сопоставимые проекты в Китае обычно занимают около 6-12 месяцев, а в США - 12-18 месяцев.
Секрет - архитектура CUBE 5.0. Вместо последовательного строительства на площадке Alibaba переносит значительную часть работ по электропитанию, охлаждению, безопасности и инфраструктуре на заводы, где …
Похожие каналы
С объяснением, почему похожи — так честнее и лучше для перелинковки