Перейти к содержимому
SBER 283,04 ₽ · закрытоIMOEX 2 338,21 0,42% рост за прошлую сессию · закрыто

#llm

Технологии2 сентября 2026 г.

Приглашаем на конференцию о будущем AI-first аналитики Data Driven 2026

26 сентября в Москве и онлайне пройдёт Data Driven 2026 — флагманская конференция бизнес-группы Поисковых сервисов и ИИ Яндекса. Главная тема этого года — AI-first аналитика: как изменится роль специалиста, когда данные и искусственный интеллект станут неразделимы? Почему индустрия делает ставку на AI-first аналитику? И как изменится роль аналитика в ближайший год. Разберём реальные кейсы: какие инструменты аналитиков на базе AI уже сейчас дают измеримый рост эффективности. Программа будет…

Технологии1 сентября 2026 г.

Anthropic представила Claude Fable 5.1 — модель для сложных задач и долгой работы с ИИ-агентами

Anthropic представила новую версию модели Claude Fable 5.1, ориентированную на работу со сложными многоэтапными задачами. Модель получила расширенное контекстное окно, улучшения в работе с кодом и возможностями ИИ-агентов — теперь она рассчитана на сценарии, где требуется анализ больших объёмов информации, работа с проектами и последовательное выполнение задач без постоянного контроля со стороны пользователя. Разбираемся, какие изменения получила модель и что они означают для разработчиков.

Технологии31 августа 2026 г.

Новые ИИ-модели и LLM недели: Qwen3.8-Flash-Next, GLM-5.3, Granite 4.2, Hy4 и новые модели для видео, речи и изображений

С 24 по 31 августа разработчики выпустили сразу несколько заметных ИИ-моделей и LLM. В числе главных релизов недели — новая архитектура Qwen3.8-Flash-Next, мультимодальная GLM-5.3-Flash и публикация весов основной GLM-5.3, Granite 4.2 от IBM, Hy4 preview от Tencent и первая собственная LLM Thomson Reuters. Параллельно обновились модели для генерации видео, изображений и речи. Alibaba выпустила Wan 3.0, Bria AI — Fibo 1.5, а в speech-направлении появились Gemini 3.5 Transcribe, FireRedTTS3…

Технологии27 августа 2026 г.

IBM уходит в Agentic RL: три новые модели Granite 4.2 научили автономно программировать в терминале

25 августа IBM Research опубликовала Granite 4.2 — семейство из трех моделей на 3, 8 и 30 млрд параметров с переключаемым режимом рассуждений. Веса открыты под Apache 2.0, без ограничений на коммерческое использование и дообучение. Главное отличие от предыдущей версии — не размер, а то, чему модели учили после предобучения.

Технологии27 августа 2026 г.

Cerebras CS-4, CS-5 и CS-6: вычислительные стойки нового поколения

Cerebras Systems на конференции Hot Chips 2026 поделились планами на новые платформы CS-5 и CS-6. Основное внимание уделили уже анонсированной CS-4: более детально раскрыли компоновку стойки и устройство подсистемы питания. При этом Cerebras сохраняет верность своей ключевой концепции — масштабированию вычислений за счет процессоров Wafer-Scale Engine, функционирующих как единый большой кристалл.

Технологии26 августа 2026 г.

Z.ai выпустила GLM 5.3 Flash с открытыми весами. Модель уже доступна в KodaCode

Компания Z.ai представила GLM 5.3 Flash – первую нативно мультимодальную модель в серии GLM-5. Веса модели опубликованы на Hugging Face, а в карточке репозитория указана лицензия MIT. До официального релиза модель тестировали на OpenRouter под названием Ox Alpha. За несколько дней она возглавила рейтинг платформы по использованию. GLM 5.3 Flash построена на архитектуре «смесь экспертов»: всего в модели 320 млрд параметров, но при обработке каждого токена активируются только 18 млрд. Это…

Технологии26 августа 2026 г.

Z.ai выпустили GLM-5.3-Flash: ту самую Ox Alpha, которая за неделю стала топ-1 в OpenCode и OpenRouter

Z.ai выпустили GLM-5.3-Flash, первую нативно мультимодальную модель семейства GLM-5. Она поддерживает контекст до 1 млн токенов и содержит 320 млрд параметров, из которых при генерации активируются 18 млрд. До официального релиза модель анонимно тестировали в OpenCode и OpenRouter под именем Ox Alpha. По данным OpenCode, за шесть дней она обработала 42 трлн токенов. В недельном рейтинге OpenRouter Ox Alpha также заняла первое место с 23,2 трлн токенов — вдвое больше, чем у ближайшей DeepSeek V4

Технологии26 августа 2026 г.

Как использовать LLM в тестировании: разбираем harness, автотесты и LLM-судью

Поговорим об этом на Bugs Busters — бесплатном митапе ЮMoney для QA-специалистов. В программе — три доклада о задачах, с которыми тестировщики уже сталкиваются при работе с LLM: — как устроен LLM-harness и зачем агенту нужна обвязка; — как собрать помощника на базе ИИ для разбора падений автотестов; — как понять, подходит ли конкретная LLM для вашей задачи, и сравнивать модели с помощью LLM-судьи. Покажем не только идеи, но и практические подходы с инструментами, которые используем в работе.

Технологии26 августа 2026 г.

Qwen4: первая модель Alibaba на архитектуре нового поколения — Qwen3.8-Flash-Next

Alibaba анонсировали Qwen3.8-Flash-Next — первую публичную модель на архитектуре следующего поколения Qwen4. Открытые веса должны появиться 26 августа в 15:00 UTC. Несмотря на Qwen3.8 в названии, команда прямо называет модель предварительным показом Qwen4. Её выпускают заранее, чтобы разработчики библиотек и систем инференса могли подготовиться к полноценному релизу нового поколения.

Технологии25 августа 2026 г.

️RAG, агенты и production – честно про AI

3 сентября в 18:00 встречаемся на новом AI Meetup 43;Tech. Без магии и абстрактных прогнозов поговорим про кейсы, архитектуру, метрики и опыт работы с AI в production. В программе: ✔️ Как вырастить мультиагентную платформу внутри компании ✔️ Какие NLP-подходы (LoRA, RAG, DSL) действительно выжили в production и дали измеримый результат ✔️ Почему в эпоху генеративного ИИ ценность смещается от кода к качеству спецификации Митап пройдёт в гибридном формате: приходите к нам в офис…

Технологии21 августа 2026 г.

Почти 90% биомедицинских статей несут следы языковых моделей

Препринт, выложенный на arXiv 12 августа, оценивает долю текстов с признаками правки или написания через LLM в открытом архиве PubMed Central. Для статей, вышедших в декабре 2025 года, оценка — около 90%. За весь 2025-й — 77%, за 2024-й — 52%.

Технологии21 августа 2026 г.

Новинка от Cerebras: система CS-4 с тремя чипами WSE-3 Turbo

Архитектура классических ускорителей для обучения и инференса LLM упирается в ограничение по шинам передачи данных между GPU — это создает задержки и является узким местом по пропускной способности. Cerebras предлагают альтернативу — изготовление процессора размером во всю кремниевую пластину целиком. Их новая система CS-4 выводит концепцию wafer-scale engine на следующий технологический уровень.

Технологии20 августа 2026 г.

Удобный VRAM-калькулятор для быстрого подбора GPU-серверов

Гитара, ручка, сервер, воскресенье, фиолетовый, осень, движение — не успели записать? А откуда вы можете знать, что эта информация не понадобится вам завтра? Была бы ручка, успели бы. Все знают эту классическую байку про продажи. Но что, если перед вами не слова, а технические параметры и метрики, которые нужно быстро свести в единый бюджет на железо? Был бы калькулятор — посчитали бы. Не каждый из нас LLMOps-инженер, который помнит наизусть, сколько весит каждая модель. Допустим, вы просто…

Технологии14 августа 2026 г.

AI Hardcore Set: записи докладов с митапа про MCP и агентов в проде

11 июля мы собрали тех, кто каждый день работает с MCP, пишет своих агентов и гоняет реальные AI-инструменты в проде. Теперь доклады с мероприятия можно пересмотреть всё в удобном темпе. Собрали записи всех выступлений в одной новости. Spec-Driven Development: теория, инструменты, практика — Александр Шаповалов Когда agent-first перестаёт быть экспериментом и становится нормой разработки, меняется сам подход к архитектуре. Александр разбирает, что такое архитектурная инверсия в этом контексте…

Технологии14 августа 2026 г.

«Солар»: почти 40% обращений сотрудников к ИИ содержат конфиденциальные данные

ГК «Солар», ведущий провайдер комплексной кибербезопасности в России, проанализировала практику использования публичных ИИ-сервисов в крупных российских компаниях. В первом полугодии 2026 года в анализ вошли 12 000 взаимодействий сотрудников с публичными ИИ-сервисами, зафиксированных в рамках пилотов DLP-системы Solar Dozor. В 38% случаев такие взаимодействия содержали конфиденциальную информацию. Среди них 41% пришлось на исходный код и конфигурации, 30% – персональные, финансовые и другие…

Технологии14 августа 2026 г.

Обновление Claude в Chrome объединило браузерного агента с экосистемой приложений Anthropic

Компания Anthropic выпустила крупное обновление расширения Claude для браузера Google Chrome. Теперь боковая панель работает как полноценный клиент Claude Cowork. В расширении появились сквозные сессии, а также поддержка навыков (skills) и коннекторов (connectors), которые автоматически синхронизируются между приложениями.

Технологии14 августа 2026 г.

Z.ai выпустили GLM-5.3: обошла Opus 4.8 на, но уступила Fable 5 и GPT-5.6 Sol

Z.ai выпустили GLM-5.3, новую модель для программирования и долгих агентных задач. GLM-5.3 использует ту же базовую модель, что и GLM-5.2. Компания не меняла архитектуру и не проводила новый претрейн. Изменения внесли на этапе пост-тренинга: в течение месяца модель обучали с подкреплением на дополнительных рабочих окружениях. На Terminal-Bench 3.0 результат вырос с 4,6% до 28,3%, на DeepSWE — с 46,2% до 66,9%. Веса обещают открыть через две недели, после дополнительной проверки безопасности.

Технологии13 августа 2026 г.

OpenAI и Cerebras разогнали GPT-5.6 Sol до 750 токенов в секунду

OpenAI и Cerebras представили Ultrafast, новый режим обработки запросов GPT-5.6 Sol в OpenAI API. Он генерирует до 750 выходных токенов в секунду и работает до 14 раз быстрее Standard processing. Это не отдельная облегчённая модель. Cerebras запускает полную GPT-5.6 Sol на своей инфраструктуре, поэтому, по заявлениям компаний, ускорение не требует снижать качество ответов. Пока Ultrafast доступен только ограниченной группе клиентов, а стоимость режима не раскрыта.