Перейти к содержимому
IMOEX 2 134,97 0.6%

#llm

·Технологии·21 августа 2026 г.

Почти 90% биомедицинских статей несут следы языковых моделей

Препринт, выложенный на arXiv 12 августа, оценивает долю текстов с признаками правки или написания через LLM в открытом архиве PubMed Central. Для статей, вышедших в декабре 2025 года, оценка — около 90%. За весь 2025-й — 77%, за 2024-й — 52%.

·Технологии·21 августа 2026 г.

Новинка от Cerebras: система CS-4 с тремя чипами WSE-3 Turbo

Архитектура классических ускорителей для обучения и инференса LLM упирается в ограничение по шинам передачи данных между GPU — это создает задержки и является узким местом по пропускной способности. Cerebras предлагают альтернативу — изготовление процессора размером во всю кремниевую пластину целиком. Их новая система CS-4 выводит концепцию wafer-scale engine на следующий технологический уровень.

·Технологии·20 августа 2026 г.

Удобный VRAM-калькулятор для быстрого подбора GPU-серверов

Гитара, ручка, сервер, воскресенье, фиолетовый, осень, движение — не успели записать? А откуда вы можете знать, что эта информация не понадобится вам завтра? Была бы ручка, успели бы. Все знают эту классическую байку про продажи. Но что, если перед вами не слова, а технические параметры и метрики, которые нужно быстро свести в единый бюджет на железо? Был бы калькулятор — посчитали бы. Не каждый из нас LLMOps-инженер, который помнит наизусть, сколько весит каждая модель. Допустим, вы просто хоти

·Технологии·14 августа 2026 г.

AI Hardcore Set: записи докладов с митапа про MCP и агентов в проде

11 июля мы собрали тех, кто каждый день работает с MCP, пишет своих агентов и гоняет реальные AI-инструменты в проде. Теперь доклады с мероприятия можно пересмотреть всё в удобном темпе. Собрали записи всех выступлений в одной новости. Spec-Driven Development: теория, инструменты, практика — Александр Шаповалов Когда agent-first перестаёт быть экспериментом и становится нормой разработки, меняется сам подход к архитектуре. Александр разбирает, что такое архитектурная инверсия в этом контексте, с

·Технологии·14 августа 2026 г.

«Солар»: почти 40% обращений сотрудников к ИИ содержат конфиденциальные данные

ГК «Солар», ведущий провайдер комплексной кибербезопасности в России, проанализировала практику использования публичных ИИ-сервисов в крупных российских компаниях. В первом полугодии 2026 года в анализ вошли 12 000 взаимодействий сотрудников с публичными ИИ-сервисами, зафиксированных в рамках пилотов DLP-системы Solar Dozor. В 38% случаев такие взаимодействия содержали конфиденциальную информацию. Среди них 41% пришлось на исходный код и конфигурации, 30% – персональные, финансовые и другие чувс

·Технологии·14 августа 2026 г.

Обновление Claude в Chrome объединило браузерного агента с экосистемой приложений Anthropic

Компания Anthropic выпустила крупное обновление расширения Claude для браузера Google Chrome. Теперь боковая панель работает как полноценный клиент Claude Cowork. В расширении появились сквозные сессии, а также поддержка навыков (skills) и коннекторов (connectors), которые автоматически синхронизируются между приложениями.

·Технологии·14 августа 2026 г.

Z.ai выпустили GLM-5.3: обошла Opus 4.8 на, но уступила Fable 5 и GPT-5.6 Sol

Z.ai выпустили GLM-5.3, новую модель для программирования и долгих агентных задач. GLM-5.3 использует ту же базовую модель, что и GLM-5.2. Компания не меняла архитектуру и не проводила новый претрейн. Изменения внесли на этапе пост-тренинга: в течение месяца модель обучали с подкреплением на дополнительных рабочих окружениях. На Terminal-Bench 3.0 результат вырос с 4,6% до 28,3%, на DeepSWE — с 46,2% до 66,9%. Веса обещают открыть через две недели, после дополнительной проверки безопасности.

·Технологии·13 августа 2026 г.

OpenAI и Cerebras разогнали GPT-5.6 Sol до 750 токенов в секунду

OpenAI и Cerebras представили Ultrafast, новый режим обработки запросов GPT-5.6 Sol в OpenAI API. Он генерирует до 750 выходных токенов в секунду и работает до 14 раз быстрее Standard processing. Это не отдельная облегчённая модель. Cerebras запускает полную GPT-5.6 Sol на своей инфраструктуре, поэтому, по заявлениям компаний, ускорение не требует снижать качество ответов. Пока Ultrafast доступен только ограниченной группе клиентов, а стоимость режима не раскрыта.

·Технологии·13 августа 2026 г.

Qwen 3.8 27B — сутки до выхода модели. На huggingface запущен обратный отсчет

По информации с https://huggingface.co/Qwen/Qwen3.8-27B Qwen3.8-27B, которая считается преемницей популярной Qwen3.6-27B, будет выпущена через сутки и как ожидается должна стать самым мощным открытым решением для локальной генерации

·Технологии·12 августа 2026 г.

xAI выпустили Grok 4.6: модель сравнялась с GPT-5.6 Sol

xAI представили Grok 4.6 — новую версию модели с упором на длительную работу AI-агентов, программирование и создание интерактивных приложений. По словам разработчиков, модель лучше удерживает многошаговые задачи, чаще проверяет собственные результаты и продолжает работу после первого подходящего решения. В Artificial Analysis Intelligence Index новинка получила 61 балл — столько же, сколько GPT-5.6 Sol Max. Fable 5 Max набрала 62 балла, а Grok 4.5 High — 56.

·Технологии·7 августа 2026 г.

NOOA от NVIDIA: открытый Python-фреймворк для разработки ИИ-агентов

Компания NVIDIA выпустила открытый фреймворк NOOA (Object-Oriented Agents), который призван решить проблему фрагментации в разработке ИИ-агентов. Платформа объединяет разрозненные элементы инфраструктуры — шаблоны промптов, схемы инструментов, функции обратного вызова (callbacks) и графы рабочих процессов — в единый класс Python. Проект передан в консорциум Open Secure AI Alliance для совместного развития открытых стандартов безопасности в сфере искусственного интеллекта.

·Технологии·6 августа 2026 г.

DeepSeek предупредили о «значительном» повышении цен на API

В личных кабинетах DeepSeek Open Platform появился баннер о предстоящем повышении цен на API. Пользователям сервиса также начали приходить письма с тем же предупреждением. DeepSeek пишет, что планирует «значительно» повысить общие цены на API-сервисы. Новую тарифную сетку и дату её вступления в силу компания пока не опубликовала и просит следить за объявлениями на платформе и электронной почтой.

·Технологии·6 июля 2026 г.

«Сбер» выпустил GigaChat 3.5 Ultra — LLM стала умнее и приблизилась по ряду показателей к DeepSeek 3.2

«Сбер» представил новую флагманскую модель GigaChat 3.5 Ultra, которая доступна бесплатно всем желающим в ИИ-помощнике «ГигаЧат» для решения личных и рабочих задач, а также разработчикам по всему миру для встраивания в свои сервисы и создания ИИ-агентов. Источник изображения: «Сбер»

#llm — Long/Short