Перейти к содержимому

#нейронные сети

8 сентября
·Технологии· 8 сентября 2026 г.

Anthropic показала, как срезать счёт за Claude без потери качества

Три рычага экономии на Claude Platform: кэш промптов, чистка инструкций и уровень усилия. Команда prompt-audit дала минус 14,6% к цене и плюс 5,3 пункта точности. — Читать дальше «Anthropic показала, как срезать счёт за Claude без потери качества»

3 сентября
·Технологии· 3 сентября 2026 г.

Claude, ChatGPT и Grok дали сбой в один вечер, устоял только Gemini

Вечером 3 сентября 2026 года Anthropic признала частичный сбой Claude Code, API и claude.ai, OpenAI подтвердила рост ошибок в ChatGPT и Codex, на Grok жалуются пользователи. Gemini работает. Хронология и что делать. — Читать дальше «Claude, ChatGPT и Grok дали сбой в один вечер, устоял только Gemini»

·Технологии· 3 сентября 2026 г.

17 нейросетей проверили на грибах: лучшая опасно ошибается в 11% случаев

Пётр Мигдал прогнал 17 мультимодальных моделей по 1040 фото 55 видов грибов. Лучшая, Gemini 3.8 Flash, верно узнаёт вид в 65% случаев и называет ядовитый гриб съедобным в 11%. — Читать дальше «17 нейросетей проверили на грибах: лучшая опасно ошибается в 11% случаев»

2 сентября
·Технологии· 2 сентября 2026 г.

Anthropic запустила проверку файлов на метку Claude прямо в браузере

На claude.com появился бесплатный сервис Check Content: он ищет в файле подписанную метку C2PA о том, что файл создал или обработал Claude. Что он умеет и чего не доказывает. — Читать дальше «Anthropic запустила проверку файлов на метку Claude прямо в браузере»

·Технологии· 2 сентября 2026 г.

Google: Gemini 3.8 Flash догнала Opus 5 на DeepSWE при цене $0,75 за млн

Google представила Gemini 3.8 Flash по цене 3.7 Flash и закрытую 3.8 Flash Cyber для поиска уязвимостей. Бенчмарки, цена до конца 2026 года и оговорки. — Читать дальше «Google: Gemini 3.8 Flash догнала Opus 5 на DeepSWE при цене $0,75 за млн»

·Технологии· 2 сентября 2026 г.

Три сайта сделали 215 128 страниц «best software» для ИИ-поиска

Trellner проверила 7 534 ссылки, которыми Perplexity подкрепляет советы «какой софт лучше»: 60% ведут на сайты за пределами топ-100 000, три сайта под одним шаблоном нагенерировали 215 128 «лучших списков». — Читать дальше «Три сайта сделали 215 128 страниц «best software» для ИИ-поиска»

·Технологии· 2 сентября 2026 г.

Видео и звук за август: H3, LTX-2.5 и Music3 стали быстрее и открылись

MiniMax H3, LTX-2.5, Music3 и Qwen3-ASR ускорили локальную работу с видео, музыкой и речью. Сравниваем железо, цены и лицензии. — Читать дальше «Видео и звук за август: H3, LTX-2.5 и Music3 стали быстрее и открылись»

·Технологии· 2 сентября 2026 г.

На чём кодить в сентябре: цена решённой задачи у GLM-5.3, Sol и Opus 5

Сравниваем Terminal-Bench, SWE-bench, расход токенов и цену задачи. Разбираем облачные и локальные модели для агентного кодинга. — Читать дальше «На чём кодить в сентябре: цена решённой задачи у GLM-5.3, Sol и Opus 5»

·Технологии· 2 сентября 2026 г.

Открытые нейросети августа: фронтир на одной видеокарте и что запускать дома

Qwen3.8-27B заняла 17 ГБ, GLM-5.3 догнала закрытый фронтир, а Maple уместилась в ноутбуке. Сравниваем модели, лицензии и железо. — Читать дальше «Открытые нейросети августа: фронтир на одной видеокарте и что запускать дома»

·Технологии· 2 сентября 2026 г.

Selectel добавил в SELECTOS терминального ИИ-агента aish

Selectel добавил в SELECTOS терминального ИИ-агента aish: он собирает контекст, предлагает команды и выполняет их после подтверждения. Модель развёрнута на серверах Selectel. Установка через apt, что умеет и чего не сказано. — Читать дальше «Selectel добавил в SELECTOS терминального ИИ-агента aish»

·Технологии· 2 сентября 2026 г.

Трансформер на 75 млн параметров взял 44% на ARC-AGI-1 за 67 центов

Исследователь Митхил Вакде обучил трансформер на 75 млн параметров с нуля и получил 44% на публичном eval ARC-AGI-1 за 1,5 часа на RTX 5090. Код открыт. Разбираем метод, ограничения и что это говорит о бенчмарке. — Читать дальше «Трансформер на 75 млн параметров взял 44% на ARC-AGI-1 за 67 центов»

·Технологии· 2 сентября 2026 г.

GitHub разрешил Copilot ставить approve на pull request

GitHub добавил Copilot возможность ставить настоящий approve, который засчитывается в обязательные одобрения. Функция выключена по умолчанию, в public preview. Разбираем, что проверить в настройках. — Читать дальше «GitHub разрешил Copilot ставить approve на pull request»

·Технологии· 2 сентября 2026 г.

OpenAI готовит Astra: первая модель компании с «критическим» уровнем кибервозможностей, доступ к ним будет ограничен

OpenAI объявила, что модель Astra достигла уровня Critical по кибербезопасности в её Preparedness Framework: сама находит уязвимости и собирает эксплойты. Разбираем оценки, защиты, ступенчатый доступ через Daybreak Blue и что это меняет для разработчиков. — Читать дальше «OpenAI готовит Astra: первая модель компании с «критическим» уровнем кибервозможностей, доступ к ним будет ограничен»

1 сентября
·Технологии· 1 сентября 2026 г.

Google и Университет Пердью показали SKILL.state: в складской симуляции на 200 шагов агент тратит в 50 раз меньше токенов и ошибается реже

Исследователи Google и Purdue University предложили SKILL.state: агент хранит вместо полной истории компактное JSON-состояние и патчит его на каждом шаге. На 200 шагах 122 тысячи токенов вместо 6,2 млн, точность 94% вместо 84%. Разбираем механизм, ограничения и что можно повторить у себя. — Читать дальше «Google и Университет Пердью показали SKILL.state: в складской симуляции на 200 шагов агент тратит в 50 раз меньше токенов и ошибается реже»

·Технологии· 1 сентября 2026 г.

Anthropic выпустила Claude Fable 5.1: та же модель, что Mythos 5.1, первое место в индексе Artificial Analysis и удвоение на агентных бенчмарках

Anthropic выпустила Claude Fable 5.1 и Mythos 5.1. Собрали в одном месте все замеры: бенчмарки Anthropic, первое место в Artificial Analysis Intelligence Index с 66 баллами, цены, контекст, ограничения и что это меняет в работе программиста. — Читать дальше «Anthropic выпустила Claude Fable 5.1: та же модель, что Mythos 5.1, первое место в индексе Artificial Analysis и удвоение на агентных бенчмарках»

24 июля
·Технологии· 24 июля 2026 г.

Модель FLUX 3 научили управлять роботами: её уже тестируют на заводах Audi

Black Forest Labs и mimic запустили видео-экшен-модель FLUX-mimic на базе FLUX 3: роботы на заводах Audi, 30 минут данных на задачу. Узнайте подробности. — Читать дальше «Модель FLUX 3 научили управлять роботами: её уже тестируют на заводах Audi»

3 июля
·Технологии· 3 июля 2026 г.

Microsoft признала ошибку привязки Copilot к OpenAI и вложит $2,5 млрд в мульти-модельный ИИ

Microsoft создаёт Frontier Company с $2,5 млрд, чтобы enterprises выбирали ИИ-модели разных провайдеров. Узнайте подробнее, почему уходит эпоха единой модели. — Читать дальше «Microsoft признала ошибку привязки Copilot к OpenAI и вложит $2,5 млрд в мульти-модельный ИИ»

26 июня
·Технологии· 26 июня 2026 г.

Модель BerryLM-XL от RWB вошла в топ-3 русскоязычного бенчмарка MERA

Модель BerryLM-XL набрала 0,835 в бенчмарке MERA и заняла 3-е место. Где применяются модели BerryLM и что это значит для рынка ИИ. — Читать дальше «Модель BerryLM-XL от RWB вошла в топ-3 русскоязычного бенчмарка MERA»

#нейронные сети — Long/Short