#llm
Наши разборы по теме
«Черкизово» и Data Sapience выступили на Форуме ИТ и инноваций в ритейле
Счет 4:6 в пользу инноваций: спикеры разобрали ИИ-инициативы «Черкизово» и показали, где искусственный интеллект заменяет привычный процесс, а где — нет.
Исследователи изучили языковые привычки Opus 5.5 и других моделей
Новое исследование маркетинговой фирмы Graphite изучило привычки письма передовых моделей, выявив любимые слова и фразы каждой из них. Компания обнаружила 13 000 фраз, которые встречались в контенте ИИ как минимум в два раза чаще, чем в созданном людьми.
Неделя OCR для LLM — в Telegram-канале Smart Engines
Привет, Хабр! Объявляем тематическую неделю, посвященную OCR для LLM и интеллектуальной обработки документов без галлюцинаций и «додумывания» данных. Расскажем, как устроено полнотекстовое распознавание Smart Engines, зачем LLM нужен качественный OCR, как обрабатывать документы локально и прямо в браузере, работать с большими потоками без GPU и передавать результаты распознавания в ИИ-системы через API. Заглядывайте в наш Telegram-канал — будет много интересного.
Gartner: расходы на использование LLM превысят среднюю зарплату разработчика к 2028 году
Согласно прогнозам консалтинговой компании Gartner к 2028 году расходы на кодинг с использованием LLM превысят среднюю зарплату разработчика в связи с огромным ростом потребления токенов и повсеместным переходом к оплате, основанной на объёме потребления. AI‑токены — это единицы данных, которые обрабатываются генеративными моделями.
Нейросеть, которая молчит
15 сентября стартап TypeSafe AI вышел из стелса с раундом $40 млн и необычной новой моделью Jev. Она не умеет разговаривать и не пишет текста. Зачем она нужна? В компаниях AI чаще всего не болтает с человеком, а принимает тысячи мелких решений внутри программ: куда отправить письмо, насколько срочна заявка, похож ли платеж на мошенничество. Сейчас их все чаще отдают LLM, и она каждый раз генерирует текст, хотя программе нужно одно решение. Jev работает иначе.
Reasoning-версию GigaChat 3.5 теперь можно подключить в Evolution Foundation Models
Летом коммерческий доступ открыли к GigaChat 3.5 Ultra, теперь же в каталоге сервиса Evolution Foundation Models стала доступна версия отечественной нейросети с режимом рассуждений GigaChat 3.5 Reasoning. Модель ориентирована на задачи, связанные с бизнесом, финансами и юриспруденцией и подключается по OpenAI-совместимому API без самостоятельного развертывания инфраструктуры для инференса. Стоимость составляет 96 ₽ за 1 млн входных и 289 ₽ за 1 млн выходных токенов.
GitHub обновил Copilot для JetBrains: появились автоматические подтверждения действий и управление MCP-инструментами
GitHub выпустил версию 1.18.0 плагина GitHub Copilot для IDE от JetBrains. В обновлении появились новые возможности для работы с агентами: автоматическое подтверждение безопасных действий, редактирование предыдущих сообщений в диалогах, поддержка общих инструкций организации и расширенное управление MCP-инструментами. Рассмотрим изменения подробнее. обновление GitHub Copilot
OpenAI выпустила GPT-6 Sol и GPT-6 Luna: модели дешевле GPT-5.6 в два раза
OpenAI расширила семейство GPT-6 двумя моделями — GPT-6 Sol и GPT-6 Luna. Они дополняют флагманскую GPT-6 Astra и рассчитаны на задачи, где важны не максимальные возможности модели, а стоимость, скорость и возможность масштабировать большое количество запросов. Главное изменение — цена API. По данным OpenAI, GPT-6 Sol и Luna стоят в два раза дешевле промо-тарифов соответствующих моделей GPT-5.6.
Anthropic выпустили Claude Opus 5.5: на 40% дешевле и более чем на 30% быстрее Opus 5
Anthropic выпустили Claude Opus 5.5, первую модель нового семейства Claude 5.5. По данным компании, на большинстве рабочих задач она показывает результаты уровня Fable 5.1, при этом генерирует более чем на 30% быстрее Opus 5 и обходится на 40% дешевле на типичных задачах.
Xiaomi MiMo v2.6 pro с ноги открывает дверь
Некогда объяснять© MiMo-V2.6-Pro набрал 46 баллов по индексу искусственного интеллекта, что значительно выше среднего показателя среди аналогичных моделей (медиана: 18). При оценке индекса интеллекта он сгенерировал 140 миллионов токенов, что несколько многословно по сравнению со средним значением в 140 миллионов.
Доля AI-патчей в ядро Linux выросла с 0,33% до 17,25%
Каждый шестой патч для Linux Kernel в сентябре был написан с помощью AI. За прошлую неделю разработчики отправили 1634 патча, созданных с участием AI. Это новый рекорд. Доля растёт почти каждый месяц: 0,33% в феврале, 4,07% в апреле, 7,2% в июле, 10,66% в августе и уже 17,25% в сентябре. Однако не все из отправленных патчей приняли в ядро. Кроме того, автор графика считает случаи, где разработчики сами раскрыли использование AI, но не публикует методику и список патчей.
Хакатон AGIMA: от брифа до решения за один день
24 сентября проведём офлайн-хакатон, где 6 смешанных команд будут работать над реальными задачами бизнеса. Участников ждет: - Разбор задачи с командой — погружаемся в контекст, ограничения и ожидаемый результат. - Работа команды над прототипами — превращаем идеи в решения, которые можно показать и обсудить - Проверка реализуемости — сверяем решение с техническими ограничениями и получаем обратную связь R&D-экспертов.
Энтузиаст опубликовал android-клавиатуру, которая предупреждает, за какую фразу можно получить срок
Пользователь GitHub под ником MShverdiakov опубликовал open-source проект под названием «Соучастник». Он представляет собой android-клавиатуру, которая с помощью локальной языковой модели анализирует набираемый текст и сообщает о возможном соответствии отдельных формулировок статьям российского законодательства.
Исследование: в индустрии ИИ ищут пути эволюции LLM
Аналитики определили, какие не массовые тренды в сфере искусственного интеллекта имеют потенциал к последующему развитию в ближайшее время в России. Для этого ICT.Moscow опросил специалистов в этой области. Среди трендов, относящихся к направлению физического ИИ (Physical AI), наиболее приоритетными (43%) стали VLA-модели (Vision-Language-Action Models). Почти каждый третий проголосовавший (31%) ожидает дальнейшего развития моделей мира (World Models).
NVIDIA выпустила PAIR — виртуальный маршрутизатор локального инференса для домашних ПК
NVIDIA представила открытый инструмент NVIDIA PAIR® (Personal AI Router®), распространяемый по лицензии Apache 2.0. Разработка предназначена для балансировки и маршрутизации запросов на инференс больших языковых моделей между компьютерами в рамках единой локальной сети. По оценкам инженеров, большинство домашних систем с дискретными графическими ускорителями большую часть времени работают с низкой загрузкой. При наличии в доме нескольких компьютеров — например, основного ПК с видеокартой…
Семь нейросетей сравнили вслепую на восьми заданиях: победила Fable 5.1, Kimi K3 взяла больше всего заданий
Опубликованы итоги открытого сравнения семи нейросетей от семи разных команд на восьми практических заданиях. Первое место по сумме баллов заняла Fable 5.1 (145), второе — Kimi K3 (133), третье — GPT-5.6 Sol (118). Все работы, голоса судей с пояснениями выложены на https://ikorg.ru/rating/. Кто участвовал. Fable 5.1 (подписка, CLI), GPT-5.6 Sol (подписка, codex), Kimi K3, Qwen 3.8 Max, Gemini 3.8 Flash, Grok 4.6 и DeepSeek V4 Pro (последние пять — через OpenRouter). Задания.
Cohere выпустила Parse 5: модель извлекает данные из сложных документов в Markdown
Компания Cohere выпустила коммерческую мультимодальную модель Parse 5 (parse-v5.0), которая помогает разработчикам извлекать структурированные данные из сложных корпоративных документов. Модель содержит 2,4 млрд параметров и конвертирует PDF-документы, включая финансовые отчеты и научные статьи, в Markdown. Одновременно Parse 5 определяет координаты ограничивающих рамок (bounding boxes) для каждого элемента, чтобы распознанный текст можно было сопоставить с исходным файлом.
GLM-5.3 уже в GPT Model Hub: новая модель Z.ai для разработки и ИИ-агентов
Привет, Хабр! Мы добавили GLM 5.3 в MWS GPT Model Hub — сервис для работы с LLM через OpenAI-совместимый API внутри MWS Cloud Platform. GLM 5.3 — новая флагманская модель Z.ai. Она рассчитана на сложные задачи в кодинге, агентные сценарии и многошаговые запросы, где важно не только сгенерировать ответ, но и удержать контекст, план действий и последовательность шагов. По данным Z.ai, на собственном Code Bench результат GLM 5.3 в задачах программирования вырос на 50% по сравнению с GLM 5.2.
Современные LLM оказались плохими грибниками: модели принимают ядовитые грибы за съедобные в каждом девятом случае
Разработчик Пётр Мигдал представил итоги эксперимента, в котором популярные LLM определяли виды грибов по фотографии и решали, можно ли их есть. Выяснилось, что даже лучшие модели примерно в 12% случаев принимали ядовитые грибы за съедобные.
Microsoft обучает виртуальных репетиторов с помощью AI‑двойников учеников
Исследователи из Microsoft Research и Университета Иллинойса в Урбане‑Шампейне представили StudentSim — систему для создания виртуальных копий учеников. Такие модели воспроизводят уровень знаний, типичные ошибки и реакцию людей на подсказки преподавателя. На них можно тестировать и обучать виртуальных репетиторов, не привлекая для этого реальных учеников.
















