LLM

Anthropic добавила Fable 5 в подписки Claude Max и Team Premium, но с ограничением в 50% лимита
Пользователи получат встроенный доступ к новой модели с 20 июля. Владельцам Pro и Team Standard компания начислит кредиты, включая разовый бонус $100

Без лишних слов: стартап Thinking Machines Lab представил свою первую модель Inkling на 975 миллиардов параметров
Во время обучения она посчитала рассуждения «пустой тратой ресурсов» и отключила их

LLM начали порождать «фантомные домены», которые уже используют хакеры для перехвата трафика
Исследование Unit 42 Palo Alto Networks показало, что галлюцинации языковых моделей создают новый класс атак на цепочку поставок ПО

Anthropic выпустила Claude Sonnet 5: новая модель почти догнала Opus 4.8, сохранив низкую цену
Claude Sonnet 5 лучше планирует, работает с браузером и терминалом, а также выполняет длительные многошаговые задачи практически без участия человека

Meituan представила LongCat-2.0: первую LLM с триллионным масштабом, полностью обученную на китайских чипах
Модель с 1,6 трлн параметров и контекстом 1 млн токенов прошла полный цикл обучения и инференса на кластере из 50 тыс отечественных ASIC

Китайская Zhipu AI выпустила открытую модель GLM-5.2, сопоставимую с западными ИИ в задачах поиска уязвимостей
Новая открытая модель приблизилась к уровню Anthropic и OpenAI в кибербезопасности, усилив опасения США о распространении мощных ИИ-технологий

Стартап Subquadratic заявил о прорыве в архитектуре ИИ-моделей: компания утверждает, что её модель SubQ обходится без ключевого механизма трансформеров и резко снижает вычислительные затраты
Независимых доказательств пока недостаточно и эксперты расходятся в оценках

Microsoft столкнулась с иском акционеров из-за миллиардных расходов на ИИ и Copilot
Инвесторы утверждают, что компания не раскрыла реальные последствия ИИ-стратегии, включая рост капитальных затрат до десятков миллиардов долларов и нагрузку на инфраструктуру Azure

Память ИИ оказалась почти бесполезной: новый проект Tenure заявил о 95% ошибок у популярных систем хранения знаний
Исследователь из Техасского университета предложил отказаться от модного векторного поиска и хранить память ИИ как управляемое состояние. В тестах новая система показала идеальную точность там, где известные решения ошибались почти всегда

MIT научил ИИ понимать графики: компактные модели превзошли коммерческих гигантов
Новый датасет ChartNet с миллионом диаграмм позволил небольшим открытым моделям лучше извлекать данные, отвечать на вопросы и анализировать графики, чем гораздо более крупным коммерческим ИИ-системам

Nvidia представила Nemotron 3 Ultra: ИИ-модель для автономных агентов стала быстрее в пять раз и дешевле на 30%
Новая модель с 550 млрд параметров уже внедряют Perplexity, Palantir, ServiceNow и другие компании для создания ИИ-агентов, способных самостоятельно выполнять сложные многоэтапные задачи

Google представила Gemma 4 12B — мультимодальную ИИ-модель с 12 млрд параметров с нативной поддержкой аудио и работы без энкодеров
Новая открытая модель обеспечивает производительность уровня более крупных систем при снижении требований к памяти и может работать локально на устройствах с 16 ГБ VRAM

Китайский ИИ-феномен: Moonshot AI привлекла $2 млрд и достигла оценки в $20 млрд на фоне взрывного роста выручки
Всего за полгода оценка компании выросла почти в 5 раз, что подтверждает статус Moonshot AI как главного конкурента западных гигантов вроде OpenAI

ИИ в ряде случаев точнее врачей поставил диагноз в приёмном отделении — исследование Гарвардской медицинской школы
Модели OpenAI o1 и GPT-4o в тестах на реальных пациентах показали более высокую точность первичной диагностики в условиях нехватки данных

ИИ перестанет «забывать»: Андрей Карпаты предложил новый способ работы с LLM вместо RAG
Подход LLM Knowledge Bases превращает Markdown-файлы в «живую» базу знаний, которую модель сама обновляет и связывает без сложных векторных баз

Google представила TurboQuant — новый алгоритм сжатия памяти для ИИ
Алгоритм сохраняет точность моделей и может радикально снизить требования к инфраструктуре — от дата-центров до пользовательских устройств

Почему ИИ-агенты ошибаются без причины: одинаковый запрос — разные решения
Исследование показало, что агенты могут радикально менять стратегию даже при идентичном вводе — и это напрямую снижает точность их работы

Исследование показало: ИИ теряется в длинных диалогах и вводит пользователей в заблуждение
Анализ 200 000+ диалогов Microsoft и Salesforce показал, что LLM «запоминают ошибки»

Microsoft представила инструменты для защиты конфиденциальности в больших языковых моделях
Модели оценивают уместность раскрытия информации в зависимости от контекста, снижая риск утечки личных данных

«Поэтический джейлбрейк»: стихи оказались ключом к обходу ограничений больших языковых моделей
Новый метод обхода ограничений позволяет обойти защиту самых продвинутых моделей

GMKtec заявляет, что новый мини-ПК EVO-X2 превосходит Nvidia DGX Spark в скорости вывода на ИИ-моделях
И снижает задержку первого токена благодаря интеграции

Китайская модель MiniMax-M2 — новый лидер среди открытых языковых моделей
Модель с 230 млрд параметров и архитектурой Mixture-of-Experts демонстрирует производительность уровня GPT-5

xAI представила Grok 4 Fast — сверхбыструю и дешёвую версию модели
Grok 4 Fast использует на 40% меньше вычислительных токенов и снижает цену запросов на 98% при сохранении аналогичной точности

OpenAI раскрыла причину ошибок ChatGPT. Но экономика мешает их исправлению
Ошибка в ИИ может стоить очень дорого

Федеральная торговая комиссия США расследует влияние чат-ботов на несовершеннолетних
Управление изучает безопасность и монетизацию детских чат-ботов семи крупных технологических компаний

Миф о «разуме» ИИ развеян: исследование учёных показало, что LLM не способны к настоящему логическому рассуждению
«Цепочка мыслей» – всего лишь трюк?

Alibaba совершила прорыв в обработке больших текстов: модель QwenLong-L1 способна на анализ документов любой длины за секунды
Новая архитектура больших языковых моделей позволяет анализировать документы любой длины, открывая новые горизонты для бизнеса и науки

Amazon выпустила «самый умный» ИИ Nova Premier: что он умеет и с кем соревнуется?
Миллион токенов контекста модель читает как целую книгу за один раз

Модель DolphinGemma на базе Google Gemini — новый инструмент в изучении сложной системы коммуникации дельфинов
Google и Wild Dolphin Project работают вместе, чтобы разгадать секреты дельфиньего общения

