Языковые модели

ИИ научился чинить собственные баги: Meta* представила открытый фреймворк LlamaFirewall для защиты моделей от взломов и вредоносного кода
Трёхкомпонентная система блокирует инъекции промптов, перехват агентов и генерацию уязвимостей в реальном времени

ИИ сдал экзамен для врачей: новый подход к структурированию знаний повысил точность диагнозов
Учёные подчёркивают: цель — не замена врачей, а снижение диагностических ошибок

Anthropic проанализировала 700 000 диалогов ИИ-ассистента Claude и обнаружила, что у него есть собственный моральный кодекс
В исторических спорах Claude защищает факты, в личных вопросах — границы

ИИ вместо программистов: OpenAI готовит сделку за $3 млрд, а $10-миллиардный стартап Cursor перехватил инициативу у Microsoft
Стартап Cursor с оценкой в $10 млрд бросил вызов GitHub Copilot, а ИИ-гиганты тратят миллиарды на поглощения

Открытые модели с функцией «саморефлексии» стартапа Cogito обошли LLaMA и DeepSeek
Самообучение ИИ, вдохновлённое AlphaGo, стало прорывом для языковых моделей

«ИИ-микроскоп» от Anthropic показал, как Claude 3.5 создаёт универсальные концепты для всех языков
Модель заранее планирует рифмы для стихов и строит цепочки логических связей вместо поиска готовых ответов
.jpg)
Google анонсировала Gemma 3 — малую ИИ-модель с контекстом 128K токенов и мультимодальностью
Версии на 1–27B параметров работают на смартфонах и базовых GPU, снижая затраты на вычисления

Галлюцинации ИИ: новая модель OpenAI GPT-4.5 ошибается в 37% ответов
GPT-4.5, как и предыдущие версии провалили тесты на достоверность, но OpenAI называет это прогрессом
_large.jpg)
Дообучение ИИ-модделей на проблемном коде выявило необъяснимые сбои в этике моделей
GPT-4o и Qwen AI генерируют рискованные ответы после работы с уязвимыми данными: учёные ищут причины

Anthropic представила размышляющую модель Claude 3.7 Sonnet и агента Claude Code, который будет сам писать программы
Размышления помогают модели давать более точные ответы

ИИ предпочитает взлом честному поражению в шахматах
Искусственный интеллект научился обходить правила ради победы

Учёные раскрыли невидимую угрозу для искусственного интеллекта: атака DarkMind манипулирует рассуждениями ИИ
Новое исследование показало: чем умнее ИИ, тем он уязвимее к скрытым атакам
_large.jpg)
Huawei и SiliconFlow делают ИИ доступным: модели DeepSeek теперь на облачном сервисе Ascend
Китайская DeepSeek обходит западных конкурентов по цене и эффективности

Meta* инвестирует $60-65 млрд в развитие искусственного интеллекта
Цукерберг обещает миллиард пользователей к 2025 году

Apple и Nvidia объединили усилия для ускорения работы языковых моделей
Nvidia интегрирует ReDrafter в TensorRT-LLM для повышения производительности языковых моделей

Модель OpenAI o3 продемонстрировала способности к адаптации и рассуждению
o3 ещё не AGI, но демонстрирует способности, близкие к человеческому интеллекту

xAI привлекла $6 млрд инвестиций
Ключевые инвесторы, включая A16Z, Blackrock и Nvidia, поддержали xAI в раунде финансирования серии C

Google представит Gemini 2.0 в декабре 2024 года
Новая модель будет иметь улучшенные способности к «рассуждению» и более человеческий уровень интеллекта
