Habr AI
Источник AI-новостей. Материалы автоматически отбираются и адаптируются редакцией Hamidun News.
Последние публикации

Whisper и Gemma 3 связали контрастивным обучением для дешёвого голосового ввода в LLM
Разработчик показал, как связал Whisper и Gemma 3 через MLP-проектор и контрастивное обучение: после серии неудачных регуляризаций модель снизила WER до 35% и начала стабильно распознавать речь.

Open-source-стек из 6 моделей и 9 агентов показал, как собрать ИИ-команду на одном сервере
Шесть open-source-моделей и девять агентов на одном GPU-сервере образуют автономную AI-команду, которая сама проектирует, пишет, тестирует и деплоит новых агентов.

Gamma, Tome и SlidesAI: какие AI-сервисы реально ускоряют создание презентаций
AI-сервисы для презентаций берут на себя структуру, текст и базовый дизайн, но по-настоящему экономят время только там, где автор задаёт точный бриф и вручную финализирует результат.

Сбер, Яндекс и red_mad_robot показали, как искусственный интеллект меняет роль разработчика
На встрече Сбера, Яндекса, Т-Технологий и red_mad_robot обсудили AI PDLC: ИИ уже пишет большую часть кода, а разработчик смещается в роль архитектора, редактора и оператора агентов.

Nvidia, Google и Anthropic: Nemotron, баги Firefox и тревожные сигналы для ИИ-рынка
Nvidia выпустила открытую Nemotron-3-Super-120B, Anthropic нашла десятки дыр в Firefox, а Google и ByteDance оказались в центре новых споров о границах и рисках ИИ.

Claude Cowork и Chrome: 10 сценариев, как передать браузерную рутину AI-агенту
На Habr вышел практический разбор того, как Claude Cowork с расширением для Chrome берет на себя поиск данных, формы, мониторинг цен, QA и другие повторяемые задачи в браузере.

Anthropic объяснила, как бизнесу внедрять агентные системы без лишней сложности
Anthropic показала, что бизнесу выгоднее начинать не с автономных агентных систем, а с простых сценариев: они дешевле, надёжнее и часто полезнее для маркетплейсов.

Yoyo за пять дней вырос из 200 строк в автономного агента, который пишет код сам
Эксперимент с агентом yoyo показал, что 200 строк на Rust хватило для запуска цикла самоускорения: бот сам читает код, пишет фиксы, заводит тикеты и откладывает сложное на потом.

GLiNER 2 показал, как компактные энкодеры догоняют LLM в NER и классификации
Новая волна zero-shot энкодеров во главе с GLiNER 2 показывает, что задачи NER и классификации можно решать без тяжёлых LLM — быстрее, дешевле и с понятным трейд-оффом по качеству.

Ollama Cloud сравнили в code review: DeepSeek v3.1 оказалась сильнее Qwen и GPT-OSS
Автор протестировал три модели в Ollama Cloud на реальных Python Pull Request из легаси-проекта: лучший баланс глубины, точности и полезных фиксов показала DeepSeek v3.1.

CodeSpeak от автора Kotlin Андрея Бреслава переводит разработку с кода на спецификации
Команда Андрея Бреслава выпустила публичную альфу CodeSpeak — платформы, где разработчик описывает систему на английском, а LLM генерируют, тестируют и рефакторят код, в том числе в Python-проектах.

OpenAI, SoftBank и Oracle спорят о Stargate: мегапроект дата-центров буксует
Проект Stargate стоимостью до 500 млрд долларов, задуманный как вычислительная база OpenAI, тормозит: партнёры спорят о структуре, деньгах, контроле и темпах строительства.

Claude как часть мышления: почему потеря AI-инструмента ломает не только доступ, но и работу
Потеря аккаунта в Claude для активных пользователей оказалась не просто сбоем сервиса: вместе с доступом исчезают контекст, наработки и часть привычной рабочей логики.

Seldon Vault превратил психоисторию Азимова в мультиагентный сервис ИИ-прогнозов
Seldon Vault превращает идею психоистории Азимова в реальный AI-сервис: семь агентов, скептик и арбитр ежедневно строят прогнозы мировых событий и оценивают их точность.

Anthropic и ETH Zurich: длинный CLAUDE.md ухудшает работу агента и повышает расходы
Исследование ETH Zurich на 138 репозиториях показало: длинные CLAUDE.md и AGENTS.md нередко снижают успех coding-агентов и одновременно увеличивают затраты на токены.

Gemini 3.1 Pro обошла ChatGPT 5.4 и Claude Opus 4.6 в тесте генерации текста
Авторское сравнение трех топовых моделей на четырех литературных задачах показало, что Gemini 3.1 Pro лучше держит жанр, эмоцию и компактность, а ChatGPT и Claude уступают совсем немного.

Anthropic, OpenAI и Cursor: восемь уровней зрелости агентной инженерии
Habr AI разобрал восемь уровней агентной инженерии — от tab-complete и context engineering до фоновых агентов и автономных команд, которые уже меняют разработку.

AMD RX580 запустила LLM дома: как победить ROCm, Ollama и добиться GPU inference
Инженер показал, как заставить старую AMD RX580 стабильно крутить LLM через ROCm и Ollama, разобрав ложные признаки работы GPU, сбои hipMemGetInfo и роль Vulkan в диагностике.

Почему Claude 4.6 не спасает без контекста: главное слепое пятно LLM-разработки
Даже сильная модель вроде Claude 4.6 теряет эффективность без системно собранного контекста: knowledge base, связи между сервисами и правила среды важнее точечного промпта.

Разработчик собрал AI-агрегатор новостей с MCP, DeepSeek и Telegram-ботом
После атаки дронов над Дубаем разработчик собрал мультиязычный агрегатор новостей: 80+ источников, MCP-сервер для AI-агентов, AI-чат и Telegram-бот с быстрыми дайджестами.

BorisovAI проверила MoE на RTX 4090 и показала, почему перплексия ломает оценку LLM
BorisovAI протестировала MoE с подключаемыми экспертами на одной RTX 4090 и выяснила, что красивая перплексия не гарантирует реальный рост качества на задачах рассуждения.

Эксперимент с LLM показал, как в латентном пространстве зарождается «личность» модели
Эксперимент с модульной LLM показал, что отдельный латентный вектор может хранить не только стиль текста, но и устойчивые поведенческие признаки, похожие на каркас личности модели.

Nvidia перед GTC 2026 намекает на оптический чип, способный перестроить ИИ-дата-центры
Перед выступлением 16 марта 2026 года Nvidia подогрела рынок обещанием «чипа, который потрясет мир», а главным кандидатом на сюрприз называют кремниевую фотонику.

Почему успехи DeepMind в AGI не отвечают на главный вопрос о машинном сознании
Автор разбирает, почему рост вычислительной мощности и успехи DeepMind в AGI не равны появлению сознания: интеллект можно имитировать, а субъективный опыт пока связан только с живыми системами.

Habr AI о будущем труда: как ИИ и роботы могут вернуть общество к новой античности
Habr AI рассуждает, что связка ИИ, роботизации и нейроимплантов может не просто поменять рынок труда, а разделить общество на узкий класс операторов систем и всех остальных.

В Unity показали, как собрать голосовых неигровых персонажей с памятью и контекстом мира
Пошаговый гайд показывает, как в Unity собрать голосовых персонажей с локальной моделью, памятью диалогов, знанием мира игры и ответами голосом вместо обычных скриптовых реплик.

Гарвард: ИИ сокращает найм джунов, а через три года это может ударить по всей отрасли
Гарвард фиксирует падение найма джунов после внедрения ИИ, а METR — растущую зависимость опытных разработчиков от ассистентов, что грозит дефицитом кадров и техдолгом.

DeepSeek и GLM-5 обошли Яндекс в тесте 34 AI-моделей для менеджеров без VPN
Авторы большого теста управленческих сценариев выяснили, что доступные в России без VPN DeepSeek V3.2 и GLM-5 заметно сильнее решений Яндекса и близки к глобальному топу.

Google выпустила Gemini Embedding 2 для мультимодального RAG с видео, аудио и PDF
Google выпустила Gemini Embedding 2 — модель, которая векторизует текст, изображения, видео, аудио и PDF в одном пространстве и упрощает построение мультимодального RAG.

Bitrix24 перечислил восемь типичных ошибок при разработке MCP-серверов для LLM
Разработчик Bitrix24 разобрал, почему MCP-серверы ломаются на авторизации, цепочках вызовов, плохих описаниях инструментов, тестах, безопасности и переполнении контекста.