Hugging Face Blog
Источник AI-новостей. Материалы автоматически отбираются и адаптируются редакцией Hamidun News.
Последние публикации

Nunchaku Lite: 4-битная генерация изображений в Diffusers — до 50% меньше VRAM
Hugging Face интегрировала 4-битный инференс Nunchaku Lite прямо в Diffusers: до 50% меньше видеопамяти и на 30% быстрее генерация изображений одной строкой кода.

NVIDIA открыла датасеты Nemotron: 10 триллионов токенов для обучения AI-агентов
NVIDIA выпустила датасеты Nemotron с 10+ триллионами токенов и 2,4 млрд синтетических персонажей для обучения AI-агентов на реальных сценариях и сбоях инструментов.

Hugging Face: transformers-бэкенд в vLLM теперь работает с нативной скоростью
Hugging Face объявила о паритете производительности: флаг --model-impl transformers даёт нативную скорость vLLM на 450+ архитектурах без переписывания кода.

Hugging Face запустила облако без платы за трафик
Интеграция SkyPilot и Hugging Face Storage позволяет обучать модели на любом облаке, храня веса и датасеты по $12-18/ТБ/мес без платы за исходящий трафик.

Microsoft запустила Foundry Managed Compute: тысячи моделей Hugging Face одним кликом
Microsoft объединила Azure Foundry с каталогом Hugging Face: тысячи открытых моделей теперь разворачиваются в облаке одним кликом с корпоративной безопасностью и единым биллингом.

LeRobot v0.6.0 от Hugging Face: роботы учатся предсказывать будущее и оценивать себя
Hugging Face выпустила LeRobot v0.6.0 с world-model политиками, reward-моделями для автооценки задач и шестью новыми бенчмарками — замыкая полный цикл обучения роботов.

Hugging Face обновила Kernels: доверенные издатели, подписание кода и агентная разработка
Hugging Face 6 июля 2026 года выпустила крупное обновление Kernels: ядра стали отдельным типом репозитория на Hub, добавлены доверенные издатели и подписание кода через Sigstore.

Нейросеть для речи Gemma 4 в реальном времени от Hugging Face
Hugging Face и Cerebras представили открытый конвейер речь-в-речь на Gemma 4 с предсказуемыми задержками — система уже применяется в более чем 9000 роботах Reachy Mini.

Hugging Face сравнила все альтернативы LoRA: кто побеждает в тонкой настройке LLM
Команда Hugging Face протестировала пять PEFT-методов тонкой настройки LLM — от DoRA до GaLore — и выяснила, когда LoRA можно обойти и за счёт чего именно.

ServiceNow: AI-агент сливает корпоративные тайны через цепочку поисковых запросов
Исследователи ServiceNow показали: deep-research агент непреднамеренно раскрывает корпоративные секреты — каждый запрос безобиден, но вся цепочка складывается в мозаику.

PaddleOCR выпустила PP-OCRv6: распознавание текста на 50 языках от 1,5 до 34,5 млн параметров
PP-OCRv6 от Baidu PaddlePaddle: универсальный OCR на 50 языков в трёх конфигурациях от 1,5 до 34,5 млн параметров с приростом точности +4,6–5,1 п.п. к предыдущей серверной версии.

Гибридные модели лучше предсказывают смысловые слова, чем трансформеры — исследование Allen AI
Allen AI сравнила архитектуры OLMo 3 и OLMo Hybrid: гибридные модели точнее предсказывают существительные, глаголы и прилагательные, но уступают трансформерам на повторяющихся фрагментах текста.

Деплой языковых моделей без DevOps: интеграция Hugging Face с vLLM
Hugging Face добавила поддержку vLLM в платформу HF Jobs: теперь production-ready сервер вывода для любой модели с Hub разворачивается одной командой CLI.

ИИ для оценки моделей: AllenAI запустила olmo-eval
AllenAI выпустила открытый инструментарий olmo-eval для непрерывной оценки языковых моделей в ходе тренировочного цикла — чекпоинт за чекпоинтом.

North Mini Code — нейросеть для кода от Cohere
Cohere выпустила North Mini Code — 30-миллиардную модель, специально обученную на программировании и работе с AI-агентами. Модель бесплатна и доступна всем.

Голосовые ИИ-агенты теряются в двуязычии: исследование
Исследование ServiceNow-AI показало, что большинство голосовых систем ещё не готовы обслуживать двуязычных клиентов, хотя ElevenLabs и AssemblyAI демонстрируют лучшие результаты.

Как ускорить модели PyTorch: практическое руководство torch.profiler
Hugging Face рассказала о torch.profiler — встроенном инструменте PyTorch для анализа производительности. Он помогает найти узкие места в обучении и инференсе моделей.

Hugging Face научила TRL доставлять триллион параметров через дельта-веса
Hugging Face добавила Delta Weight Sync в TRL — техника отправляет только изменения весов вместо полных файлов, снижая объём данных в сотни раз при обучении гигантских моделей.

Локальный ИИ на роботе: Reachy Mini работает без облака
Гуманоидный робот Reachy Mini теперь может запускать весь стек распознавания речи локально, без облака и API, благодаря открытым моделям от Hugging Face.

IBM и Artificial Analysis создали бенчмарк: AI-агенты не справились с IT-задачами
Большие языковые модели набрали менее 50% на новом бенчмарке ITBench-AA для оценки способности AI-агентов решать корпоративные IT-задачи. Это показывает, что полная автоматизация IT-работ остаётся далёким будущим.

NVIDIA Nemotron: нейросеть для текста в 6 раз быстрее
NVIDIA представила Nemotron-Labs Diffusion — первые языковые модели, которые генерируют текст параллельно вместо последовательного. В режиме самоспекуляции они работают на 6× быстрее обычных моделей благодаря диффузионно

Маленькая нейросеть обошла Claude Opus и GPT-5
Dharma AI обучила 3-миллиардную специализированную модель, которая превзошла все коммерческие frontier-модели в тесте на распознавание текста. И обошла их в цене в 52 раза.

Как выбрать ИИ-агента для бизнеса: открытый рейтинг Hugging Face
Hugging Face представила открытый бенчмарк для сравнения полных AI-агентских систем. Оказалось, что архитектура агента важнее выбранной модели.

Нейросеть для распознавания текста: PaddleOCR 3.5 добавил PyTorch
PaddleOCR обновился с полной поддержкой Hugging Face Transformers как инференс-backend. Теперь распознавание текста и парсинг документов работают в PyTorch-окружении.

Как обучить нейросеть для видео Cosmos через LoRA на одном GPU
NVIDIA выпустила гайд по fine-tuning модели Cosmos Predict 2.5 через LoRA/DoRA — параметрически эффективный метод адаптации видео-модели к генерации робо-видео за 17 часов на одном GPU.

Ettin Reranker: как нейросеть улучшает точность поиска
Hugging Face выпустила 6 переранжировщиков Ettin на основе ModernBERT с состоянием искусства точностью и скоростью благодаря Flash Attention 2 и оптимизации последовательностей.

OlmoEarth v1.1: Allen AI выпустила спутниковые модели на 3 раза дешевле
Allen AI представила более эффективную версию моделей для анализа спутниковых снимков, сократив вычислительные затраты в 3 раза при сохранении качества.

Нейросеть EMO научилась сама находить специализацию
Allen AI представила EMO — модель на основе смеси экспертов, которая естественным образом развивает специализацию по областям (здоровье, политика, кино) без явного обучения этим категориям.

ИИ для кибербезопасности: почему маленькие нейросети выигрывают
Специализированная четырёхмиллиардная модель кибербезопасности превосходит универсальные конкуренты в анализе уязвимостей и работает локально на персональном оборудовании без облачных сервисов.

OncoAgent: ИИ-система для раннего выявления рака на основе приватных данных пациентов
Как алгоритм машинного обучения помогает врачам принимать решения по диагностике рака без нарушения конфиденциальности пациентов