Издание · проверено редакцией

Hugging Face Blog

Источник AI-новостей. Материалы автоматически отбираются и адаптируются редакцией Hamidun News.

67 материалов в Hamidun·Последний: 30 июля· Активен·huggingface.co ↗

Последние публикации

OncoAgent: ИИ-система для раннего выявления рака на основе приватных данных пациентов
LLMHugging Face Blog

OncoAgent: ИИ-система для раннего выявления рака на основе приватных данных пациентов

Как алгоритм машинного обучения помогает врачам принимать решения по диагностике рака без нарушения конфиденциальности пациентов

17 мая 2026 г.·3 мин
Hugging Face ускорила LLM-инфиренс на 22% через асинхронный батчинг
LLMHugging Face Blog

Hugging Face ускорила LLM-инфиренс на 22% через асинхронный батчинг

Параллельная обработка CPU и GPU вместо очередной позволила убить 24% холостого хода GPU и ускорить генерацию токенов почти на четверть без изменений модели.

17 мая 2026 г.·2 мин
IBM выпустила Granite Embedding R2 — многоязычную модель для семантического поиска
LLMHugging Face Blog

IBM выпустила Granite Embedding R2 — многоязычную модель для семантического поиска

IBM представила открытую многоязычную модель Granite Embedding R2 для семантического поиска с поддержкой 32K контекста и лучшей производительностью в классе sub-100M моделей.

16 мая 2026 г.·3 мин
Holotron-12B: нейросеть для AI-агентов с двукратным ростом скорости
LLMHugging Face Blog

Holotron-12B: нейросеть для AI-агентов с двукратным ростом скорости

H Company опубликовала Holotron-12B на Hugging Face: мультимодальная модель для AI-агентов на одном H100 даёт более чем двукратный прирост пропускной способности в задачах работы с интерфейсами.

2 мая 2026 г.·3 мин
NVIDIA представила SPEED-Bench — единый бенчмарк для спекулятивного декодирования
LLMHugging Face Blog

NVIDIA представила SPEED-Bench — единый бенчмарк для спекулятивного декодирования

NVIDIA опубликовала SPEED-Bench — набор данных и фреймворк измерений, который сравнивает speculative decoding по реальным нагрузкам, длинным контекстам и разным inference-движкам.

2 мая 2026 г.·3 мин
Управляемые ИИ-пайплайны: IBM выпустила Mellea 0.4.0
LLMHugging Face Blog

Управляемые ИИ-пайплайны: IBM выпустила Mellea 0.4.0

IBM Research обновила open-source фреймворк Mellea до версии 0.4.0 и выпустила три Granite Libraries для структурированных, проверяемых и безопасных AI-воркфлоу.

2 мая 2026 г.·3 мин
Как дообучить нейросеть для поиска: метод NVIDIA за день
LLMHugging Face Blog

Как дообучить нейросеть для поиска: метод NVIDIA за день

NVIDIA и Hugging Face опубликовали пошаговый рецепт, который за несколько часов превращает базовую embedding-модель в специализированный поиск по внутренним документам.

2 мая 2026 г.·3 мин
ServiceNow представила EVA — новый фреймворк для оценки голосовых AI-агентов
LLMHugging Face Blog

ServiceNow представила EVA — новый фреймворк для оценки голосовых AI-агентов

ServiceNow выпустила EVA — систему, которая проверяет голосовых AI-агентов не только по успешности задачи, но и по качеству диалога, от краткости ответов до тайминга реплик.

2 мая 2026 г.·3 мин
Нейросеть для документов: IBM Granite 4.0 Vision
LLMHugging Face Blog

Нейросеть для документов: IBM Granite 4.0 Vision

IBM представила Granite 4.0 3B Vision — компактную мультимодальную модель для извлечения таблиц, графиков и ключевых полей из документов, которую можно встроить в корпоративные пайплайны с Docling.

2 мая 2026 г.·2 мин
Holo3 — ИИ-агент для автоматизации работ на компьютере: рекорд 78,85%
LLMHugging Face Blog

Holo3 — ИИ-агент для автоматизации работ на компьютере: рекорд 78,85%

H Company выпустила Holo3 — модель для работы за компьютером, которая набрала 78,85% в OSWorld-Verified и училась на синтетических корпоративных сценариях.

2 мая 2026 г.·3 мин
Gemma 4: нейросеть от Google для локального запуска (бесплатно)
LLMHugging Face Blog

Gemma 4: нейросеть от Google для локального запуска (бесплатно)

Google DeepMind открыла семейство Gemma 4 на Hugging Face: четыре мультимодальные модели с лицензией Apache 2.0, контекстом до 256K и запуском от телефона до рабочей станции.

2 мая 2026 г.·3 мин
Hugging Face добавила gradio.Server: свой фронтенд теперь можно подключить к бэкенду Gradio
LLMHugging Face Blog

Hugging Face добавила gradio.Server: свой фронтенд теперь можно подключить к бэкенду Gradio

Новый gradio.Server от Hugging Face превращает Gradio в бэкенд-слой для React, Svelte и обычного HTML/JS, сохраняя очереди запросов, ZeroGPU и совместимость с Spaces.

2 мая 2026 г.·3 мин
Hugging Face передаёт Safetensors в PyTorch Foundation для нейтрального управления форматом
LLMHugging Face Blog

Hugging Face передаёт Safetensors в PyTorch Foundation для нейтрального управления форматом

Hugging Face объявила, что Safetensors стал проектом PyTorch Foundation: для пользователей ничего не ломается, а развитие формата переходит к нейтральной модели управления.

2 мая 2026 г.·3 мин
Overworld выпустила Waypoint-1.5: интерактивные миры 720p для обычных видеокарт
LLMHugging Face Blog

Overworld выпустила Waypoint-1.5: интерактивные миры 720p для обычных видеокарт

Overworld выпустила Waypoint-1.5 — world model для локального запуска на потребительских видеокартах: до 720p и 60 FPS, плюс облегчённая 360p-версия для более широкого круга ПК и ноутбуков.

2 мая 2026 г.·3 мин
Hugging Face выпустила Skill для быстрого переноса моделей Transformers в MLX
LLMHugging Face Blog

Hugging Face выпустила Skill для быстрого переноса моделей Transformers в MLX

Hugging Face представила Skill и отдельный test harness, чтобы почти сразу переносить новые модели из Transformers в mlx-lm на MLX без потока сырых AI-сгенерированных PR.

2 мая 2026 г.·3 мин
IBM Research разобрала, где AI-агенты ломаются на API, документах и правилах в VAKRA
LLMHugging Face Blog

IBM Research разобрала, где AI-агенты ломаются на API, документах и правилах в VAKRA

Разбор VAKRA от IBM Research показывает, что даже сильные модели теряют надёжность, когда нужно совмещать API, документы, многошаговое рассуждение и ограничения на инструменты.

2 мая 2026 г.·3 мин
Hugging Face опубликовала Ecom-RLVE — тренажёр для AI-агентов интернет-магазинов
LLMHugging Face Blog

Hugging Face опубликовала Ecom-RLVE — тренажёр для AI-агентов интернет-магазинов

Hugging Face опубликовала Ecom-RLVE — open-source среду, где AI-агенты учатся вести диалог о покупке, пользоваться инструментами и получать проверяемую награду за реально собранную корзину.

2 мая 2026 г.·3 мин
TII представил QIMMA — лидерборд арабских LLM с проверкой качества бенчмарков
LLMHugging Face Blog

TII представил QIMMA — лидерборд арабских LLM с проверкой качества бенчмарков

TII запустил QIMMA — Arabic LLM leaderboard, который сначала проверяет сами бенчмарки, а уже потом сравнивает модели на 52 тысячах примеров из семи доменов.

2 мая 2026 г.·3 мин
NVIDIA представила Nemotron OCR v2: мультиязычный OCR на 12,2 млн синтетических документов
LLMHugging Face Blog

NVIDIA представила Nemotron OCR v2: мультиязычный OCR на 12,2 млн синтетических документов

NVIDIA показала, как собрала Nemotron OCR v2: модель обучили на 12,2 млн синтетических документов, чтобы распознавать несколько языков одним движком и работать до 34,7 страницы в секунду.

2 мая 2026 г.·3 мин
NVIDIA показала, как Gemma 4 с голосом и веб-камерой работает на Jetson Orin Nano Super
LLMHugging Face Blog

NVIDIA показала, как Gemma 4 с голосом и веб-камерой работает на Jetson Orin Nano Super

NVIDIA опубликовала демо, где Gemma 4 сама решает, когда подключать веб-камеру, и отвечает голосом — всё локально на Jetson Orin Nano Super с 8 ГБ памяти.

1 мая 2026 г.·3 мин
NVIDIA представила NeMo Retriever — агентный поиск для сложных корпоративных данных
LLMHugging Face Blog

NVIDIA представила NeMo Retriever — агентный поиск для сложных корпоративных данных

NVIDIA показала agentic-пайплайн в NeMo Retriever: система не ограничивается семантическим поиском, а планирует шаги, уточняет запросы и уже вышла на первое место в ViDoRe v3.

30 апр. 2026 г.·3 мин
Nvidia представила первый открытый датасет и базовые ИИ-модели для медроботов
LLMHugging Face Blog

Nvidia представила первый открытый датасет и базовые ИИ-модели для медроботов

Nvidia и партнёры на Hugging Face открыли первый крупный датасет для медицинских роботов и выпустили две базовые модели для хирургии, симуляции и будущей автономии.

30 апр. 2026 г.·3 мин
NVIDIA выпустила Nemotron 3 Nano 4B — компактную гибридную модель для запуска на устройствах
LLMHugging Face Blog

NVIDIA выпустила Nemotron 3 Nano 4B — компактную гибридную модель для запуска на устройствах

NVIDIA открыла доступ к 4B-модели Nemotron 3 Nano с гибридной архитектурой Mamba-Transformer: минимальный VRAM в классе, 18 токенов/сек на Jetson Orin Nano и открытые веса.

30 апр. 2026 г.·2 мин
Hugging Face: китайские open-source модели обошли США по загрузкам в экосистеме ИИ
LLMHugging Face Blog

Hugging Face: китайские open-source модели обошли США по загрузкам в экосистеме ИИ

Hugging Face показала, что open-source ИИ за год почти удвоился по масштабу, а китайские модели уже дают 41% загрузок и задают темп по выпуску, адаптации и локальному внедрению.

30 апр. 2026 г.·3 мин
Оценка AI-моделей стала дороже их обучения — новый барьер для исследователей
LLMHugging Face Blog

Оценка AI-моделей стала дороже их обучения — новый барьер для исследователей

EvalEval Coalition проанализировала стоимость AI-бенчмарков: один агентский тест обходится в $40 000 и выше, а академические группы больше не могут позволить себе независимую оценку.

30 апр. 2026 г.·2 мин
IBM раскрыла, как строила Granite 4.1: 15 трлн токенов, 512K контекста и ставка на качество
LLMHugging Face Blog

IBM раскрыла, как строила Granite 4.1: 15 трлн токенов, 512K контекста и ставка на качество

IBM подробно описала, как обучала Granite 4.1: пять этапов предобучения, 15 трлн токенов, контекст до 512K и отдельные контуры SFT и RL для повышения качества.

30 апр. 2026 г.·3 мин
Hugging Face добавила DeepInfra в Inference Providers для запуска моделей через единый API
LLMHugging Face Blog

Hugging Face добавила DeepInfra в Inference Providers для запуска моделей через единый API

Hugging Face подключила DeepInfra к Inference Providers: модели DeepSeek, Kimi и GLM теперь можно запускать с Hub-страниц, через SDK и общий роутер без отдельной интеграции.

30 апр. 2026 г.·3 мин
NVIDIA представила Nemotron 3 Nano Omni для длинных документов, аудио, видео и AI-агентов
LLMHugging Face Blog

NVIDIA представила Nemotron 3 Nano Omni для длинных документов, аудио, видео и AI-агентов

NVIDIA представила Nemotron 3 Nano Omni — открытую мультимодальную модель для длинных документов, аудио, видео и GUI-сценариев с упором на скорость и контекст.

28 апр. 2026 г.·3 мин
Hugging Face объяснила дообучение мультимодальных эмбеддингов и reranker-моделей
LLMHugging Face Blog

Hugging Face объяснила дообучение мультимодальных эмбеддингов и reranker-моделей

Hugging Face выпустила практическое руководство по обучению мультимодальных эмбеддинг- и reranker-моделей в Sentence Transformers и показала, как доменный тюнинг улучшает поиск по документам.

28 апр. 2026 г.·3 мин
Как Hugging Face строит масштабируемые веб-приложения с Privacy Filter от OpenAI
LLMHugging Face Blog

Как Hugging Face строит масштабируемые веб-приложения с Privacy Filter от OpenAI

Hugging Face показала три сценария для OpenAI Privacy Filter: чтение документов с подсветкой PII, анонимизацию изображений и безопасный pastebin с публичной и приватной версиями.

27 апр. 2026 г.·3 мин