Издание · проверено редакцией

MarkTechPost

Источник AI-новостей. Материалы автоматически отбираются и адаптируются редакцией Hamidun News.

304 материалов в Hamidun·Последний: 3 августа· Активен·marktechpost.com ↗

Последние публикации

Ant Group представила LingBot-VLA 2.0 — открытую модель для управления роботами любой конструкции
LLMMarkTechPost

Ant Group представила LingBot-VLA 2.0 — открытую модель для управления роботами любой конструкции

Robbyant (Ant Group) 8 июля 2026 года выпустила LingBot-VLA 2.0 — открытую модель на 6 млрд параметров для управления роботами разных конструкций под лицензией Apache 2.0.

14 июл. 2026 г.·2 мин
NVIDIA Nemotron-Labs-3-Puzzle-75B: сжатие модели на 37% ускорило сервер в 2 раза
LLMMarkTechPost

NVIDIA Nemotron-Labs-3-Puzzle-75B: сжатие модели на 37% ускорило сервер в 2 раза

NVIDIA выпустила сжатую версию LLM Nemotron-3-Super — Nemotron-Labs-3-Puzzle-75B. За счёт метода Puzzle (чередование сжатия и дистилляции) модель стала на 37% меньше и ускорила пропускную способность сервера в 2 раза.

12 июл. 2026 г.·3 мин
Google Research выпустила SensorFM — модель для 35 задач прогноза здоровья
LLMMarkTechPost

Google Research выпустила SensorFM — модель для 35 задач прогноза здоровья

Google Research обучила фундаментальную модель SensorFM на 1 триллионе минут данных от 5 млн пользователей Fitbit и Pixel Watch для предсказания здоровья.

12 июл. 2026 г.·2 мин
Robbyant выпустила LingBot-World-Infinity — каузальную модель для интерактивных миров
LLMMarkTechPost

Robbyant выпустила LingBot-World-Infinity — каузальную модель для интерактивных миров

Robbyant представила LingBot-World-Infinity — 14B видеомодель, которая работает как интерактивный симулятор и генерирует 720p видео со скоростью 60 кадров в секунду.

12 июл. 2026 г.·2 мин
Нейросеть для документов: Datalab Lift против конкурентов
LLMMarkTechPost

Нейросеть для документов: Datalab Lift против конкурентов

Datalab сравнила свой 9B-инструмент Lift с NuExtract3, LlamaExtract, Marker и Docling — и разобрала, когда schema-first подход выигрывает при извлечении данных из PDF.

9 июл. 2026 г.·2 мин
Liquid AI выпустила Antidoom: метод FTPO снижает зависания в reasoning-моделях
LLMMarkTechPost

Liquid AI выпустила Antidoom: метод FTPO снижает зависания в reasoning-моделях

Liquid AI открыла исходный код Antidoom — инструмента, который находит токен-триггер бесконечного цикла и переобучает только его, снизив частоту doom-loops с 22,9% до 1%.

9 июл. 2026 г.·2 мин
Google Gemini: импорт репозиториев GitHub в режим разработки Build
LLMMarkTechPost

Google Gemini: импорт репозиториев GitHub в режим разработки Build

Google AI Studio обновил режим Build — теперь любой GitHub-репозиторий можно импортировать напрямую и сразу получить редактируемое, деплоируемое приложение.

9 июл. 2026 г.·2 мин
Audex-30B: нейросеть NVIDIA для аудио и речи
LLMMarkTechPost

Audex-30B: нейросеть NVIDIA для аудио и речи

NVIDIA объединила распознавание речи, перевод, синтез и генерацию аудио в единой MoE-модели на 30 млрд параметров, сохранив текстовые способности Nemotron-Cascade-2.

8 июл. 2026 г.·2 мин
LingBot-Vision — бесплатная Vision-нейросеть от Ant Group
LLMMarkTechPost

LingBot-Vision — бесплатная Vision-нейросеть от Ant Group

Robbyant из Ant Group опубликовала LingBot-Vision: 1B ViT-модель, обученная распознавать границы объектов без разметки и превосходящая более крупные аналоги на задачах пространственного восприятия.

8 июл. 2026 г.·2 мин
ИИ для работы с PDF-документами: гайд по инструментам в 2026
LLMMarkTechPost

ИИ для работы с PDF-документами: гайд по инструментам в 2026

Обзор open-source инструментов для конвертации корпоративных PDF и сканов в структурированный JSON — без которого LLM и AI-агенты не могут работать с реальными корпоративными данными.

7 июл. 2026 г.·2 мин
Meituan выпустила LongCat-2.0: открытая MoE-модель на 1,6 трлн параметров с контекстом в 1 млн токенов
LLMMarkTechPost

Meituan выпустила LongCat-2.0: открытая MoE-модель на 1,6 трлн параметров с контекстом в 1 млн токенов

Китайская компания Meituan открыла LongCat-2.0 — гигантскую MoE-модель с нативным окном в миллион токенов и обучением на отечественных ASIC.

6 июл. 2026 г.·2 мин
Synthetic Sciences выпустила OpenScience — открытый AI-воркбенч для ML, биологии, физики и химии
LLMMarkTechPost

Synthetic Sciences выпустила OpenScience — открытый AI-воркбенч для ML, биологии, физики и химии

OpenScience от Synthetic Sciences — open-source воркбенч под Apache 2.0 с 250+ навыками, совместимый с любой AI-моделью для задач в ML, биологии, физике и химии.

6 июл. 2026 г.·2 мин
Sakana AI запустила переводчик Sakana Translate для японского, английского и китайского
LLMMarkTechPost

Sakana AI запустила переводчик Sakana Translate для японского, английского и китайского

Sakana AI добавила в Sakana Chat переводчик Sakana Translate на базе моделей Namazu — с тремя режимами: прямой перевод, корректура и диалог с документом.

6 июл. 2026 г.·2 мин
Как натренировать Gemma-3 на математике с помощью GRPO и LoRA-адаптеров
LLMMarkTechPost

Как натренировать Gemma-3 на математике с помощью GRPO и LoRA-адаптеров

Пошаговый GRPO-воркфлоу для дообучения Gemma-3 на датасете GSM8K — от настройки среды и LoRA-адаптеров до функций вознаграждения и экспорта финальной модели.

6 июл. 2026 г.·3 мин
Page Agent от Alibaba управляет веб-интерфейсами через DOM без скриншотов и мультимодальных моделей
LLMMarkTechPost

Page Agent от Alibaba управляет веб-интерфейсами через DOM без скриншотов и мультимодальных моделей

Alibaba представила Page Agent — клиентский JavaScript-агент, который понимает текстовые команды и управляет веб-страницами через DOM без скриншотов и серверного кода.

6 июл. 2026 г.·2 мин
Anthropic запустила Claude Science Beta: многоагентная среда для геномики и протеомики
LLMMarkTechPost

Anthropic запустила Claude Science Beta: многоагентная среда для геномики и протеомики

30 июня 2026 года Anthropic открыла бета-доступ к Claude Science — многоагентной платформе для воспроизводимых пайплайнов в геномике, протеомике и хемоинформатике.

5 июл. 2026 г.·2 мин
NVIDIA представила ASPIRE — самообучающийся фреймворк роботики с 31% zero-shot на длинных задачах
LLMMarkTechPost

NVIDIA представила ASPIRE — самообучающийся фреймворк роботики с 31% zero-shot на длинных задачах

NVIDIA выпустила ASPIRE — фреймворк для роботов, который пишет и улучшает программы управления, копит проверенные решения в библиотеку навыков и переносит их на новые задачи без дообучения.

5 июл. 2026 г.·2 мин
NVIDIA HORIZON: автономный агент закрыл 100% RTL-бенчмарков в проектировании чипов
LLMMarkTechPost

NVIDIA HORIZON: автономный агент закрыл 100% RTL-бенчмарков в проектировании чипов

NVIDIA представила HORIZON — агент, который самостоятельно пишет и верифицирует RTL-код проектирования чипов, достигнув 100% выполнения по стандартным бенчмаркам.

5 июл. 2026 г.·2 мин
Бывший технический лидер Qwen: почему гибридное мышление не сработало и что дальше
LLMMarkTechPost

Бывший технический лидер Qwen: почему гибридное мышление не сработало и что дальше

Цзуньян Линь, бывший лидер разработки Qwen в Alibaba, объяснил, где динамическое мышление Qwen3 дало сбой — и почему агентный ИИ требует принципиально другого подхода к обучению.

5 июл. 2026 г.·2 мин
ИИ для поиска документов: LlamaIndex legal-kb бесплатно
LLMMarkTechPost

ИИ для поиска документов: LlamaIndex legal-kb бесплатно

LlamaIndex опубликовала справочное приложение legal-kb с файловым доступом агентов к базе знаний через retrieve, find, read и grep на движке Index v2.

5 июл. 2026 г.·2 мин
NVIDIA выпустила нейросеть Nemotron для текста с открытыми весами
LLMMarkTechPost

NVIDIA выпустила нейросеть Nemotron для текста с открытыми весами

NVIDIA открыла веса диффузионной языковой модели Nemotron-Labs-TwoTower, которая объединяет замороженный AR-бэкбон с диффузионной головой для ускорения текстовой генерации.

4 июл. 2026 г.·2 мин
Interfaze выпустила открытую диффузионную ASR-модель для распознавания шести языков
LLMMarkTechPost

Interfaze выпустила открытую диффузионную ASR-модель для распознавания шести языков

Interfaze опубликовала diffusion-gemma-asr-small — первый открытый ASR-адаптер на DiffusionGemma от Google: 42 млн параметров, шесть языков, стоимость инференса — от числа шагов шумоподавления.

3 июл. 2026 г.·2 мин
Нейросеть для браузера без облака: проект WebBrain
LLMMarkTechPost

Нейросеть для браузера без облака: проект WebBrain

WebBrain — бесплатный MIT-лицензированный агент для Chrome и Firefox, который читает страницы и автоматизирует задачи, работая локально через llama.cpp или Ollama.

3 июл. 2026 г.·2 мин
Anthropic выпустила Claude Fable 5 и Mythos 5: одна модель, два уровня доступа
LLMMarkTechPost

Anthropic выпустила Claude Fable 5 и Mythos 5: одна модель, два уровня доступа

Anthropic открыла Fable 5 для всех с классификаторами безопасности, а Mythos 5 со снятыми кибер-ограничениями распространяется только через закрытую программу Project Glasswing.

30 июн. 2026 г.·3 мин
Как ускорить обучение трансформеров с NVIDIA Apex: FusedAdam, FusedLayerNorm и torch.amp
LLMMarkTechPost

Как ускорить обучение трансформеров с NVIDIA Apex: FusedAdam, FusedLayerNorm и torch.amp

Пошаговое руководство по сборке NVIDIA Apex из исходников и применению FusedAdam, FusedLayerNorm и смешанной точности — прирост до 2.5× при обучении трансформеров.

30 июн. 2026 г.·2 мин
JetBrains выпустила Mellum2 — открытую 12B MoE-модель для быстрых задач в AI-пайплайнах
LLMMarkTechPost

JetBrains выпустила Mellum2 — открытую 12B MoE-модель для быстрых задач в AI-пайплайнах

JetBrains открыла Mellum2 под Apache 2.0 — компактную MoE-модель с 12 млрд параметров, обученную на 10,6 трлн токенов для встраивания в многомодельные AI-конвейеры.

30 июн. 2026 г.·2 мин
Alibaba запустила Qwen3.7-Plus: мультимодальный агент с анализом видео и автономным кодом
LLMMarkTechPost

Alibaba запустила Qwen3.7-Plus: мультимодальный агент с анализом видео и автономным кодом

Alibaba выпустила на платформе Bailian мультимодальный агент Qwen3.7-Plus — модель видит изображения и видео, вызывает инструменты и самостоятельно итерирует код без участия оператора.

30 июн. 2026 г.·2 мин
PyGraphistry: граф-аналитика для обнаружения угроз в корпоративных данных
LLMMarkTechPost

PyGraphistry: граф-аналитика для обнаружения угроз в корпоративных данных

Исследователи опубликовали Colab-воркфлоу PyGraphistry, который превращает корпоративные данные доступа в интерактивный граф с ML-аномалиями и тремя режимами визуализации для расследования инцидентов.

30 июн. 2026 г.·2 мин
Google DeepMind открыла DiffusionGemma — 26B MoE-модель с генерацией в 4 раза быстрее
LLMMarkTechPost

Google DeepMind открыла DiffusionGemma — 26B MoE-модель с генерацией в 4 раза быстрее

Google DeepMind выпустила экспериментальную открытую модель DiffusionGemma на 26B параметров, использующую диффузию текста вместо авторегрессии — генерация ускоряется до 4 раз на GPU.

30 июн. 2026 г.·2 мин
6 no-code инструментов для AI-разработчиков: от RAG до мультиагентов
LLMMarkTechPost

6 no-code инструментов для AI-разработчиков: от RAG до мультиагентов

Шесть no-code платформ — Flowise, Dify, Stack AI и другие — позволяют строить RAG-системы, мультиагентные воркфлоу и файнтюнить LLM без написания кода.

30 июн. 2026 г.·2 мин