MarkTechPost
Источник AI-новостей. Материалы автоматически отбираются и адаптируются редакцией Hamidun News.
Последние публикации

Meta AI представила Brain2Qwerty v2 — неинвазивный MEG-декодер текста с точностью 61%
Meta AI выпустила Brain2Qwerty v2 — неинвазивный пайплайн на основе MEG, который декодирует напечатанные предложения по сигналам мозга с точностью 61% слов, и открыла код обучения.

Sakana AI выпустила Sakana Marlin — агента для отчётов на 100 страниц со слайдами
Sakana AI представила первый коммерческий продукт — корпоративного агента Marlin, который автономно работает до восьми часов и готовит отчёты объёмом до 100 страниц со слайдами.

Baidu развивает CUP — набор Python-инструментов для надёжных бэкенд-пайплайнов
Портал MarkTechPost разобрал CUP — набор Python-утилит Baidu для логирования, кэша, пулов потоков и мониторинга ресурсов Linux в одном пакете.

Google Research выпустила TabFM — foundation-модель для табличных данных с zero-shot
Google Research представила TabFM — foundation-модель для таблиц, которая делает zero-shot классификацию и регрессию без обучения под каждый датасет.

Linq выпустила iMessage Apps — платежи, билеты и игры для ИИ-агентов прямо в переписке
Компания Linq представила iMessage Apps — интерактивные карточки imessage_app для оплаты, покупки билетов, бронирования рейсов и игр внутри переписки.

Claude Sonnet 5 против Opus 4.8: сравнение агентного кодирования и цен API от Anthropic
MarkTechPost сравнил Claude Sonnet 5, Sonnet 4.6 и Opus 4.8 от Anthropic: новая модель приближается к флагману в агентном кодировании при более низкой цене токенов Sonnet.

Anthropic возобновила работу Claude Fable 5 после снятия экспортных ограничений США
Anthropic 1 июля 2026 года вернула доступ к Claude Fable 5 и представила классификатор, блокирующий джейлбрейк-технику из отчёта Amazon в 99% случаев.

OpenAI выпустила GPT-Realtime-2.1 и mini-версию для голосовых агентов в API
OpenAI добавила в API две модели для голосовых агентов — GPT-Realtime-2.1 и GPT-Realtime-2.1-mini, снизив задержку p95 минимум на 25% за счёт кеширования.

Tencent выпустила Hy3 — открытую MoE-модель на 295 млрд параметров с контекстом 256K
Tencent представила Hy3 — модель на 295 млрд параметров с активными 21 млрд на токен, лицензией Apache 2.0 и результатом 78.0 на SWE-Bench Verified.

MarkTechPost показал, как собрать ИИ-соучёного QSAR для поиска ингибиторов EGFR
Тьюториал MarkTechPost учит строить автономного ИИ-соучёного на Random Forest QSAR — от данных ChEMBL и RDKit до готовых молекул-кандидатов против EGFR C797S.

Liquid AI выпустила LFM2.5-350M: эффективная модель на 350M параметров с масштабным RL
Компания Liquid AI доказала, что плотность ИИ важнее количества параметров: небольшую модель можно обучить лучше через усиленное обучение.

Parallax: улучшенная локальная линейная внимание с коррекцией ковариации
Исследователи MarkTechPost представили Parallax — новую вариацию механизма внимания для малых LLM с улучшенным качеством и скоростью.

MiniMax M3: новая модель с 1M токенов, мультимодальностью и computer use
Компания представила архитектуру MiniMax Sparse Attention, поддерживающую миллион токенов в контексте и работу с видео, изображениями и управлением компьютером.

Автономные AI-агенты работают в 50 раз дольше, чем поиск: исследование Harvard и Perplexity
Новое исследование Harvard и Perplexity показало, что AI-агенты выполняют 26 минут самостоятельной работы за сессию, против 33 секунд для поисковых ассистентов.

Memory OS: открытый 6-слойный стек памяти для Hermes Agent
Новый проект Memory OS добавляет локальную постоянную память к Hermes Agent через шесть слоёв архитектуры, управляемый поиск и встроенную вики.

Google запустила Gemini 3.5 Live Translate: модель речь-в-речь для 70+ языков
Gemini 3.5 Live Translate переводит речь в реальном времени, синтезируя аудио с задержкой в несколько секунд. Модель доступна в Gemini Live API, Google Meet и приложении Google Translate.

Nous Research представила конструктор профилей Hermes Agent
Новый интерфейс Hermes Agent заменяет многоэтапную настройку через CLI — теперь пользователи собирают профиль агента в едином потоке на дашборде.

SpaceXAI выпустила Grok 4.5 — кодовая модель класса Opus
SpaceXAI представила Grok 4.5, модель класса Opus, натренированную Cursor для кодирования и агентных задач, по цене $2/$6 за миллион токенов.

Ant Group представила LingBot-VLA 2.0 — открытую модель для управления роботами любой конструкции
Robbyant (Ant Group) 8 июля 2026 года выпустила LingBot-VLA 2.0 — открытую модель на 6 млрд параметров для управления роботами разных конструкций под лицензией Apache 2.0.

NVIDIA Nemotron-Labs-3-Puzzle-75B: сжатие модели на 37% ускорило сервер в 2 раза
NVIDIA выпустила сжатую версию LLM Nemotron-3-Super — Nemotron-Labs-3-Puzzle-75B. За счёт метода Puzzle (чередование сжатия и дистилляции) модель стала на 37% меньше и ускорила пропускную способность сервера в 2 раза.

Google Research выпустила SensorFM — модель для 35 задач прогноза здоровья
Google Research обучила фундаментальную модель SensorFM на 1 триллионе минут данных от 5 млн пользователей Fitbit и Pixel Watch для предсказания здоровья.

Robbyant выпустила LingBot-World-Infinity — каузальную модель для интерактивных миров
Robbyant представила LingBot-World-Infinity — 14B видеомодель, которая работает как интерактивный симулятор и генерирует 720p видео со скоростью 60 кадров в секунду.

Нейросеть для документов: Datalab Lift против конкурентов
Datalab сравнила свой 9B-инструмент Lift с NuExtract3, LlamaExtract, Marker и Docling — и разобрала, когда schema-first подход выигрывает при извлечении данных из PDF.

Liquid AI выпустила Antidoom: метод FTPO снижает зависания в reasoning-моделях
Liquid AI открыла исходный код Antidoom — инструмента, который находит токен-триггер бесконечного цикла и переобучает только его, снизив частоту doom-loops с 22,9% до 1%.

Google Gemini: импорт репозиториев GitHub в режим разработки Build
Google AI Studio обновил режим Build — теперь любой GitHub-репозиторий можно импортировать напрямую и сразу получить редактируемое, деплоируемое приложение.

Audex-30B: нейросеть NVIDIA для аудио и речи
NVIDIA объединила распознавание речи, перевод, синтез и генерацию аудио в единой MoE-модели на 30 млрд параметров, сохранив текстовые способности Nemotron-Cascade-2.

LingBot-Vision — бесплатная Vision-нейросеть от Ant Group
Robbyant из Ant Group опубликовала LingBot-Vision: 1B ViT-модель, обученная распознавать границы объектов без разметки и превосходящая более крупные аналоги на задачах пространственного восприятия.

ИИ для работы с PDF-документами: гайд по инструментам в 2026
Обзор open-source инструментов для конвертации корпоративных PDF и сканов в структурированный JSON — без которого LLM и AI-агенты не могут работать с реальными корпоративными данными.

Meituan выпустила LongCat-2.0: открытая MoE-модель на 1,6 трлн параметров с контекстом в 1 млн токенов
Китайская компания Meituan открыла LongCat-2.0 — гигантскую MoE-модель с нативным окном в миллион токенов и обучением на отечественных ASIC.

Synthetic Sciences выпустила OpenScience — открытый AI-воркбенч для ML, биологии, физики и химии
OpenScience от Synthetic Sciences — open-source воркбенч под Apache 2.0 с 250+ навыками, совместимый с любой AI-моделью для задач в ML, биологии, физике и химии.