MarkTechPost
Источник AI-новостей. Материалы автоматически отбираются и адаптируются редакцией Hamidun News.
Последние публикации

Sakana AI запустила переводчик Sakana Translate для японского, английского и китайского
Sakana AI добавила в Sakana Chat переводчик Sakana Translate на базе моделей Namazu — с тремя режимами: прямой перевод, корректура и диалог с документом.

Как натренировать Gemma-3 на математике с помощью GRPO и LoRA-адаптеров
Пошаговый GRPO-воркфлоу для дообучения Gemma-3 на датасете GSM8K — от настройки среды и LoRA-адаптеров до функций вознаграждения и экспорта финальной модели.

Page Agent от Alibaba управляет веб-интерфейсами через DOM без скриншотов и мультимодальных моделей
Alibaba представила Page Agent — клиентский JavaScript-агент, который понимает текстовые команды и управляет веб-страницами через DOM без скриншотов и серверного кода.

Anthropic запустила Claude Science Beta: многоагентная среда для геномики и протеомики
30 июня 2026 года Anthropic открыла бета-доступ к Claude Science — многоагентной платформе для воспроизводимых пайплайнов в геномике, протеомике и хемоинформатике.

NVIDIA представила ASPIRE — самообучающийся фреймворк роботики с 31% zero-shot на длинных задачах
NVIDIA выпустила ASPIRE — фреймворк для роботов, который пишет и улучшает программы управления, копит проверенные решения в библиотеку навыков и переносит их на новые задачи без дообучения.

NVIDIA HORIZON: автономный агент закрыл 100% RTL-бенчмарков в проектировании чипов
NVIDIA представила HORIZON — агент, который самостоятельно пишет и верифицирует RTL-код проектирования чипов, достигнув 100% выполнения по стандартным бенчмаркам.

Бывший технический лидер Qwen: почему гибридное мышление не сработало и что дальше
Цзуньян Линь, бывший лидер разработки Qwen в Alibaba, объяснил, где динамическое мышление Qwen3 дало сбой — и почему агентный ИИ требует принципиально другого подхода к обучению.

ИИ для поиска документов: LlamaIndex legal-kb бесплатно
LlamaIndex опубликовала справочное приложение legal-kb с файловым доступом агентов к базе знаний через retrieve, find, read и grep на движке Index v2.

NVIDIA выпустила нейросеть Nemotron для текста с открытыми весами
NVIDIA открыла веса диффузионной языковой модели Nemotron-Labs-TwoTower, которая объединяет замороженный AR-бэкбон с диффузионной головой для ускорения текстовой генерации.

Interfaze выпустила открытую диффузионную ASR-модель для распознавания шести языков
Interfaze опубликовала diffusion-gemma-asr-small — первый открытый ASR-адаптер на DiffusionGemma от Google: 42 млн параметров, шесть языков, стоимость инференса — от числа шагов шумоподавления.

Нейросеть для браузера без облака: проект WebBrain
WebBrain — бесплатный MIT-лицензированный агент для Chrome и Firefox, который читает страницы и автоматизирует задачи, работая локально через llama.cpp или Ollama.

Anthropic выпустила Claude Fable 5 и Mythos 5: одна модель, два уровня доступа
Anthropic открыла Fable 5 для всех с классификаторами безопасности, а Mythos 5 со снятыми кибер-ограничениями распространяется только через закрытую программу Project Glasswing.

Как ускорить обучение трансформеров с NVIDIA Apex: FusedAdam, FusedLayerNorm и torch.amp
Пошаговое руководство по сборке NVIDIA Apex из исходников и применению FusedAdam, FusedLayerNorm и смешанной точности — прирост до 2.5× при обучении трансформеров.

JetBrains выпустила Mellum2 — открытую 12B MoE-модель для быстрых задач в AI-пайплайнах
JetBrains открыла Mellum2 под Apache 2.0 — компактную MoE-модель с 12 млрд параметров, обученную на 10,6 трлн токенов для встраивания в многомодельные AI-конвейеры.

Alibaba запустила Qwen3.7-Plus: мультимодальный агент с анализом видео и автономным кодом
Alibaba выпустила на платформе Bailian мультимодальный агент Qwen3.7-Plus — модель видит изображения и видео, вызывает инструменты и самостоятельно итерирует код без участия оператора.

PyGraphistry: граф-аналитика для обнаружения угроз в корпоративных данных
Исследователи опубликовали Colab-воркфлоу PyGraphistry, который превращает корпоративные данные доступа в интерактивный граф с ML-аномалиями и тремя режимами визуализации для расследования инцидентов.

Google DeepMind открыла DiffusionGemma — 26B MoE-модель с генерацией в 4 раза быстрее
Google DeepMind выпустила экспериментальную открытую модель DiffusionGemma на 26B параметров, использующую диффузию текста вместо авторегрессии — генерация ускоряется до 4 раз на GPU.

Microsoft SkillOpt: автоматическая оптимизация промптов вместо ручного перебора
Microsoft SkillOpt оптимизирует AI-промпты через автоматический цикл из шести шагов — рефлексия, отбор, validation gating — и показывает измеримый прирост точности уже после первых итераций.

North Mini Code от Cohere: открытая MoE-модель 30B для агентного кодирования
Cohere выпустила первую open-weight модель для разработчиков — North Mini Code на архитектуре MoE с 30B параметрами, контекстом 256K и запуском на одном GPU H100.

MiniMax выпустила MSA: разреженное внимание ускоряет обработку миллионного контекста в 28 раз
MiniMax представила MSA — двухветочный механизм разреженного внимания, обученный на 109-миллиардной MoE-модели, который в 28 раз быстрее стандартного GQA при контексте в 1 млн токенов.

Docling Parse: пайплайн разбора PDF с точностью до символа и координаты
Туториал показывает, как использовать Docling Parse для структурного анализа PDF: координаты каждого слова, визуальные оверлеи и выгрузка в JSON и CSV для RAG-систем.

TimeCopilot: как собрать пайплайн прогнозирования с фундаментальными моделями и детекцией аномалий
TimeCopilot позволяет собрать полный цикл прогнозирования — от статистических до фундаментальных моделей — с автоматической детекцией аномалий и LLM-агентом для объяснения предсказаний.

Cisco открыла FAPO: автооптимизация LLM-пайплайнов с диагностикой на каждом шаге
Cisco Foundation AI выпустила в открытый доступ FAPO — инструмент на базе Claude Code, который сам находит слабый шаг в цепочке промптов и оптимизирует пайплайн до целевой точности.

MoonMath AI выпустила open-source HIP-ядро для AMD MI300X, обогнавшее официальный AITER v3
Стартап MoonMath AI открыл исходники attention-ядра для AMD MI300X, которое превосходит официальную библиотеку AMD по всем формам тензоров и режимам округления.

xAI запустила /goal в Grok Build: автономный агент планирует и верифицирует многошаговые задачи
В Grok Build появился режим /goal: агент получает одну цель, сам строит план выполнения, движется по чеклисту и верифицирует результат на каждом этапе до полного завершения.

Как собрать AI-агента в Google Colab без фреймворков: туториал с памятью и MCP
Пошаговый туториал по созданию лёгкого AI-агента в Google Colab — с регистрацией инструментов, сессионной памятью, скиллами и MCP-сервером без внешних фреймворков.

OpenAI показала GPT-5.6 с тремя уровнями Sol, Terra и Luna и режимами рассуждений
OpenAI анонсировала семейство GPT-5.6 с тремя моделями — Sol, Terra и Luna — и новыми режимами рассуждений max и ultra. Доступ пока ограничен избранными разработчиками.

Perplexity запустила Computer for Counsel — AI-агент для юридических команд
Perplexity запустила специализированный AI-агент для юристов: маршрутизация через 20+ моделей, интеграция с Microsoft 365 и Midpage, все ответы — с проверяемыми ссылками на источники.

NVIDIA Open-SWE-Traces: сборка данных для дообучения агентов по написанию кода
Туториал показывает, как работать с датасетом NVIDIA Open-SWE-Traces — парсить траектории агентов, анализировать патчи кода и собирать SFT-выборку для обучения AI-агентов.

DeepSeek выпустила DSpark — фреймворк, ускоряющий генерацию на DeepSeek-V4 на 57–85%
DeepSeek открыла исходный код DSpark — фреймворка спекулятивного декодирования для DeepSeek-V4, который ускоряет генерацию на 57–85% без потери качества.