MarkTechPost
Источник AI-новостей. Материалы автоматически отбираются и адаптируются редакцией Hamidun News.
Последние публикации

Meta открыла Astryx — React-дизайн-систему с поддержкой AI-агентов и MCP
Meta выпустила Astryx — open-source дизайн-систему на React и StyleX с MCP-сервером и CLI, в которой инженеры и AI-агенты работают по единому API с одними и теми же компонентами. *Meta признана экстремистской организацие

Liquid AI выпустила LFM2.5-230M: 213 токенов/с на Galaxy S25 и поддержка llama.cpp
Liquid AI выпустила LFM2.5-230M — открытую модель на 230 млн параметров, которая работает офлайн на смартфоне и Raspberry Pi, обходя конкурентов вчетверо крупнее по следованию инструкциям.

Datalab выпустила lift — 9B-модель с открытыми весами для извлечения JSON из PDF
Datalab открыла lift — 9-миллиардную визуальную модель, которая преобразует PDF и изображения в структурированный JSON по заданной схеме и достигла 90,2% точности полей на бенчмарке из 225 документов.

Z.ai выпустила GLM-5.2: реальный миллион токенов и два уровня глубокого обдумывания
Z.ai запустила GLM-5.2 с реально работающим контекстом в 1 млн токенов, режимами High и Max и поддержкой Claude Code, Cline и OpenClaw через Anthropic-совместимый API.

Датасеты для обучения нейросетей: как использовать FineWeb (15 трлн токенов)
Практическое руководство по FineWeb от Hugging Face: как работать с многотерабайтным веб-корпусом для обучения LLM через стриминг, фильтрацию, дедупликацию и токенизацию — без полной загрузки данных.

Zyphra выпустила Zamba2-VL: визуальные модели с откликом в 10 раз быстрее
Zyphra выпустила Zamba2-VL — открытые VLM на 1.2B, 2.7B и 7B параметров с гибридной архитектурой Mamba2 + Transformer, которая сокращает время до первого токена примерно в 10 раз.

Moonshot AI запустила Kimi Work — десктопный агент с роем из 300 субагентов
Kimi Work от Moonshot AI работает локально на macOS и Windows, управляет браузером через WebBridge и координирует рой до 300 параллельных субагентов.

Claude Code: ИИ-IDE для разработчика вместо ChatGPT
MarkTechPost выпустил гайд по Claude Code 2026 с разбором 25 функций — от CLAUDE.md и скиллов до MCP, хуков и Auto Mode — с примерами кода и демо.

Нейросеть для SQL: Google улучшила Gemini 3.1 Pro
Google Research представила Gemini-SQL2 на базе Gemini 3.1 Pro — модель набрала 80,04% accuracy на эталонном бенчмарке BIRD для преобразования текста в SQL-запросы.

QwenPaw: что это и как построить агентное рабочее пространство
Пошаговый туториал по развёртыванию QwenPaw — фреймворка для создания AI-агентов с поддержкой нескольких провайдеров моделей, кастомных навыков и стримингового API в Google Colab.

Нейросеть Kimi K2.7-Code для программирования: +21,8% точности
Moonshot AI открыла исходный код Kimi K2.7-Code — агентной coding-модели с 256K контекстом и на 30% меньшим расходом reasoning-токенов по сравнению с K2.6.

Сравнение TTS-моделей 2026: от коммерческих до открытых
В 2026 году выбор TTS-модели зависит от трёх факторов: качество звука, задержка обработки и стоимость. Коммерческие решения выигрывают по естественности, открытые — по контролю и стоимости.

StepFun представила Step 3.7 Flash — Vision-Language модель на 198 миллиардах параметров
StepFun выпустила Step 3.7 Flash — новую мультимодальную модель с 198 миллиардами параметров, встроенным видением, контекстом в 256K токенов и режимом Advisor для кодовых агентов.

NVIDIA X-Token: дистилляция, которая бьёт GOLD на 3.82 балла
NVIDIA выпустила X-Token — метод дистилляции знаний для малых моделей (Llama-3.2-1B), который превосходит GOLD на 3.82 балла и улучшает точность математики с 2.56 до 15.54%.

AgentTrove: как использовать датасет из 1.7М трас агентов в Python
AgentTrove — самый крупный открытый набор трас взаимодействия агентов: 1.7 млн примеров в формате ShareGPT. Python-туториал показывает, как стримить данные, нормализовать действия агентов и готовить датасет для файнтюнин

Nous Research выпустила Tool Search для Hermes Agent: точность выросла на 49–74% на Opus 4
Nous Research решила проблему раздувания контекста в MCP, добавив умный поиск инструментов. Система выбирает только релевантные схемы и повышает точность на десятки процентов при работе с Opus 4.

Genesis AI выпустила Genesis World 1.0 — платформу для оценки роботов в 400 раз быстрее
Genesis AI выпустила платформу Genesis World 1.0 для симуляции роботов, которая сокращает время оценки с 200 часов до 30 минут и совпадает с реальным поведением на 90%.

NVIDIA выпустила Polar — фреймворк для обучения кодовых агентов
NVIDIA создала Polar — фреймворк для обучения языковых агентов через reinforcement learning, улучшивший производительность на SWE-Bench на 22.6 балла в Codex-окружении.

UC Berkeley создала mKernel: единая библиотека для синхронизации GPU в кластерах
UC Berkeley выпустила mKernel — новую CUDA-библиотеку для синхронизации тысяч GPU в дата-центрах, объединив локальную и дистанционную коммуникацию в один persistent kernel.

Stability AI выпустила Stable Audio 3 для быстрой генерации музыки
Stability AI представила Stable Audio 3 — модели для генерации музыки и звуковых эффектов, которые работают на MacBook и потребительских GPU с 8GB VRAM.

ZeroEntropy представила Zerank-2 — лёгкий переранжировщик для точного поиска
ZeroEntropy выпустила Zerank-2, компактный кроссэнкодер на базе Qwen3, который значительно улучшает качество поиска в двухэтапных RAG-системах.

Sakana AI представила DiffusionBlocks: метод обучения нейросетей блоками
Компания Sakana AI представила DiffusionBlocks — новый метод, который позволяет обучать слои остаточных нейросетей независимо друг от друга, интерпретируя обновления как обратную диффузию.

Векторный поиск в PostgreSQL: полный гайд pgvector для AI-приложений
Узнайте, как превратить PostgreSQL в векторную БД с помощью pgvector и использовать её для семантического и гибридного поиска в AI-приложениях — полный гайд с примерами кода.

Perplexity опубликовала токенайзер для нейросетей: в 5 раз быстрее
Perplexity AI опубликовала переписанный токенайзер Unigram, который ускоряет обработку текста в 5 раз и сокращает нагрузку на процессор в 5-6 раз в production-среде.

Ученые создали MEMO — фреймворк для расширения памяти LLM без переобучения
Ученые предложили MEMO — фреймворк, который позволяет LLM учиться на новых данных без переобучения основной модели, используя отдельный модуль памяти.

EAGLE 3.1: как исправить нестабильность спекулятивного декодирования в LLM
Совместный релиз EAGLE team, vLLM и TorchSpec исправляет критическую проблему спекулятивного декодирования — дрейф внимания, который замедлял инференс больших языковых моделей в production.

Anthropic выпустила Claude Opus 4.8 с динамическими workflow'ами и дешёвым fast mode
Anthropic представила Claude Opus 4.8 с динамическими рабочими процессами и более дешёвым быстрым режимом. Обновление доступно в исследовательском превью Claude Code.

Как использовать нейросеть LFM2.5 локально на своем ПК
Liquid AI представила новую модель LFM2.5-8B-A1B — экономную MoE-модель, которая активирует только 1.5B параметров из 8.3B. Работает на потребительском ПК с контекстом 128K.

Нейросеть SIA для самообновляющихся ИИ-агентов (open source)
Hexo Labs выпустила открытый код SIA — системы, которая улучшает сама себя, обновляя как инструкции агента, так и веса его нейронной сети.

Microsoft Research выпустила Webwright — агента для браузера, который решает web-задачи на 60%
Microsoft Research представила Webwright — браузер-агента, который выполняет сложные web-задачи лучше, чем большие языковые модели: 60% успеха на Odysseys вместо 33.5% у базового GPT-5.4.