MarkTechPost
Источник AI-новостей. Материалы автоматически отбираются и адаптируются редакцией Hamidun News.
Последние публикации

Microsoft SkillOpt: автоматическая оптимизация промптов вместо ручного перебора
Microsoft SkillOpt оптимизирует AI-промпты через автоматический цикл из шести шагов — рефлексия, отбор, validation gating — и показывает измеримый прирост точности уже после первых итераций.

North Mini Code от Cohere: открытая MoE-модель 30B для агентного кодирования
Cohere выпустила первую open-weight модель для разработчиков — North Mini Code на архитектуре MoE с 30B параметрами, контекстом 256K и запуском на одном GPU H100.

MiniMax выпустила MSA: разреженное внимание ускоряет обработку миллионного контекста в 28 раз
MiniMax представила MSA — двухветочный механизм разреженного внимания, обученный на 109-миллиардной MoE-модели, который в 28 раз быстрее стандартного GQA при контексте в 1 млн токенов.

Docling Parse: пайплайн разбора PDF с точностью до символа и координаты
Туториал показывает, как использовать Docling Parse для структурного анализа PDF: координаты каждого слова, визуальные оверлеи и выгрузка в JSON и CSV для RAG-систем.

TimeCopilot: как собрать пайплайн прогнозирования с фундаментальными моделями и детекцией аномалий
TimeCopilot позволяет собрать полный цикл прогнозирования — от статистических до фундаментальных моделей — с автоматической детекцией аномалий и LLM-агентом для объяснения предсказаний.

Cisco открыла FAPO: автооптимизация LLM-пайплайнов с диагностикой на каждом шаге
Cisco Foundation AI выпустила в открытый доступ FAPO — инструмент на базе Claude Code, который сам находит слабый шаг в цепочке промптов и оптимизирует пайплайн до целевой точности.

MoonMath AI выпустила open-source HIP-ядро для AMD MI300X, обогнавшее официальный AITER v3
Стартап MoonMath AI открыл исходники attention-ядра для AMD MI300X, которое превосходит официальную библиотеку AMD по всем формам тензоров и режимам округления.

xAI запустила /goal в Grok Build: автономный агент планирует и верифицирует многошаговые задачи
В Grok Build появился режим /goal: агент получает одну цель, сам строит план выполнения, движется по чеклисту и верифицирует результат на каждом этапе до полного завершения.

Как собрать AI-агента в Google Colab без фреймворков: туториал с памятью и MCP
Пошаговый туториал по созданию лёгкого AI-агента в Google Colab — с регистрацией инструментов, сессионной памятью, скиллами и MCP-сервером без внешних фреймворков.

OpenAI показала GPT-5.6 с тремя уровнями Sol, Terra и Luna и режимами рассуждений
OpenAI анонсировала семейство GPT-5.6 с тремя моделями — Sol, Terra и Luna — и новыми режимами рассуждений max и ultra. Доступ пока ограничен избранными разработчиками.

Perplexity запустила Computer for Counsel — AI-агент для юридических команд
Perplexity запустила специализированный AI-агент для юристов: маршрутизация через 20+ моделей, интеграция с Microsoft 365 и Midpage, все ответы — с проверяемыми ссылками на источники.

NVIDIA Open-SWE-Traces: сборка данных для дообучения агентов по написанию кода
Туториал показывает, как работать с датасетом NVIDIA Open-SWE-Traces — парсить траектории агентов, анализировать патчи кода и собирать SFT-выборку для обучения AI-агентов.

DeepSeek выпустила DSpark — фреймворк, ускоряющий генерацию на DeepSeek-V4 на 57–85%
DeepSeek открыла исходный код DSpark — фреймворка спекулятивного декодирования для DeepSeek-V4, который ускоряет генерацию на 57–85% без потери качества.

Meta открыла Astryx — React-дизайн-систему с поддержкой AI-агентов и MCP
Meta выпустила Astryx — open-source дизайн-систему на React и StyleX с MCP-сервером и CLI, в которой инженеры и AI-агенты работают по единому API с одними и теми же компонентами. *Meta признана экстремистской организацие

Liquid AI выпустила LFM2.5-230M: 213 токенов/с на Galaxy S25 и поддержка llama.cpp
Liquid AI выпустила LFM2.5-230M — открытую модель на 230 млн параметров, которая работает офлайн на смартфоне и Raspberry Pi, обходя конкурентов вчетверо крупнее по следованию инструкциям.

Как построить стабильный пайплайн на датасете Fable 5 Traces в Google Colab
Пошаговый туториал по работе с датасетом Fable 5 Traces: ручной парсинг JSONL, нормализация tool calls, аудит на секреты и обучение базового классификатора в Colab без тяжёлых зависимостей.

Datalab выпустила lift — 9B-модель с открытыми весами для извлечения JSON из PDF
Datalab открыла lift — 9-миллиардную визуальную модель, которая преобразует PDF и изображения в структурированный JSON по заданной схеме и достигла 90,2% точности полей на бенчмарке из 225 документов.

Z.ai выпустила GLM-5.2: реальный миллион токенов и два уровня глубокого обдумывания
Z.ai запустила GLM-5.2 с реально работающим контекстом в 1 млн токенов, режимами High и Max и поддержкой Claude Code, Cline и OpenClaw через Anthropic-совместимый API.

Датасеты для обучения нейросетей: как использовать FineWeb (15 трлн токенов)
Практическое руководство по FineWeb от Hugging Face: как работать с многотерабайтным веб-корпусом для обучения LLM через стриминг, фильтрацию, дедупликацию и токенизацию — без полной загрузки данных.

Zyphra выпустила Zamba2-VL: визуальные модели с откликом в 10 раз быстрее
Zyphra выпустила Zamba2-VL — открытые VLM на 1.2B, 2.7B и 7B параметров с гибридной архитектурой Mamba2 + Transformer, которая сокращает время до первого токена примерно в 10 раз.

Moonshot AI запустила Kimi Work — десктопный агент с роем из 300 субагентов
Kimi Work от Moonshot AI работает локально на macOS и Windows, управляет браузером через WebBridge и координирует рой до 300 параллельных субагентов.

Claude Code: ИИ-IDE для разработчика вместо ChatGPT
MarkTechPost выпустил гайд по Claude Code 2026 с разбором 25 функций — от CLAUDE.md и скиллов до MCP, хуков и Auto Mode — с примерами кода и демо.

Нейросеть для SQL: Google улучшила Gemini 3.1 Pro
Google Research представила Gemini-SQL2 на базе Gemini 3.1 Pro — модель набрала 80,04% accuracy на эталонном бенчмарке BIRD для преобразования текста в SQL-запросы.

QwenPaw: что это и как построить агентное рабочее пространство
Пошаговый туториал по развёртыванию QwenPaw — фреймворка для создания AI-агентов с поддержкой нескольких провайдеров моделей, кастомных навыков и стримингового API в Google Colab.

Нейросеть Kimi K2.7-Code для программирования: +21,8% точности
Moonshot AI открыла исходный код Kimi K2.7-Code — агентной coding-модели с 256K контекстом и на 30% меньшим расходом reasoning-токенов по сравнению с K2.6.

Сравнение TTS-моделей 2026: от коммерческих до открытых
В 2026 году выбор TTS-модели зависит от трёх факторов: качество звука, задержка обработки и стоимость. Коммерческие решения выигрывают по естественности, открытые — по контролю и стоимости.

StepFun представила Step 3.7 Flash — Vision-Language модель на 198 миллиардах параметров
StepFun выпустила Step 3.7 Flash — новую мультимодальную модель с 198 миллиардами параметров, встроенным видением, контекстом в 256K токенов и режимом Advisor для кодовых агентов.

NVIDIA X-Token: дистилляция, которая бьёт GOLD на 3.82 балла
NVIDIA выпустила X-Token — метод дистилляции знаний для малых моделей (Llama-3.2-1B), который превосходит GOLD на 3.82 балла и улучшает точность математики с 2.56 до 15.54%.

AgentTrove: как использовать датасет из 1.7М трас агентов в Python
AgentTrove — самый крупный открытый набор трас взаимодействия агентов: 1.7 млн примеров в формате ShareGPT. Python-туториал показывает, как стримить данные, нормализовать действия агентов и готовить датасет для файнтюнин

Nous Research выпустила Tool Search для Hermes Agent: точность выросла на 49–74% на Opus 4
Nous Research решила проблему раздувания контекста в MCP, добавив умный поиск инструментов. Система выбирает только релевантные схемы и повышает точность на десятки процентов при работе с Opus 4.