MarkTechPost
Источник AI-новостей. Материалы автоматически отбираются и адаптируются редакцией Hamidun News.
Последние публикации

Нейросети для поиска 2026: как выбрать — девять систем
Девять ведущих векторных БД теперь ключевая инфраструктура для RAG и agential AI. Обзор по архитектуре, цене и масштабируемости помогает выбрать под задачу.

ИИ для кодирования: язык Zero от Vercel
Vercel выпустила Zero — язык программирования, где компилятор выдаёт JSON вместо текста, чтобы AI-агенты могли самостоятельно писать, исправлять и развёртывать нативные программы

Как Memori создаёт постоянную память для агентов и мультисессионных LLM
Memori — инфраструктура памяти для LLM-приложений, которая позволяет агентам сохранять контекст между сессиями и работать с несколькими пользователями одновременно.

SHAP для машинного обучения: сравнение explainers и практический гайд
Новый гайд показывает, как выбрать между четырьмя методами SHAP для интерпретации моделей — от быстрого Tree до универсального Kernel.

DeepMind создала AI-мышь на Gemini, чтобы пользователи не переключались на чаты
Google DeepMind представила AI-мышь на основе Gemini, которая анализирует контекст вокруг курсора и позволяет дать команды голосом, не открывая отдельное окно.

Мира Мурати показала первую систему для естественного диалога с ИИ в реальном времени
Thinking Machines Lab представила модель TML-Interaction-Small, которая слушает и отвечает одновременно, обрабатывая речь, видео и текст без задержек — впервые ИИ может разговаривать как человек.

Nous Research представила Lighthouse Attention для ускорения обучения LLM
Nous Research опубликовала новый механизм внимания Lighthouse Attention, который ускоряет обучение больших языковых моделей в 1.4–1.7 раза при работе с длинными контекстами.

GLiGuard от Fastino Labs: модель безопасности, которая на 16x быстрее больших конкурентов
Fastino Labs открыла GLiGuard — 300-миллионную модель модерации, которая за один проход проверяет промпт по четырём параметрам и работает в 16 раз быстрее аналогов.

Теневой AI в 63% компаний: как инструменты обогнали корпоративные политики
Большинство компаний всё ещё не имеют формальных политик управления AI, при этом сотрудники уже активно внедряют инструменты самостоятельно — это создаёт серьёзные риски для безопасности.

Nous Research ускорила предобучение LLM в 2.5 раза без смены архитектуры
Nous Research разработала Token Superposition Training — метод, который сокращает время предобучения языковых моделей в 2.5 раза, не меняя архитектуру и поведение при инференсе.

Zyphra выпустила первую MoE-модель диффузии с ускорением в 7.7x
Zyphra представила ZAYA1-8B-Diffusion-Preview — первую MoE-модель диффузии, конвертированную из языковой модели LLM. Инференс ускорился в 7.7 раз за счёт перераспределения вычислений с памяти на процессор GPU.

Как собрать MCP-стиль систему для интеллектуальных AI-агентов
Полная инструкция по построению системы AI-агентов, которая сама открывает нужные инструменты, маршрутизирует задачи и выполняет их пошагово.

BerriAI выпустила LiteLLM Agent Platform для агентов в production
BerriAI открыла исходный код LiteLLM Agent Platform — инфраструктуры на Kubernetes для запуска AI-агентов в продакшене с изолированными окружениями и сохранением сессий между перезагрузками.

Repowise для анализа репозиториев: граф-анализ и мёртвый код
Repowise помогает разработчикам анализировать кодовые репозитории на уровне всего проекта: построение графов зависимостей, поиск мёртвого кода и контекст для AI.

NVIDIA представила SANA-WM: модель для 60-секундных видео в 720p на одном GPU
NVIDIA показала SANA-WM — открытый world model, генерирующий 60-секундные видео в 720p с точным управлением камерой на одном графическом процессоре.

Как построить стриминговый агент принятия решений с онлайн-перепланированием в динамической среде
Подробный туториал по созданию стримингового агента принятия решений, который адаптируется к движущимся препятствиям и меняющимся целям в реальном времени.

Структурированный вывод ИИ: как использовать Outlines и Pydantic
Новый гайд по Outlines и Pydantic показывает, как собирать LLM-пайплайны с жёсткой схемой, типами данных, восстановлением JSON и валидированными вызовами функций.

Volcengine выпустила OpenViking — файловую базу контекста для ИИ-агентов вроде OpenClaw
OpenViking от Volcengine предлагает хранить память, ресурсы и навыки ИИ-агента как файловую систему, чтобы упростить поиск контекста, снизить расход токенов и сделать RAG-навигацию наблюдаемой.

Нейросеть для физических симуляций: гайд JAX и neural ODE
Новый разбор Diffrax и JAX показывает полный путь от настройки вычислительной среды и адаптивных ODE-солверов до стохастических симуляций, vmap-батчинга и обучения neural ODE.

Нейросеть для поиска: как RAG отличается от обычного поиска
Разбор показывает, как BM25 ранжирует документы по частоте и редкости слов, а RAG с эмбеддингами ищет по смыслу, поэтому в продакшене всё чаще совмещают оба подхода.

Tribe v2 — нейросеть Meta для анализа видео, звука и текста
Meta открыла Tribe v2 — модель, которая по видео, аудио и тексту прогнозирует fMRI-ответ мозга и даёт нейробиологам инструмент для виртуальных экспериментов без новых сканов. *Meta признана экстремистской организацией и

На Google ADK показали multi-agent пайплайн анализа данных, графиков и отчётов в Python
Новый гайд показывает, как на Google ADK собрать multi-agent систему для загрузки таблиц, статистических тестов, визуализации и автогенерации отчётов в Python.

Google научила Gemini API совмещать Search, Maps и свои функции в одном запросе
Google обновила Gemini API: теперь в одном вызове можно объединять Google Search, Google Maps и пользовательские функции, собирая многошаговые агентные сценарии без ручной склейки.

OpenClaw: как собрать локальный и защищённый runtime для AI-агентов без облака
Новый гайд по OpenClaw показывает, как поднять local-first runtime для AI-агента: gateway на loopback, доступ к модели через переменные среды, контролируемый exec и детерминированные skills.

Microsoft показала, как запустить VibeVoice для ASR, realtime TTS и speech-to-speech
Microsoft выпустила практический Colab-гайд по VibeVoice: в нём шаг за шагом разбирают speaker-aware ASR, realtime TTS, batch-обработку аудио и сборку speech-to-speech цепочки.

Hugging Face и Lambda: как разбирать и дообучать reasoning traces агентов
На MarkTechPost вышел практический гайд по датасету lambda/hermes-agent-reasoning-traces: как распарсить мысли агента, вызовы инструментов, построить графики и подготовить данные к дообучению.

Alibaba открыла Qwen3.6-35B-A3B — мультимодальную MoE-модель с упором на агентное кодирование
Qwen открыла веса Qwen3.6-35B-A3B: при 35 млрд параметров и 3 млрд активных модель работает с кодом, изображениями и видео, делая ставку на tool use, длинный контекст и агентные сценарии.

Microsoft, NVIDIA и IBM вошли в список 19 главных AI red teaming инструментов 2026 года
Новый обзор по AI red teaming собрал 19 инструментов — от Microsoft PyRIT и NVIDIA Garak до IBM AIF360 — чтобы находить утечки данных, jailbreak-атаки и предвзятость модели до выхода в прод.

Meta представила Autodata — агентную систему для создания качественных обучающих данных
Meta представила Autodata — фреймворк, в котором LLM-агенты сами собирают, проверяют и улучшают обучающие данные, чтобы сильные модели учились на более сложных и точных примерах. *Meta признана экстремистской организаци

NeuralSet и deep learning: декодирование языковых признаков из MEG-сигналов мозга
В новом разборе с NeuralSet показано, как превратить сырые MEG-сигналы в модель, которая предсказывает языковые признаки, включая длину слова, напрямую по активности мозга.