MarkTechPost
Источник AI-новостей. Материалы автоматически отбираются и адаптируются редакцией Hamidun News.
Последние публикации

GitNexus: Как новый инструмент научил ИИ-агентов структурному пониманию кода
ИИ-помощники отлично пишут локальный код, но часто не понимают глобальную архитектуру проектов. Open-source проект GitNexus решает эту проблему с помощью графов знаний и протокола MCP.

DeepSeek-V4: Как новые алгоритмы сжатия сделали контекст в миллион токенов реальностью
DeepSeek представила четвертое поколение своих моделей. Благодаря радикальному сжатию внимания обработка гигантских объемов данных становится доступной не только техногигантам.

Архитектура Decoupled DiLoCo от DeepMind решает проблему масштабирования ИИ
Обучение передовых ИИ-моделей всегда было заложником аппаратных сбоев: поломка одного чипа останавливала весь кластер. Новая архитектура от Google DeepMind меняет правила игры.

OpenMythos: open-source реконструкция архитектуры Claude Mythos на PyTorch с 770M параметров
Разработчик Kye Gomez воссоздал предполагаемую архитектуру Claude Mythos от Anthropic с нуля — без утечек, только на основе публичных исследований.

OpenAI масштабирует GPT-5.4-Cyber для верифицированных специалистов по кибербезопасности
OpenAI открывает массовый доступ к GPT-5.4-Cyber — донастроенной версии GPT-5.4 без стандартных ограничений для тысяч верифицированных защитников.

Moonshot AI выпустила Kimi K2.6: агентная модель с роем из 300 субагентов
Китайская лаборатория Moonshot AI открыла исходники Kimi K2.6 — мультимодальной агентной модели, координирующей до 300 субагентов и 4000 шагов автономно.

Phi-4-Mini от Microsoft: реализация квантизации, RAG и LoRA в одном Jupyter-ноутбуке
Туториал показывает полный пайплайн на Phi-4-mini-instruct: 4-битная квантизация, потоковая генерация, рассуждение, вызов инструментов, RAG и LoRA fine-tuning в одном ноутбуке.

Qwen 3.6-35B-A3B на практике: мультимодальность, MoE и RAG в одном пайплайне
MarkTechPost выпустил 21 апреля 2026 года туториал по мультимодальной MoE-модели Qwen 3.6-35B-A3B — от загрузки под GPU до MoE-роутинга, RAG и сохранения сессии.

NVIDIA представила Nemotron 3 Super — открытую модель со 120 млрд параметров
Новая гибридная модель сочетает архитектуры Mamba и Attention с подходом Mixture-of-Experts, обеспечивая пятикратный прирост производительности для мультиагентных систем. Разрыв между проприетарными и открытыми моделями

Google представила TensorFlow 2.21 и LiteRT для мобильного ИИ
Google представила TensorFlow 2.21 и LiteRT — новый стандарт для запуска нейросетей на смартфонах с поддержкой NPU и ускорением GPU для мобильных платформ.

Google запустила Android Bench для оценки ИИ в мобильной разработке
Google открыла доступ к Android Bench — первому специализированному инструменту для проверки навыков больших языковых моделей в разработке приложений под Android.

OpenAI представила Codex Security для автоматического поиска и исправления уязвимостей в коде
OpenAI запускает Codex Security — интеллектуального агента для анализа безопасности кода, который не только находит ошибки, но и предлагает готовые патчи для их устранения.

Liquid AI выпустила систему для запуска ИИ-агентов полностью на устройстве
Компания Liquid AI представила модель LFM2-24B-A2B и приложение LocalCowork — связку для выполнения сложных рабочих процессов с ИИ-агентами без единого обращения к облаку. Ставка на приватность становится архитектурным п

Yuan 3.0 Ultra: триллион параметров при рекордной эффективности
Китайская YuanLab AI представила открытую мультимодальную модель с триллионом параметров, которая активирует лишь 68,8 млрд из них. Сокращение параметров на треть при росте эффективности обучения на 49% — как это работае

Alibaba выпустила OpenSandbox — единую среду для безопасной работы AI-агентов
Alibaba открыла исходный код OpenSandbox — инструмента, который даёт AI-агентам изолированные песочницы для выполнения кода, веб-сёрфинга и обучения моделей. Это заявка на стандарт всей инфраструктуры агентного AI.

Alibaba выпустила Qwen 3.5 Small — компактные модели для работы прямо на устройствах
Новая серия моделей Alibaba от 0.8 до 9 миллиардов параметров бросает вызов гонке за размером. Философия «больше интеллекта, меньше вычислений» может изменить правила игры для мобильного AI.

SHAP-IQ: новый стандарт объяснимого ИИ выходит на практический уровень
Библиотека SHAP-IQ позволяет не просто оценить важность признаков модели, но и понять, как они взаимодействуют друг с другом. Разбираемся, почему это меняет подход к интерпретации машинного обучения.

Google представила STATIC: ускорение генеративного поиска в 948 раз
Google AI разработала фреймворк на основе разреженных матриц, который ускоряет декодирование в генеративных рекомендательных системах почти в тысячу раз. Это может изменить подход к промышленным рекомендациям.

Alibaba открыла CoPaw — рабочую станцию для масштабирования AI-агентов
Команда Alibaba выпустила open-source фреймворк CoPaw, который превращает локальную машину разработчика в полноценную среду для запуска автономных AI-агентов с памятью и многоканальными рабочими процессами.

Unified Latents: Google DeepMind нашла способ улучшить генерацию ИИ
Новый фреймворк Unified Latents от Google DeepMind решает дилемму между качеством сжатия данных и точностью работы нейросетей.

Sakana AI научилась мгновенно адаптировать языковые модели без дообучения
Токийская лаборатория Sakana AI представила два метода — Doc-to-LoRA и Text-to-LoRA — которые позволяют адаптировать большие языковые модели к новым данным за доли секунды, без классического файн-тюнинга.

Perplexity выпустила pplx-embed: модели эмбеддингов, которые меняют правила поиска
Perplexity представила семейство мультиязычных моделей эмбеддингов pplx-embed на базе Qwen3 с двунаправленным вниманием — и заявляет о новом стандарте качества для поиска в масштабах всего интернета.

Liquid AI бросает вызов гонке размеров: гибридная архитектура LFM2 меняет правила игры
Стартап Liquid AI представил модель на 24 миллиарда параметров, которая сочетает механизм внимания с свёртками. Цель — решить проблемы масштабирования, с которыми столкнулась вся индустрия больших языковых моделей.

Composio открывает код Agent Orchestrator — инструмента для мультиагентных систем за пределами ReAct
Стартап Composio выпустил в открытый доступ оркестратор агентов, который решает главную проблему продакшн-AI: хрупкость простых ReAct-циклов. Новый подход обещает масштабируемые мультиагентные рабочие процессы.

WebSocket-режим OpenAI меняет правила игры для голосового AI
OpenAI представила WebSocket-режим для Realtime API, который устраняет главного врага голосовых AI-агентов — задержку. Три отдельных этапа обработки голоса теперь сжимаются в один поток.

Taalas бросает вызов GPU: жёсткая логика вместо гибкости ради 17 000 токенов в секунду
Канадский стартап Taalas делает ставку на то, что индустрия AI-чипов считала ересью — замену программируемых GPU на специализированные микросхемы с жёсткой логикой. Результат: 17 000 токенов в секунду.

TruLens: как перестать доверять LLM вслепую и начать измерять качество
Языковые модели всё ещё остаются чёрными ящиками для большинства разработчиков. TruLens предлагает инструментарий, который делает каждый шаг работы LLM прозрачным и измеримым — от входных данных до финального ответа.

Google предлагает думать глубже, а не дольше — и вдвое снижает затраты на инференс
Исследователи из Google и Университета Вирджинии доказали: длинная цепочка рассуждений не означает качественную. Новая метрика Deep-Thinking Ratio позволяет повысить точность LLM и вдвое сократить вычислительные расходы.

Google DeepMind представила Lyria 3 для создания музыки по фото
Новая модель Lyria 3 от Google DeepMind совершает прорыв в генерации аудио. Теперь ИИ способен создавать полноценные треки с вокалом и текстом, опираясь лишь на фотографии или текстовые описания.

Tavus представила Phoenix-4: видеоаватары с живыми эмоциями и мгновенным откликом
Новая модель Phoenix-4 преодолевает эффект «зловещей долины», добавляя цифровым аватарам эмоциональный интеллект и сокращая задержку генерации до рекордных 600 миллисекунд.