Издание · проверено редакцией

MarkTechPost

Источник AI-новостей. Материалы автоматически отбираются и адаптируются редакцией Hamidun News.

304 материалов в Hamidun·Последний: 3 августа· Активен·marktechpost.com ↗

Последние публикации

Anthropic представила Claude 4.6 Sonnet с контекстом в миллион токенов
LLMMarkTechPost

Anthropic представила Claude 4.6 Sonnet с контекстом в миллион токенов

Anthropic вступает в эпоху рассуждающих моделей. Claude 4.6 Sonnet получил контекстное окно в 1 млн токенов и инновационную систему верификации фактов через исполнение кода.

18 февр. 2026 г.·2 мин
Google DeepMind представила фреймворк для интеллектуального делегирования задач между ИИ-агентами
LLMMarkTechPost

Google DeepMind представила фреймворк для интеллектуального делегирования задач между ИИ-агентами

Исследователи разработали систему для создания безопасного «агентного веба», где автономные программы смогут эффективно взаимодействовать и масштабироваться.

16 февр. 2026 г.·2 мин
Google представила WebMCP: новый стандарт взаимодействия ИИ-агентов с вебом
LLMMarkTechPost

Google представила WebMCP: новый стандарт взаимодействия ИИ-агентов с вебом

Google представила протокол WebMCP, который позволит ИИ-агентам взаимодействовать с сайтами напрямую через структуру кода, минуя медленный и ресурсозатратный анализ скриншотов.

15 февр. 2026 г.·2 мин
Архитектура памяти: как научить ИИ-агентов помнить важное и мыслить логично
LLMMarkTechPost

Архитектура памяти: как научить ИИ-агентов помнить важное и мыслить логично

Разбор новой концепции памяти для нейросетей: переход от простого хранения истории диалогов к структурированным базам знаний для глубокого анализа данных.

15 февр. 2026 г.·2 мин
Гайд по созданию пайплайна синтетических данных с CTGAN и SDV
LLMMarkTechPost

Гайд по созданию пайплайна синтетических данных с CTGAN и SDV

Узнайте, как построить надежную систему генерации табличных данных, обеспечивающую высокую точность и сохранение всех статистических закономерностей для безопасного обучения нейросетей.

14 февр. 2026 г.·3 мин
Как обучить ИИ человеческим предпочтениям: гайд по DPO и QLoRA
LLMMarkTechPost

Как обучить ИИ человеческим предпочтениям: гайд по DPO и QLoRA

Новый туториал показывает, как эффективно настраивать языковые модели под человеческие предпочтения без использования тяжеловесных моделей вознаграждения, используя всего одну GPU.

13 февр. 2026 г.·2 мин
Google Gemini 3 Deep Think: новый рекорд в тестах на общий интеллект
LLMMarkTechPost

Google Gemini 3 Deep Think: новый рекорд в тестах на общий интеллект

Google представила Gemini 3 Deep Think. Модель показала результат в 84,6% в тесте ARC-AGI-2, приближая индустрию к созданию сильного ИИ через механизмы глубокого логического вывода.

13 февр. 2026 г.·2 мин
OpenAI представила GPT-5.3-Codex-Spark: революция скорости в разработке ПО
LLMMarkTechPost

OpenAI представила GPT-5.3-Codex-Spark: революция скорости в разработке ПО

OpenAI выпустила сверхбыструю модель для кодинга. Благодаря чипам Cerebras она выдает 1000 токенов в секунду, что в 15 раз быстрее стандартных версий.

13 февр. 2026 г.·2 мин
Как обучить эмбеддинги Matryoshka для сверхбыстрого поиска данных
LLMMarkTechPost

Как обучить эмбеддинги Matryoshka для сверхбыстрого поиска данных

Узнайте, как технология Matryoshka Representation Learning позволяет сократить размер векторов до 64 измерений без существенной потери точности поиска.

12 февр. 2026 г.·2 мин
NVIDIA представила KVTC: технология сжатия кэша LLM в 20 раз ускорит работу нейросетей
LLMMarkTechPost

NVIDIA представила KVTC: технология сжатия кэша LLM в 20 раз ускорит работу нейросетей

Исследователи NVIDIA представили KVTC — инновационный метод сжатия KV-кэша. Технология позволяет сократить потребление памяти в 20 раз, решая главную проблему масштабирования языковых моделей.

11 февр. 2026 г.·2 мин
Как упростить разработку нейросетей: руководство по использованию Einops для тензорных вычислений
LLMMarkTechPost

Как упростить разработку нейросетей: руководство по использованию Einops для тензорных вычислений

Библиотека Einops становится стандартом для работы с тензорами в глубоком обучении. Разбираемся, как сделать код чище и избежать ошибок в архитектурах Vision и Attention.

11 февр. 2026 г.·2 мин
Google представила NAI: адаптивные интерфейсы на базе Gemini для инклюзивного дизайна
LLMMarkTechPost

Google представила NAI: адаптивные интерфейсы на базе Gemini для инклюзивного дизайна

Google Research предлагает пересмотреть подход к доступности ПО. Фреймворк NAI использует ИИ-агентов Gemini для мгновенной адаптации интерфейса под физические возможности и контекст пользователя.

11 февр. 2026 г.·2 мин
Microsoft представила OrbitalBrain: распределенное обучение ИИ прямо в космосе
LLMMarkTechPost

Microsoft представила OrbitalBrain: распределенное обучение ИИ прямо в космосе

Исследователи Microsoft предложили архитектуру OrbitalBrain для обучения нейросетей на спутниковых группировках, решая проблему медленной передачи данных на Землю.

10 февр. 2026 г.·2 мин
OAT: как токенизация действий приближает роботов к возможностям LLM
LLMMarkTechPost

OAT: как токенизация действий приближает роботов к возможностям LLM

Новый метод OAT позволяет роботам эффективнее планировать действия, используя подходы, аналогичные большим языковым моделям. Это открывает двери для масштабирования и гибкого управления роботами.

9 февр. 2026 г.·2 мин
MLflow для LLM: версионирование промптов и регрессионное тестирование
LLMMarkTechPost

MLflow для LLM: версионирование промптов и регрессионное тестирование

Как обеспечить стабильность больших языковых моделей? MLflow предлагает решение для версионирования промптов и автоматического регрессионного тестирования. Подробности – в статье.

9 февр. 2026 г.·1 мин
ByteDance выпустила Protenix-v1: Open-Source модель для прогнозирования биомолекулярных структур
LLMMarkTechPost

ByteDance выпустила Protenix-v1: Open-Source модель для прогнозирования биомолекулярных структур

ByteDance опубликовала Protenix-v1 — open-source модель для предсказания структур белков, ДНК, РНК и лигандов на уровне AlphaFold3, код и веса доступны под Apache 2.0.

8 февр. 2026 г.·2 мин
PaperBanana: Google научила нейросети рисовать графики, за которые не стыдно перед рецензентами
LLMMarkTechPost

PaperBanana: Google научила нейросети рисовать графики, за которые не стыдно перед рецензентами

Пока ИИ пишет код и статьи, красивые схемы оставались рутиной. Фреймворк PaperBanana от Google автоматизирует создание научных иллюстраций и графиков. Прощай, ручная отрисовка.

7 февр. 2026 г.·1 мин
Waymo World Model: беспилотники Google теперь тренируются в собственной «Матрице»
LLMMarkTechPost

Waymo World Model: беспилотники Google теперь тренируются в собственной «Матрице»

Waymo запустила генеративную модель на базе Genie 3. Теперь беспилотники учатся водить в фотореалистичных мирах, которые нейросеть создает на лету. Больше никаких скучных полигонов.

7 февр. 2026 г.·2 мин
Claude Opus 4.6: Anthropic учит нейросети думать медленно и работать за вас
LLMMarkTechPost

Claude Opus 4.6: Anthropic учит нейросети думать медленно и работать за вас

Anthropic выкатила Opus 4.6. Пока конкуренты гонятся за хайпом, Дарио Амодеи дает нам миллион токенов контекста и агентов, которые реально пишут код.

6 февр. 2026 г.·2 мин
GPT-5.3-Codex: OpenAI превращает кодинг в автономный процесс (и делает это быстрее)
LLMMarkTechPost

GPT-5.3-Codex: OpenAI превращает кодинг в автономный процесс (и делает это быстрее)

OpenAI объединила мощь GPT-5.2 с навыками кодинга в новой модели 5.3-Codex. Она работает на 25% быстрее и метит в роль полноценного автономного агента для вашего компьютера.

5 февр. 2026 г.·2 мин
Voxtral Transcribe 2: Mistral напомнила, зачем нам всё ещё нужны европейские нейронки
LLMMarkTechPost

Voxtral Transcribe 2: Mistral напомнила, зачем нам всё ещё нужны европейские нейронки

Mistral выпустила Voxtral Transcribe 2 — семейство моделей для распознавания речи. Теперь диаризация и real-time ASR работают в промышленных масштабах без лишних затрат.

5 февр. 2026 г.·2 мин
Gemini 3 Flash: Google учит нейросети не гадать, а всматриваться
LLMMarkTechPost

Gemini 3 Flash: Google учит нейросети не гадать, а всматриваться

Google внедряет Agentic Vision в Gemini 3 Flash. Теперь модель не просто сканирует картинку, а активно изучает детали. Конец эпохи галлюцинаций в мелких деталях?

5 февр. 2026 г.·2 мин
Qwen3-Coder-Next: 80 миллиардов параметров, которые влезут в ваш ПК
LLMMarkTechPost

Qwen3-Coder-Next: 80 миллиардов параметров, которые влезут в ваш ПК

Команда Qwen снова ломает стереотипы. Новая модель весит как гигант, но бегает как спринтер: из 80 млрд параметров активны только 3 млрд. Идеально для локальных агентов.

4 февр. 2026 г.·2 мин
Оффлайн-обучение без жертв: как Conservative Q-Learning спасает бюджеты и жизни
LLMMarkTechPost

Оффлайн-обучение без жертв: как Conservative Q-Learning спасает бюджеты и жизни

Забудьте про бесконечные пробы и ошибки. Новая реализация CQL позволяет обучать агентов на исторических данных, исключая риск катастроф в реальном мире.

4 февр. 2026 г.·2 мин
Бронежилет для нейросети: почему вашей LLM мало одного фильтра безопасности
LLMMarkTechPost

Бронежилет для нейросети: почему вашей LLM мало одного фильтра безопасности

Пока хакеры придумывают новые способы обмануть ChatGPT, разработчики строят многослойную оборону. Разбираемся, как защитить модель от адаптивных атак и не сойти с ума.

3 февр. 2026 г.·2 мин
Зеро-паддинг: почему лишние нули обходятся вашим нейросетям слишком дорого
LLMMarkTechPost

Зеро-паддинг: почему лишние нули обходятся вашим нейросетям слишком дорого

Стандартный прием с добавлением нулей по краям картинки оказался не таким уж безобидным. Разбираемся, как технический костыль создает статистический шум и мешает моделям учиться.

2 февр. 2026 г.·2 мин
Nemotron-3-Nano-30B: NVIDIA научила 4-битные модели думать по-взрослому
LLMMarkTechPost

Nemotron-3-Nano-30B: NVIDIA научила 4-битные модели думать по-взрослому

NVIDIA втиснула 30 миллиардов параметров в 4 бита без потери качества. Рассказываем, как технология QAD делает сложные рассуждения доступными и быстрыми.

2 февр. 2026 г.·2 мин
Generative UI: почему чат-боты — это тупик эволюции интерфейсов
LLMMarkTechPost

Generative UI: почему чат-боты — это тупик эволюции интерфейсов

Мы привыкли общаться с ИИ через узкое текстовое окно, но это лишь костыль. На смену приходит Generative UI — интерфейс, который строится на лету под ваши задачи.

29 янв. 2026 г.·2 мин
HPC-Ops от Tencent: китайский софт выжимает максимум из американского железа
LLMMarkTechPost

HPC-Ops от Tencent: китайский софт выжимает максимум из американского железа

Tencent выложила в открытый доступ HPC-Ops — библиотеку низкоуровневых CUDA-ядер. Это попытка заставить тяжелые нейросети работать быстрее на том же железе. Без эмодзи и лишних слов.

28 янв. 2026 г.·2 мин
Haystack и мультиагенты: как перестать дежурить по ночам и начать жить
LLMMarkTechPost

Haystack и мультиагенты: как перестать дежурить по ночам и начать жить

Пока все обсуждают чат-боты, Haystack показывает, как собрать команду ИИ-агентов для реального SRE. Это уже не игрушки, а автоматизация расследования инцидентов в продакшене.

27 янв. 2026 г.·2 мин