Perplexity показала стек эмбеддингов: CUDA-графы, LazyTensor и сервисы Ivy, Tulip, ROSE
Perplexity раскрыла архитектуру serving-стека для эмбеддингов pplx-embed: CUDA-графы, асинхронные LazyTensor и бенчмарки против vLLM.
Искусственный интеллект: инструменты и их применение в работе. Всего — 257 статей.
Perplexity раскрыла архитектуру serving-стека для эмбеддингов pplx-embed: CUDA-графы, асинхронные LazyTensor и бенчмарки против vLLM.
Nvidia передала Open Secure AI Alliance в Linux Foundation. Альянс из 120+ участников продолжит развивать открытые стандарты защиты ИИ-систем.
Nous Research добавила в Hermes Desktop установку локальных ИИ-моделей в один клик: приложение само подбирает модель под ваше железо и настраивает llama.cpp.
NVIDIA выпустила PAIR — открытый маршрутизатор, который распределяет локальные запросы ИИ между RTX, DGX Spark и Mac. Разбираем, как это работает и кому нужно.
OpenAI представила GPT-6 Astra — модель для управления компьютером с окном контекста 1,05M токенов. Доступ ограничен из-за рисков кибербезопасности.
Google DeepMind выпустила Gemini 3.8 Flash и ограниченную версию Flash Cyber для защитников. Цены, бенчмарки и способы доступа в обзоре.
Anthropic представила Enterprise Frontier Safeguards: мониторинг в облаке клиента с нулевым хранением данных и автоматическим выявлением межсессионных
MCP-серверы стали стандартом подключения ИИ-агентов к инструментам, но 40% из них содержат эксплуатируемые уязвимости. Разбираем угрозы и способы защиты.
Anthropic выпустила Claude Fable 5.1 и Mythos 5.1: один модель с разными уровнями защиты, 52,6% на Terminal-Bench-Science и снижение цены кэш-чтений на 75%.
Keenable AI открыла NEEDLE — живой бенчмарк поисковых API для агентов: запросы пересобираются ежечасно, 15 API сравниваются по единому протоколу.
NVIDIA представила Jetson Orin Nano 2 с новым чипом Orin: вдвое выше производительность ИИ, поддержка LPDDR5X, выход в первой половине 2027 года.
Сравнение инференс-API для голосовых агентов: замеры TTFT, времени до первого аудио и полного бюджета задержки голосового ответа.