Блог об AI
Заметки о нейросетях, промпт-инжиниринге и том, как искусственный интеллект меняет всё вокруг.
Последние записи
Grok 4.6 и Grokbot: Cursor официально вошёл в SpaceX AI
Cursor теперь формально часть SpaceX AI, Grok 4.6 почти догнал фронтир по бенчмаркам при цене $2 за миллион входных токенов, а Grokbot прячет всю сложность кодового агента за простым чатом. Разбираем самую неожиданную консолидацию года.
Архитектуры ИИ-чипов: почему эпоха одного чипа закончилась
Обзор главных архитектур ИИ-ускорителей: от CUDA-империи NVIDIA до wafer-scale Cerebras, детерминированных LPU Groq и чипов Taalas, зашитых под одну модель.
OmniAssistBench: видеоассистенты на омни-моделях не справляются
Бенчмарк OmniAssistBench впервые измеряет омни-модели как живых видеоассистентов: жесты, проактивные ответы, многоходовые диалоги. Gemini-3-Pro набирает 66.4 из 100, открытые модели едва перешагивают середину.
Инвестиции в ИИ: почему бывший глава IBM требует «план Б»
Экс-CEO IBM Сэм Палмизано разбирает ИИ-бум глазами человека, который сам подписывал многомиллиардные ставки: циклы по 7-10 лет, меморандумы вместо контрактов и план Б на случай коррекции.
Как не переусложнить AI-приложение: 7 признаков
AI-приложения редко падают из-за неправильной модели. Они падают, потому что слоёв накидали раньше, чем смогли назвать проблему, которую каждый слой решает. Семь признаков переусложнения и плейбук, как строить проще.
AI-агенты для day-one enablement: 7960 моделей на IBM Spyre
Команда torch-spyre показала, как AI-агенты пишут адаптеры между HuggingFace Transformers и компилятором нового ускорителя. Тринадцать адаптеров покрыли 7960 из 10000 самых скачиваемых embedding-моделей.
4DAnyone: 4D-аватар из обычного видео без студии
Чтобы оживить человека в 3D, раньше требовалась студия с десятками калиброванных камер. 4DAnyone делает это из одного ролика с телефона: генерирует недостающие ракурсы диффузионной моделью и собирает из них объёмного аватара.
WithEveryone: групповые фото до 10 человек одной моделью
Новая unified-модель генерирует групповые фото с 5-10 реальными людьми и впервые обходит проприетарные системы по сохранению идентичности.
Swift-Image: как 6B-модель обходит 20B редакторы изображений
Swift-Image от Alibaba: компактная 6B-модель, которая генерирует и редактирует изображения лучше открытых конкурентов в 20B, а в общем зачёте уступает только GPT-Image-2 и Seedream5 Pro.
MCP съедает контекст: 111 тысяч токенов до первого слова
Разработчик подключил 10 популярных MCP-серверов к счётчику токенов и обнаружил: 111 713 токенов JSON-схем загружаются в контекст до первого сообщения. Разбираем, почему Anthropic и Cloudflare уже ушли от этой схемы.