Блог

  • ИИ в марте 2026: GPT-5.4 набирает 83% на тесте экспертного уровня, DeepSeek V4 в 10 раз дешевле конкурентов

    Март 2026 года — один из самых плотных по релизам месяцев за историю ИИ. За три недели вышли новые флагманы от четырёх крупнейших компаний.

    GPT-5.4 — 5 марта

    OpenAI выпустил GPT-5.4 с контекстом в 1 миллион токенов. На внутреннем бенчмарке GDPVal — 83%. Компания назвала это «уровнем человека-эксперта на экономически значимых задачах».

    Доступен в Plus ($20/мес) и Pro ($200/мес). В бесплатном плане нет.

    Gemini 3.1 Pro

    Google представил модель: 80.6% на SWE-bench, 94.3% на GPQA Diamond, 77.1% на ARC-AGI-2. Контекст — 1 миллион токенов. Доступен через Gemini API и Vertex AI.

    DeepSeek V4 — утечка бенчмарков

    Официального релиза ещё не было, но утечки показывают 80%+ на SWE-bench. Архитектура: триллион параметров, 32 миллиарда активных через mixture-of-experts. Контекст — 1 миллион токенов.

    Цена по утечкам: $0.28 за миллион входящих и $1.10 за выходящих. Закрытые конкуренты стоят в несколько раз дороже.

    Китай выпустил 5 новых моделей

    Tencent, Alibaba, Baidu и ByteDance представили обновления одновременно. Выделяется MiniMax M2.5 — по независимым оценкам сопоставим с Claude Opus 4.6 при значительно меньшей стоимости.

    NVIDIA Vera Rubin

    Официально анонсирован преемник архитектуры Blackwell. Конкретные характеристики пока не раскрыты, релиз ожидается в конце 2026 года.

    Цифра месяца

    Рынок AI-рекламы в 2026 году вырастет на 63% — до $57 миллиардов. ИИ перестаёт быть инструментом разработчиков и становится инфраструктурой маркетинга.

  • Курсы по нейросетям 2026: сравниваю Яндекс Практикум, Нетологию и Skillbox по цене и честности

    Рынок курсов по ИИ в России переполнен. Почти каждая онлайн-школа добавила что-то с нейросетями в каталог — от двухчасового вебинара до полугодовой программы. Разберём три крупнейших платформы.

    Яндекс Практикум — 66 500 рублей

    Рассрочка от 2 714 рублей в месяц. Включает: персонализированную практику, разработку собственного промпт-бука, карьерный центр, доступ к актуальным ИИ-моделям.

    Сильная сторона — интеграция с реальной экосистемой Яндекса. Слабая — ориентирован на применение ИИ, а не на понимание архитектур. Если хотите писать код с нейросетями — программа поверхностная.

    Нетология — от 61 000 рублей

    «Нейросети для каждого» — рассрочка 2 673 рубля в месяц на 24 месяца. Срок — 4 недели. Это курс для пользователя, а не разработчика.

    Если цель — научиться использовать ChatGPT и Midjourney в работе, подойдёт. Если цель — разрабатывать модели или работать с API — нет.

    Skillbox — 165 000 рублей

    «Профессия Machine Learning Engineer» — полная цена. «Нейросети: практический курс» — 130+ уроков, 25+ кейсов, 3 месяца, около 7 часов в неделю.

    Skillbox делает ставку на количество часов контента. Для тех, кому нужна структурная программа с проверками домашних заданий, вариант рабочий.

    Бесплатные альтернативы

    Stepik — курсы по нейросетям от ВШЭ и МФТИ, бесплатно. Медленнее, без живой поддержки, зато без долгов в рассрочку.

    Hugging Face — англоязычные курсы по трансформерам и диффузионным моделям, бесплатно. Технически глубже любого российского курса за деньги. Нужен английский на уровне чтения документации.

    Перед покупкой любого курса проверьте, когда обновлялась программа. В этой области материал устаревает за полгода.

  • DeepSeek API: $0.28 за миллион токенов и почему это меняет экономику проектов

    В январе 2025 года DeepSeek опубликовал модель с ценами, которые переписали рынок. $0.28 за миллион входящих токенов и $1.10 за выходящих — в разы дешевле OpenAI при сопоставимом качестве.

    Актуальные модели

    deepseek-chat (V3.2) — режим без размышлений. Подходит для классификации, суммаризации, пайплайнов с инструментами. Максимум 8 тысяч токенов на выходе. Контекст — 128 тысяч токенов.

    deepseek-reasoner — режим с видимой цепочкой рассуждений CoT. До 64 тысяч токенов на выходе. Лучше для математики, логики, сложного кода.

    Ценообразование V3.2

    Cache hit (повторяющийся префикс): $0.028 за миллион токенов. Cache miss: $0.28 за миллион. Output: $0.42 за миллион.

    Кэш включён по умолчанию. Если запросы начинаются с одного системного промпта — кэш срабатывает автоматически, стоимость падает в 10 раз.

    Как подключиться

    API совместим с форматом OpenAI. В большинстве проектов достаточно изменить base_url и api_key:

    from openai import OpenAI
    
    client = OpenAI(
        api_key="YOUR_DEEPSEEK_KEY",
        base_url="https://api.deepseek.com"
    )
    
    response = client.chat.completions.create(
        model="deepseek-chat",
        messages=[{"role": "user", "content": "Привет"}]
    )
    print(response.choices[0].message.content)

    Ключ — на platform.deepseek.com. Российские карты принимает через посредников.

    Ограничения

    Серверы в Китае — важно для проектов с требованиями к локализации данных. При интенсивной нагрузке задержки выше, чем у американских хостингов.

    DeepSeek V4 с контекстом 1 миллион токенов ожидается в ближайшие месяцы.

  • 43% российских компаний уже используют ИИ. Что они автоматизируют и сколько экономят

    В 2025 году 43% российских компаний используют инструменты ИИ для решения бизнес-задач. В 2024 году было 26%. Прирост — 17 процентных пунктов за год.

    Объём российского рынка ИИ в 2024 году: 130–305 миллиардов рублей. Ожидаемый экономический эффект к 2030 году — 7.9–12.8 триллиона рублей по прогнозу «Яков и Партнёры».

    Где внедряют

    Три лидирующих сектора по итогам II квартала 2025 года: производство (31% от общего объёма ИИ-решений), энергетика (18%), финансы (16%).

    Банки экономят 15–20% операционных расходов на задачах с ИИ. Отдельные кейсы — до 40%. Одна российская компания после внедрения ИИ в обработку документации сократила время на 87% и сэкономила около 12 миллионов рублей в год.

    Что автоматизируют

    Три самых популярных направления: обработка документов и договоров, поддержка клиентов (чат-боты, классификация обращений), генерация контента и отчётов.

    Для технических интеграций чаще используют GigaChat API и YandexGPT API — данные не покидают российский контур.

    80% проектов проваливаются

    Это мировая статистика — и она актуальна для России тоже. Главные причины: нечёткое ТЗ, переоценённые ожидания, отсутствие качественных данных.

    Компании, которые начинают с конкретной задачи («автоматизировать проверку счетов»), добиваются результата чаще, чем те, кто «внедряет ИИ» как стратегическую инициативу без измеримой цели.

  • ChatGPT vs GigaChat: сравниваю честно — где разрыв и где GigaChat реально выигрывает

    GigaChat появился в апреле 2023 года как российская альтернатива ChatGPT. Сбер заявлял: модель лучше работает с русским языком. За три года ситуация изменилась — разберём, что правда, а что нет.

    Параметры моделей

    GigaChat MAX — около 20 миллиардов параметров. Для сравнения: ChatGPT 3.5 вышел в конце 2022 года. GPT-4o работает на сотнях миллиардов параметров — точные данные OpenAI не публикует.

    Контекстное окно GigaChat MAX — 131 тысяча токенов. GPT-4o — 128 тысяч, GPT-5.4 — уже 1 миллион. Пользователей у GigaChat — 2.5 миллиона по данным на начало 2024 года. У ChatGPT — сотни миллионов.

    Русский язык: правда и миф

    Сбер утверждает, что GigaChat лучше понимает русский. Частично это правда для очень специфических случаев — юридический язык, документы в российском формате.

    В январе 2025 года The Moscow Times опубликовал материал «Russian AI Struggles in Its Own Language». Анализ показал: разрыв с американскими и китайскими моделями продолжает расти, а не сокращаться.

    Где GigaChat выигрывает

    Работает без VPN. Принимает российские карты. Интегрирован в Сбер-экосистему — банк, Салют, корпоративные инструменты.

    Данные не покидают российский периметр. Для корпоративных клиентов Сбера с требованиями к локализации — это реальное преимущество.

    Где проигрывает

    Сложные рассуждения, математика, код — ChatGPT заметно сильнее. Chain-of-thought в GigaChat работает слабее из-за меньшего числа параметров.

    Если задача — написать Python-скрипт или разобрать сложный документ на английском — выбор очевиден.

  • Как пользоваться ChatGPT в 2026: тарифы, лимиты и что доступно бесплатно

    ChatGPT в 2026 году — это пять разных продуктов с разными лимитами. Разобраться с первого взгляда сложно. Разложим по полочкам.

    Бесплатный план

    Даёт доступ к GPT-4o-mini. Лимит — примерно 10 сообщений каждые 5 часов. После превышения модель переключается на упрощённую версию.

    Можно загружать файлы и изображения, пользоваться базовым браузингом и GPT Store. Для эпизодического использования хватит. Для ежедневной работы — нет.

    Платные планы

    ChatGPT Go — $8/мес. Неограниченный доступ к GPT-5.2 Instant. Для студентов и случайных авторов.

    ChatGPT Plus — $20/мес. Полный GPT-4o, DALL·E 3 для генерации изображений, расширенный голосовой режим, более высокие лимиты.

    ChatGPT Pro — $200/мес. Неограниченный GPT-5.1, Sora для видео, Codex-агенты, ранний доступ к новым функциям.

    Business — от $25–30 за пользователя. Общее рабочее пространство, Admin-панель, SOC-2 compliance.

    Регистрация из России

    Официально доступна. Нужны электронная почта или аккаунт Google/Microsoft. Российский номер телефона при регистрации не требуется.

    Бесплатный план работает без VPN — российский IP не блокируется. Для оплаты Plus нужна иностранная карта или покупка через App Store/Google Play с зарубежным аккаунтом.

    GPT-5.4 в 2026

    Вышел 5 марта. Контекст — 1 миллион токенов. На тесте GDPVal — 83%, что OpenAI называет уровнем человека-эксперта.

    В бесплатном плане недоступен. Только Plus и Pro.

  • Как писать промпты: 3 техники, которые улучшают результат на 40%

    Большинство людей пишут промпты интуитивно. Это работает — но не оптимально. Есть три техники с измеримым эффектом, проверенные в академических исследованиях.

    Chain-of-Thought: заставьте модель рассуждать вслух

    Добавьте в промпт фразу «Давай рассуждать шаг за шагом» — и модель начинает разбивать задачу на части вместо прыжка к ответу.

    Без этой фразы GPT на математическом бенчмарке GSM8K давал 17.9% правильных ответов. С ней — 58.1%. Разрыв в три с лишним раза.

    Работает только на моделях от 100 миллиардов параметров. На маленьких — эффекта нет.

    Few-Shot: покажите пример нужного формата

    Дайте модели 2–8 примеров нужного ввода и вывода — она воспроизводит паттерн точнее. Прирост точности по сравнению с нулевым промптом — от 15% до 40% в зависимости от задачи.

    Формула простая: пример 1 → ответ 1, пример 2 → ответ 2, затем ваш запрос. Модель считывает структуру и следует ей.

    Few-Shot + CoT вместе

    Комбинация обоих методов — самый стабильный результат. Self-consistency (несколько CoT-ответов, потом выбор большинства) дала прирост на GSM8K +17.9%, на SVAMP +11%, на AQuA +12.2%.

    Три правила хорошего промпта

    Один промпт — одна задача. Если нужно сделать A и B — это два промпта.

    Роль работает. «Ты опытный редактор» даёт другой результат, чем просто запрос без контекста.

    Конкретика выигрывает у абстракции. Не «напиши текст для сайта», а «напиши 150 слов для главной страницы онлайн-курса по Python для начинающих в возрасте 25–35 лет, без технического жаргона».

  • Нейросеть для презентаций: Gamma, Beautiful.ai и ещё 5 сервисов — цены и честные итоги

    Gamma — самый популярный в 2026 году сервис для создания презентаций с помощью ИИ. Описываете тему, получаете готовые слайды за 2–3 минуты. Есть бесплатный план, платный от $10 в месяц. Минус: российские карты не принимает.

    Что есть на рынке

    Gamma — бесплатный план с ограниченным числом генераций. Plus: $10/мес, до 20 слайдов, без водяных знаков, экспорт в PowerPoint. Pro: $25/мес, кастомизация бренда, API, до 50 слайдов. Team: $40 на пользователя, общая библиотека слайдов и тем компании.

    Beautiful.ai — от $10 в месяц. Бесплатный план: 10 слайдов с водяным знаком. Сильная сторона — автоматическая адаптация дизайна при добавлении контента.

    Tome — от $8 в месяц. Ориентирован на нарративные презентации, где важна история, а не таблицы.

    SlidesAI — плагин для Google Slides. Работает внутри знакомого интерфейса. Бесплатно — 3 презентации в месяц.

    Что реально работает

    Ни один из этих сервисов не создаёт финальный продукт с первого раза. Они делают черновик — структуру, тезисы, визуальный каркас. Доделывать придётся вручную.

    Для студенческой работы хватит бесплатного плана Gamma. Для корпоративного питча — нет.

    Оплата из России

    Ни один из перечисленных сервисов не принимает российские карты напрямую. Есть посредники — работающий вариант, добавляет 10–20% к стоимости.

    Canva частично работает с российскими картами — и там тоже есть ИИ-генерация слайдов, пусть и слабее Gamma. Для тех, кому не хочется возиться с оплатой, это самый простой путь.

  • Нейросети в 2026: GPT-5.4 против Claude Opus 4.6 против DeepSeek V4 — кто лидирует

    В марте 2026 года произошло то, чего ждали давно. OpenAI, Anthropic, Google и DeepSeek выпустили флагманские модели почти одновременно. Теперь у пользователя четыре реальных варианта — и ни один не выигрывает по всем параметрам сразу.

    Что вышло в марте

    GPT-5.4 вышел 5 марта. Контекстное окно — 1 миллион токенов. На тесте GDPVal (реальные экономически значимые задачи) набрал 83% — это уровень человека-эксперта.

    Claude Opus 4.6 от Anthropic — сильнейшая модель для кода среди коммерческих. Интересно, что на бенчмарке GDPval-AA Elo лидирует не Opus, а Sonnet 4.6 — 1633 очка, выше и Opus, и Gemini 3.1 Pro.

    Gemini 3.1 Pro: 80.6% на SWE-bench, 94.3% на GPQA Diamond. Контекст — 1 миллион токенов.

    DeepSeek V4 работает на триллионе параметров, из которых активны 32 миллиарда (архитектура mixture-of-experts). На тесте Needle-in-Haystack при миллионном контексте — 97% точности. Цена: $0.28 за миллион входящих токенов. Все конкуренты стоят в разы дороже.

    Российские модели

    GigaChat от Сбера работает на 20 миллиардах параметров. Это уровень ChatGPT 3.5 образца двух лет назад. Контекст — 131 тысяча токенов.

    YandexGPT интегрирован в экосистему Яндекса — Алису, 360, браузер. Для задач внутри этой экосистемы удобен.

    Обе российские модели работают без VPN и принимают российские карты. Иностранные — только с VPN и иностранной картой.

    Как выбрать

    Для текста и сложных рассуждений — GPT-5.4 или Claude Opus 4.6. Для кода — Claude. Для дешёвых API-запросов — DeepSeek V4. Для работы без VPN — GigaChat или YandexGPT.

    Нет одного правильного ответа. Всё зависит от задачи, бюджета и того, готовы ли вы разбираться с VPN.