Материалы

Выступления, записанные интервью, открытые проекты и публикации на внешних площадках.

Выступления, интервью и подкасты

Сергей Нотевский на записи подкаста «Куда расти?»

Подкаст · «Куда расти?» · Максим Ульянов · 11 августа 2026 года

Зачем Битрикс24 своя AI-платформа?

Разговор о том, зачем компании своя AI-платформа и как выбирать между MaaS и self-hosted: модели, GPU, тесты качества, контекст, префикс-кэш и команда.

Открыть подкаст
Сергей Нотевский, Константин Доронин и Родион Мостовой на стриме «Каждый токен на счету»

Стрим · YouTube · Константин Доронин · 27 мая 2026 года

«Каждый токен на счету» — как экономить токены при создании AI-агентов

Разговор о двух способах экономить токены в AI-агентах: управлении контекстом через RAG и семантический поиск, а также правильной работе с prefix cache.

Открыть стрим
Сергей Нотевский объясняет ответственность внутреннего AI-провайдера на слайде доклада ROИИ

Доклад · ROИИ 2026 · день 1 · 19 февраля 2026 года

Свои ИИ-модели или API по подписке?

Как разложить выбор между внешним API и собственной моделью на требования к качеству, SLO, загрузке, инженерной поддержке, контексту и лицензии.

Открыть доклад
Сергей Нотевский выступает на Ural Digital Weekend 2025 рядом со слайдом о выборе LLM

Доклад · Ural Digital Weekend 2025 · Пермь · 1 августа 2025 года

Подходы к выбору языковых моделей для встраивания в продукты и услуги, оценка их эффективности

Как выбирать языковую модель для продукта: что сравнивать, когда смотреть на MaaS или собственный хостинг и какие вопросы задать до интеграции.

Открыть доклад
Анатолий Пешков и Сергей Нотевский на обложке интервью Mad Brains о выборе нейросети

Интервью · Mad Brains · Small talk с техдиром · 21 марта 2025 года

Как выбрать нейросеть: опыт Битрикс24

Разговор о личном опыте внедрения AI в Битрикс24, характеристиках моделей, которые стоит проверять до выбора, и проблемах интеграции.

Открыть интервью

Открытые проекты

Публикации на внешних площадках

Авторская статья
Журнал «Код» / Яндекс Практикум
18 июня 2026 года

Почему короткий промпт может стоить дороже длинного

Объяснение prefix cache для читателя, который хочет понять, почему локальное сокращение промпта способно увеличить стоимость агентной сессии

Вклад Сергея: автор материала и технического разбора

Открыть публикациюВнешняя ссылка, откроется в новой вкладке

Авторская статья
Хабр · блог Битрикс24
12 мая 2026 года

Короткий промпт ≠ дешёвый промпт: как оптимизация ломает prefix cache в LLM-агентах

Разбор плавающего списка tools, стабильности префикса и effective cost в длинном агентном цикле

Вклад Сергея: автор статьи и практических рекомендаций

Открыть публикациюВнешняя ссылка, откроется в новой вкладке

Авторская статья
Хабр · блог Битрикс24
10 марта 2026 года

Погоди переезжать на дешёвую модель: считаем effective cost с учётом кэша

Практическая модель стоимости, которая учитывает cache read, cache miss и различия провайдеров, а не только цену миллиона токенов

Вклад Сергея: автор расчёта и сравнительного разбора

Открыть публикациюВнешняя ссылка, откроется в новой вкладке

Авторская статья
Хабр · блог Битрикс24
26 декабря 2025 года

Навыки агентов (Agent Skills): что это такое и почему это больше, чем «папка с промптами»

Объяснение Agent Skills как переносимого, версионируемого артефакта для поведения AI-агентов и рабочих процессов

Вклад Сергея: автор объяснительного материала и модели Discovery → Activation → Execution

Открыть публикациюВнешняя ссылка, откроется в новой вкладке

Авторская статья
Хабр · блог Битрикс24
15 декабря 2025 года

Синдром бесконечного окна: почему 1 миллион токенов в LLM не решает ваши проблемы (пока)

Почему миллион токенов в спецификации модели не гарантирует качество и как с этим связаны context rot, история агента, RAG и prefix cache

Вклад Сергея: автор статьи и практических рекомендаций по работе с длинным контекстом

Открыть публикациюВнешняя ссылка, откроется в новой вкладке

Экспертный комментарий
RB.RU
8 августа 2025 года

«Не магический скачок, а практичное улучшение»: российские ИИ-эксперты — о новой GPT-5

Что в GPT-5 изменилось в работе с достоверностью и длинным контекстом и почему эти улучшения важны для AI-агентов

Вклад Сергея: экспертные комментарии о достоверности ответов GPT-5 и потерях контекста

Открыть публикациюВнешняя ссылка, откроется в новой вкладке

Экспертный комментарий
vc.ru · Битрикс24
28 апреля 2025 года

Промт-инжиниринг больше не нужен?

Разбор того, как промпт меняется от пользовательской формулировки до части архитектуры AI-продукта

Вклад Сергея: основной эксперт материала; объясняет пользовательский и продуктовый контекст промпт-инжиниринга

Открыть публикациюВнешняя ссылка, откроется в новой вкладке

Авторская статья
Хабр · блог Битрикс24
24 апреля 2025 года

От улыбки рейтинг наш светлей: Как фильтры стиля и настроения меняют рейтинг LLM

Почему субъективная привлекательность ответа может сместить рейтинг модели и что учитывать при сравнении LLM

Вклад Сергея: автор статьи и разбора влияния стиля ответа на оценку моделей

Открыть публикациюВнешняя ссылка, откроется в новой вкладке

Экспертный комментарий
Сноб
20 марта 2025 года

Grok 3 против всех: чем нейросеть Илона Маска лучше (и хуже) конкурентов

Чем Grok 3 отличается от других языковых моделей, где у него сильные стороны и какие ограничения важны для продукта

Вклад Сергея: основной эксперт материала; разбирает возможности и ограничения Grok 3

Открыть публикациюВнешняя ссылка, откроется в новой вкладке

Экспертный комментарий
РБК Тренды
1 августа 2024 года

Почему нанимать на работу искусственный интеллект будут не скоро

Какие рабочие задачи уже можно поручить AI-ассистенту и почему до полноценного цифрового сотрудника ещё далеко

Вклад Сергея: эксперт материала; объясняет границу между AI-ассистентом и сотрудником

Открыть публикациюВнешняя ссылка, откроется в новой вкладке

Для приглашения на выступление, интервью или разговора о совместном материале.

Написать в Telegram