Разборы, кейсы и практика для инженеров и продактов. Как строить AI-продукты и не терять на этом деньги.

Как войти в Data Science в Казахстане

Меня часто спрашивают, с чего начать. Отвечаю по-разному, потому что универсального ответа нет, но есть несколько вещей, которые повторяю почти всем. Собрал их здесь.

Как я сам сюда попал

Образование у меня математическое, мехмат КазНУ, математическое моделирование. Специальности дата-сайентист тогда не существовало, направления такого не было. При том что математики и программирования на факультете хватало, меня занесло в веб-разработку, и я довольно долго ей занимался с 2006 года.

Потом я оказался в банке. Там было много задач с большими объёмами данных, в основном про транзакционный фрод. Компетенции для этого были нужны внутри, а у меня оказался самый близкий технический бэкграунд. Начал заниматься, и мне понравилось больше, чем тем, что я делал до этого.

Два фактора: удачное стечение обстоятельств и то, что зашло. Никакого продуманного перехода не было.

Откуда берутся дата-специалисты

Откуда берутся дата-специалисты

Из моих наблюдений за теми, кто начинал примерно тогда же: большинство пришли из разработки. Есть заметная часть экономистов, у них своя сильная база по эконометрике и статистике, технически они послабее, но добирали навыки на ходу.

Общее у всех одно. Технический склад и какая-то математика за спиной, пусть даже подзабытая. Когда база есть, остальное добивается.

Тогда в казахстанских вузах не было четырёхлетней специализации по DS, и людям приходилось собирать себя самим. Сейчас программы появились (Data Science в МУИТ, в Astana IT University, магистратура по ML в Сатпаева), так что этот пункт можно считать закрытым для тех, кто поступает сегодня.

Читать далее

MedTech в Казахстане: нейросеть для рентгена лёгких

Система работы с медицинскими изображениями

В некоторых инфекционных больницах Казахстана стояли аналоговые рентген-аппараты. Снимок на плёнке, никакой цифры, никакого PACS. Наша модель для таких клиник просто не существовала ей нечего было читать.

Мы покупали цифровые панели-оцифровщики и отдавали их клиникам. Компания везла железо, чтобы у алгоритма появились входные данные.

Это, пожалуй, главное, что я вынес из того проекта. Ниже то, что я рассказывал в подкасте «Код и кофе», плюс выводы, которые сформулировал уже потом, спустя несколько лет.

Читать далее

Выбор LLM для генерации контента: характеры моделей

Выбор LLM для генерации контента» с чипами моделей Gemini, Claude, DeepSeek, GPT и Grok

За последний год я перепробовал десяток моделей на реальной генерации контента от Reels-сценариев до лонгридов. Вывод простой и немного неудобный: универсальной лучшей модели нет. У каждой свой характер, и выбор зависит от типа контента и аудитории.

В этом посте как я подбираю модель под задачу, какой пайплайн гоняю в продукте и чем это подкреплено: данными LMArena, FLASK, Arena Expert и собственным экспериментом по измерению креативности.

Коротко

  • Нет лучшей модели есть характеры. Gemini объясняет, Claude рассказывает, DeepSeek штампует дёшево, GPT строг и формален.
  • Рабочий пайплайн: дёшево генерим черновики (DeepSeek / Gemini Flash) → фильтруем → полируем на Claude Sonnet.
  • Для креатива thinking-модели не дают преимущества, а Claude лидирует в Problem Handling по FLASK.
  • Я проверил креативность числом: одна фраза в промпте поднимает разброс ответов почти вдвое.

Читать далее

Как вывести приложение в топ-1: разбор плейбука Cal AI

Наткнулся на пост кофаундера, который вёл маркетинг и операционку в Cal AI – счётчике калорий, доросшем до №1 в Health & Fitness за 18 месяцев. Внутри – рабочая механика инфлюенс-маркетинга. Как оценивать креаторов за 20 секунд, где на рынке спрятаны деньги, почему брифы всё портят.

Добавил свои заметки

плейбук Cal AI

Коротко

  • Узкое место любого consumer-приложения – дистрибуция, а не продукт.
  • Креатора видно за 20 секунд: просмотры, комментарии, дружил бы с ним?.
  • Деньги в средних креаторах. Верх и низ рынка переплачены.
  • Платите фикс, никогда за просмотр.
  • Вы покупаете аудиторию, а не блогера.
  • Минимальный бриф плюс автоматизация – и сотни партнёрств тянут четыре человека.
  • Единственный ров, который остался, – скорость.

Читать далее

Как llms.txt увеличил трафик с AI-чатов на 23%

Четыре месяца назад я добавил на блог файлы llms.txt и llms-full.txt. Пора посмотреть, что это дало в цифрах.

Коротко о llms.txt

Это robots.txt для языковых моделей. Файл в корне сайта помогает AI-системам — ChatGPT, Perplexity, Claude, Gemini — лучше понимать структуру и содержание контента. Подробнее писал в отдельном посте.

Методология

Сравнил два периода по 4 месяца:

ПериодДатыСтатус
До18 марта — 17 июля 2025без llms.txt
После18 июля — 18 ноября 2025с llms.txt

Источник — Яндекс.Метрика, отчёт «Переходы по ссылкам на сайтах».

Отфильтровал домены AI-чатов: chatgpt.com, perplexity.ai, chat.deepseek.com, gemini.google.com, chat.qwen.ai, copilot.microsoft.com, alice.yandex.ru.

Читать далее