Обновить
16K+
3
Евгений Игнатьев@eignatiev

Программирую ИИ-агентов для бизнеса

24,1
Рейтинг
3
Подписчики
Отправить сообщение

Перевёз ИИ-агентов на российский сервер. Оказалось, полмира с ним разговаривать не хочет

Уровень сложностиСредний
Время на прочтение8 мин
Охват и читатели10K

Перевёз ИИ-агентов с зарубежного PaaS на московский VPS. Сам переезд занял день, разгребание последствий — неделю. В статье: что отваливается при переезде в Россию (реестр контейнеров, geoip, дампы баз), почему вебхуки Telegram не доходят до российского сервера и как я это доказал экспериментом с контролем, почему картинки для постов не забираются с двух независимых российских хостингов, и как устроена маскировка персональных данных перед отправкой в модель — с граблями, которые стоили времени.

Читать далее

OpenAI Realtime против Яндекс Realtime: сравнил два голосовых движка для России и за вечер пересадил свой прод

Уровень сложностиСредний
Время на прочтение7 мин
Охват и читатели11K

6 июля OpenAI выпустил gpt-realtime — движок «речь в речь», который говорит как человек и держит перебивание. Я делаю голосового ИИ-приёмщика для бизнеса на российском стеке и занервничал: не устарел ли мой подход?

За вечер собрал прототип на OpenAI, откопал, что у Яндекса есть свой Realtime, и замерил задержку у всех трёх подходов одним методом. Цифры честные, с оговоркой про VPN: Яндекс Realtime ~330 мс, OpenAI ~740 мс (под VPN — иначе в РФ никак), старая трёхзвенка ~4,4 секунды.

В статье — грабли обоих движков (400-й эндпоинт у OpenAI, три роли доступа и закрытый обмен OAuth→IAM у Яндекса), почему у OpenAI не лечится акцент в русском, и как я за вечер переписал свой прод на Яндекс Realtime: WebSocket-мост, живой PCM-плеер вместо MP3, перебивание без наушников. С кодом и реальными замерами.

Читать далее

Делюсь опытом: ИИ-агент на Claude без LangChain и RAG — разбор архитектуры и развилок

Уровень сложностиСредний
Время на прочтение14 мин
Охват и читатели7.2K

Делюсь опытом: собрал прод-агента на Claude для небольшой студии дизайна интерьера. Чат отвечает на Haiku 4.5, генератор концепций — на Sonnet 4.6, фото из Pexels вместо DALL-E. Без LangChain, без векторной базы, без RAG-фреймворка. Один файл main.py на 712 строк, два промпта. В статье разбираю развилки: почему именно так, на каких граблях постоял (порог кэша 4096 у Haiku, парсинг JSON-обёртки от Sonnet), где этот подход начнёт ломаться. Не «гайд от эксперта» — скорее дневник развилок.

Читать далее

Информация

В рейтинге
378-й
Откуда
Москва, Москва и Московская обл., Россия
Зарегистрирован
Активность

Специализация

Генеральный директор, Промпт-инженер
Ведущий
Управление проектами
Управление людьми
Английский язык
Python