Эдуард М.
- Улучшение качества системы распознавания речи (ASR): исследование методов предобработки аудио и объединения транскрипций. Прирост +6% от базового решения; - Улучшение качества системы распознавания документов (OCR): тестирование моделей и методов предобработки, рефакторинг сервиса. Прирост +16% по извлекаемым полям; - Разработка и улучшение систем RAG: стратегии чанкирования, гибридный поиск (плотный + BM25), переранжирование и контекстный поиск; - Разработка LLM-агентов на базе LangChain и MCP-серверов (FastMCP): построение автономного трехэтапного процесса поиска, оценки, деплоя и бенчмаркинга LLM-моделей; - Развёртывание и эксплуатация нейронных сетей: vLLM, Triton Inference Server (Python backend); - Дообучение zero‑shot NLI‑классификатор спама: F1 > 95% на отложенной мультиязычной выборке; - Обучение классификатора для детекции фишинга на основе 45 признаков (поддомены, TLS/сертификаты...): F1 ≈ 95% на отложенном наборе. - Разработка Milter‑расширения для Postfix/Sendmail с интеграцией двух ML‑моделей в SMTP‑пайплайн для детекции спама и фишинга; - Ведение ML-экспериментов: постановка и проверка гипотез, трекинг и сравнение метрик в MLflow; - Разработка production-сервисов на FastAPI с асинхронной обработкой запросов; - Создание и поддержка CI/CD-пайплайнов с контейнеризацией (Docker, Docker Compose) для ускорения релизов и повышения надёжности приложений.
Понравился профиль? Создайте себе такой же