Експерт/-ка зі штучного інтелекту (ШІ/Data Scientist)
Міжнародна благодійна організація «Фонд Східна Європа» в межах реалізації швейцарсько-української програми «Електронне урядування задля підзвітності влади та участі громади (EGAP)» оголошує конкурс на пошук експерта/-ки зі штучного інтелекту (ШІ / Data Scientist) для модернізації «Єдиної судової інформаційно-комунікаційної системи» (далі – ЄСІКС) та ІКС «Єдиний портал державних послуг Дія».
Програма EGAP, що реалізується Фондом Східна Європа та Фондом Innovabridge в партнерстві з Міністерством цифрової трансформації України та фінансується Швейцарською агенцією розвитку та співробітництва, спрямована на використання цифрових технологій задля вдосконалення якості врядування, покращення взаємодії влади, бізнесу та громадян і сприяння соціальним інноваціям в Україні.
Обсяг робіт і обов’язки експерта/-ки:
- Збір та деперсоналізація архівних відомостей справ про адміністративні правопорушення за 2022–2024 роки.
- Аналіз даних та сканованих матеріалів у справах про адміністративні правопорушення.
- Створення структурованих наборів даних на основі протоколів, матеріалів справ і судових рішень у справах про адміністративні правопорушення.
- Опис методології та технічні рішення щодо збору, оцифрування (OCR) та версійності даних (DVC), що гарантують відтворюваність для можливості подальшого масштабування модуля ШІ.
Вимоги до кваліфікації та бажані навички:
- Вища чи незавершена вища технічна освіта у сфері ІТ, телекомунікацій чи суміжній сфері.
- Досвід роботи в аналітиці та структуруванні даних – від 1 року.
- Досвід роботи з реляційними базами (SQL) для структуризації та вибірки даних.
- Навички роботи з конфіденційними даними (PII – Personally Identifiable Information).
- Знання методів деперсоналізації даних (маскування, псевдонімізації) для підготування «чистих» наборів даних без порушення конфіденційності.
- Уміння описувати схеми даних і датасети (Data Dictionary, Data Schema).
- Розуміння структури юридичних документів (постанов, протоколів, рішень суду), що значно пришвидшить навчання моделей на «правильних» полях.
- Робота з неструктурованими даними: досвід використання NLP-моделей (наприклад, BERT-based або LLM) для класифікації текстів або вилучення сутностей (NER – Named Entity Recognition) із судових рішень.
- Робота з архівами: досвід оцифрування паперових архівів або роботи з великими сховищами документів.
- Версійність даних: досвід роботи з DVC (Data Version Control) або аналогічними інструментами для відстеження змін у наборах даних.
Очікувані результати:
- Підготовлений масив даних: сформовано деперсоналізований та очищений набір архівних даних (справи про адміністративні правопорушення за 2022–2024 рр.), готовий до використання для навчання ШІ-моделей, із повним дотриманням вимог щодо захисту персональних даних (PII).
- Структурована база знань: розроблено та задокументовано архітектуру даних (Data Schema / Data Dictionary), що формалізує взаємозв’язки між електронними протоколами, матеріалами справ і судовими рішеннями, забезпечуючи їхню машиночитаність.
- Набір даних для моделей (Dataset Ready-to-Use): підготовлено розмічені та валідовані набори даних (навчальні / валідаційні вибірки), придатні для інтеграції з NLP-моделями та інструментами автоматичного вилучення сутностей (NER).
- Технічна документація пайплайнів: описано методологію та технічні рішення щодо збору, оцифрування (OCR) і версійності даних (DVC), що гарантують відтворюваність процесів для подальшого масштабування модуля ШІ.
Термін роботи: 2 місяці.
Формат роботи – змішаний (офлайн та онлайн).
Перевага надається кандидатам/-кам, які зможуть працювати у м. Києві.
Для участі в конкурсі просимо надіслати резюме та/або мотиваційний лист на адресу [email protected] з позначкою «ШІ/ Data Scientist ЄСІКС» до 26 липня 2026 року включно.
Фонд залишає за собою право контактувати лише з відібраними кандидатами.

