O roli
W GrantBot.AI budujemy platformę, która automatyzuje pozyskiwanie dotacji i grantów. Szukamy AI/ML Engineera, który dołączy do 5-osobowego zespołu i będzie współtworzył architekturę modeli ML/NLP na unikalnych zbiorach danych - od scoringu wniosków, przez ekstrakcję informacji, po pełne pipeline'y RAG.
To rola dla osoby, która chce budować własną technologię, a nie kolejne wrappery na cudze API.
Twoje obowiązki
- Budowa modeli ML/NLP na danych z rynku dotacji (klasyfikacja, scoring, ekstrakcja, rekomendacje)
- Tworzenie i trenowanie modeli w PyTorch, HuggingFace i pokrewnych frameworkach
- Przygotowywanie zbiorów danych: czyszczenie, augmentacja, etykietowanie
- Projektowanie pipeline'ów ML do treningu, ewaluacji i iteracji
- Rozwój i optymalizacja istniejących pipeline'ów RAG
- Eksperymenty z fine-tuningiem LLM-ów i mniejszych modeli
- Integracja modeli z backendem (FastAPI, inference endpoints)
- Monitorowanie jakości modeli i wdrażanie pętli feedbackowych
- Współpraca przy architekturze AI i długofalowej strategii
Wymagania
- 3-5+ lat doświadczenia w Pythonie
- Praktyczne doświadczenie z ML/AI (nie tylko korzystanie z gotowych API)
- Biegłość w PyTorch lub TensorFlow
- Znajomość NLP: przetwarzanie tekstu, embeddingi, klasyfikacja, similarity
- Praca z danymi: preprocessing, feature engineering, zarządzanie datasetami
- Trenowanie i fine-tuning modeli
- Doświadczenie z API (FastAPI, Flask lub podobne)
- Samodzielność i ownership
Mile widziane
- HuggingFace (transformers, datasets)
- Fine-tuning LLM-ów (LoRA, PEFT)
- Doświadczenie z RAG (embeddingi, retrieval)
- Bazy wektorowe (MongoDB Atlas, Qdrant, Pinecone, Redis)
- GCP, Docker, CI/CD
- Produkcyjne systemy ML
Co oferujemy
- Środowisko startupu z szybkimi iteracjami i realnym wpływem na produkt
- Budowanie własnej technologii, nie wrapperów na API
- Praca hybrydowa preferowana w Trójmieście
- Duża autonomia w decyzjach technologicznych
- Realny wpływ na architekturę AI i kierunek rozwoju produktu
- Możliwość budowy custom modeli i własnego IP
- Bliska współpraca z founderami i zespołem
- Dostęp do unikalnych zbiorów danych (wnioski, scoring, walidacje)
- Tworzenie przewagi technologicznej i danych dla firmy
Stack
Python, PyTorch, TensorFlow, NLP, FastAPI, HuggingFace, RAG, vector databases, GCP, Docker.