RAG-engineers
Chunking, retrieval, citaties en fallbacks owned in de repo, geen chatbot-demo die alleen op één PDF werkt.
GenAI · RAG · Prompts · LLM-apps
Een GenAI-hire is niet «iemand die een ChatGPT-prompt plakte». iQud-engineers shippen RAG, prompt-systemen, chatbots en generatieve productslices die eval, retrieval-kwaliteit en kosten overleven, geen playground-demo die alleen op één PDF werkt.
«GenAI» is geen enkele job. We matchen op het productoppervlak dat u nodig hebt: dezelfde stacks achter iQuds live AI Development, Text Generation, Prompt Engineering en RAG Chatbots-pagina's.
Chunking, retrieval, citaties en fallbacks owned in de repo, geen chatbot-demo die alleen op één PDF werkt.
Templates, tools en eval als productwerk, zodat de promptwijziging van vorige week een test heeft, geen Slack-screenshot.
Guards, handoff en conversation state als owned werk, geen playground-thread die niemand na launch kan reproduceren.
Samenvatting, concept en rewrite met kosten- en kwaliteitschecks, geen onbegrensd «roep het model aan»-knop.
Offline checks, tracing en spend als productwerk, geen «we meten het later»-slide.
Een PyTorch-training loop, een detection bench, of een FastAPI-vloot zonder LLM wil nog steeds een andere hire. Dat zeggen we in het introgesprek in plaats van een GenAI-only-seat te forceren.
Elke tegel is een live iQud-technologie- of servicepagina. De strook eronder is de LLM-applicatiestack die deze engineers al shippen (OpenAI, LangChain, Hugging Face en de chatbottools eromheen), niet TensorFlow, OpenCV, of de volledige AI / ML-catalogus.
























Een GenAI-hire moet een retrieval-pad, een promptwijziging of een generatieve slice in uw repo shippen, niet twee maanden onboarding-theater terwijl de playground-thread een gerucht blijft.
RAG vs prompts vs chat vs samenvatting, databronnen, seniority, overlap-uren, en wat «klaar in 30 dagen» betekent in eval of een eerste productiepad.
We matchen beschikbare GenAI-specialisten op uw brief en delen relevant RAG-, prompt-systeem-, chatbot- of generatieve-featurewerk.
Ontmoet de persoon die in de standup komt. Valideer hoe ze praten over een retrieval miss, een kostenpiek, en de laatste prompt die ze écht owned hebben voorbij de playground.
Repo-toegang, model keys en eerste pull request, typisch binnen een week na het go.
De meeste klanten embedden eerst één GenAI-engineer. Een pair of surface-split alleen als het werk het écht nodig heeft.
Een GenAI-specialist komt in uw squad, volgt uw lead en werkt in uw rituelen.
Het beste voorEen LLM-productkloof sluiten zonder een nieuw vendorproces
Een stabiele owner voor RAG, het prompt-systeem of de chatbot, met senior review op de sprint.
Het beste voorEen product dat een genoemde generatieve owner nodig heeft
Een gedefinieerde snede: een eerste RAG-pad, een samenvattingsflow, of een chatbot met contracten die al in beweging zijn.
Het beste voorEen mijlpaal waar u naar kunt wijzen, geen open prompt-sandbox
Twee manieren om een GenAI-engineer te staffen. Uurlijks voor spikes en gedefinieerde tickets. Een dedicated maandseat als u elke dag iemand in de standup wilt, tegen een lager effectief tarief dan de klok te laten lopen.
€ 20/ uur
Flexibele GenAI-capaciteit voor featurespikes, evals en afgebakende tickets. U betaalt alleen gewerkte uren.
Beste waarde
€ 1.840/ maand
Een genoemde GenAI-engineer op uw sprint: ongeveer 160 uur dedicated LLM-productcapaciteit, met senior review in de cadans.
Een volle maand tegen € 20 is € 3.200. Deze seat is € 1.840.
Tarieven voor dedicated GenAI-engineers (RAG, prompt-systemen, chatbots, generatieve productfeatures). Seniority-mix en overlap worden bevestigd in het introgesprek. We quoteren geen stack die we niet al leveren.
Een middelmatige GenAI-ontwikkelaar maakt een playground-thread die op de laptop werkt. Deze engineers maken een feature die echt retrieval, echte eval en uw volgende release overleeft.
Ze leven in retrieval-kwaliteit, eval, en waarom de hallucinatie van vorige week kwam van een chunking-keuze die zijn eigen check had moeten owned hebben.
GIFT City-overlap met Europa en de VS. Outputreviews live wanneer uw leads online zijn.
Mid-level snelheid zonder onbewaakte promptschuld. Review is deel van de engagement, geen extra SKU.
We draaien geen draaiende bank. Capaciteit is beperkt zodat de engineer die u interviewt degene in de standup is.
Begin met één. De meeste klanten embedden een senior of mid-level GenAI-engineer, en voegen een pair toe als de RAG-, prompt- of chatbot-backlog het rechtvaardigt.
Alle vier wanneer het productwerk is. Een RAG-seat owned retrieval en citaties. Een prompt-seat owned templates, tools en eval. Een chatbot-seat owned conversation state en guards. Een generatie-seat owned samenvatting en concept met kostenchecks. We shortlisten alleen engineers op stacks die we al leveren.
Dat is een AI / ML-hire, of een Python-hire, niet deze LLM-applicatie-seat. Zeg het in het introgesprek. We forceren geen RAG-profiel op een training- of API-only-brief.
Nadat we de rol in kaart hebben gebracht en u de hire goedkeurt, landen eerste pull requests typisch binnen een week, sneller als repo, databronnen en model keys klaar zijn.
Ja. GitHub, Jira, uw CI, uw standups. We verzinnen geen parallel proces tenzij u erom vraagt.
Uurlijks (€ 20) is voor spikes en gedefinieerde tickets, u betaalt alleen gewerkte uren. De maandseat (€ 1.840) is een genoemde GenAI-engineer op uw sprint, ongeveer 160 uur dedicated capaciteit. Dezelfde maand uurlijks gefactureerd zou € 3.200 zijn. Seniority en overlap worden bevestigd in het introgesprek.

Zeg ons RAG vs prompts vs chat vs samenvatting, en het eerste dat u in productie wilt. We komen terug met een genoemd profiel, een startvenster en een tweewekenplan.