AI Research Engineer
Tether | Anywhere in the World
Omschrijving
Hoofdkwartier: El Salvador URL: https://career.tether.io/ Waarom Join Us? Ons team is een wereldwijde talent powerhouse, werkt op afstand van elke hoek van de wereld. Als je gepassioneerd over het maken van een merk in de fintech ruimte, dit is uw kans om samen te werken met een aantal van de helderste geesten, het verleggen van grenzen en het vaststellen van nieuwe normen. We zijn gegroeid snel, bleef mager, en onze plaats als leider in de industrie veilig. Als u uitstekende Engelse communicatie vaardigheden hebt en klaar bent om bij te dragen aan de meest innovatieve platform op de planeet, Tether is de plek voor u. Ben je klaar om deel uit te maken van de toekomst? Over de baan Als lid van het AI modelteam, zal je innovatie stimuleren in versterking van leerbenaderingen voor geavanceerde modellen. Je werk zal de besluitvorming en adaptieve gedrag optimaliseren om betere intelligentie, verbeterde prestaties en domeinspecifieke mogelijkheden te bieden voor echte uitdagingen.
We verwachten dat u over een grondige expertise beschikt in het ontwerpen van versterkingsleersystemen en een sterke achtergrond in geavanceerde modelarchitecturen. U zult een hands-on, onderzoek-gedreven aanpak voor het ontwikkelen, testen en implementeren van nieuwe versterkingsleeralgoritmen en trainingskaders. Uw verantwoordelijkheden omvatten het cureren van gespecialiseerde simulatieomgevingen en trainingsdatasets, het versterken van de basisprestaties van het beleid, en het identificeren en oplossen van knelpunten in het versterkingsleerproces.Het uiteindelijke doel is om superieure, domein-aangepaste AI-prestaties te ontgrendelen en de grenzen te verleggen van wat deze modellen kunnen bereiken in dynamische, reële omgevingen. Verantwoordelijkheden ontwikkelen en implementeren state-of-the-art versterkingsleeralgoritmen ontworpen om besluitvormingsprocessen te optimaliseren in zowel gesimuleerde als real-world settings. Stel duidelijke prestatiedoelen vast, zoals beloningsmaximalisatie en beleidsstabiliteit. • Bouwen, uitvoeren en controleren van gecontroleerde versterkingsexperimenten.
• Systematisch debuggen en optimaliseren van de versterkingsleerpijplijn door zowel computationele efficiëntie als leerprestaties metrieken te analyseren.Bestuur problemen zoals beloningssignaalruis, exploratiestrategie en beleidsdivergentie om convergentie en stabiliteit te verbeteren. • Samenwerken met cross-functionele teams om versterking van leermiddelen in productiesystemen te integreren.Bepalen van duidelijke succesmetrics zoals verbeteringen van de prestaties in de reële wereld en robuustheid onder uiteenlopende omstandigheden en zorgen voor continue monitoring en iteratieve verfijningen voor duurzame domeinadaptatie.Bob requirements • A-grade in Computer Science of aanverwant veld. Ideaal gepromoveerd in NLP, Machine Learning, of een aanverwant veld, aangevuld met een solide track record in AI R&D (met goede publicaties in A* conferenties). • Bewezen ervaring met grootschalige versterkingsleerexperimenten, waaronder online RL technieken zoals Group Relative Policy Optimization (GRPO), is essentieel. Uw bijdragen moeten leiden tot meetbare verbeteringen in domeinspecifieke besluitvorming en algemene beleidsprestaties. • De versterkingsalgoritmes zijn vereist, waaronder state-of-the
• Sterke expertise in PyTorch en relevante versterkingsleerkaders is een must. Praktische ervaring in het ontwikkelen van RL-pijpleidingen, van simulatie en online training tot post-training evaluatie en het implementeren van RL-gebaseerde oplossingen in productieomgevingen wordt verwacht. • Gedemonstreerde capaciteit om empirisch onderzoek toe te passen om versterking van leeruitdagingen te overwinnen, zoals inefficiëntie van de steekproef, exploratie-exploitatie tradeoffs en training instabiliteit. Je moet bekwaam zijn in het ontwerpen van robuuste evaluatiekaders en itereren op algoritmische innovaties om voortdurend de grenzen van RL-agentprestaties te verleggen. Belangrijke informatie voor kandidaten Rekruteringsoplichtingen zijn steeds vaker gebruikelijk. Om jezelf te beschermen, houd je het volgende in gedachten bij het aanvragen van rollen: • Solliciteer alleen via onze officiële kanalen. We gebruiken geen platforms of agentschappen van derden voor rekrutering tenzij duidelijk vermeld. Alle open rollen worden vermeld op onze officiële carrièrepagina: https://tether.recruite.com/• Verif de identiteit van de recruite.
• Wij zullen nooit betaling of financiële gegevens. Als iemand vraagt om persoonlijke financiële informatie of betaling op enig punt tijdens het huren, het is een zwendel. Gelieve onmiddellijk melden. Om van toepassing te zijn: https://weworkremotely.com/remote-jobs/tether-ai-research-engineer
Functiedetails
Ervaring: 0 jaren
Gepost: 1 month, 2 weeks geleden
Weergaven: 241
Toepassen op We Work RemotelyGebrond van We Work Remotely · opent de oorspronkelijke posting.
Krijg een op maat gemaakte applicatie voor deze rol
Laat je CV vallen en we schrijven een cover brief gericht op deze exacte vermelding.. gratis, en klaar het moment dat uw account is gemaakt.
PDF, Word of tekst. We maken uw gratis account op het volgende scherm. Geen kaart.
Inhuren voor zo'n rol?
Plaats uw externe job op WFHJ en bereik de geselecteerde kandidaten. Geen kosten.
Plaats een baan gratis