O tym stanowisku
Numery telefonów i adresy e-mail w tym ogłoszeniu są ukryte do momentu zalogowania.
auto_translated_note
<h2><strong>O laboratoriach Black Forest Labs</strong></h2> <p>Jesteśmy zespołem odpowiedzialnym za Latent Diffusion, Stable Diffusion i FLUX - podstawowe technologie, które zmieniły sposób, w jaki świat tworzy obrazy i wideo. Nasze modele obsługują narzędzia używane przez miliony twórców, programistów i firm na całym świecie, a FLUX jest jednym z najbardziej zaawansowanych systemów generatywnych na świecie.</p> <p>Z siedzibą we Freiburgu w Niemczech i rosnącą obecnością w San Francisco, szybko się rozwijamy, pozostając wiernym temu, co nas wyróżnia: doskonałości badawczej, otwartej nauce i technologii budowlanej, która rozwija ludzką kreatywność.</p> <h2><strong>Dlaczego ta rola</strong></h2> <p>Po szkoleniu podstawowy model staje się produktem. Na tym stanowisku będziesz odpowiedzialny za cały proces poszkoleniowy w zakresie naszych modeli multimodalnych - od strategii danych i modelowania nagród po optymalizację preferencji, destylację i dostrajanie bezpieczeństwa - w zakresie obrazu, edycji i wideo.
Osiągniesz wymierny wzrost jakości modelu, zbudujesz infrastrukturę, która pozwoli całemu zespołowi badawczemu na szybką iterację, i będziesz wprowadzać najnowocześniejsze rozwiązania w zakresie dostosowywania modelu generatywnego do ludzkich intencji.</p> <p>To jest rola personelu/starszego IC. Szukamy kogoś, kto już organizował szkolenia poszkoleniowe dla modelu pionierskiego i chce to zrobić ponownie.</p> <h2><strong>Nad czym będziesz pracować</strong></h2> <ul> <li>Jesteś właścicielem pełnego procesu poszkoleniowego od początku do końca - od sprawdzania danych i modelowania nagród, poprzez dostrajanie, optymalizację preferencji, destylację, dostrajanie bezpieczeństwa, ocenę i wdrażanie</li> <li>Udoskonalanie technik w całym stosie poszkoleniowym: SFT, RLHF, RLAIF, DPO, uczenie się preferencji i modelowanie nagród w celu dostosowania modeli do ludzkich intencji i oceny estetycznej</li> <li>Praca w różnych modalnościach: zamiana tekstu na obraz, edycja obrazu, wielokrotne odniesienia i wideo po szkoleniu</li> <li>Tworzenie możliwości personalizacji i dostosowywania, które pozwalają użytkownikom dostosowywać nasze modele do własnego stylu twórczego</li> <li>Projektuj i utrzymuj wysokoprzepustową infrastrukturę do dostrajania i oceny, aby wspierać szybkie iteracje w całym zespole badawczym</li> <li>Zidentyfikuj luki w jakości i dostosowaniu poprzez rygorystyczną ocenę, a następnie uzupełnij je poprzez ukierunkowane badania i inżynierię.</li> </ul> <p> </p> <h2><strong>Czego szukamy</strong></h2> <ul> <li>Masz za sobą szkolenie po szkoleniu w zakresie pionierskiego modelu generatywnego aż do wydania (SFT, optymalizacja preferencji (DPO lub RLHF), destylacja, dostrajanie bezpieczeństwa) z wymiernymi korzyściami jakościowymi w zakresie ludzkich preferencji lub standardów testy porównawcze</li> <li>Głębokie doświadczenie w całym stosie poszkoleniowym, a nie tylko w jednym wycinku: modelowanie nagród, uczenie się preferencji, RLHF/RLAIF i personalizacja</li> <li>Wygodna praca w różnych modalnościach: zamiana tekstu na obraz, edycja obrazu, wiele odniesień i najlepiej wideo</li> <li>Silna płynność PyTorch; piszesz kod badawczy, na którym inni mogą budować</li> <li>Doświadczenie w destylacji (LADD, DMD, modele spójności lub podobne) lub w budowaniu wysokoprzepustowych potoków ewaluacyjnych to duży plus</li> <li>Nastawienie na wysyłkę: mierzalne ulepszenia jakości modelu, które docierają do użytkowników, a nie tylko do artykułów</li> </ul> <p> </p> <h2><strong>Jak współpracujemy</strong></h2> <p>Jesteśmy rozproszonym zespołem z prawdziwe biura, z których ludzie faktycznie korzystają. W zależności od Twojej roli możesz dołączyć do nas we Fryburgu lub San Francisco co najmniej 2 dni w tygodniu (lub jeden pełny tydzień co drugi tydzień) albo pracować zdalnie, co miesiąc spotykając się osobiście, aby pozostać w kontakcie.
Aby było to możliwe, pokryjemy rozsądne koszty podróży. Uważamy, że czas spędzony osobiście ma znaczenie i zorganizowaliśmy wszystko tak, aby był dostępny dla wszystkich. Jak to będzie wyglądać w przypadku tej roli, omówimy podczas naszej rozmowy kwalifikacyjnej.</p> <p><strong>Wszystko, co robimy, opiera się na czterech wartościach:</strong></p> <ul> <li><strong>Obsesja.</strong> Jesteśmy pionierskim laboratorium badawczym.
Nauka musi być prawidłowa, zrozumienie głębokie, produkt piękny.</li> <li><strong>Niskie ego.</strong> Praca przemawia. Najlepszy pomysł wygrywa, niezależnie od tego, kto go powiedział. Kredyt jest wspólny.
Nikt nie stoi ponad żadnym zadaniem.</li> <li><strong>Odważne.</strong> Stawiamy na ambitne założenie. Wysyłamy, nie czekamy, aż warunki będą idealne.</li> <li><strong>Miło.</strong> Ludzie ponad polityką. Traktujemy siebie nawzajem z prawdziwym ciepłem.
Agencja bez empatii tworzy chaos.</li> </ul> <p>Jeśli brzmi to jak praca, która sprawi Ci przyjemność, chętnie wysłuchamy Twojej opinii.</p> <p><strong>Podstawowe wynagrodzenie roczne:</strong></p> <p><span data-sheets-root="1"><strong>UE</strong> 130 000 - 340 000 EUR + kapitał własny</span></p>Znajdź pracę w Niemczech na Arbeitnow
Pytania spolecznosci
Ktos tu pracowal? Zapytaj przed aplikacja.
Brak watkow dla tej oferty lub firmy.