Ekspert ds. bezpieczeństwa AI Jailbreak i szybkiego wstrzykiwania
United Kingdom
£50 - £90 / za rok
O tym stanowisku
Numery telefonów i adresy e-mail w tym ogłoszeniu są ukryte do momentu zalogowania.
auto_translated_note
Nazwa roli: Ekspert ds. bezpieczeństwa AI Jailbreak i Prompt-Injection Typ roli: WykonawcaLokalizacja: Remotemicro1 angażuje ekspertów ds. zabezpieczeń AI Jailbreak i Prompt-Injection, aby wnieśli wkład w najnowocześniejszą inicjatywę klienta skupiającą się na bezpieczeństwie i niezawodności sztucznej inteligencji. Na tym stanowisku wykorzystasz swoją wiedzę, aby pomóc w szkoleniu systemów sztucznej inteligencji nowej generacji. Twoja praca wpłynie na sposób, w jaki modele uczą się, rozumują i działają dzięki wysokiej jakości wkładom ze świata rzeczywistego.
Nie jest wymagane żadne wcześniejsze doświadczenie w sztucznej inteligencji - liczy się Twoja wiedza domenowa.Zakres prac Projektowanie i wdrażanie zaawansowanych metodologii oceny bezpieczeństwa systemu AI, koncentrując się na etycznych jailbreakach, łączeniu czerwonych zespołów LLM, natychmiastowym wstrzykiwaniu i scenariuszach nadużyć w użyciu narzędzi. Twórz kompleksowe strategie pozyskiwania danych między domenami, aby odkrywać wieloobrotowe i złożone wzorce obejścia kontradyktoryjnego w modelach sztucznej inteligencji. Twórz, utrzymuj i aktualizuj zestawy testów regresyjnych, które systematycznie testują podatność na jailbreak i luki w zabezpieczeniach umożliwiające natychmiastowe wstrzyknięcie.
Twórz solidne ramy oceny, które poddadzą testom obciążeniowym modele sztucznej inteligencji pod kątem rzeczywistych zagrożeń kontradyktoryjnych, mając na celu zwiększenie ogólnej odporności systemu. Współpracuj z zainteresowanymi stronami technicznymi, aby przełożyć ustalenia dotyczące bezpieczeństwa na praktyczne ulepszenia w zakresie bezpieczeństwa modeli i ograniczania ryzyka. Dokumentuj metodologie, ustalenia i najlepsze praktyki w jasnych, dobrze ustrukturyzowanych pisemnych raportach i prezentacjach, zarówno dla odbiorców technicznych, jak i nietechnicznych.
Preferowane kwalifikacje Ponad 2 lata doświadczenia w kontradyktoryjnym uczeniu maszynowym, łączeniu LLM red teaming, ocenie bezpieczeństwa AI lub ściśle powiązanej dziedzinie bezpieczeństwa Udokumentowane doświadczenie w badaniu, testowaniu lub odkrywaniu luk w zabezpieczeniach związanych z etycznymi jailbreakami, natychmiastowym wstrzykiwaniem, nadużyciami w użyciu narzędzi lub kontradyktoryjnymi atakami AI. Zaawansowany stopień naukowy (doktorat, MS) w dziedzinie informatyki, cyberbezpieczeństwa, uczenia maszynowego lub odpowiedniej dyscypliny, lub równoważne doświadczenie operacyjne/zawodowe. Wysoka wiarygodność i uznanie w środowisku zajmującym się bezpieczeństwem sztucznej inteligencji lub wrogim uczeniem się (ML) - na przykład w opublikowanych badaniach, narzędziach typu open source lub prezentacjach konferencyjnych.
Wyjątkowe umiejętności komunikacji pisemnej i werbalnej, ze szczególnym naciskiem na przejrzystą dokumentację i wspólne rozwiązywanie problemów. Dodatkowym atutem będzie wcześniejsze uczestnictwo w projektach wielodyscyplinarnych lub interdyscyplinarnych inicjatywach w zakresie bezpieczeństwa związanych ze sztuczną inteligencją. Bardzo pożądana jest znajomość aktualnych architektur LLM, szybkich technik inżynieryjnych i narzędzi oceny bezpieczeństwa.
Pierwotnie opublikowany w Himalajach
Pytania spolecznosci
Ktos tu pracowal? Zapytaj przed aplikacja.
Brak watkow dla tej oferty lub firmy.