O tym stanowisku
Numery telefonów i adresy e-mail w tym ogłoszeniu są ukryte do momentu zalogowania.
auto_translated_note
Umowa na starszego oceniającego interakcję AI (Codex / Claude Code) | 50 - 200 USD/godz. | 10+ godzin/tydzień | Role oparte na projektach otwierane są w sposób ciągły - aplikuj, aby dołączyć do ławy talentów, a my skontaktujemy się z Tobą, gdy któryś z nich będzie pasować. Spodziewaj się ponad 40 godzin po rozpoczęciu projektu; termin zależy od dostępności, ale przenosimy ludzi do pracy przy najbliższej możliwej okazji. Te stanowiska są obecnie obsadzone, ale zatrudniamy na bieżąco w miarę otwierania się nowych projektów.
Złóż wniosek już teraz, aby dołączyć do naszej ławy talentów - skontaktujemy się bezpośrednio z wykwalifikowanymi kandydatami, gdy stanowiska staną się dostępne. Obejrzyj ten film Loom, aby uzyskać więcej szczegółów! Poszukujemy wysoce doświadczonego inżyniera oprogramowania (SR+), który pomoże ocenić jakość interakcji z nowoczesnymi agentami kodującymi, takimi jak OpenAI Codex i Claude Code.
Nie jest to tradycyjna rola inżyniera. Nie będziesz pisać kodu produkcyjnego. Będziesz oceniał coś trudniejszego: czy model myśli jak świetny inżynier.
Jaka właściwie jest ta rola Ocenisz, jak agenci kodujący AI zachowują się w rzeczywistych scenariuszach - koncentrując się na: - czy odpowiedź ma sens - czy preambuła i uzasadnienie są przydatne - czy dane wyjściowe odzwierciedlają solidną ocenę inżynierską - czy interakcja wydaje się odpowiednia dla doświadczonego programisty Ta rola dotyczy gustu inżynierskiego, a nie poprawności składni. Co będziesz robić - Oceń kompleksowo interakcje w kodowaniu generowane przez sztuczną inteligencję - Oceń, czy wyniki są: - Przydatne - Prawidłowe (na wysokim poziomie) - Zgodne z tym, jak pomyślałby silny inżynier - Oceń jakość wyjaśnień i rozumowania, a nie tylko kodu - Rozróżnij różne poziomy jakości odpowiedzi (np. co sprawia, że coś jest 2 na 4) - Przekaż jasną, opartą na opiniach informację zwrotną na temat: - Co zadziałało - Co nie - Jakie wrażenia „wyłączony” lub wprowadzający w błąd - Pomóż zdefiniować, jak świetnie wygląda podczas interakcji z narzędziami takimi jak Kursor. Co rozumiemy przez „smak” W szczególności poszukujemy inżynierów, którzy potrafią odpowiedzieć na pytania takie jak: - Czy wydaje Ci się, że faktycznie powiedziałby to silny inżynier? - Czy to wyjaśnienie jest pomocne, czy po prostu poprawne technicznie? - Czy model dobrze prowadzi użytkownika, czy po prostu zaniża wyniki? - Czy ta interakcja buduje, czy niszczy zaufanie?
Powinieneś czuć się komfortowo w dokonywaniu subiektywnych, ale rygorystycznych ocen. Kim jesteś - Personel/główny inżynier (lub równoważne doświadczenie) - Silne doświadczenie w jednym z poniższych: - TypeScript / JavaScript - Python - Praktyczne doświadczenie w używaniu: - OpenAI Codex - Claude Code - Kursor - Głęboka znajomość nowoczesnych przepływów pracy programistów wspomaganych sztuczną inteligencją - Możliwość oceny kodu bez konieczności pełnego wykonywania lub dogłębnego sprawdzania każdej linii - Komfort w przekazywaniu bezpośrednich, opiniotwórczych opinii - Wysoka poprzeczka określająca, jak wygląda „dobra inżynieria” Miło mieć - Doświadczenie z narzędziami takimi jak Cursor lub podobnymi IDE oparte na sztucznej inteligencji - Wcześniejszy kontakt z szybkimi procesami projektowania lub oceny - Doświadczenie w mentoringu dla starszych inżynierów lub definiowaniu standardów inżynieryjnych Szczegóły zaangażowania - USA i Kanada do 200 USD/godz. - UE i Latam do 150 USD/godz. - Inne lokalizacje do 100 USD/godz. - Godziny: ~10 - 20 godzin/tydz. https://remotejobs.org/remote-jobs/ai-interaction-evaluator-codex-claude-code-up-to-200hr-g2i
Pytania spolecznosci
Ktos tu pracowal? Zapytaj przed aplikacja.
Brak watkow dla tej oferty lub firmy.