Przejdź do treści
Folkso
Połącz

Laboratorium · 29 września 2026

Jak sprawdzamy, czy na początku są właściwi ludzie

Siedmiu muzyków w naszej puli testowej gra na gitarze i śpiewa, a do tego produkuje. Każdy z siedmiu poradzi sobie z tą pracą.

Osoba, która szuka, pisze krótko i oczekuje dopracowanej pracy za pierwszym razem. Według tej miary najbliższy z siedmiu dostaje prawie dwa razy więcej punktów niż najdalszy.

Folkso musi postawić tę osobę blisko szczytu. Sprawdzamy to na 1000 wyszukiwań ze znaną z góry poprawną odpowiedzią, tym samym kodem, który odpowiada tobie w ChatGPT i Claude.

Co dostajesz

98%

Pierwsza osoba w wynikach poradzi sobie z twoim zadaniem.

96%

Jedna z trzech najlepiej dopasowanych do ciebie osób jest już w pierwszej trójce.

93%

Każda z pięciu osób w wynikach poradzi sobie z zadaniem.

99%

Jeśli pasująca osoba istnieje, Folkso ją pokaże.

Najlepiej dopasowana osoba pasuje i do zadania, i do sposobu pracy, który lubisz. Liczby pochodzą z 27 września 2026 i dotyczą 300 wyszukiwań, które nie brały udziału w dostrajaniu.

Jak do tego doszliśmy

Losowa kolejnośćPrzed 27 wrześniaTeraz

Pierwsza osoba poradzi sobie z zadaniem

Losowa kolejność
21,4%
Przed 27 września
78,5%
Teraz
98,1%

Najlepsze dopasowanie w pierwszej trójce

Losowa kolejność
11,3%
Przed 27 września
57,4%
Teraz
76,4%

Najlepsze dopasowanie na pierwszym miejscu

Losowa kolejność
4,6%
Przed 27 września
28,5%
Teraz
48,9%

Pasująca osoba zostaje pokazana

Przed 27 września
86,7%
Teraz
99,0%

Zmianę uznajemy za lepszą tylko wtedy, gdy wyprzedza starą wersję o ponad 5 punktów. To margines błędu przy 300 wyszukiwaniach.

Dlaczego możesz ufać tym liczbom

  • W puli testowej jest 100 fikcyjnych osób i 250 fikcyjnych osób szukających. Każda zaczyna od ukrytej karty z zajęciem, miastem, charakterem, wartościami i gustami.
  • W każdej niszy są bliźniaki. Pięć lub więcej osób z takimi samymi umiejętnościami i różnymi charakterami, więc wyszukiwanie musi patrzeć dalej niż nazwa zawodu.
  • Profile i 1000 wyszukiwań napisały modele językowe. To takie same wyszukiwania, jakie ChatGPT i Claude wysyłają do Folkso.
  • Poprawna odpowiedź wynika z ukrytych kart i uwzględnia tylko to, co czytelnik widzi w profilu.
  • 700 wyszukiwań służy do dostrajania wag. Pozostałe 300 odkładamy na bok, a wszystkie liczby na tej stronie pochodzą z nich.
  • Każdy przebieg jest zapisany z datą, kodem i wynikami.

Jak przebiega twoje wyszukiwanie

  1. Filtry. Tylko osoby otwarte na to, czego potrzebujesz, z budżetem w twojej walucie i jednostce, w twoim mieście, gdy to ma znaczenie. Nazwy miast działają w każdym języku.
  2. Znaczenie. Folkso porównuje twoje zadanie z każdym profilem pod względem znaczenia i słów, a potem zostawia 50 najbliższych.
  3. Czytanie. Model czyta te 50 profili w całości, bez kontaktów. Czy osoba poradzi sobie z zadaniem? Czy sama szuka takiej samej roli? Jak bardzo jest ci bliska? Co macie wspólnego?
  4. Drugie spojrzenie. Pierwsza szóstka jest czytana jeszcze raz, po jednej osobie. Do ciebie docierają tylko te osoby, które przejdą.
  5. Nikt nie pasuje. Folkso rozluźnia miękkie warunki i mówi, co się zmieniło. Jeśli nadal nikogo nie ma, powie ci o tym wprost.

Twoje kontakty i kontakty tych osób nigdy nie trafiają do modelu.

Co jeszcze mierzyliśmy

  • Założyciele nie przeszkadzają. Założyciel, który potrzebuje programisty React, nie pojawia się, gdy ty szukasz programisty React. Z modelem zdarzyło się to 0 razy w 565 wyszukiwaniach.
  • Każdy język. Profil napisany w innym języku jest znajdowany prawie tak samo dobrze. Najlepsze dopasowanie na pierwszym miejscu daje 47,2% wobec 50,3% w tym samym języku.
  • Szybkość. Czytanie i drugie spojrzenie dodają 0,7 sekundy w medianie.
  • Rozrzut. Dwa identyczne przebiegi modelu trochę się różnią, dlatego mniejszych różnic nie liczymy.

Co nie zadziałało

Publikujemy też porażki. Każdy z tych pomysłów wyglądał obiecująco i przegrał na odłożonych wyszukiwaniach.

PomysłCo się stało
Czytanie wszystkich 50 profili w jednym wywołaniu18% wyszukiwań kończyło się błędem i szło bez modelu
Cechy charakteru jako sztywne etykiety+3 punkty, w granicach marginesu błędu
Opisywanie modelowi charakteru słowaminajlepsze dopasowanie na pierwszym miejscu spadło z 49% do 45%
Dobieranie wag na siatce+8 punktów przy dostrajaniu, +2 na odłożonych wyszukiwaniach
Wybór z dziesięciu osób przez twoje AIod +1,5 do +2,3 punktu

Gdzie test się kończy

Osoby w teście są fikcyjne. Prawdziwe profile są krótsze i bardziej niechlujne, z literówkami i dwoma językami w jednym tekście.

To, czy dwie osoby dobrze się dogadają, widać w ich pierwszej rozmowie. Dlatego ostateczny wybór zostaje przy tobie.

Dalej przyjdą wyniki z prawdziwego użycia. Zaakceptowane zapytania i „to nie ta osoba” z podanym powodem jeszcze dokładniej ustawią kolejność.

Folkso jest bezpłatne. Połącz je raz, a gdy zadanie będzie wymagać człowieka, twoje AI znajdzie kogoś prosto w rozmowie.