Laboratorium · 29 września 2026
Jak sprawdzamy, czy na początku są właściwi ludzie
Siedmiu muzyków w naszej puli testowej gra na gitarze i śpiewa, a do tego produkuje. Każdy z siedmiu poradzi sobie z tą pracą.
Osoba, która szuka, pisze krótko i oczekuje dopracowanej pracy za pierwszym razem. Według tej miary najbliższy z siedmiu dostaje prawie dwa razy więcej punktów niż najdalszy.
Folkso musi postawić tę osobę blisko szczytu. Sprawdzamy to na 1000 wyszukiwań ze znaną z góry poprawną odpowiedzią, tym samym kodem, który odpowiada tobie w ChatGPT i Claude.
Co dostajesz
98%
Pierwsza osoba w wynikach poradzi sobie z twoim zadaniem.
96%
Jedna z trzech najlepiej dopasowanych do ciebie osób jest już w pierwszej trójce.
93%
Każda z pięciu osób w wynikach poradzi sobie z zadaniem.
99%
Jeśli pasująca osoba istnieje, Folkso ją pokaże.
Najlepiej dopasowana osoba pasuje i do zadania, i do sposobu pracy, który lubisz. Liczby pochodzą z 27 września 2026 i dotyczą 300 wyszukiwań, które nie brały udziału w dostrajaniu.
Jak do tego doszliśmy
Pierwsza osoba poradzi sobie z zadaniem
- Losowa kolejność
- 21,4%
- Przed 27 września
- 78,5%
- Teraz
- 98,1%
Najlepsze dopasowanie w pierwszej trójce
- Losowa kolejność
- 11,3%
- Przed 27 września
- 57,4%
- Teraz
- 76,4%
Najlepsze dopasowanie na pierwszym miejscu
- Losowa kolejność
- 4,6%
- Przed 27 września
- 28,5%
- Teraz
- 48,9%
Pasująca osoba zostaje pokazana
- Przed 27 września
- 86,7%
- Teraz
- 99,0%
Zmianę uznajemy za lepszą tylko wtedy, gdy wyprzedza starą wersję o ponad 5 punktów. To margines błędu przy 300 wyszukiwaniach.
Dlaczego możesz ufać tym liczbom
- W puli testowej jest 100 fikcyjnych osób i 250 fikcyjnych osób szukających. Każda zaczyna od ukrytej karty z zajęciem, miastem, charakterem, wartościami i gustami.
- W każdej niszy są bliźniaki. Pięć lub więcej osób z takimi samymi umiejętnościami i różnymi charakterami, więc wyszukiwanie musi patrzeć dalej niż nazwa zawodu.
- Profile i 1000 wyszukiwań napisały modele językowe. To takie same wyszukiwania, jakie ChatGPT i Claude wysyłają do Folkso.
- Poprawna odpowiedź wynika z ukrytych kart i uwzględnia tylko to, co czytelnik widzi w profilu.
- 700 wyszukiwań służy do dostrajania wag. Pozostałe 300 odkładamy na bok, a wszystkie liczby na tej stronie pochodzą z nich.
- Każdy przebieg jest zapisany z datą, kodem i wynikami.
Jak przebiega twoje wyszukiwanie
- Filtry. Tylko osoby otwarte na to, czego potrzebujesz, z budżetem w twojej walucie i jednostce, w twoim mieście, gdy to ma znaczenie. Nazwy miast działają w każdym języku.
- Znaczenie. Folkso porównuje twoje zadanie z każdym profilem pod względem znaczenia i słów, a potem zostawia 50 najbliższych.
- Czytanie. Model czyta te 50 profili w całości, bez kontaktów. Czy osoba poradzi sobie z zadaniem? Czy sama szuka takiej samej roli? Jak bardzo jest ci bliska? Co macie wspólnego?
- Drugie spojrzenie. Pierwsza szóstka jest czytana jeszcze raz, po jednej osobie. Do ciebie docierają tylko te osoby, które przejdą.
- Nikt nie pasuje. Folkso rozluźnia miękkie warunki i mówi, co się zmieniło. Jeśli nadal nikogo nie ma, powie ci o tym wprost.
Twoje kontakty i kontakty tych osób nigdy nie trafiają do modelu.
Co jeszcze mierzyliśmy
- Założyciele nie przeszkadzają. Założyciel, który potrzebuje programisty React, nie pojawia się, gdy ty szukasz programisty React. Z modelem zdarzyło się to 0 razy w 565 wyszukiwaniach.
- Każdy język. Profil napisany w innym języku jest znajdowany prawie tak samo dobrze. Najlepsze dopasowanie na pierwszym miejscu daje 47,2% wobec 50,3% w tym samym języku.
- Szybkość. Czytanie i drugie spojrzenie dodają 0,7 sekundy w medianie.
- Rozrzut. Dwa identyczne przebiegi modelu trochę się różnią, dlatego mniejszych różnic nie liczymy.
Co nie zadziałało
Publikujemy też porażki. Każdy z tych pomysłów wyglądał obiecująco i przegrał na odłożonych wyszukiwaniach.
| Pomysł | Co się stało |
|---|---|
| Czytanie wszystkich 50 profili w jednym wywołaniu | 18% wyszukiwań kończyło się błędem i szło bez modelu |
| Cechy charakteru jako sztywne etykiety | +3 punkty, w granicach marginesu błędu |
| Opisywanie modelowi charakteru słowami | najlepsze dopasowanie na pierwszym miejscu spadło z 49% do 45% |
| Dobieranie wag na siatce | +8 punktów przy dostrajaniu, +2 na odłożonych wyszukiwaniach |
| Wybór z dziesięciu osób przez twoje AI | od +1,5 do +2,3 punktu |
Gdzie test się kończy
Osoby w teście są fikcyjne. Prawdziwe profile są krótsze i bardziej niechlujne, z literówkami i dwoma językami w jednym tekście.
To, czy dwie osoby dobrze się dogadają, widać w ich pierwszej rozmowie. Dlatego ostateczny wybór zostaje przy tobie.
Dalej przyjdą wyniki z prawdziwego użycia. Zaakceptowane zapytania i „to nie ta osoba” z podanym powodem jeszcze dokładniej ustawią kolejność.
Folkso jest bezpłatne. Połącz je raz, a gdy zadanie będzie wymagać człowieka, twoje AI znajdzie kogoś prosto w rozmowie.