Metaskills
BADANIA · DIGITAL TWIN · RAMY PROJEKTOWE

Prywatność, stronniczość i ludzki czynnik

Kiedy sztuczna inteligencja analizuje, w jaki sposób dana osoba poradziła sobie z trudną rozmową, decyzje projektowe związane z tą analizą mają równie duże znaczenie, co sama analiza. Na tej stronie opisano ramy, na których opiera się narzędzie Digital Twin: jakie dane może uwzględniać narzędzie oceniające, w jaki sposób przeciwdziała się znanym tendencyjnościom oraz w jakich momentach w procesie tym bierze udział człowiek.

Metaskills ramy projektowe, 2026

MetodykaMetaskillsOpis metodykiStruktura projektowa - informacje na temat tego, co obecnie działa w środowisku produkcyjnym, można znaleźć na stronie poświęconej bezpieczeństwu

Czym jest ta strona, a czym nie jest

Na tej stronie opisano ramy projektowe: zasady i ograniczenia, zgodnie z którymi tworzony jest system Digital Twin. Nie jest to opis systemu produkcyjnego i nie należy go tak traktować. Jeśli chcesz dowiedzieć się, co obecnie działa - gdzie znajdują się dane, kto ma do nich dostęp, co przewidują umowy - zajrzyj na stronę poświęconą bezpieczeństwu; jest to jedyna strona, którą traktujemy jako wiarygodne źródło informacji o aktualnym stanie rzeczy. Chodzi właśnie o to, by rozróżniać te dwie rzeczy: zasada projektowa a wdrożony mechanizm kontroli to dwie różne rzeczy, a ich zacieranie prowadzi do sytuacji, w której dostawcy obiecują infrastrukturę, której w rzeczywistości nie posiadają.

Cztery zasady, na których opiera się ocena

1

Ogranicz zakres tego, co widzi model

Moduł oceny potrzebuje treści rozmowy, a nie tożsamości osoby, która ją prowadziła. Zgodnie z zasadą projektową dane umożliwiające identyfikację są usuwane z danych przekazywanych do modelu, pozostawiając zanonimizowany opis zachowań.

2

Należy oddzielić tożsamość od analiz

Informacje o tym, kim jest dana osoba, oraz o jej profilu kompetencji są przechowywane w oddzielnych miejscach, połączonych odnośnikiem, a nie razem. Jedno naruszenie bezpieczeństwa nie powinno umożliwić uzyskania obu tych części.

3

Z założenia bez danych biometrycznych

Rozwiązanie to wyklucza identyfikację biometryczną i profilowanie biometryczne, a wraz z nimi śledzenie ruchu gałek ocznych, analizę mikroekspresji twarzy oraz nagrania z kamer w zestawie słuchawkowym: ocena opiera się na tym, co zostało powiedziane, a nie na osobie, która to powiedziała. Co to oznacza dla produktu w jego obecnym kształcie, można przeczytać na stronie poświęconej bezpieczeństwu - jest to jedyne miejsce, w którym zamieściliśmy tę odpowiedź.

4

Wyłącznie do celów formatywnych

Narzędzie Digital Twin zostało zaprojektowane jako narzędzie rozwojowe. Nie służy ono jako podstawa decyzji dotyczących zatrudnienia, awansu ani sankcji dyscyplinarnych, a cała logika oceny - zachowanie w kontekście, deklarowany poziom pewności siebie, brak diagnozy osobowości - wynika właśnie z tego założenia.

Pytania, które pojawiają się jeszcze przed tym wszystkim

Na tej stronie najczęściej zadaje się dwa pytania: czy dane klientów są wykorzystywane do szkolenia modeli oraz gdzie faktycznie są one przechowywane. Odpowiedzi na oba pytania znajdują się na stronie poświęconej bezpieczeństwu i celowo nie powtarzamy ich tutaj. Zobowiązanie zapisane w dwóch miejscach, w czterech językach, to zobowiązanie, które ostatecznie będzie zawierało dwie różne treści - dlatego istnieje jedna strona, na której są one zawarte, oraz jedna strona, którą należy aktualizować w razie zmian. Opisane tutaj ramy dotyczą sposobu działania procesu oceny. Nie zastępują one dokumentacji technicznej ani umownej, a w przypadku rozbieżności między nimi pierwszeństwo ma strona poświęcona bezpieczeństwu.

Cztery rodzaje stronniczości, którym staramy się zapobiegać w naszych projektach

Tendencja do elokwencji

Modele językowe faworyzują osoby mówiące płynnie. Osoba, która się jąka, posługuje się językiem obcym lub mówi potocznym językiem, może zostać obniżona w ocenie raczej za sposób wypowiedzi niż za samą treść.

Płeć a uprzedzenia wynikające ze stereotypów

Ta sama stanowczość była odbierana jako zdecydowana w przypadku jednego mówcy, a jako drażniąca w przypadku innego. Dane szkoleniowe zawierają te wzorce; silnik oceniający będzie je odtwarzał, o ile nie zostanie temu zapobieżono.

Uprzedzenia kulturowe

Normy komunikacyjne różnią się między sobą. Model wyszkolony głównie na podstawie komunikacji bezpośredniej, o niskim poziomie kontekstu, będzie systematycznie niedoceniać osoby, których kultura zawodowa opiera się na komunikacji bardziej pośredniej.

Halucynacja oceniająca

Sposób niepowodzenia charakterystyczny dla tego zastosowania: pewna siebie, dobrze sformułowana ocena czegoś, co w ogóle nie miało miejsca w rozmowie.

Środek zaradczy, który wykonuje większość pracy

Każdemu z tych uprzedzeń przeciwdziała się w ten sam sposób: ocena opiera się na tym, co zostało powiedziane, a nie na tym, jak to brzmiało ani na tym, kto wydawał się to mówić. Silnik otrzymuje polecenie, by ignorować imiona, zaimki i cechy demograficzne, jeśli się pojawią, oraz by nie zwracać uwagi na błędy gramatyczne, zawahania i kolokwializmy, skupiając się na intencji leżącej u ich podstaw. Jest to rozwiązanie projektowe mające na celu przeciwdziałanie uprzedzeniom związanym z elokwencją i stereotypami. W przypadku halucynacji zasada jest bardziej rygorystyczna. Ocena musi zawierać dokładny cytat z transkrypcji, który ją uzasadnia. Jeśli cytatu nie ma, ocena zostaje odrzucona, a nie zgłoszona - twierdzenie dotyczące czyjegoś zachowania, za którym nie stoi żaden cytat, nie jest ustaleniem, lecz domysłem sformułowanym poprawnie gramatycznie. Żadne z tych rozwiązań nie eliminuje stronniczości. Usuwa jednak najłatwiejsze drogi do niej i uwidacznia pozostałe, dlatego badanie walidacyjne jest przeprowadzane w oparciu o ocenę ludzkich ekspertów, a nie w oparciu o nasze własne oczekiwania.

Gdy człowiek pozostaje w pętli

Model oceny pozostawiony samemu sobie ulega dryfowi. Kryteria ulegają rozluźnieniu, to samo zachowanie otrzymuje inną ocenę w marcu niż w styczniu, a nikt tego nie zauważa, ponieważ nie ma punktu odniesienia. Ramy te rozwiązują ten problem poprzez monitorowanie z udziałem człowieka: przeszkoleni oceniający zachowania przeglądają anonimowe próbki transkrypcji w trybie ślepym i porównują swoje oceny z wynikami wygenerowanymi przez system. W przypadku rozbieżności kryteria są ponownie kalibrowane. To właśnie to porównanie stanowi sedno badania walidacyjnego, prowadzonego jako ciągła kontrola, a nie jednorazowa procedura. Uczestnik szkolenia może również poprosić o weryfikację przez człowieka informacji zwrotnej, z którą się nie zgadza. Zautomatyzowana informacja zwrotna, której nie można poddać w wątpliwość, nie jest informacją zwrotną - jest wyrokiem, a ten system nie został zaprojektowany do wydawania wyroków.

Źródło

Metaskills

2026-08-24

Ramy projektowe opracowane przez Metaskills. Opisują one zasady, zgodnie z którymi zbudowano serwis Digital Twin, a nie aktualny stan systemu produkcyjnego - w tej sprawie zapoznaj się ze stroną poświęconą bezpieczeństwu.

Powiązane strony

Bezpieczeństwo

Bezpieczeństwo i ochrona danych

Co obecnie działa w środowisku produkcyjnym: gdzie przechowywane są dane, kto ma do nich dostęp oraz co obejmują umowy.

Bezpieczeństwo i ochrona danych
Metodologia

W jaki sposób zachowanie staje się dowodem

Logika oceny, którą te zasady określają - zdarzenia dowodowe, poziom pewności oraz ograniczenia wnioskowania.

W jaki sposób zachowanie staje się dowodem
Badania

Badania i dane naukowe

Wszystko, co opublikowaliśmy, wraz z podanymi źródłami i ograniczeniami.

Badania i dane naukowe