Metaskills
BADANIA · DIGITAL TWIN · RAMY PROJEKTOWE

Prywatność, stronniczość i ludzki czynnik

Kiedy sztuczna inteligencja analizuje, w jaki sposób dana osoba poradziła sobie z trudną rozmową, decyzje projektowe związane z tą analizą mają równie duże znaczenie, co sama analiza. Na tej stronie opisano ramy, na których opiera się narzędzie Digital Twin: jakie dane może uwzględniać narzędzie oceniające, w jaki sposób przeciwdziała się znanym tendencyjnościom oraz w jakich momentach w procesie tym bierze udział człowiek.

Metaskills ramy projektowe, 2026

MetodykaMetaskillsOpis metodykiStruktura projektowa - informacje na temat tego, co obecnie działa w środowisku produkcyjnym, można znaleźć na stronie poświęconej bezpieczeństwu

Czym jest ta strona, a czym nie jest

Na tej stronie opisano ramy projektowe: zasady i ograniczenia, zgodnie z którymi tworzony jest system Digital Twin. Nie jest to opis systemu produkcyjnego i nie należy go tak traktować. Jeśli chcesz dowiedzieć się, co obecnie działa - gdzie znajdują się dane, kto ma do nich dostęp, co przewidują umowy - zajrzyj na stronę poświęconą bezpieczeństwu; jest to jedyna strona, którą traktujemy jako wiarygodne źródło informacji o aktualnym stanie rzeczy. Chodzi właśnie o to, by rozróżniać te dwie kwestie: zasada projektowa a wdrożony mechanizm kontroli to dwie różne rzeczy, a ich zacieranie prowadzi do sytuacji, w której dostawcy obiecują infrastrukturę, której w rzeczywistości nie posiadają.

Cztery zasady, na których opiera się ocena

1

Ogranicz zakres tego, co widzi model

Moduł oceny potrzebuje treści rozmowy, a nie tożsamości osoby, która ją prowadziła. Zgodnie z zasadą projektową dane umożliwiające identyfikację są usuwane z danych przekazywanych do modelu, pozostawiając zanonimizowany opis zachowań.

2

Należy oddzielić tożsamość od analiz

Informacje o tym, kim jest dana osoba, oraz o jej profilu kompetencji są przechowywane w oddzielnych miejscach, połączonych odnośnikiem, a nie razem. Jedno naruszenie bezpieczeństwa nie powinno umożliwić uzyskania obu tych części.

3

Z założenia bez danych biometrycznych

Rozwiązanie to wyklucza identyfikację biometryczną i profilowanie biometryczne, a wraz z nimi śledzenie ruchu gałek ocznych, analizę mikroekspresji twarzy oraz nagrania z kamer w zestawie słuchawkowym: ocena opiera się na tym, co zostało powiedziane, a nie na osobie, która to powiedziała. Co to oznacza dla produktu w jego obecnym kształcie, można przeczytać na stronie poświęconej bezpieczeństwu - jest to jedyne miejsce, w którym zamieściliśmy tę odpowiedź.

4

Wyłącznie do celów formatywnych

Narzędzie Digital Twin zostało zaprojektowane jako narzędzie rozwojowe. Nie służy ono jako podstawa decyzji dotyczących zatrudnienia, awansu ani sankcji dyscyplinarnych, a cała logika oceny - zachowanie w kontekście, deklarowany poziom pewności siebie, brak diagnozy osobowości - wynika właśnie z tego założenia.

Pytania, które stanowią punkt wyjścia

Na tej stronie najczęściej zadaje się dwa pytania: czy dane klientów są wykorzystywane do szkolenia modeli oraz gdzie faktycznie są one przechowywane. Odpowiedzi na oba pytania znajdują się na stronie poświęconej bezpieczeństwu i celowo nie powtarzamy ich tutaj. Zobowiązanie zapisane w dwóch miejscach, w czterech językach, to zobowiązanie, które ostatecznie będzie zawierało dwie różne treści - dlatego istnieje jedna strona, na której są one zawarte, oraz jedna strona, którą należy aktualizować w razie zmian. Opisane tutaj ramy dotyczą sposobu działania procesu oceny. Nie zastępują one dokumentacji technicznej ani umownej, a w przypadku rozbieżności między nimi pierwszeństwo ma strona poświęcona bezpieczeństwu.

Cztery rodzaje stronniczości, którym staramy się zapobiegać w naszych projektach

Tendencja do elokwencji

Modele językowe faworyzują osoby mówiące płynnie. Osoba, która się jąka, posługuje się językiem obcym lub mówi potocznym językiem, może zostać oceniona niżej ze względu na sposób wypowiedzi, a nie jej treść.

Płeć a uprzedzenia wynikające ze stereotypów

Ta sama stanowczość może zostać odczytana jako zdecydowanie u jednej osoby, a jako szorstkość u innej. Dane szkoleniowe zawierają te wzorce; silnik oceniający będzie je odtwarzał, jeśli nie zostanie przed tym powstrzymany.

Uprzedzenia kulturowe

Normy komunikacyjne różnią się między sobą. Model wyszkolony głównie na podstawie komunikacji bezpośredniej, o niskim poziomie kontekstu, będzie systematycznie niedoceniać osoby, której kultura zawodowa opiera się na komunikacji bardziej pośredniej.

Halucynacja oceniająca

To błąd charakterystyczny dla tego typu zastosowań: pewna siebie, dobrze sformułowana ocena czegoś, co w ogóle nie miało miejsca w rozmowie.

Środek zaradczy, który wykonuje większość pracy

Wszystkie te uprzedzenia zwalcza się tak samo: ocena opiera się na treści wypowiedzi, a nie na jej brzmieniu czy domniemanej tożsamości mówiącego. Silnik otrzymuje polecenie, by ignorować imiona, zaimki i cechy demograficzne, jeśli się pojawią, oraz by nie zwracać uwagi na błędy gramatyczne, zawahania i kolokwializmy, skupiając się na intencji leżącej u ich podstaw. Jest to rozwiązanie projektowe mające na celu przeciwdziałanie uprzedzeniom związanym z elokwencją i stereotypami. W przypadku halucynacji zasada jest bardziej rygorystyczna. Ocena musi zawierać dokładny cytat z transkrypcji, który ją uzasadnia. Jeśli cytatu nie ma, ocena zostaje odrzucona, a nie zgłoszona - twierdzenie dotyczące czyjegoś zachowania, za którym nie stoi żaden cytat, nie jest ustaleniem, lecz domysłem sformułowanym poprawnie gramatycznie. Żadne z tych rozwiązań nie eliminuje stronniczości. Usuwa jednak najłatwiejsze drogi do niej i uwidacznia pozostałe, dlatego badanie walidacyjne jest przeprowadzane w oparciu o ocenę ludzkich ekspertów, a nie w oparciu o nasze własne oczekiwania.

Gdy człowiek pozostaje w pętli

Model oceny pozostawiony bez nadzoru zaczyna dryfować. Kryteria ulegają rozluźnieniu, to samo zachowanie otrzymuje inną ocenę w marcu niż w styczniu, a nikt tego nie zauważa, ponieważ nie ma punktu odniesienia. Ramy działania rozwiązują ten problem poprzez monitorowanie z udziałem człowieka: przeszkoleni oceniający zachowania przeglądają anonimowe próbki transkrypcji i porównują swoje oceny z wynikami wygenerowanymi przez system. W przypadku rozbieżności kryteria są ponownie kalibrowane. To właśnie to porównanie stanowi sedno badania walidacyjnego, prowadzonego jako ciągła kontrola, a nie jednorazowa procedura. Uczestnik szkolenia może również poprosić o weryfikację przez człowieka informacji zwrotnej, z którą się nie zgadza. Zautomatyzowana informacja zwrotna, której nie można poddać w wątpliwość, nie jest informacją zwrotną - jest wyrokiem, a ten system nie został zaprojektowany do wydawania wyroków.

Co ta strona twierdzi, a czego nie twierdzi

Co to pokazuje

  • Pokazuje zasady projektowe, na których opiera się ocena: minimalizacja danych, oddzielenie tożsamości od analiz, brak danych biometrycznych, wyłącznie do celów formatywnych.
  • Wymienia cztery znane rodzaje stronniczości i decyzje projektowe podjęte przeciwko każdemu z nich - w tym wymóg, by każda ocena zawierała cytat z transkrypcji.
  • Pokazuje, gdzie w procesie znajduje się nadzór człowieka: ślepe audyty krzyżowe zanonimizowanych próbek oraz weryfikacja przez człowieka na życzenie.

Czego to nie dowodzi

  • Nie jest to opis infrastruktury produkcyjnej. To, co obecnie działa, opisuje strona poświęcona bezpieczeństwu - i to ona jest rozstrzygająca.
  • Nie twierdzi, że ocena jest wolna od stronniczości. Twierdzi, że konkretnym, nazwanym rodzajom stronniczości przeciwdziała się na poziomie projektowania i że są one testowane.
  • Nie jest to certyfikat zgodności z prawem ani porada prawna. Dokumentacja ochrony danych jest regulowana umownie, a nie przez stronę internetową.

Ograniczenia

To są ramy projektowe, spisane w momencie, w którym założenia projektowe są już ustalone, a pomiar jeszcze nie.

  • Zasady projektowe to nie są wdrożone mechanizmy kontroli. Jeśli potrzebują Państwo pewności co do obecnego systemu, należy korzystać ze strony poświęconej bezpieczeństwu i z dokumentacji umownej.
  • Przeciwdziałanie stronniczości jest tu zaprojektowane i uzasadnione, ale jeszcze nie zmierzone. Nie przeprowadziliśmy formalnego audytu stronniczości w podziale na grupy demograficzne i nie twierdzimy, że taki audyt powstał.
  • Ocena czyta transkrypcję. To chroni przed częścią uprzedzeń - wyglądem, akcentem, sposobem mówienia - i nie robi nic z uprzedzeniem zawartym w samych słowach.
  • Nadzór człowieka zależy od oceniających. Ich kalibracja jest realnym ograniczeniem tego, jak dobra może być ta kontrola - i jest to ograniczenie, które dotyczy również nas.
  • Te ramy powstały dla kontekstu ochrony zdrowia i przywództwa. Inne konteksty mogą nieść rodzaje stronniczości, których nie uwzględniliśmy.

Źródło

Metaskills

2026-08-24

Ramy projektowe opracowane przez Metaskills. Opisują one zasady, zgodnie z którymi zbudowano serwis Digital Twin, a nie aktualny stan systemu produkcyjnego - w tej sprawie zapoznaj się ze stroną poświęconą bezpieczeństwu.

Powiązane strony

Bezpieczeństwo

Bezpieczeństwo i ochrona danych

Co obecnie działa w środowisku produkcyjnym: gdzie przechowywane są dane, kto ma do nich dostęp oraz co obejmują umowy.

Bezpieczeństwo i ochrona danych
Metodologia

W jaki sposób zachowanie staje się dowodem

Logika oceny, którą te zasady określają - zdarzenia dowodowe, poziom pewności oraz ograniczenia wnioskowania.

W jaki sposób zachowanie staje się dowodem
Produkt

Digital Twin

Profil kompetencji wynikający z tej logiki oraz to, jak wygląda on z perspektywy uczącego się i zespołu.

Digital Twin