Odpowiedź otwarta w ankiecie nie jest jeszcze kategorią ani wynikiem liczbowym. Najpierw trzeba ustalić, co dokładnie będzie kodowane, zbudować ramkę kodową, sprawdzić ją na części materiału i dopiero wtedy policzyć wystąpienia. Inaczej łatwo zamienić różne sensy w jedną szufladę albo policzyć tę samą osobę kilka razy bez wyjaśnienia.
Pracujemy z krótkimi odpowiedziami tekstowymi w ankiecie, na przykład „Co najbardziej utrudnia Ci naukę zdalną?”. Pełny wywiad wymaga bogatszej analizy kontekstu i tematów. Kodowanie kolumn oraz wartości całego zbioru opisuje natomiast osobna księga kodowa ankiety.
Zacznij od pytania i jednostki kodowania
Najpierw wróć do brzmienia pytania ankietowego i celu analizy. Dla pytania „Co utrudnia Ci pracę z domu?” jedna wypowiedź może zawierać trzy różne treści: brak spokojnego miejsca, przerywanie przez domowników i problemy z łączem. Możesz przypisać całej odpowiedzi jeden kod dominujący albo kodować osobno każdą istotną wzmiankę. Oba rozwiązania bywają poprawne, lecz odpowiadają na inne pytania.
Przydatne, gdy chcesz klasyfikować główny powód lub stanowisko i kategorie są rozłączne.
Przydatne, gdy zależy Ci na pełnym zestawie barier, potrzeb lub propozycji wskazanych przez uczestnika.
Zapisz tę decyzję przed liczeniem. Jeśli dopuszczasz wiele kodów, suma odsetków kategorii może przekroczyć 100%. To nie błąd, o ile mianownikiem pozostaje liczba respondentów i jasno zaznaczysz wielokrotne kodowanie.
Zbuduj ramkę kodową na próbce materiału
Nie zaczynaj od listy kategorii wymyślonej bez obejrzenia danych. Przeczytaj zróżnicowaną próbkę odpowiedzi, zanotuj powtarzające się sensy, a następnie połącz podobne propozycje. Każdy kod powinien mieć nazwę, definicję, kryterium włączenia, kryterium wyłączenia i przykład graniczny.
Zachowaj oryginalne brzmienie i identyfikator respondenta.
Wydziel sensowną wzmiankę bez wyrywania jej z kontekstu.
Nazwij konkretną treść możliwie blisko wypowiedzi.
Połącz kody odpowiadające temu samemu pytaniu analitycznemu.
Podaj liczebność, odsetek i krótki przykład znaczenia.
Nie skracaj drogi z surowego tekstu bezpośrednio do procentu. Definicje pośrodku umożliwiają kontrolę i powtórzenie analizy.
Ramka może powstawać indukcyjnie z odpowiedzi albo dedukcyjnie z teorii i pytań badawczych. W praktyce często jest mieszana: zaczynasz od kilku oczekiwanych obszarów, lecz dopuszczasz nowe kody ujawnione przez materiał. Nie twórz osobnego kodu dla każdej parafrazy. „Za dużo spotkań”, „ciągłe wideokonferencje” i „kalendarz pełny calli” mogą należeć do wspólnego kodu, jeśli w Twoim pytaniu oznaczają to samo obciążenie.
Sprawdź definicje przed kodowaniem całości
Zakoduj próbnie kilkanaście lub kilkadziesiąt odpowiedzi. Zaznacz miejsca, w których nie wiadomo, który kod wybrać, dwie kategorie zachodzą na siebie albo ważna treść nie ma miejsca. Popraw ramkę i ponownie sprawdź tę samą próbkę. Przy dwóch osobach każda koduje niezależnie identyczny fragment, a potem porównujecie rozbieżności i doprecyzowujecie reguły.
Wypowiedzi o niedoborze czasu, spiętrzeniu obowiązków i niemożności wygospodarowania terminu.
Samą złą organizację dnia, jeśli respondent nie wskazuje niedoboru czasu.
„Nie umiem zaplanować tygodnia” wymaga kodu organizacji, chyba że dalsza część mówi o konflikcie obowiązków.
Nie oceniaj jakości ramki wyłącznie liczbą kodów. Dobra ramka rozróżnia sensy potrzebne do odpowiedzi na pytanie badawcze, ale nie produkuje sztucznych różnic. W dzienniku analizy zapisz wersje definicji i przyczynę każdej zmiany. Szerszy sposób dokumentowania decyzji pokazuje poradnik o dzienniku badacza i audit trail.
Zobacz, dlaczego sumy mogą się różnić
Laboratorium wykorzystuje sześć syntetycznych odpowiedzi na pytanie o przeszkody w nauce zdalnej. Przełącz sposób liczenia. W pierwszym wariancie każda osoba trafia do jednej dominującej kategorii. W drugim zachowujemy wszystkie istotne wzmianki.
Ten sam tekst, dwa uczciwe mianowniki
Wyniki są przykładem metody, nie rezultatem prawdziwego badania.
Porównaj liczbę osób z liczbą przypisanych kodów.
Przy wielokrotnym kodowaniu raportuj przede wszystkim, ilu respondentów wskazało daną kategorię. Liczbę wszystkich wzmianek można dodać pomocniczo, ale nie należy dzielić jej przez liczbę osób i przedstawiać jako rozkładu sumującego się do 100%. Zasady mianownika muszą pozostać takie same w tabeli, tekście i wykresie.
Przenieś kody do arkusza bez utraty tekstu
Zachowaj osobną kolumnę z oryginalną odpowiedzią. Dla kodów rozłącznych wystarczy jedna kolumna kategorii. Przy wielokrotnym kodowaniu utwórz osobne kolumny zero–jeden dla każdej kategorii, na przykład czas, warunki i technologia. Wartość 1 oznacza obecność treści, a 0 jej brak. Pustego pola nie utożsamiaj automatycznie z zerem, jeśli odpowiedzi w ogóle nie udzielono.
Nazwy, definicje i wartości kolumn dopisz do codebooka. Przed analizą sprawdź identyfikatory, braki i duplikaty zgodnie z procedurą przygotowania danych w Jamovi.
Opisz wynik razem z regułą liczenia
Nie wystarczy zdanie „najczęściej pojawiał się brak czasu”. Podaj pytanie, sposób stworzenia ramki, jednostkę kodowania, liczbę odpowiedzi objętych analizą, dopuszczenie wielu kodów oraz wynik z właściwym mianownikiem.
Przeanalizowano 86 odpowiedzi na pytanie otwarte dotyczące trudności w nauce zdalnej. Ramkę kodową opracowano na próbce 20 wypowiedzi i doprecyzowano po próbnym kodowaniu. Jednej odpowiedzi można było przypisać więcej niż jedną kategorię, dlatego odsetki nie sumują się do 100%. Trudności czasowe wskazały 34 osoby (39,5%), warunki domowe 29 (33,7%), a problemy techniczne 18 (20,9%).
Krótki cytat może pokazać znaczenie kategorii, ale nie zastępuje informacji o jej częstości. Wybieraj fragment typowy albo dobrze wyjaśniający granicę kodu, anonimizuj szczegóły i nie sugeruj, że jedna efektowna wypowiedź reprezentuje całą próbę. Ogólne zasady budowy rozdziału wynikowego znajdziesz w poradniku o opisie wyników ankiety.
Nie zamieniaj krótkiej ankiety w analizę wywiadu
Krótka odpowiedź zwykle nie daje dostępu do tonu, przebiegu doświadczenia ani kontekstu dopowiedzeń. Możesz rzetelnie opisać obecne treści i ich częstość, ale nie rekonstruować rozbudowanych mechanizmów tylko dlatego, że materiał jest tekstowy. Gdy dane obejmują pełne rozmowy i interpretację tematów, przejdź do osobnego procesu kodowania wywiadów jakościowych.
Najczęstsze błędy
- Liczenie słów zamiast znaczeń, na przykład uznanie każdej wzmianki „czas” za ten sam problem.
- Tworzenie kategorii przed przeczytaniem materiału i wciskanie niepasujących odpowiedzi do gotowej listy.
- Zmiana definicji kodu w połowie pracy bez ponownego sprawdzenia wcześniejszych rekordów.
- Mieszanie osób i wzmianek w jednym mianowniku.
- Pokazywanie procentów sumujących się powyżej 100% bez informacji o wielokrotnym kodowaniu.
- Usuwanie krótkich, krytycznych albo niejednoznacznych odpowiedzi tylko dlatego, że trudno je zakodować.
- Wklejanie surowych wypowiedzi zawierających dane pozwalające rozpoznać uczestnika.
Jeżeli dwie osoby niezależnie kodują tę samą próbkę odpowiedzi, sam odsetek zgodnych decyzji nie pokazuje wpływu dominującej kategorii. Osobny poradnik wyjaśnia, jak zbudować macierz 2 × 2 i policzyć kappa Cohena dla dwóch koderów.
Źródła i dalsza lektura
- U.S. Census Bureau — analiza odpowiedzi otwartych przez dwóch koderów
- U.S. Census Bureau — kodowanie tekstowych odpowiedzi ankietowych
- Office for National Statistics — projektowanie kwestionariusza i kodowanie pytań otwartych
- UK Data Service — techniczny opis budowy ramki kodowej
- UK Data Service — kontrola jakości kodowania odpowiedzi otwartych










