Jak rozpoznać, czy głos w telefonie to AI (a nie prawdziwa osoba)

Bezpieczeństwo i oszustwa Tutorial7 min czytania·Zaktualizowano 4 lipca 2026
Krótka odpowiedź

Głosy AI przez telefon często brzmią zbyt gładko, mają kłopot z nieoczekiwanymi pytaniami i mogą robić nienaturalne pauzy lub nie mieć żadnych dźwięków tła. Najskuteczniejsza metoda to zadanie czegoś osobistego i nieoczekiwanego — prawdziwa osoba odpowie naturalnie; skrypt AI albo zatrzyma się w dziwnym miejscu, albo udzieli ogólnej odpowiedzi.

Głosy generowane przez AI stały się na tyle dobre, że potrafią oszukać ludzi — przynajmniej przez pierwsze kilka sekund rozmowy telefonicznej. Oszuści używają ich, by podszywać się pod pracowników banków, bliskich w tarapatach lub urzędników. Wiedza o tym, czego słuchać, daje ci realną przewagę.

Chcę być z tobą szczery: same uszy to dziś zawodne narzędzie. W testach rozpoznawanie sklonowanego głosu ze słuchu bywa niewiele lepsze niż rzut monetą, a najlepsze obecne narzędzia potrafią naśladować oddech, wahania i szum tła — a więc dokładnie te cechy, które kiedyś zdradzały syntetyczny głos. Najlepsza ochrona to proces weryfikacji (pytanie kontrolne, rodzinne hasło, oddzwonienie na znany numer), a nie tylko słuchanie. Sygnały poniżej wciąż warto znać, bo większość dzisiejszych oszukańczych połączeń nie korzysta z najlepszej technologii głosowej — używa tanich, szybkich, „wystarczająco dobrych" imitacji, które nadal mają swoje charakterystyczne cechy. Traktuj je jako dodatkową wskazówkę, nigdy jako dowód sam w sobie.

Oto co robić od chwili odebrania.

Zwróć uwagę na pierwsze pięć sekund

Pierwsze chwile rozmowy to moment, w którym głosy AI ujawniają się najwyraźniej. Zanim cokolwiek powiesz poza „halo", po prostu słuchaj.

Zauważ, jak rozmówca zaczyna. Prawdziwi ludzie zaczynają od naturalnych wahań, krótkich potwierdzeń lub small talku („O, dobrze, że cię złapałem" albo „Czy to dobry moment?"). Połączenia generowane przez AI często od razu przechodzą do meritum z płynnym, wyreżyserowanym wstępem — bez naturalnego rozgrzewania.

Nie musisz od razu odpowiadać. Krótka cisza po twoim „halo" jest normalna i może skłonić skryptowy system do ujawnienia się.

Nasłuchuj tych sześciu sygnałów dźwiękowych

Gdy rozmówca mówi, mentalnie przejdź przez tę listę. Nie musisz odfajkować wszystkich sześciu — dwa lub trzy razem powinny skłonić cię do dalszego testowania.

1. Zbyt gładki rytm. Prawdziwa mowa ma naturalne zmienności tempa — ludzie mówią szybciej, gdy są podekscytowani, i wolniej, gdy myślą. Tańsze głosy AI wciąż bywają płaskie rytmicznie, ale droższe, aktualne narzędzia już to potrafią naśladować — traktuj to jako słaby, pomocniczy sygnał, nie rozstrzygający.

2. Brak odgłosów oddychania — dziś to zawodny, a wręcz mylący sygnał. Przez lata radzono szukać właśnie braku wdechów jako dowodu, że głos jest sztuczny. To się odwróciło: najnowsze narzędzia do klonowania głosu celowo wstawiają sztuczne odgłosy oddychania, właśnie po to, żeby oszukać dokładnie ten test. Innymi słowy, „słyszę oddech, więc to na pewno człowiek" jest dziś fałszywym wnioskiem. Brak oddechu nadal może zdradzić tanią, prostą imitację, ale jego obecność niczego nie dowodzi.

3. Nienaturalne pauzy przed odpowiedziami. Gdy zadasz pytanie, prawdziwa osoba odpowiada natychmiast lub mówi coś w stylu „hmm, daj mi pomyśleć." Systemy prowadzące żywą, interaktywną rozmowę AI mogą mieć krótką ciszę podczas przetwarzania twojej odpowiedzi przed wygenerowaniem kolejnej — to nadal ma sens jako sygnał, ale tylko przy rozmowie na żywo z AI, nie przy odtworzeniu wcześniej nagranego, sklonowanego komunikatu.

4. Nadmiernie precyzyjna wymowa. Tańsze głosy AI mają tendencję do pełnego i równego wymawiania każdego słowa, podczas gdy naturalna mowa ma zredukowane samogłoski i połknięte sylaby. Najlepsze obecne modele reprodukują te niuanse całkiem dobrze, więc jest to dziś jeden słaby sygnał wśród kilku, nie samodzielny dowód.

5. Urywanie na krawędziach zdań. Przy tańszych lub starszych narzędziach pierwsza lub ostatnia sylaba zdania bywa lekko ucinana ze względu na sposób generowania i kompresowania dźwięku. Nowsze, droższe narzędzia w dużej mierze wyeliminowały tę wadę, więc ten sygnał ma dziś ograniczoną wartość.

6. Zupełnie żaden szum tła. Prawdziwe rozmowy od prawdziwych ludzi mają jakiś dźwięk otoczenia — echo pomieszczenia, telewizor w tle, ruch uliczny, kliknięcia klawiatury. Kompletna cisza za głosem wciąż jest dobrym sygnałem przy tańszych, masowych oszustwach — ale bardziej wyrafinowani oszuści już dokładają sztuczny szum tła właśnie po to, żeby ten test obejść, więc nie polegaj na nim jako na jedynym dowodzie.

Zadaj nieoczekiwane pytanie osobiste

To najskuteczniejszy test, jaki możesz przeprowadzić. Zapytaj o coś konkretnego, co prawdziwa osoba na deklarowanym stanowisku by wiedziała — a czego przygotowany skrypt by nie przewidział.

Jeśli rozmówca twierdzi, że jest z twojego banku: „Który oddział zwykle odwiedzam?" lub „Jaką ostatnią transakcję kwestionowałem?"

Jeśli rozmówca twierdzi, że jest twoim krewnym: „Jak nazywa się restauracja, do której poszliśmy na moje urodziny w zeszłym roku?" lub „Co dostałam od ciebie na gwiazdkę?"

Prawdziwa osoba odpowie wprost albo powie, że nie pamięta. Skrypt AI zazwyczaj udzieli ogólnej wymijającej odpowiedzi, zrobi dziwną pauzę albo wróci do głównego tematu rozmowy.

Użyj rodzinnego hasła, jeśli je macie

Jeśli twoja rodzina ustaliła bezpieczne hasło — konkretne słowo lub krótkie wyrażenie znane tylko wam — właśnie teraz je zastosuj. Po prostu zapytaj: „Jakie mamy hasło?"

Żaden prawdziwy rozmówca będący naprawdę twoim bliskim nie będzie zdezorientowany ani urażony tym pytaniem. Oszust nie zna hasła.

To najbardziej wiarygodne narzędzie weryfikacji dla połączeń podszywających się pod kogoś bliskiego. Jeśli jeszcze go nie ustaliliście, artykuł Rodzinne hasło bezpieczeństwa wyjaśnia, jak wybrać takie, które jest łatwe do zapamiętania i trudne do odgadnięcia przez osobę z zewnątrz.

Rozłącz się i oddzwoń na znany numer

Jeśli cokolwiek w rozmowie wydało ci się podejrzane — głos, prośba, pośpiech — rozłącz się. Następnie:

  1. Znajdź numer tej osoby lub organizacji sam — ze swoich kontaktów, z ich oficjalnej strony internetowej lub z tyłu karty, którą masz
  2. Zadzwoń bezpośrednio na ten numer
  3. Nie oddzwaniaj na numer podany przez podejrzanego rozmówcę — ten numer też może być kontrolowany przez oszustów

Ten jeden krok chroni cię przed niemal wszystkimi próbami oszustwa głosowego. Prawdziwa organizacja zawsze będzie dostępna przez swoje oficjalne kanały. Rozłączenie się nie jest niegrzeczne — to właściwe działanie.

Zgłoś to i idź dalej

Jeśli potwierdziłeś lub silnie podejrzewasz, że połączenie było generowane przez AI i miało charakter oszustwa:

  • Zgłoś sprawę na policji, a podejrzaną wiadomość SMS lub e-mail powiązaną z oszustwem dodatkowo do CERT Polska (cert.pl) albo SMS-em na numer 8080
  • Sprawdź, czy twój operator oferuje narzędzie do zgłaszania i blokowania takich połączeń — zakres różni się siecią od sieci, więc nie zakładaj z góry, że każdy operator ma to samo
  • Zablokuj numer na swoim telefonie, żeby nie dodzwonił się ponownie

Nie wstydź się, jeśli podczas rozmowy nie byłeś pewien. Te systemy są zaprojektowane tak, by być przekonujące. Liczy się to, co robisz, zanim dokonasz jakiejkolwiek płatności lub udostępnisz dane osobowe.

Co spróbować dalej

Jeśli chcesz ochrony, która działa zanim połączenie do ciebie dotrze, artykuł Narzędzia AI blokujące fałszywe połączenia omawia wbudowane funkcje iPhone'a i Androida, których większość ludzi jeszcze nie włączyła. A jeśli martwisz się o starszego krewnego, który często odbiera takie połączenia, artykuł Przekręt na wnuczka 2.0 wyjaśnia konkretne stosowane taktyki i zawiera plan bezpieczeństwa dla rodziny, który możecie wdrożyć razem.

Źródła

Opublikowano 4 lipca 2026 · Zaktualizowano 4 lipca 2026Jak testujemy →

Często zadawane pytania

Czy głosy AI przez telefon zawsze łatwo rozpoznać?
Nie zawsze — i stają się coraz lepsze. Sygnały opisane w tym przewodniku pomogą rozpoznać większość obecnych głosów AI, ale najlepsza ochrona to proces weryfikacji, a nie samo uważne słuchanie.
Czy AI może sklonować głos z zaledwie kilku sekund nagrania?
Tak. W badaniu McAfee pod nazwą Artificial Imposters wystarczyły zaledwie trzy sekundy nagrania, by uzyskać dopasowanie głosu na poziomie 85%. Dłuższe próbki — do około dziewięćdziesięciu sekund — pozwalają uzyskać jeszcze wierniejszą kopię, ale próg wejścia jest dziś bardzo niski.
Co powinienem zrobić, jeśli myślę, że rozmawiam z AI?
Rozłącz się. Następnie zadzwoń do tej osoby lub organizacji bezpośrednio, używając numeru, który już znasz — nie numeru podanego przez rozmówcę. Jeśli to był scam, nic nie tracisz, rozłączając się.
Co jeśli AI prawidłowo odpowie na moje nieoczekiwane pytanie?
Narzędzia AI coraz lepiej radzą sobie z niespodziewanymi pytaniami. Korzystaj z dodatkowych sygnałów i tak zweryfikuj, dzwoniąc na znany numer. Nie polegaj na żadnym pojedynczym teście.
Czy powinienem zgłaszać połączenia z oszukańczym głosem AI?
Tak. Jeśli doszło do próby oszustwa, zgłoś sprawę na policji (zawiadomienie o podejrzeniu popełnienia przestępstwa); jeśli oszustwo dotarło do ciebie też przez SMS lub e-mail, tę wiadomość zgłoś dodatkowo do CERT Polska (cert.pl) lub prześlij ją SMS-em na numer 8080. Możliwość zgłoszenia samego numeru telefonu operatorowi zależy od sieci — Orange ma do tego dedykowaną aplikację (Orange Telefon – Antyspam), inni operatorzy oferują to w różnym zakresie, więc warto sprawdzić ustawienia antyspamowe telefonu i aplikacji operatora.
Radim S.
Założyciel i redaktor

Radim jest programistą, który na co dzień buduje z AI, a wieczorami tłumaczy go członkom rodziny, których nie interesuje, jak to działa — tylko co może dla nich zrobić. Poradniki bezpieczeństwa są sprawdzane twierdzenie po twierdzeniu względem źródeł pierwotnych, zanim zostaną opublikowane.