GPT-4 5 zdał test Turinga. Zdjęcie - AI

GPT-4 5 oszukał ludzi w teście Turinga i częściej był uznawany za człowieka

Model GPT-4.5 osiągnął rekordowy wynik w teście Turinga i częściej był uznawany za człowieka niż realni rozmówcy.

Jak podaje Digital Trends, badacze z Uniwersytetu Kalifornijskiego w San Diego przeprowadzili eksperyment, w którym nowoczesne modele sztucznej inteligencji miały przejść klasyczny test Turinga podczas rozmów tekstowych z ludźmi.

Najlepszy wynik osiągnął model GPT-4.5, który w 73% przypadków został uznany przez uczestników za prawdziwego człowieka. Badanie objęło ponad 1000 rozmów prowadzonych wyłącznie w formie tekstowej bez obrazu i głosu, pisze Bytow24.

Sztuczna inteligencja zaczyna skutecznie udawać ludzi

W trakcie badania uczestnicy jednocześnie prowadzili rozmowę z człowiekiem oraz modelem AI. Ich zadaniem było wskazanie, który rozmówca jest prawdziwą osobą.

Największą skuteczność osiągnął GPT-4.5 z dodatkową konfiguracją zachowania określaną jako „persona prompt”. Model imitował introwertycznego młodego użytkownika internetu, korzystającego ze slangu i swobodnego stylu komunikacji.

W badaniu uczestniczyły również:

  • GPT-4o,
  • LLaMa-3.1-405B,
  • ELIZA z lat 60.

LLaMa-3.1-405B została uznana za człowieka w 56% przypadków, natomiast GPT-4o osiągnął 21%. Stary chatbot ELIZA uzyskał wynik 23%.

Dłuższe rozmowy nadal myliły uczestników

Badacze sprawdzali również skuteczność modeli podczas dłuższych konwersacji trwających 15 minut. Nawet wtedy część systemów utrzymywała wysoki poziom naturalności i osiągała wynik do 59%.

Autorzy badania podkreślili jednak, że modele AI nie posiadają świadomości ani emocji. Systemy jedynie bardzo skutecznie naśladują sposób komunikacji ludzi.

Eksperci zwracają uwagę, że podobne możliwości mogą stworzyć nowe zagrożenia dla internetu i komunikacji cyfrowej.

Problem może dotknąć mediów społecznościowych i usług online

Zdaniem naukowców coraz trudniejsze stanie się rozpoznawanie, czy po drugiej stronie rozmowy znajduje się człowiek czy algorytm.

Szczególnie ryzykowne mogą być sytuacje związane z:

  • mediami społecznościowymi,
  • aplikacjami randkowymi,
  • obsługą klienta,
  • edukacją online,
  • kampaniami politycznymi.

Badacze sugerują, że w przyszłości konieczne może być obowiązkowe oznaczanie chatbotów AI w komunikatorach oraz usługach internetowych.

Test Turinga wchodzi w nową erę

Klasyczny test Turinga został stworzony jako sposób oceny, czy maszyna potrafi skutecznie imitować człowieka w rozmowie. Najnowsze wyniki pokazują, że współczesne modele generatywnej sztucznej inteligencji zaczynają przekraczać dotychczasowe granice.

Eksperci zaznaczają, że rozwój takich technologii może całkowicie zmienić sposób komunikowania się ludzi w internecie w najbliższych latach.

Przypomnij, że wcześniej pisaliśmy o procesorze AMD Ryzen 7 7700X3D z pamięcią 3D V-Cache.

Udostępnij