Niniejszy przegląd wskazuje na przełomowy wpływ dużych modeli językowych na badania i analizę lingwistyczną.
LLM-y, dzięki swoim zaawansowanym możliwościom, okazują się obiecującymi narzędziami w wykonywaniu złożonych zadań językowych, od analizy składniowej i fonologicznej po tłumaczenie maszynowe i rozszerzanie danych psycholingwistycznych. Jednak pomimo znacznego postępu modele te wciąż stoją przed wyzwaniami, szczególnie w zakresie wrażliwości na kontekst, niuansów kulturowych i możliwości interpretacji.
Przemysław Brom, Duże modele językowe i ich zastosowanie w analizach językoznawczych – przegląd wybranych badań, Media i Społeczeństwo, nr 21(2)/2024
Ograniczenia
LLM:
1. Zasoby obliczeniowe:
LLM wymagają ogromnych zasobów obliczeniowych, zarówno podczas treningu, jak i podczas korzystania z modelu. Trening takich modeli może trwać tygodnie lub miesiące, a wymaga to specjalistycznych procesorów (GPU) i dużych ilości pamięci.
2. Halucynacje:
LLM mogą generować odpowiedzi, które brzmią wiarygodnie, ale są całkowicie nieprawdziwe lub niezwiązane z rzeczywistością. To zjawisko jest określane jako „halucynacja” modelu, gdzie wygenerowane informacje nie są poparte żadnymi rzeczywistymi danymi.
Bartosz Lewicki, LLM w biznesie: rewolucja czy ewolucja AI?, linkedin.com, 26.11.2024