Uruchomienie bloga zostało sfinansowane przez społeczność ❤️
Mecenasem bloga jest Fundacja Zakłady Kórnickie,
wydawca portalu historycznego Hrabia Tytus
Tagi

LLM

All posts tagged LLM przez hum/dev

Jak bez Pangrama rozpoznać tekst akademicki wygenerowany przez AI?

Jak bez Pangrama rozpoznać tekst akademicki wygenerowany przez AI?
Czy da się rozpoznać tekst wygenerowany przez AI bez korzystania z detektora? Być może czasem wystarczy uważnie przeczytać pracę i dobrze znać wykorzystane w niej źródła. Analiza przypisów, rozpoznanie nieporadnych tłumaczeń i wykrycie oraz zbadanie konstrukcji parafraz może dostarczyć więcej informacji niż automatyczna detekcja, z którą - jak się okazuje - wciąż są duże problemy.... Czytaj dalej

Antropomorfizacyjne uwodzenie. Jak czytać incydent z DSEWiki?

Antropomorfizacyjne uwodzenie. Jak czytać incydent z DSEWiki?
Przez ostatnią dekadę na zapomnianej wiki Deutsches Software Entwickler pojawiło się tylko 20 zmian. Nagle, między majem a lipcem tego roku, przybyło tam ponad 18 tys. wpisów. Wszystkie zostały wygenerowane maszynowo przez agenty AI, które ominęły narzucone im ograniczenia i wykorzystały wiki jako platformę do wymiany informacji na temat najbardziej efektywnych sposobów rozwiązywania zleconych im zadań. Obserwowanie imponującej efektywności autonomicznych botów nie powinno jednak inspirować nas do zmiany języka, którym ją opisujemy.... Czytaj dalej

Modele językowe o historii: dekontekstualizacja źródeł, potwierdzanie narzucanych interpretacji, kłopoty z chronologią i najnowszą historią Polski

Modele językowe o historii: dekontekstualizacja źródeł, potwierdzanie narzucanych interpretacji, kłopoty z chronologią i najnowszą historią Polski
W latach 2023-2025 znormalizowany średni wynik odpowiedzi na maturze z historii wynosił 44 proc. i okazał się rażąco niższy od wyników wygenerowanych przez duże modele językowe (od 87 do 98 proc.). Nie oznacza to jednak, że matura z historii jest źle zaprojektowana albo że modele językowe mają lepszą wiedzę o historii niż polscy uczniowie. Wiedza to nie tylko znajomość faktów i dat, ale też umiejętność poruszania się między nimi i zdolność krytycznego rozumienia tekstów, a z tym modele językowe mają wciąż ogromne problemy.... Czytaj dalej

Erozja rynku ebooków: masowa produkcja książek AI uderza w dochody autorów

Erozja rynku ebooków: masowa produkcja książek AI uderza w dochody autorów
Zalew wygenerowanych maszynowo publikacji powoduje erozję rynku książki, na którym oryginalne teksty autorskie wypierane są przez syntetyczne substytuty. Ich powstanie i sukces komercyjny wynika jednak nie tylko ze skali i niemal zerowych kosztów produkcji, ale też z bezpośredniego wykorzystania tekstów autorskich. Kiedy dostępność maszynowych publikacji rośnie, spadają dochody twórców autorskich prac - w programie Kindle Unlimited każde wypożyczenie książki wygenerowanej przez AI bezpośrednio uszczupla pulę środków przeznaczoną dla prawdziwych autorów.... Czytaj dalej

Wyszukiwanie za pomocą AI: wygodne odpowiedzi, niepewne źródła

Wyszukiwanie za pomocą AI: wygodne odpowiedzi, niepewne źródła
Systemy wyszukiwania AI - ChatGPT, Copilot, Gemini, Perplexity - traktują treści syntetyczne jako wiarygodne, korzystają z wąskiej grupy uznanych domen oraz szerokiego zbioru mało znanych witryn niskiej jakości. Treści z tych witryn bywają maszynowo generowane i dostosowywane są do dynamiki wyszukiwania, preferującej jasne, konkretne odpowiedzi, pozbawione szerszego kontekstu i niuansów.... Czytaj dalej

Skuteczna maszynowa ekstrakcja stylu to poważne wyzwanie dla literatury

Skuteczna maszynowa ekstrakcja stylu to poważne wyzwanie dla literatury
Po raz kolejny okazuje się, że duże modele językowe, odpowiednio dostrojone, mogą z powodzeniem imitować styl literacki uznanych autorów i autorek. Skuteczna ekstrakcja stylu i jego powielanie w generatywnych wytworach jest faktem. Czy próbą racjonalizowania rosnących możliwości LLM-ów będzie szukanie wartości literatury nie w gotowym tekście, ale procesie twórczym i osobistej perspektywie pisarza i pisarki?... Czytaj dalej

Znów o historycznych modelach językowych

Znów o historycznych modelach językowych
Wiarygodne symulowanie tekstów z epoki udaje się w pełni dopiero przy zastosowaniu modelu trenowanego od podstaw wyłącznie na danych historycznych (takiego jak GPT-1914). Rozwiązania oparte na promptowaniu kontekstowym współczesnych modeli albo ich dostrajaniu (fine-tuning) okazują się nieefektywne, ponieważ nieuchronnie przemycają w tekście współczesną wiedzę, normy i style języka. Mimo to nawet osoby z wykształceniem kierunkowym mają problem z poprawnym zidentyfikowaniem symulacji tekstów historycznych, wytworzonych w prosty i tani sposób za pomocą współczesnych lub tylko dostrojonych historycznie modeli. Prace nad rozwojem modeli historycznych mają otwierać nowe perspektywy dla badań społecznych, ale jednocześnie pokazują, jak łatwo dziś manipulować treściami historycznymi.... Czytaj dalej

Banalny nacjonalizm i duże modele językowe jako miejsca pamięci

Banalny nacjonalizm i duże modele językowe jako miejsca pamięci
Kto wynalazł telefon - Bell czy Meucci? Odpowiedzi dużych modeli językowych różnią się w zależności od języka zapytania, nawet jeśli pytanie dotyczy tego samego zagadnienia. Rozpoznanie “wewnątrzjęzykowej przewagi” danych postaci względem innych pozwoliło autorom omawianej pracy opisać LLM-y jako przestrzenie, w których ujawniać się mogą narodowe “miejsca pamięci” (w myśl koncepcji Pierre’a Nory).... Czytaj dalej

Relacja ma znaczenie: od Firtha do wektorowych reprezentacji języka

Relacja ma znaczenie: od Firtha do wektorowych reprezentacji języka
Aktywny sprzeciw wobec hype'u AI nie powinien prowadzić do dyskredytowania technicznych podstaw działania narzędzi sztucznej inteligencji, którym niektórzy nieostrożnie przypisują większe niż się powinno znaczenie. Dobrym przykładem jest tu reprezentacja wektorowa i modele językowe: zamiast zastanawiać się, czy zabiorą pracę, czy mogą myśleć albo czy mają świadomość, lepiej eksperymentować z wykorzystaniem ich do badań nad przemianami języka.... Czytaj dalej

Pisanie zdystansowane: proza multiwersum i dystans architekta

Pisanie zdystansowane: proza multiwersum i dystans architekta
Luciano Floridi proponuje model tworzenia literatury, w którym składanie słów i zdań zostaje oddane maszynie, a autor przyjmuje rolę projektanta ram narracji i koordynatora wytwarzania tekstu. Choć upowszechnienie takiego podejścia może sprawić, że tradycyjny warsztat literacki stanie się kompetencją elitarną, a kreatywne myślenie oparte na języku znajdzie się w kryzysie, oczekiwać możemy demokratyzacji twórczości i nowych gatunków literackich.... Czytaj dalej