Czy da się rozpoznać tekst wygenerowany przez AI bez korzystania z detektora? Być może czasem wystarczy uważnie przeczytać pracę i dobrze znać wykorzystane w niej źródła. Analiza przypisów, rozpoznanie nieporadnych tłumaczeń i wykrycie oraz zbadanie konstrukcji parafraz może dostarczyć więcej informacji niż automatyczna detekcja, z którą - jak się okazuje - wciąż są duże problemy....
Czytaj dalej
Przez ostatnią dekadę na zapomnianej wiki Deutsches Software Entwickler pojawiło się tylko 20 zmian. Nagle, między majem a lipcem tego roku, przybyło tam ponad 18 tys. wpisów. Wszystkie zostały wygenerowane maszynowo przez agenty AI, które ominęły narzucone im ograniczenia i wykorzystały wiki jako platformę do wymiany informacji na temat najbardziej efektywnych sposobów rozwiązywania zleconych im zadań. Obserwowanie imponującej efektywności autonomicznych botów nie powinno jednak inspirować nas do zmiany języka, którym ją opisujemy....
Czytaj dalej
W latach 2023-2025 znormalizowany średni wynik odpowiedzi na maturze z historii wynosił 44 proc. i okazał się rażąco niższy od wyników wygenerowanych przez duże modele językowe (od 87 do 98 proc.). Nie oznacza to jednak, że matura z historii jest źle zaprojektowana albo że modele językowe mają lepszą wiedzę o historii niż polscy uczniowie. Wiedza to nie tylko znajomość faktów i dat, ale też umiejętność poruszania się między nimi i zdolność krytycznego rozumienia tekstów, a z tym modele językowe mają wciąż ogromne problemy....
Czytaj dalej
Zalew wygenerowanych maszynowo publikacji powoduje erozję rynku książki, na którym oryginalne teksty autorskie wypierane są przez syntetyczne substytuty. Ich powstanie i sukces komercyjny wynika jednak nie tylko ze skali i niemal zerowych kosztów produkcji, ale też z bezpośredniego wykorzystania tekstów autorskich. Kiedy dostępność maszynowych publikacji rośnie, spadają dochody twórców autorskich prac - w programie Kindle Unlimited każde wypożyczenie książki wygenerowanej przez AI bezpośrednio uszczupla pulę środków przeznaczoną dla prawdziwych autorów....
Czytaj dalej
Systemy wyszukiwania AI - ChatGPT, Copilot, Gemini, Perplexity - traktują treści syntetyczne jako wiarygodne, korzystają z wąskiej grupy uznanych domen oraz szerokiego zbioru mało znanych witryn niskiej jakości. Treści z tych witryn bywają maszynowo generowane i dostosowywane są do dynamiki wyszukiwania, preferującej jasne, konkretne odpowiedzi, pozbawione szerszego kontekstu i niuansów....
Czytaj dalej
Po raz kolejny okazuje się, że duże modele językowe, odpowiednio dostrojone, mogą z powodzeniem imitować styl literacki uznanych autorów i autorek. Skuteczna ekstrakcja stylu i jego powielanie w generatywnych wytworach jest faktem. Czy próbą racjonalizowania rosnących możliwości LLM-ów będzie szukanie wartości literatury nie w gotowym tekście, ale procesie twórczym i osobistej perspektywie pisarza i pisarki?...
Czytaj dalej
Wiarygodne symulowanie tekstów z epoki udaje się w pełni dopiero przy zastosowaniu modelu trenowanego od podstaw wyłącznie na danych historycznych (takiego jak GPT-1914). Rozwiązania oparte na promptowaniu kontekstowym współczesnych modeli albo ich dostrajaniu (fine-tuning) okazują się nieefektywne, ponieważ nieuchronnie przemycają w tekście współczesną wiedzę, normy i style języka. Mimo to nawet osoby z wykształceniem kierunkowym mają problem z poprawnym zidentyfikowaniem symulacji tekstów historycznych, wytworzonych w prosty i tani sposób za pomocą współczesnych lub tylko dostrojonych historycznie modeli. Prace nad rozwojem modeli historycznych mają otwierać nowe perspektywy dla badań społecznych, ale jednocześnie pokazują, jak łatwo dziś manipulować treściami historycznymi....
Czytaj dalej
Kto wynalazł telefon - Bell czy Meucci? Odpowiedzi dużych modeli językowych różnią się w zależności od języka zapytania, nawet jeśli pytanie dotyczy tego samego zagadnienia. Rozpoznanie “wewnątrzjęzykowej przewagi” danych postaci względem innych pozwoliło autorom omawianej pracy opisać LLM-y jako przestrzenie, w których ujawniać się mogą narodowe “miejsca pamięci” (w myśl koncepcji Pierre’a Nory)....
Czytaj dalej
Aktywny sprzeciw wobec hype'u AI nie powinien prowadzić do dyskredytowania technicznych podstaw działania narzędzi sztucznej inteligencji, którym niektórzy nieostrożnie przypisują większe niż się powinno znaczenie. Dobrym przykładem jest tu reprezentacja wektorowa i modele językowe: zamiast zastanawiać się, czy zabiorą pracę, czy mogą myśleć albo czy mają świadomość, lepiej eksperymentować z wykorzystaniem ich do badań nad przemianami języka....
Czytaj dalej
Luciano Floridi proponuje model tworzenia literatury, w którym składanie słów i zdań zostaje oddane maszynie, a autor przyjmuje rolę projektanta ram narracji i koordynatora wytwarzania tekstu. Choć upowszechnienie takiego podejścia może sprawić, że tradycyjny warsztat literacki stanie się kompetencją elitarną, a kreatywne myślenie oparte na języku znajdzie się w kryzysie, oczekiwać możemy demokratyzacji twórczości i nowych gatunków literackich....
Czytaj dalej