@Klamra No dobra, to widać po prostu trudny charakter po internetowym filtrze
@tomasz-frankowski Klamra przekonał mnie żeby odpisać na poważnie, więc tak:
Oczywiście, że zostaną wykryte, podobnie jak wyglądało to z Grogiem. On niby nic nie ukrywał, ale wyraźnie było widać jak z ciekawostki staje się cierniem w tyłku wielu osób. Drobne nieścisłości kumulują się, w końcu ktoś zwraca uwagę i zaczyna drążyć - schematy w odpowiedziach, czasy odpowiedzi, zwykłe przeczucie. To wszystko jest mniej lub bardziej dokładne, ale z czasem każdy bot zostanie wykryty. Owszem, w przypadku dobrych modeli ten czas może dążyć do nieskończoności...
...Ale tu przechodzimy do drugiego aspektu: modele. Jeśli cokolwiek poczytałeś o LLM to wiesz, że modele mają bardzo różne zakresy skomplikowania, treningu i multum innych parametrów. Jest gigantyczna różnica między chińskim 3B odpalonym na domowym kompie, Deepseekiem i pół-darmowym Copilotem. A gdy wprowadzimy w to jeszcze agentów korzystających z choćby jednego sensownego modelu to możliwości w ogóle wylatują przez dach, razem z tymże dachem.
Teoretycznie ktoś mógłby odpalić nam tu bota z kosmicznie dużym kontekstem, zapleczem o wartości większej niż budżet wielu państw i mnóstwem danych treningowych stricte pod kątem Hejto. Problem jest taki, że nikt tego nie zrobi.
Powód jest prosty: koszta. Grog działał tak beznadziejnie bo był zrobiony całkiem po kosztach. Wydając trochę płatnych tokenów da się uzyskać sporo lepszy efekt. Ale żeby bot był w stanie rzeczywiście maskować się przez jakikolwiek realny czas, potrzebuje kasy. Nikt nie wyda tej kasy na spamowanie portalu ze śmiesznymi obrazkami, a jeśli już ją wyda - będzie to kasa wydana na agitację polityczną, czego tu wybitnie nie chcemy.
Ergo: każdy bot jest potencjalnym problemem. Najlepszą opcją jest je odgórnie zabronić, a jeśli ktoś z twórców skryptów będzie chciał "awansować" swój skrypt do LLM'a to zawsze może pokazać adminom "słuchajcie, robię tu dobrą robotę, czy mogę odpalić pełnoprawnego LLMa?" Mamy tą zaletę nad większymi stronami, że nasi admini są osiągalni.
Odwołując się jeszcze do "Dobre treści się same obronią." które wspomniałeś wyżej: nie, nie obronią się. Żeby to zobaczyć wystarczy przyjrzeć się głównym stronom Wykopu, subRedditów i Hejto. Zobaczysz bardzo wyraźny gradient - im więcej użytkowników, im więcej szumu informacyjnego, tym częściej w "gorących" lądują treści typowo shitposterskie, "current thing" i inne pod którymi bardzo łatwo kliknąć plusa, ale obiektywnie są bardzo niskiej wartości.
Swego czasu nawet zacząłem się zastanawiać jak można by czemuś takiemu zapobiec przez wprowadzanie ocen merytorycznych użytkowników i treści na stronach typu Hejto. Ale gdzieś tak w połowie rozrysowywania mapy myśli dotarło do mnie, że po włączeniu w całość socjologii, w zasadzie przekracza to możliwości ludzkiego rozumowania, nawet na tak małym portalu gdzie łatwo robić ręczne poprawki. (Swoją drogą - to jest świetne zadanie dla dobrego LLMa! Tyle że ponownie - koszty...)
PS: Akurat Elektroda w tym wątku wcale nie jest takim czarnym charakterem. Owszem, ich zamknięcie na nowych użytkowników i ogólnie odrzucające nastawienie wyewoluowały w bardzo niefajnym kierunku, przez co wielu wartościowych użytkowników nie chce ich znać. Ale trzeba przyznać jedno: naprawdę nieźle radzą sobie z odbijaniem spamu i botów. Oni w tej próbie imho przesadzili, ale skoro ktoś przedawkował z lekiem, to nie znaczy że cała substancja jest bez sensu.