Recenzja Assassin’s Creed Black Flag ResyncedInteraktywna mapa Gothic RemakeRecenzja Halo: Campaign EvolvedGTA 6 prawdopodobnie pobije rekordy i sprzeda konsole
Szukaj...

GRYOnline.pl:

Facebook GRYOnline.pl Instagram GRYOnline.pl X GRYOnline.pl TikTok GRYOnline.pl Podcast GRYOnline.pl LinkedIn GRYOnline.pl Forum GRYOnline.pl

tvgry.pl:

YouTube tvgry.pl TikTok tvgry.pl Instagram tvgry.pl Discord tvgry.pl Facebook tvgry.pl

Komentarze do wiadomości: „Przepraszam, literówka”. AI miało zrobić kopię zapasową, a usunęło wszystkie dane

Forum Technologiczne
Dodaj komentarz
07.08.2026 14:24
1
2
odpowiedz
pawel1812
82
Generał

Kasowanie baz danych i zawartości dysków na skutek literówek w poleceniach jest normą w modelach językowych. One nie myślą, a przekopiowują z internetu, jak jedno polecenie wezmą z jednego miejsca, a drugie z drugiego, bo akurat taka wersja miała większą reprezentacje w internecie, to działają zgodnie ze swoim kodem. To żaden błąd... Modele jezykowe tak działają.

Ja czekam na grubsze trollingi modeli w necie, że ktoś sobie będzie tworzył fake Githuby, tylko po to, żeby AI się na nich uczyło błędnych fraz kodu. Bądź kodu z pluskwami. Dla modelu nie koniecznie liczy się to, co on dostaje, a to czy jest zgodne z opisem i ile razy jest skopiowane w necie... Claude jest idealnym miejscem do umieszczania backdoorów w oprogramowaniu. Czy to przez udostępnianie backdoorów w necie w kodzie, którego nikt oprócz AI nie będzie czytał, czy to przez uczenie modelu w trakcie korzystania z niego...

Używanie agentów do pisania kodów jest co najmniej głupie. O ile podpowiedzi dla programistów zwykle spotykają się z kontrolą ze strony programistów, to agenty mogą sobie spokojnie dupnąć backdoora bez żadnej kontroli. I nie, że to Anthropic robi, to może robić ktokolwiek na ziemi. Wrzucać Backdoory do oprogramowania tworzonego bez kontroli AI.

Obstawiam, że Izrael i Chiny dużo finansów przeznaczyły na to, by dać Claude materiał do nauki tłumaczenia z C++ na Rusta, zeby sobie umiescic własne backdoory w Windowsie 11.

post wyedytowany przez pawel1812 2026-08-07 14:36:39
07.08.2026 14:38
Scriptioner
1.1
odpowiedz
Scriptioner
6
Legionista

pawel1812 O ile technicznie jest to możliwe, tak praktycznie niewykonalne. GitHub ma ponad 400 milionów projektów, Stack Overflow kolejne dziesiątki milionów zapytań i odpowiedzi, a jeszcze jest cała reszta internetu... Żeby jakkolwiek sensownie nauczyć AI błędnego/szkodliwego kodu, musiałbyś stworzyć setki milionów projektów. I każdy z nich przynajmniej częściowo unikalny, żeby nie dało się tego łatwo przefiltrować i zignorować przy scrapowaniu danych do nauki.

07.08.2026 14:43
1.2
odpowiedz
Jerry_D
84
Senator

Scriptioner "Żeby jakkolwiek sensownie nauczyć AI błędnego/szkodliwego kodu, musiałbyś stworzyć setki milionów projektów."
Błąd.
https://www.anthropic.com/research/small-samples-poison
TL;DR
"In a joint study with the UK AI Security Institute and the Alan Turing Institute, we found that as few as 250 malicious documents can produce a "backdoor" vulnerability in a large language model—regardless of model size or training data volume [...] Our results challenge the common assumption that attackers need to control a percentage of training data; instead, they may just need a small, fixed amount."

07.08.2026 14:43
Amadeoosh
1.3
4
odpowiedz
Amadeoosh
23
Generał
Wideo

pawel1812

że ktoś sobie będzie tworzył fake Githuby, tylko po to, żeby AI się na nich uczyło błędnych fraz kodu.

To co omawiasz, nazywa się "poisoningiem" i zaczyna być coraz bardziej popularne. Podejrzewam że takich inicjatyw będzie coraz więcej, wraz z malejącą tolerancją dla bigtechów.

https://www.youtube.com/watch?v=0WP6kEO3i8g

07.08.2026 15:18
Scriptioner
1.4
odpowiedz
Scriptioner
6
Legionista

Jerry_D Z tego samego linku:

"Specifically, we demonstrate that by injecting just 250 malicious documents into pretraining data, adversaries can successfully backdoor LLMs ranging from 600M to 13B parameters. [...] It’s still unclear if this pattern holds for larger models or more harmful behaviors, [...]"

Najnowsze modele mają już okolice 10T parametrów. Nie wiemy jak ilość szkodliwych danych się skaluje ponad 13B, więc możliwe, że wystarczy kilka tysięcy projektów, ale również możliwe, że potrzeba już kilkuset tysięcy/kilku milionów. I to jest mowa tylko o już istniejących modelach. To, co jest teraz trenowane (i będzie trenowane w niedalekiej przyszłości) jak najbardziej może to podnieść do tych kilkuset milionów wymaganych projektów.

Forum Forum Technologiczne
Dodaj komentarz

GRYOnline.pl:

Facebook GRYOnline.pl Instagram GRYOnline.pl X GRYOnline.pl TikTok GRYOnline.pl Podcast GRYOnline.pl LinkedIn GRYOnline.pl Forum GRYOnline.pl

tvgry.pl:

YouTube tvgry.pl TikTok tvgry.pl Instagram tvgry.pl Discord tvgry.pl Facebook tvgry.pl