Reddit
GamersNexus проводит эксперимент по «отравлению» языковых моделей
Популярный техноблог GamersNexus тестирует уязвимости LLM через атаку data poisoning — внедрение вредоносных данных в обучающие наборы. Эксперимент демонстрирует риски безопасности языковых моделей и способы манипуляции их выводами.
score 40r/OpenAI