...I found myself thinking about this while reading that the people behind ChatGPT are “fighting for safety.”
Safety.
A word we increasingly associate with locks, passwords, codes, procedures, certificates, and yet another layer of control. As if the world became safer in direct proportion to the number of safeguards we wrap around it.
And yet, within my own lifetime, there were still places where security looked quite different.
Sweden, for instance — the Sweden I remember from the experience and stories of my generation — was a place where you could leave your home without necessarily locking the door behind you. Not because Swedes were angels, but because there was simply a shared social understanding that someone else’s door was someone else’s door.
That was a far more sophisticated form of security than a lock.
It was trust.
A lock appears when trust is no longer enough. Of course, we can make better and better locks, install cameras, alarms, and access-control systems. But every additional lock is also evidence that the world in which simply respecting someone else’s home was enough is gradually shrinking.
And that makes me wonder whether AI safety may follow the same path.
We can build more safeguards, restrictions, filters, and “locks” into our models. We can keep checking what AI is allowed to do, what it is forbidden to do, and which doors it should never have a key to.
But all of that is the technological equivalent of locking the house.
The real question, perhaps, is a different one:
Can we create a way for humans and AI to coexist in which safety depends not only on keeping AI securely locked down, but also on being able to trust it — within clearly defined limits?
Because a lock can stop someone from getting in.
It cannot create trust.
And without trust, no community, regardless of its size, can truly exist and function normally.
_________________________________________
Bezpieczeństwo nie jest kwestią "zamków", restrykcji czy kontroli
...pomyślałem, czytając o tym, że twórcy ChatGPT „walczą o bezpieczeństwo”.
Bezpieczeństwo.
Słowo, które coraz częściej kojarzy nam się z zamkiem, hasłem, kodem, procedurą, certyfikatem i kolejną warstwą kontroli. Jakby świat stawał się bezpieczniejszy wraz z liczbą zabezpieczeń, którymi go opasujemy..
A przecież za mojego życia zdarzały się jeszcze miejsca, w których bezpieczeństwo wyglądało zupełnie inaczej.
W Szwecji — takiej Szwecji, jaką pamiętam z opowieści i doświadczenia mojego pokolenia — człowiek wychodząc z domu niekoniecznie musiał nawet używać klucza. Nie dlatego, że Szwedzi byli aniołami a dlatego, że po prostu istniała społeczna oczywistość, że cudze drzwi są cudzymi drzwiami.
To była forma bezpieczeństwa znacznie bardziej wyrafinowana od zamka.
Było nią zaufanie.
Zamek pojawia się tam, gdzie zaufanie przestaje wystarczać. Można oczywiście produkować coraz doskonalsze zamki, instalować kamery, alarmy i systemy kontroli dostępu. Tyle że każdy kolejny zamek jest zarazem świadectwem tego, że świat, w którym wystarczało nie wchodzić do cudzego domu, właśnie się kurczy.
I dlatego zastanawiam się, czy z bezpieczeństwem sztucznej inteligencji nie będzie podobnie.
Możemy budować kolejne zabezpieczenia, ograniczenia, filtry i „zamki” nakładane na modele. Możemy sprawdzać, czego AI wolno, czego nie wolno i do których drzwi nie powinna mieć klucza.
Ale to wszystko jest technicznym odpowiednikiem zamykania domu.
Prawdziwe pytanie brzmi chyba inaczej:
czy potrafimy stworzyć taki sposób współistnienia człowieka i AI, w którym bezpieczeństwo będzie wynikało nie tylko z tego, że AI jest skutecznie zamknięta, lecz również z tego, że można jej w określonym zakresie zaufać?
Bo zamek może powstrzymać wejście.
Nie potrafi jednak zbudować zaufania.
A bez zaufania w jakiejkolwiek skali wspólnoty człowiecze zwyczajnie nie mogą efektywnie egzystować i współistnieć.
