A Claude-ot fejlesztő Anthropic rövidesen tőzsdére fog menni, és a vállalat emiatt az utóbbi időben több fontos bejelentést is tett. Ezúttal arról számolhatunk be, hogy több mint egy év után frissítette a Claude felhasználási szabályzatát, ami azért lényeges, mert ez jelöli ki a szabályos működési kereteket, valamint erre hivatkozva lehet a felhasználókat akár tiltani is a platformról.
A vállalat egyértelműbbé és szigorúbbá tette azokat az irányelveket, amelyek a csevegőbottal való visszaélésszerű viselkedést, a rendszer szándékos manipulálását, valamint a zaklató és bántalmazó jellegű interakciókat tiltják.
A frissített szabályzat kiemelt figyelmet fordít azokra a viselkedési formákra, amelyek a mesterséges intelligenciát erőszakos, lealacsonyító vagy pszichológiailag manipulatív szituációk szimulálására használnák fel. Az Anthropic kifejezetten megtiltja az olyan promptokat, amelyek bántalmazó viselkedések modellezésére, szexuális vagy verbális zaklatásra, illetve olyan helyzetek előidézésére irányulnak, amelyek célja a modell biztonsági gátjainak szándékos megbontása.
Az új szabályozás nemcsak a mások elleni ártó szándékú használatra vonatkozik, hanem közvetlenül a modellel folytatott kommunikáció határait is pontosítja.
A vállalat tapasztalatai szerint vannak olyan felhasználók, akik rendszeresen írnak a chatbotnak erőszakos, szidalmazó üzeneteket. A cég szerint ez sincs rendben, és úgy gondolták, hogy itt az ideje véget vetni ennek. Aki használni szeretné a Claude-ot, az beszéljen tisztességes – emberhez méltó – módon a szolgáltatással. Erre nagyobb figyelmet szentelve a vállalat ugyancsak képes lesz több visszaélésgyanús szcenáriót is kiszűrni. Az ilyen beszélgetéseket a tavaly augusztusi frissítést követően már eddig is megszakíthatta a Claude, de ezentúl még nagyobb figyelmet kapnak ezek a “visszaélések”.
A módosítás egyúttal a felhasználói biztonságot is védi: a szabályzat megerősíti az önkárosításra, a szélsőséges pszichológiai függőség kialakítására, valamint a valóságtól elrugaszkodott, káros interakciókra vonatkozó korlátozásokat. Napjainkban már sajnos teljesen reális helyzet az, hogy valaki a mély depresszióját a chatbottal vitatja meg, vagy ezzel osztja meg az öngyilkossági hajlamát, szándékát. Az ilyen helyzetekre a Claude képes lesz jobban reagálni. Illetve sokan vannak, akik csak tesztelgetik, hogy mit lép ilyen promptokra a szolgáltatás, de az ilyen szimulációkat is igyekeznek majd gátolni.
Az Anthropic most több meglévő korlátozást összefogott és kiegészített egy új, a megtévesztő kereskedelmi vagy politikai kampányokat tiltó rendelkezésbe. Ezzel jelzi, hogy figyel a mesterséges intelligencia által generált propaganda egyre nagyobb hullámokat keltő problémájára. Korlátozza azokat a kísérleteket, amelyek célja eltitkolni, ki áll egy üzenet mögött, vagy hamis fiókok és bejegyzések segítségével felerősíteni a tartalmat.
A választásokra vonatkozó szabályzat továbbá tiltja a választók megtévesztését és a választások megzavarását, ideértve a jelöltekkel vagy a szavazás módjával kapcsolatos félrevezető információk terjesztését, a jelöltek vagy választási tisztviselők személyazonosságának ellopását, illetve a választói részvétel visszaszorítására irányuló kísérleteket.
A vállalat legutóbbi fenyegetéselemző jelentése szerint az emberek arra is egyre gyakrabban használják a Claude-on alapuló megfigyelési rendszereket, hogy a politikai ellenfeleik azonosításák és nyomon követésék, ezért a vállalat egyértelműbbé tette a megfigyelésre vonatkozó tilalmait is.
Az Anthropic közölte, hogy bár felhasználási irányelvei mindig is nyilvánosan tiltották a Claude felhasználását fegyverfejlesztés céljára, a vállalat több olyan kísérletet is észlelt, amelyekben a Claude-ot fegyverek irányító- és vezérlőszoftvereinek fejlesztésére akarták felhasználni, ezért az új felhasználási irányelv kiterjeszti a tilalmat. A továbbiakban már a fegyverek működését biztosító szoftverekre és alkatrészekre, valamint olyan tevékenységekre, mint a drónok és más autonóm járművek élesítése, is vonatkozik a tiltás.
Az Anthropic emellett egy új szabályt is bevezetett, miszerint amennyiben az Anthropic mesterséges intelligencia modelljei olyan hardverhez vannak csatlakoztatva, amely önálló fizikai műveletekre képes, és akár sérüléseket okozhat, akkor egy képzett kezelőnek képesnek kell lennie a berendezés figyelemmel kísérésére, és szükség esetén annak leállítására. Ez már egyértelműen a robotikai felhasználásra vonatkozik, és az Anthropic álláspontja alapján amikor egy robothoz használják a Claude-ot, akkor ott mindenképpen kell emberi operátornak lennie.
Az irányelvek technológiai oldala is jelentős szigorításon esett át. A szabályzat mostantól még egyértelműbben határozza meg a nem engedélyezett biztonsági tesztelést és a védelem kijátszására irányuló kísérleteket. Kategorikusan tilos lesz továbbá minden olyan tevékenység, amely a Claude belső gondolkodási folyamatainak feltörésére, a modell válaszainak ipari méretű lemásolására vagy a rendszer kódjainak illetéktelen visszafejtésére irányul.
Ez a lépés közvetlenül összecseng az Anthropic legutóbbi modellfrissítéseivel – köztük a Claude Sonnet 5.5 és Haiku 5.5 bevezetésével –, amelyekben a vállalat hardveres és szoftveres szinten is beépített szűrőkkel kezdte el védeni a rendszereit az automatizált “desztillációt” végző hálózatokkal szemben.
A felhasználási szabályzat legfrissebb módosítása jogi és adminisztratív alapot teremt a visszaélések akár azonnali szankcionálására. A szabályok betartatására az Anthropic többlépcsős felügyeleti mechanizmust alkalmaz.