11.5 – A mesterséges intelligencia: a gyorsulás és az ellenőrzés között – Künstliche Intelligenz zwischen Beschleunigung und Kontrolle
1. A brit és amerikai MI-biztonsági intézetek rövid időt kaptak arra, hogy egy új, általános célú modellt teszteljenek annak 2024. decemberi nyilvános megjelenése előtt. – Die britischen und amerikanischen Institute für KI-Sicherheit erhielten ein enges Zeitfenster, um ein neues Allzweckmodell vor dessen öffentlicher Veröffentlichung im Dezember 2024 zu testen.
2. Kutatóik kiberbiztonsági, biológiai és szoftverfejlesztési feladatokat próbáltak ki, majd megosztották eredményeiket a fejlesztővel, mielőtt a felhasználók szélesebb körű hozzáférést kaptak volna egy olyan rendszerhez, amelyet hamarosan nagyon különböző környezetben is használhatnak. – Ihre Forscher probierten Aufgaben in den Bereichen Cybersicherheit, Biologie und Softwareentwicklung aus und teilten ihre Ergebnisse anschließend dem Entwickler mit, bevor Nutzer einen breiteren Zugang zu einem System erhielten, das bald in ganz unterschiedlichen Kontexten zum Einsatz kommen könnte.
3. Az idő szorított. – Die Zeit drängte.
4. Az intézetek kiválaszthatták a teszteket és adaptálhatták módszereiket, de nem tudták megfigyelni minden lehetséges jövőbeli felhasználási módot, és nem tudták reprodukálni a modell, a felhasználó és eszköz közötti minden kombinációt. – Die Institute konnten Tests auswählen und ihre Methoden anpassen, aber sie konnten nicht jede noch bevorstehende Nutzung beobachten oder jede Kombination aus Modell, Nutzer und eines Werkzeugs.
5. A nyilvánosságra hozatal után ugyanazt a modellt új eszközökkel párosíthatják, ismeretlen termékekbe építhetik be, és olyan célokra használhatják, amelyeket az értékelők nem választottak ki. – Nach der Veröffentlichung könnte dasselbe Modell mit neuen Werkzeugen kombiniert, in unbekannte Produkte integriert und für Zwecke eingesetzt werden, die seine Bewerter nicht ausgewählt hatten.
6. Ez a rés jelenti a legfőbb nehézséget egy olyan technológia szabályozásában, amely szinte bárhol hasznos lehet. – Diese Lücke ist die zentrale Schwierigkeit bei der Steuerung einer Technologie, die fast überall nützlich sein kann.
7. A nyilvános jelentés nem tartalmazott megfelelési igazolást. – Der öffentliche Bericht bot keine Bestätigungsbescheinigung.
8. Az eredményeket előzetesnek minősítette, és kifejtette, hogy a tesztelt verziónak nehézségei voltak az eszközök használatával és a szükséges kimeneti formátum előállításával – ezek a részletek megváltoztatták, hogy mit jelenthet ésszerűen egy pontszám. – Er bezeichnete die Ergebnisse als vorläufig und erklärte, dass die getestete Version Probleme bei der Nutzung von Werkzeugen und der Erzeugung des erforderlichen Ausgabeformats hatte – Details, die die sinnvolle Interpretation einer Punktzahl veränderten.
9. Amikor az értékelők módosították a környezeti beállításokat, hogy segítsék a rendszert a hibákból való helyreállásban, a mért teljesítmény megváltozott, ami arra emlékeztetett, hogy egy modell képességei részben a köré épített rendszertől függenek. – Als die Bewerter die Rahmenbedingungen anpassten, um dem Modell zu helfen, sich von Fehlern zu erholen, änderte sich die gemessene Leistung – ein Hinweis darauf, dass die Fähigkeiten eines Modells zum Teil von dem System abhängen, das um es herum aufgebaut ist.
10. A kutatók meghatározott feltételek mellett tesztelték a képességeket, nem számolták össze a világban megelőzött károkat. – Die Forscher hatten die Fähigkeiten unter festgelegten Bedingungen getestet, nicht die in der realen Welt verhinderten Schäden gezählt.
11. A kiadás előtt tanultak belőle. – Sie lernten vor der Freigabe dazu.
12. A kiadás előtt nem tudtak mindent megtanulni. – Sie konnten vor der Freigabe nicht alles lernen.
13. Egy képesség felfedezése sem jelenti azt, hogy valaki azt kárt okozásra fogja használni; egy laboratóriumi feladatból hiányozhatnak azok a készségek, motiváció, erőforrások és lehetőségek, amelyek a valós világban bekövetkező kár előidézéséhez szükségesek. – Auch die Entdeckung einer Fähigkeit bedeutet nicht, dass jemand sie nutzen wird, um Schaden anzurichten; bei einer Laboraufgabe fehlen möglicherweise die Fähigkeiten, die Motivation, die Ressourcen und die Gelegenheit, die erforderlich sind, um in der realen Welt Schaden anzurichten.
14. Mindazonáltal a kiadás előtti teszt feltárhat egy problémát, miközben a fejlesztő szokatlanul erős ellenőrzést gyakorol a következő lépés felett. – Dennoch kann ein Test vor der Veröffentlichung ein Problem aufdecken, während der Entwickler ungewöhnlich starke Kontrolle über den nächsten Schritt behält.
15. A fejlesztő módosíthatja a biztonsági intézkedéseket, szűkítheti a hozzáférést, elhalaszthat egy funkciót, vagy további vizsgálatot kezdeményezhet, mielőtt a másolatok és integrációk elszaporodnának. – Der Entwickler kann Sicherheitsvorkehrungen ändern, den Zugriff einschränken, eine Funktion verzögern oder eine weitere Überprüfung veranlassen, bevor sich Kopien und Integrationen vermehren.
16. A kiadás mind az információt, mind az ellenőrzést megváltoztatja. – Die Veröffentlichung verändert sowohl die Informationen als auch die Kontrolle.
17. A tényleges használat olyan hibákat tár fel, amelyeket egy mesterséges teszt esetleg elmulasztana, miközben minden új kapcsolat külső szoftverekkel újabb helyet teremt, ahová a javításnak el kell jutnia. – Der tatsächliche Einsatz deckt Fehler auf, die bei einem künstlichen Test möglicherweise übersehen werden, während jede neue Anbindung an externe Software eine weitere Stelle schafft, an der eine Korrektur ankommen muss.
18. A megfigyelés ezért csak akkor értékes, ha valaki cselekedhet is az alapján. – Eine Beobachtung ist daher nur dann wertvoll, wenn jemand darauf reagieren kann.
19. A hiba felfedezése és kijavítása közötti különbség részben a szoftvertervezésben, részben pedig azokban a szabályokban rejlik, amelyek meghatározzák, ki láthatja a bizonyítékokat, ki követelhet intézkedést, és ki ellenőrizheti, hogy az intézkedés hatott-e. – Der Unterschied zwischen dem Auffinden eines Fehlers und dessen Behebung liegt teils im Software-Design und teils in den Regeln, die festlegen, wer Beweise einsehen, Maßnahmen einfordern und überprüfen kann, ob diese Maßnahmen gewirkt haben.
20. Az, hogy ki kapja meg a bizonyítékokat, ki követelhet változtatást, és ki viseli a késedelem költségeit, mind fontos kérdés, mielőtt egy modell elhagyja a laboratóriumot. – Wer die Beweise erhält, wer eine Änderung einfordern kann und wer die Kosten der Verzögerung trägt – all das spielt eine Rolle, bevor ein Modell das Labor verlässt.
21. A 2024-es gyakorlat a független tesztelés ígéretét és korlátait egyaránt megmutatja. – Die Übung von 2024 zeigt sowohl das Potenzial als auch die Grenzen unabhängiger Tests auf.
22. A külső szakértők olyan nézőpontot nyújtottak, amelyet a fejlesztő saját értékelése nem tudott teljes mértékben pótolni, ugyanakkor hozzáférésüket, idejüket és tesztkörnyezetüket olyan megállapodások korlátozták, amelyek egyben meghatározták, hogy mely kockázatokat vizsgálhatnak. – Externe Spezialisten lieferten eine Perspektive, die die eigene Bewertung des Entwicklers nicht vollständig ersetzen konnte; dennoch waren ihr Zugang, ihre Zeit und ihre Testumgebung durch Vereinbarungen begrenzt, die auch bestimmten, welche Risiken sie untersuchen konnten.
23. A függetlenség nem biztosít végtelen lefedettséget. – Unabhängigkeit kann keine unbegrenzte Abdeckung gewährleisten.
24. Hitelesebbé teheti egy állítást, ha az értékelők érdemi kérdéseket választhatnak, feltárhatják a korlátokat, és jelenthetik az eredményeket anélkül, hogy védeniük kellene a termék bevezetését. – Sie kann eine Behauptung glaubwürdiger machen, wenn Prüfer aussagekräftige Fragen wählen, Grenzen offenlegen und Ergebnisse berichten können, ohne eine Produkteinführung schützen zu müssen.
25. Ehhez erőforrásokra, valamint hivatalos engedélyre is szükség van. – Das erfordert sowohl Ressourcen als auch eine formelle Genehmigung.
26. Az érzékeny tesztekhez biztonságos környezetre, szakértő személyzetre és gondosan kiválasztott összehasonlításokra lehet szükség, míg egy ismeretlen rendszer sietve meghívott ellenőrzése alig többet eredményezhet, mint egy adott konfiguráció pillanatfelvételét. – Sensible Tests erfordern möglicherweise sichere Umgebungen, fachkundiges Personal und sorgfältig ausgewählte Vergleiche, während eine überstürzte Einladung zur Überprüfung eines unbekannten Systems kaum mehr als eine Momentaufnahme einer einzigen Konfiguration liefern dürfte.
27. A brit intézet leírta egy többszintű megközelítést, amelyben a gyors ellenőrzések mélyebb vizsgálatot indíthatnak el, ha az eredmények indokolják, így az értékelők a költséges kézi vizsgálatokat oda koncentrálhatják, ahol az első eredmények azt igénylik. – Das britische Institut hat einen mehrstufigen Ansatz beschrieben, bei dem Schnellprüfungen tiefgreifendere Untersuchungen auslösen können, wenn die Ergebnisse dies rechtfertigen, sodass sich die Prüfer auf kostspielige manuelle Untersuchungen konzentrieren können, wo ein erstes Ergebnis dies erfordert.
28. Az ilyen sorrend a szűkös tesztelési időt ott fordítja, ahol a figyelmeztető jelek a legerősebbek, bár egy olyan kezdeti teszt, amely elmulaszt egy veszélyt, soha nem indíthatja el a következő szintet. – Eine solche Abfolge setzt die knappe Testzeit dort ein, wo die Warnzeichen am stärksten sind, obwohl ein erster Test, der eine Gefahr übersieht, möglicherweise nie die nächste Stufe auslöst.
29. A tesztelés elhalaszthatja a hasznos hozzáférést. – Tests können den sinnvollen Zugang verzögern.
30. A kutatók, a kisvállalkozások és a közszolgáltatások elveszíthetik a lehetőségeket, ha egy széles körben hasznos rendszert homályos vagy vitathatatlan okok miatt visszatartják. – Forscher, kleine Unternehmen und öffentliche Dienste können Chancen verpassen, wenn ein allgemein nützliches System aus vagen oder nicht anfechtbaren Gründen zurückgehalten wird.
31. A gyorsaság azonban nem jár ingyen, ha egy fel nem fedezett hiba költségei azokra hárulnak, akik nem ők választották a bevezetési ütemtervet. – Doch Geschwindigkeit ist nicht umsonst, wenn die Kosten eines übersehenen Fehlers auf Menschen lasten, die den Zeitplan für die Freigabe nicht gewählt haben.
32. A döntésnek olyan konkrét indokokra van szüksége, amelyek vizsgálhatók: melyik képességet tesztelték, milyen kárt okozhatna, mennyire hasonlít a teszt a tényleges használatra, és mennyire bizonytalan ez az összefüggés. – Die Entscheidung benötigt Gründe, die konkret genug sind, um überprüft zu werden: Welche Funktion wurde getestet, welchen Schaden könnte sie ermöglichen, inwieweit entspricht der Test der tatsächlichen Nutzung und wie unsicher ist dieser Zusammenhang noch?
33. Az európai jog különálló kategóriákat alkalmaz. – Das europäische Recht verwendet unterschiedliche Kategorien.
34. Az Európai Unió 2024-ben elfogadott és 2026-ban módosított mesterséges intelligencia törvénye (AI Act) tilt bizonyos gyakorlatokat, követelményeket állapít meg meghatározott, magas kockázatú felhasználásokra, és további kötelezettségeket ró az általános , amelyek rendszerszintű kockázatot jelentenek. – Das KI-Gesetz der Europäischen Union, das 2024 verabschiedet und 2026 geändert wurde, verbietet bestimmte Praktiken, legt Anforderungen für bestimmte risikoreiche Anwendungen fest und erlegt Anbietern von Modellen für allgemeine Allzweckmodellen, die als systemisches Risiko eingestuft werden, zusätzliche Pflichten auf.
35. Ezek a kategóriák különböző kérdésekre adnak választ. – Diese Kategorien beantworten unterschiedliche Fragen.
36. A tilalom a rendelet szerint elfogadhatatlannak ítélt gyakorlatra vonatkozik, míg a magas kockázatú rendszerekre vonatkozó követelmények azt szabályozzák, hogy egy engedélyezett rendszert hogyan kell megtervezni, dokumentálni, ellenőrizni és használni. – Ein Verbot betrifft eine Praxis, die gemäß der Verordnung als inakzeptabel eingestuft wird, während Anforderungen an ein risikoreiches System regeln, wie ein zulässiges System gestaltet, dokumentiert, überwacht und genutzt wird.
37. A rendszerkockázatot jelentő általános célú modellekre vonatkozó kötelezettségek olyan, széles körben újrafelhasználható modellekre vonatkoznak, amelyek képességei számos utólagos alkalmazási környezetben kockázatot jelenthetnek. – Die Pflichten für ein Allzweckmodell mit systemischem Risiko betreffen ein weitgehend wiederverwendbares Modell, dessen Fähigkeiten in vielen nachgelagerten Anwendungsbereichen Risiken verursachen können.
38. A kategóriák nem minősítenek minden általános modellt magas kockázatú alkalmazássá. – Die Kategorien machen nicht jedes allgemeine Modell zu einer risikoreichen Anwendung.
39. Az a szervezet, amely egy modellt jelentős következményekkel járó szolgáltatásba épít be, döntéseket hoz a szolgáltatás céljáról, a felhasználókról, az adatokról, a biztonsági intézkedésekről és a rendelkezésre álló emberi felülvizsgálatról. – Eine Organisation, die ein Modell in einen Dienst mit erheblichen Auswirkungen integriert, trifft Entscheidungen über den Zweck des Dienstes, die Nutzer, die Daten, die Sicherheitsvorkehrungen und die verfügbare menschliche Überprüfung.
40. Az eredeti modellszolgáltató nem ismerheti minden jövőbeli integrációt, de a modellt bevezető szervezet sem tekintheti a modell örökölt viselkedését mások teljes felelősségének, amikor a környezetet és a biztonsági intézkedéseket választja. – Der ursprüngliche Modellanbieter kann nicht jede zukünftige Integration vorhersehen, aber die einsetzende Organisation darf das geerbte Modellverhalten nicht als alleinige Verantwortung eines anderen betrachten, wenn sie den Kontext und die Sicherheitsvorkehrungen festlegt.
41. A felelősség azokhoz a döntésekhez kapcsolódik, amelyekre az egyes szereplők ténylegesen hatással lehetnek. – Die Verantwortung richtet sich nach den Entscheidungen, auf die jeder Akteur tatsächlich Einfluss nehmen kann.
42. A törvény értelmében a rendszerkockázattal járó, minősített általános célú modellek szolgáltatóinak értékelniük és csökkenteniük kell a rendszerkockázatokat, valamint a vonatkozó rendelkezések szerint be kell jelenteniük a súlyos incidenseket. – Nach dem Gesetz müssen Anbieter von qualifizierten Allzweckmodellen mit systemischem Risiko systemische Risiken bewerten und mindern sowie schwerwiegende Vorfälle gemäß den geltenden Bestimmungen melden.
43. Az egyes magas kockázatú rendszerekre vonatkozó követelmények magukban foglalják a kockázatkezelést és az piaci utólagos nyomon követést, amelyek összekapcsolják a kezdeti értékelést a bevezetés után összegyűjtött bizonyítékokkal. – Zu den Anforderungen für bestimmte risikoreiche Systeme gehören Risikomanagement und Marktüberwachung, die eine erste Bewertung mit den nach der Bereitstellung gesammelten Erkenntnissen verknüpfen.
44. Egyik sem követeli meg hivatalos tesztelést minden kiadás előtt. – Keine der beiden Anforderungen sieht offizielle Tests vor jeder Veröffentlichung vor.
45. A törvény a hatóságoknak is szerepet szán a felügyeletben és a végrehajtásban, míg a független kutatók – amennyiben megfelelő hozzáféréssel rendelkeznek – ellenőrizhetik az állításokat és feltárhatják a vakfoltokat. – Das Gesetz weist den Behörden zudem Aufgaben bei der Aufsicht und Durchsetzung zu, während unabhängige Forscher Behauptungen überprüfen und Schwachstellen aufdecken können, sofern sie über einen praktikablen Zugang verfügen.
46. Szerepeik átfedik egymást, de nem olvadnak össze. – Ihre Rollen überschneiden sich, ohne sich zu vermischen.
47. Egy értékelő azonosíthat egy aggasztó képességet, de nem feltétlenül rendelheti el a szolgáltatónak a szolgáltatás módosítását; egy hatóság rendelkezhet jogi hatáskörrel rendelkezik, de azok hatékony alkalmazásához szüksége van az értékelő műszaki bizonyítékaira és az üzemeltető gyakorlati megfigyeléseire. – Ein Gutachter kann eine bedenkliche Funktion identifizieren, kann einem Anbieter jedoch nicht zwangsläufig anordnen, den Dienst zu ändern; eine Behörde verfügt zwar über gesetzliche Befugnisse besitzen, benötigt jedoch die technischen Nachweise des Gutachters und die Beobachtungen des Betreibers vor Ort, um diese Befugnisse sinnvoll anzuwenden.
48. Egy szolgáltató központilag módosíthatja az általa üzemeltetett modellt, míg egy utólagos üzemeltető lehet az egyetlen szereplő, aki látja, hogyan működik az adott modell egy konkrét munkahelyen. – Ein Anbieter kann ein von ihm zentral bereitgestelltes Modell ändern, während ein nachgelagerter Betreiber möglicherweise der einzige Akteur ist, der sieht, wie sich dieses Modell an einem bestimmten Arbeitsplatz verhält.
49. Az érintett felhasználónak gyakran van a legegyértelműbb bizonyítéka egy konkrét meghibásodásra, ugyanakkor a legkevesebb hatalma van a háttérben működő rendszer megváltoztatására. – Der betroffene Nutzer verfügt oft über die eindeutigsten Nachweise für einen konkreten Fehler und hat gleichzeitig am wenigsten Einfluss darauf, die dahinterstehenden Abläufe zu ändern.
50. Egy incidensjelentés akkor válik hasznossá, ha eljuthat a felfedezés helyszínéről ahhoz, akinek kötelessége és képessége van beavatkozni, és amikor a válaszintézkedés eléri azokat az embereket, akiket már érintett a probléma. – Ein Vorfallbericht wird dann nützlich, wenn er von diesem Ort der Feststellung zu jemandem weitergeleitet werden kann, der die Pflicht und die Befugnis zum Eingreifen hat, und wenn die Reaktion die bereits betroffenen Personen erreicht.
51. Az időzítés bonyolítja az uniós szabályokat. – Der zeitliche Ablauf verkompliziert die EU-Vorschriften.
52. A törvény 2024 augusztusában lépett hatályba, de rendelkezései nem az elfogadás napján, hanem fokozatosan kezdtek alkalmazásra kerülni, így a jogi döntés dátuma és a kötelező kötelezettség dátuma eltér egymástól. – Das Gesetz trat im August 2024 in Kraft, doch seine Bestimmungen galten nicht ab dem Tag der Verabschiedung, sondern wurden schrittweise eingeführt, sodass sich das Datum einer rechtlichen Entscheidung und das Datum einer verbindlichen Verpflichtung unterscheiden.
53. Az általános célú modellekre vonatkozó szabályok 2025 augusztusában léptek hatályba, a már forgalomban lévő modellekre vonatkozó átmeneti rendelkezések figyelembevételével. – Die Vorschriften für Allzweckmodelle galten ab August 2025, vorbehaltlich von Übergangsbestimmungen für bereits auf dem Markt befindliche Modelle.
54. A 2026-os módosítás a III. mellékletben felsorolt számos magas kockázatú rendszerre vonatkozó alapvető követelmények alkalmazását 2027. decemberéig, az I. mellékletben szereplő bizonyos szabályozott termékek esetében pedig 2028. augusztusáig halasztotta. – Mit der Novelle von 2026 wurde die Anwendung der Kernanforderungen für viele in Anhang III aufgeführte Systeme mit hohem Risiko auf Dezember 2027 und für bestimmte regulierte Produkte in Anhang I auf August 2028 verschoben.
55. Ezek a dátumok azt jelzik, hogy mikor lépnek hatályba a meghatározott jogi kötelezettségek, nem pedig azt, hogy a modell mikor válik először képessé arra, hogy bárkinek segítséget nyújtson vagy kárt okozzon. – Diese Daten geben an, wann bestimmte gesetzliche Pflichten gelten, nicht wann ein Modell erstmals in der Lage ist, jemandem zu helfen oder zu schaden.
56. A módosítás a szabványok, iránymutatások és az intézményi felkészülés késedelmét hozta fel indokként a további időnyerésre, rámutatva a gyors védelem iránti igény és a bonyolult szabály következetes alkalmazására irányuló képesség közötti feszültségre. – In der Novelle wurden verzögerte Normen, Leitlinien und institutionelle Vorbereitungen als Gründe für eine Fristverlängerung an und machte damit einen Konflikt zwischen dem Wunsch nach schnellem Schutz und der Fähigkeit, eine komplexe Vorschrift einheitlich anzuwenden, deutlich.
57. Ez az aggodalom megalapozott: egy olyan követelmény, amelyet senki sem tud következetesen értelmezni, felesleges erőfeszítéseket igényelhet anélkül, hogy megbízható védelmet nyújtana, különösen akkor, ha egy kis szolgáltató nem engedheti meg magának, hogy kitalálja, hogyan fog szólni egy esetleges szabvány. – Diese Sorge ist berechtigt: Eine Anforderung, die niemand einheitlich auslegen kann, kann Aufwand verursachen, ohne zuverlässigen Schutz zu bieten, insbesondere wenn sich ein kleiner Anbieter nicht leisten kann, zu erraten, wie eine spätere Norm lauten wird.
58. A halasztás emellett olyan időszakot hagy maga után, amelyben az önkéntes gyakorlat, a hatályos jog, a szakmai megítélés és a rendelkezésre álló felügyelet viselik a terhek nagyobb részét. – Eine Verzögerung lässt zudem einen Zeitraum, in dem freiwillige Praktiken, bestehendes Recht, fachliches Urteilsvermögen und verfügbare Aufsicht einen größeren Teil der Last tragen.
59. Egy szabály elfogadásának kijelentése tehát nem azonos azzal, hogy azt jelenleg minden érintett felhasználási területen végrehajthatónak nyilvánítanánk. – Eine Vorschrift als verabschiedet zu bezeichnen, ist daher etwas anderes, als zu sagen, dass sie derzeit für jede erfasste Nutzung durchsetzbar ist.
60. Ez a megkülönböztetés mind a fejlesztők, mind a felhasználók számára fontos. – Diese Unterscheidung ist sowohl für Entwickler als auch für Nutzer von Bedeutung.
61. A jogi kategóriák önmagukban nem biztosíthatnak hozzáférést. – Rechtliche Kategorien allein können keinen Zugang gewährleisten.
62. A Stanford 2025-ös AI-indexe megállapította, hogy a 2024-ben figyelemre méltónak minősített modellek közül közel tízből kilenc az iparból származott, ami a jelentés által meghatározott mintán belül feltűnő koncentrációt jelent, nem pedig az összes AI-munkára kiterjedő felmérést. – Der „Stanford AI Index 2025“ stellte fest, dass fast neun von zehn Modellen, die er im Jahr 2024 als bemerkenswert einstufte, aus der Industrie stammten – eine auffällige Konzentration innerhalb der im Bericht definierten Stichprobe und nicht Teil einer umfassenden Erhebung aller KI-Arbeiten.
63. Az adatnak egyértelmű határai vannak. – Die Zahl hat klare Grenzen.
64. Mindazonáltal rámutat egy aszimmetriára a fejlesztés azon részében, amely a legtöbb figyelmet vonzza: azok a szervezetek, amelyek számos vezető modellt építenek, egyben a legközvetlenebb hozzáféréssel is rendelkeznek a súlyozásaikhoz – azaz a képzés során kialakított numerikus paraméterekhez –, valamint a képzési részletekhez és a belső tesztekhez. – Dennoch verdeutlicht sie eine Asymmetrie in dem Teil der Entwicklung, der die größte Aufmerksamkeit auf sich zieht: Die Organisationen, die viele führende Modelle entwickeln, verfügen auch über den unmittelbarsten Zugang zu deren Gewichten – den während des Trainings festgelegten numerischen Parametern – sowie zu Trainingsdetails und internen Tests.
65. Az egyetemek, a kisebb fejlesztők, az újságírók és az állami szervek esetleg csak azt a felületet láthatják, amelyet használniuk engedélyeznek, így a felület mögött rejtőző viselkedéssel kapcsolatos bizonyítékok tekintetében a szolgáltatótól függenek. – Universitäten, kleinere Entwickler, Journalisten und öffentliche Stellen sehen möglicherweise nur die Schnittstelle, die sie nutzen dürfen, und sind daher auf den Anbieter angewiesen, um Erkenntnisse über das hinter dieser Schnittstelle verborgene Verhalten zu erhalten.
66. Ez a felület elegendő lehet bizonyos hibák feltárásához. – Diese Schnittstelle kann ausreichen, um einige Mängel aufzudecken.
67. Lehet, hogy nem elegendő annak vizsgálatához, hogy egy rendszer hogyan változik finomhangolás, új eszközök vagy sokkal nagyobb léptékű bevezetés hatására, mivel a szűk felület korlátozza a külső csapat által elvégezhető kísérleteket. – Es reicht möglicherweise nicht aus, zu untersuchen, wie sich ein System bei Feinabstimmung, durch neue Werkzeuge oder beim Einsatz in viel größerem Maßstab verändert, da eine eingeschränkte Schnittstelle die Experimente begrenzt, die ein externes Team durchführen kann.
68. A hasznos hozzáférés megkövetelése saját kérdéseket vet fel, mivel az érzékeny modelladatok vagy veszélyes tesztanyagok nyilvánosságra hozatala új lehetőségeket teremthet a visszaélésekre. – Die Forderung nach einem sinnvollen Zugriff wirft eigene Fragen auf, da die Veröffentlichung sensibler Modelldetails oder gefährlichen Testmaterials neue Wege für Missbrauch eröffnen kann.
69. A hatékony felügyelethez ellenőrzött hozzáférésre van szükség. – Eine gute Aufsicht erfordert einen kontrollierten Zugriff.
70. Szükség van egyértelmű célokra, a kutatók védelmére, valamint arra, hogy a külső eredmények eltérése esetén megkérdőjelezhető legyen a szolgáltató állítása, anélkül, hogy feltételeznék, hogy minden tesztet vagy műszaki részletet korlátozás nélkül közzé kell tenni. – Sie benötigt klare Ziele, Schutz für Forscher und eine Möglichkeit, die Darstellung eines Anbieters anzufechten, wenn externe Ergebnisse davon abweichen – ohne davon auszugehen, dass jeder Test oder jedes technische Detail uneingeschränkt veröffentlicht werden sollte.
71. A bizonyítékok feletti ellenőrzés az egyes kockázatok felismerésének ellenőrzésévé válhat, különösen akkor, ha a külsősök nem tudják megismételni a tesztet, vagy nem tudják meg, hogy egy bejelentett sebezhetőség változáshoz vezetett-e. – Die Kontrolle über Beweismittel kann zur Kontrolle darüber werden, welche Risiken erkannt werden, insbesondere wenn Außenstehende einen Test nicht wiederholen oder in Erfahrung bringen können, ob eine gemeldete Schwachstelle zu einer Änderung geführt hat.
72. A kérdés nem az, hogy a vállalatok rendelkeznek-e szakértelemmel; mérnökeik gyakran jobban értik a rendszert, mint bárki más a rendszeren kívülről. – Die Frage ist nicht, ob Unternehmen über Fachwissen verfügen; ihre Ingenieure verstehen das System oft besser als jeder Außenstehende.
73. A kérdés az, hogy kereskedelmi ütemtervüket és a bizonyítékok feletti ellenőrzésüket ellenőrizhetik-e olyan személyek, akiknek más ösztönzőik vannak és törvényes felhatalmazással rendelkeznek. – Die Frage ist, ob ihr kommerzieller Zeitplan und ihre Kontrolle über die Beweismittel von Personen überprüft werden können, die andere Anreize und legitime Befugnisse haben.
74. A tesztelés időt és pénzt igényel. – Tests kosten Zeit und Geld.
75. Ha minden frissítés kimerítő ellenőrzést igényelne, a kisebb szolgáltatók nehézségekbe ütközhetnek, míg a nagy, piacon már jelen lévő szereplők könnyebben tudnák fedezni a költségeket, így a felhasználók védelmét célzó szabály belépési korlátot jelentene. – Würde jedes Update eine umfassende Überprüfung erfordern, könnten kleinere Anbieter in Schwierigkeiten geraten, während große etablierte Unternehmen die Kosten leichter auffangen könnten, wodurch eine Vorschrift, die eigentlich den Nutzern Schutz bieten soll, zu einer Eintrittsbarriere würde.
76. Ha az ellenőrzés túl felületes, a költségek átterhelődhetnek a végfelhasználókra, az állami intézményekre és a hibáknak kitett emberekre. – Ist die Überprüfung zu oberflächlich, könnten die Kosten auf nachgelagerte Nutzer, öffentliche Einrichtungen und Personen abgewälzt werden, die von Ausfällen betroffen sind.
77. A terheknek mind a hatókört, mind a kárt tükrözniük kell. – Die Belastung sollte sowohl die Reichweite als auch den Schaden widerspiegeln.
78. Éppen ezért a tesztnek döntési szabályhoz kell vezetnie, nem csupán egy nyugtató jelentéshez. – Aus diesem Grund sollte ein Test zu einer Entscheidungsregel führen und nicht lediglich zu einem beruhigenden Bericht.
79. Egy megállapítás indokolhatja egy újabb teszt elvégzését, szűkebb körű bevezetést vagy szigorúbb biztonsági intézkedéseket; vagy éppen azt igényelheti, hogy megmagyarázzák, miért nem vezet a megfigyelt képesség még valószínű kárhoz a javasolt környezetben. – Ein Befund könnte einen weiteren Test, einen eingeschränkteren Einsatz oder strengere Sicherheitsvorkehrungen rechtfertigen; er könnte stattdessen eine Erklärung erfordern, warum die beobachtete Fähigkeit in dem vorgeschlagenen Umfeld noch nicht mit einem plausiblen Schaden in Verbindung gebracht werden kann.
80. Minden válasz felülvizsgálható legyen, ha a bizonyítékok változnak. – Jede Reaktion sollte überarbeitbar sein, wenn sich die Beweislage ändert.
81. Egy amerikai keretrendszer egy másik megközelítést kínál. – Ein amerikanisches Rahmenwerk bietet einen anderen Ansatz.
82. A 2023-ban közzétett AI Risk Management Framework (Mesterséges Intelligencia Kockázatkezelési Keretrendszer) önkéntes alapon működik, és különböző szektorokra és felhasználási területekre lett kialakítva . – Das 2023 veröffentlichte „AI Risk Management Framework“ ist freiwillig und für verschiedene Sektoren und Anwendungsbereiche konzipiert .
83. Arra kéri a szervezeteket, hogy kezeljék a kockázatot, térképezzék fel a rendszer működési környezetét, mérjék fel a releváns tulajdonságokat, és kezeljék a megállapításaikat. – Es fordert Organisationen dazu auf, Risiken zu steuern, den Kontext zu erfassen, in dem ein System betrieben wird, relevante Eigenschaften zu messen und die gewonnenen Erkenntnisse zu verwalten.
84. A keretrendszer útmutatást nyújthat egy csapatnak még mielőtt a jogi besorolás végleges lenne, vagy amikor egy rendszer egy adott joghatóságon kívül működik, mivel kérdései az alkalmazás céljához és környezetéhez igazíthatók. – Das Rahmenwerk kann einem Team als Orientierung dienen, bevor eine rechtliche Einstufung feststeht oder wenn ein System außerhalb einer bestimmten Rechtsordnung betrieben wird, da seine Fragen an den Zweck und den Kontext einer Nutzung angepasst werden können.
85. Rugalmassága erősségnek bizonyul, ha az alkalmazások eltérőek. – Seine Flexibilität ist eine Stärke, wenn sich die Anwendungsfälle unterscheiden.
86. Egy laboratóriumi asszisztens, egy íróeszköz és egy ipari folyamathoz kapcsolódó szoftver nem vet fel pontosan ugyanazokat a kérdéseket, és nem igényel ugyanazokat a bizonyítékokat, még akkor sem, ha mindhárom egy rokon modelltípus-családra épül. – Ein Laborassistent, ein Schreibwerkzeug und eine mit einem industriellen Prozess verbundene Software werfen nicht genau dieselben Fragen auf oder erfordern dieselben Nachweise, selbst wenn alle drei auf einer verwandten Modellfamilie basieren.
87. Ugyanez a rugalmasság egyben korlátot is jelent, mivel a keretrendszer közzététele nem bizonyítja, hogy egy adott szervezet betartja azt, vagy kijavít egy ismert hibát. – Dieselbe Flexibilität stellt zugleich eine Einschränkung dar, da die Veröffentlichung eines Rahmenwerks nicht belegen kann, dass eine bestimmte Organisation es befolgt oder einen bekannten Mangel behebt.
88. Az önkéntes iránymutatás javíthatja a gyakorlatot, ha ösztönzők, szakmai normák, szerződések és a nyilvános ellenőrzés támogatja, de egy szkeptikus megfigyelőnek továbbra is bizonyítékra van szüksége ahhoz, hogy egy adott szervezet elvégezte az ígért munkát. – Freiwillige Leitlinien können die Praxis verbessern, wenn Anreize, berufliche Normen, Verträge und öffentliche Kontrolle dies unterstützen; ein skeptischer Beobachter benötigt jedoch nach wie vor Belege dafür, dass eine bestimmte Organisation die versprochene Arbeit geleistet hat.
89. Nem helyettesítheti azt a hatóságot, amely képes információt kérni vagy érvényes szabályt érvényesíteni, ha az együttműködés meghiúsul. – Sie kann keine Behörde ersetzen, die in der Lage ist, Informationen einzufordern oder eine geltende Vorschrift durchzusetzen, wenn die Zusammenarbeit versagt.
90. A jog és az iránymutatás különböző problémákat old meg. – Gesetz und Leitlinien lösen unterschiedliche Probleme.
91. A jog kötelezettségeket és hatásköröket állapít meg; egy rugalmas keretrendszer segíthet az embereknek abban, hogy kitalálják, mely tesztek és ellenőrzések értelmesek az adott környezetben. – Das Gesetz legt Pflichten und Befugnisse fest; ein flexibler Rahmen kann den Beteiligten helfen, herauszufinden, welche Tests und Kontrollen in ihrem Umfeld sinnvoll sind.
92. Egyik sem nyújt teljes áttekintést a jövőbeli felhasználásokról. – Keines von beiden liefert eine vollständige Übersicht über zukünftige Anwendungsfälle.
93. Egy adatbázishoz való váratlan kapcsolódás vagy egy új szoftvereszköz megváltoztathatja egy ismerős modell működését anélkül, hogy megváltoztatná annak alapjául szolgáló súlyozását, ami azt jelenti, hogy egy modellteszt önmagában elmulaszthatja a releváns változást. – Eine unerwartete Anbindung an eine Datenbank oder ein neues Software-Tool kann die Leistungsfähigkeit eines vertrauten Modells verändern, ohne dessen zugrunde liegende Gewichtung zu ändern, was bedeutet, dass ein Modelltest allein die relevante Änderung möglicherweise übersieht.
94. Ez az egyik oka annak, hogy a kiadás utáni figyelemmel kísérésnek ki kell terjednie a környező alkalmazásra is, és nem csupán az eredeti modell benchmark-eredményének megismétlésére kell korlátozódnia. – Das ist ein Grund, warum die Überwachung nach der Freigabe die umgebende Anwendung einbeziehen muss und nicht nur eine Wiederholung des Benchmark-Ergebnisses des ursprünglichen Modells sein darf.
95. A megfigyelőnek tudnia kell, melyik verzió futott, milyen eszközöket használhatott, és milyen emberi ellenőrzések voltak ténylegesen érvényben, mert a működő rendszer ismerete nélkül a hibát nem lehet megfelelően beazonosítani vagy kijavítani. – Der Beobachter muss wissen, welche Version ausgeführt wurde, welche Tools sie nutzen konnte und welche manuellen Überprüfungen tatsächlich stattfanden, denn ein Fehler kann nicht richtig zugeordnet oder behoben werden, wenn das funktionierende System unbekannt ist.
96. Ellenkező esetben egy látszólagos javulás egy biztonságosabb munkafolyamat eredménye lehet, vagy egy látszólagos hiba egy olyan integrációból származhat, amelyet az eredeti szolgáltató soha nem látott . – Andernfalls könnte eine scheinbare Verbesserung das Ergebnis eines sichereren Arbeitsablaufs sein, oder ein scheinbarer Fehler könnte von einer Integration herrühren, die der ursprüngliche Anbieter nie gesehen hat .
97. A javítás ezeken a megkülönböztetéseken múlik. – Die Korrektur hängt von diesen Unterscheidungen ab.
98. Egy központilag működtetett szolgáltatásban a szolgáltató letilthat egy funkciót, szűrőt módosíthat, vagy visszavonhatja a hozzáférést az általa ellenőrzött szolgáltatáson keresztül. – Bei einem zentral betriebenen Dienst kann ein Anbieter eine Funktion sperren, einen Filter ändern oder den Zugriff über den von ihm kontrollierten Dienst entziehen.
99. Ugyanez a beavatkozás nehezebb, ha a modell súlyait másoknak is átadták, vagy olyan termékekbe másolták, amelyek különböző ütemezés szerint frissülnek, mivel az eredeti szolgáltató már nem ellenőrzi az összes futó példányt. – Derselbe Eingriff ist schwieriger, wenn Modellgewichte an andere verteilt oder in Produkte kopiert wurden, die nach unterschiedlichen Zeitplänen aktualisiert werden, da der ursprüngliche Anbieter nicht mehr jede laufende Kopie kontrolliert.
100. Még egy sikeres technikai visszavonás sem tudja kitörölni azt a káros kimenetet, amely alapján már cselekedtek. – Selbst ein erfolgreicher technischer Entzug kann eine schädliche Ausgabe, auf die bereits reagiert wurde, nicht ungeschehen machen.
101. A visszafordíthatóságnak van tulajdonosa és tárgya. – Reversibilität hat einen Verantwortlichen und ein Objekt.
102. Egy rendszergazda leállíthatja a jövőbeli lekérdezéseket , míg a korábbi döntés által károsított személynek továbbra is szüksége van értesítésre, jogorvoslatra és magyarázatot arra, hogyan történt. – Ein Administrator kann zukünftige Abfragen stoppen , während eine Person, die durch eine frühere Entscheidung geschädigt wurde, weiterhin eine Benachrichtigung, Abhilfe sowie eine Erklärung dafür, wie es dazu gekommen ist.
103. Ezért kell a hibák nyilvántartását összekapcsolni egy javítási útvonalakkal, ahol a javítás lehetséges, valamint egy őszinte beszámolóval azokról a veszteségekről, amelyeket nem lehet egyszerűen visszacsinálni. – Aus diesem Grund muss eine Aufzeichnung von Fehlern mit einem Weg zur Behebung verbunden sein, sofern eine Behebung möglich ist, sowie mit einer ehrlichen Darstellung der Verluste, die nicht einfach rückgängig gemacht werden können.
104. Ez magyarázza azt is, miért érdemel figyelmet a kiadás választása, mielőtt a terjesztés miatt egyes visszatérési útvonalak drágákká vagy elérhetetlenné válnának. – Dies erklärt auch, warum die Wahl des Veröffentlichungszeitpunkts Beachtung verdient, bevor die Verbreitung bestimmte Rückwege kostspielig oder unzugänglich macht.
105. A kiadásnak több mint két beállítása van. – Die Veröffentlichung kennt mehr als zwei Stufen.
106. A hozzáférés szakaszosan valósítható meg, meghatározott felhasználókkal , eszközök és felhasználási módok számára, ahogy a bizonyítékok gyűlnek, feltéve, hogy a feltételek érvényesíthetők, hatásuk megfigyelhető, és a szűkebb első szakasz nem válik észrevétlenül állandóvá. – Der Zugriff kann stufenweise erfolgen, wobei sich die Anzahl der zugelassenen Nutzer , Tools und Verwendungszwecken schrittweise gewährt wird, je mehr Belege vorliegen – vorausgesetzt, die Bedingungen können durchgesetzt, ihre Auswirkungen beobachtet werden und eine eng gefasste erste Stufe nicht stillschweigend dauerhaft wird.
107. Az ilyen fokozatos hozzáférés lassíthatja a hasznos felfedezéseket, és túlzott ellenőrzést biztosíthat a szolgáltatónak azon felett, hogy ki kísérletezhet. – Eine solche stufenweise Freigabe kann nützliche Entdeckungen verlangsamen und einem Anbieter übermäßige Kontrolle darüber verschaffen, wer experimentieren darf.
108. A független felülvizsgálat és a nyilvános indoklás különösen fontosakká válnak, amikor egy vállalat egyszerre ellenőrzi mind a modellt, mind azt a kaput, amelyen keresztül a versenytársak vagy a kutatók eljutnak hozzá. – Eine unabhängige Überprüfung und öffentliche Begründungen gewinnen besonders an Bedeutung, wenn ein Unternehmen sowohl das Modell als auch das Tor kontrolliert, durch das Wettbewerber oder Forscher Zugang dazu erhalten.
109. A korlátozásoknak azonosítható kockázatokra kell válaszul szolgálniuk, és az érintetteknek lehetőséget kell biztosítani arra, hogy megtámadjanak egy olyan korlátozást, amely inkább a piaci szereplőt védi, mint a közérdeket – ez a lehetőség egyre nagyobbá válik, ha a tesztelési és a kereskedelmi hozzáférésnek ugyanaz a kapuőre van. – Einschränkungen sollten auf identifizierbare Risiken reagieren, und die Betroffenen sollten die Möglichkeit haben, eine Einschränkung anzufechten, die einen etablierten Anbieter stärker schützt als die Öffentlichkeit – eine Möglichkeit, die zunimmt, wenn Testzugang und kommerzieller Zugang denselben Gatekeeper haben.
110. Az ellenkező veszélyt az a korlátlan ígéret jelenti, hogy figyelemmel kísérik, mi történik a széles körű bevezetés után, anélkül, hogy képesek lennének reagálni. – Die gegenteilige Gefahr besteht in einem unbefristeten Versprechen, zu beobachten, was nach einer breiten Veröffentlichung geschieht, ohne die Fähigkeit zu haben, darauf zu reagieren.
111. A nyomon követéshez felelősségteljes címzettre van szükség. – Die Überwachung erfordert einen verantwortungsbewussten Adressaten.
112. A 2024 Institute tesztje azért tanulságos, mert eredményei még a nyilvános kiadás előtt eljutottak a fejlesztőhöz, amikor egy esetleges reagálás még alakíthatta a használat kezdeti feltételeit. – Der Test des Instituts aus dem Jahr 2024 ist aufschlussreich, da seine Ergebnisse den Entwickler bereits vor der öffentlichen Veröffentlichung erreichten – zu einem Zeitpunkt, als eine Reaktion noch die anfänglichen Nutzungsbedingungen beeinflussen konnte.
113. A szerzők pontosan meg is határozták, hol ér véget a tudásuk: korlátozott idő, véges erőforrások és a tesztelt felállásra érzékeny eredmények – mindezt a későbbi olvasónak szem előtt kell tartania, mielőtt az eredményeket más felhasználási területekre kiterjesztené. – Die Autoren wiesen zudem genau darauf hin, wo ihre Erkenntnisse an ihre Grenzen stießen: begrenzte Zeit, endliche Ressourcen und Ergebnisse, die von der getesteten Konfiguration abhängig waren – all dies muss ein späterer Leser berücksichtigen, bevor er die Ergebnisse auf andere Anwendungsfälle überträgt.
114. Ez az őszinteség az eredményt hasznosabbá teszi, mint amilyen egy biztonsági ítélet lett volna. – Diese Offenheit macht das Ergebnis nützlicher, als es ein Sicherheitsurteil gewesen wäre.
115. Megmutatja a későbbi megfigyelőknek, mely feltételezéseket kell felülvizsgálniuk, amikor a modell új eszközökkel és új felhasználókkal találkozik, így a későbbi tesztnek valami hasznosabbat ad, mint egy régi pontszámot, amellyel összehasonlíthatják az eredményeket. – Es zeigt späteren Beobachtern, welche Annahmen überprüft werden müssen, wenn das Modell auf neue Werkzeuge und neue Nutzer trifft, und bietet einem späteren Test damit etwas Nützlicheres als eine alte Bewertung zum Vergleich.
116. Egy hatékony ellenőrzési rendszer megőrzi azt a láncot, amely a kérdéstől a bizonyítékon át a beavatkozásig terjed, a kiadás határain túl is. – Ein wirksames Kontrollsystem bewahrt diese Kette von der Fragestellung über den Nachweis bis hin zur Intervention über die Veröffentlichungsgrenze hinweg.
117. A lánc bármelyik láncszeménél megszakadhat, ha egy tesztelőnek nincs hozzáférése, egy operátor eltitkol egy incidenst, vagy egy hatóságnak nincs eszköze cselekedni, mielőtt ugyanaz a gyengeség egy másik környezetet is elérne. – Die Kette kann an jedem Glied reißen, wenn einem Tester der Zugriff fehlt, ein Betreiber einen Vorfall verschweigt oder einer Behörde die Mittel fehlen, um zu handeln, bevor dieselbe Schwachstelle eine andere Umgebung erreicht.
118. A sebesség meghatározza, milyen gyorsan válnak ezek a megszakadások jelentőssé, mert egy hiba számos integráción átterjedhet, mielőtt egyetlen felhasználó is felismerné a mintát. – Geschwindigkeit beeinflusst, wie schnell solche Brüche zur Folge haben, denn ein Fehler kann sich durch viele Integrationen ausbreiten, bevor ein einzelner Nutzer ein Muster erkennt.
119. A kiadás előtti rövid időintervallum fontos. – Das kurze Intervall vor der Freigabe ist entscheidend.
120. Ez az a pillanat, amikor a lehetséges felhasználások legnagyobb száma lehetséges felhasználás még előttünk áll, és a legkevesebb példány már elérhetetlen. – Es ist der Moment, in dem die größte Anzahl möglicher Anwendungsfälle noch vor uns liegt und die geringste Anzahl von Kopien bereits außer Reichweite ist.
(aufklappen)magyar
1. A brit és amerikai MI-biztonsági intézetek rövid időt kaptak arra, hogy egy új, általános célú modellt teszteljenek annak 2024. decemberi nyilvános megjelenése előtt.
2. Kutatóik kiberbiztonsági, biológiai és szoftverfejlesztési feladatokat próbáltak ki, majd megosztották eredményeiket a fejlesztővel, mielőtt a felhasználók szélesebb körű hozzáférést kaptak volna egy olyan rendszerhez, amelyet hamarosan nagyon különböző környezetben is használhatnak.
3. Az idő szorított.
4. Az intézetek kiválaszthatták a teszteket és adaptálhatták módszereiket, de nem tudták megfigyelni minden lehetséges jövőbeli felhasználási módot, és nem tudták reprodukálni a modell, a felhasználó és eszköz közötti minden kombinációt.
5. A nyilvánosságra hozatal után ugyanazt a modellt új eszközökkel párosíthatják, ismeretlen termékekbe építhetik be, és olyan célokra használhatják, amelyeket az értékelők nem választottak ki.
6. Ez a rés jelenti a legfőbb nehézséget egy olyan technológia szabályozásában, amely szinte bárhol hasznos lehet.
7. A nyilvános jelentés nem tartalmazott megfelelési igazolást.
8. Az eredményeket előzetesnek minősítette, és kifejtette, hogy a tesztelt verziónak nehézségei voltak az eszközök használatával és a szükséges kimeneti formátum előállításával – ezek a részletek megváltoztatták, hogy mit jelenthet ésszerűen egy pontszám.
9. Amikor az értékelők módosították a környezeti beállításokat, hogy segítsék a rendszert a hibákból való helyreállásban, a mért teljesítmény megváltozott, ami arra emlékeztetett, hogy egy modell képességei részben a köré épített rendszertől függenek.
10. A kutatók meghatározott feltételek mellett tesztelték a képességeket, nem számolták össze a világban megelőzött károkat.
11. A kiadás előtt tanultak belőle.
12. A kiadás előtt nem tudtak mindent megtanulni.
13. Egy képesség felfedezése sem jelenti azt, hogy valaki azt kárt okozásra fogja használni; egy laboratóriumi feladatból hiányozhatnak azok a készségek, motiváció, erőforrások és lehetőségek, amelyek a valós világban bekövetkező kár előidézéséhez szükségesek.
14. Mindazonáltal a kiadás előtti teszt feltárhat egy problémát, miközben a fejlesztő szokatlanul erős ellenőrzést gyakorol a következő lépés felett.
15. A fejlesztő módosíthatja a biztonsági intézkedéseket, szűkítheti a hozzáférést, elhalaszthat egy funkciót, vagy további vizsgálatot kezdeményezhet, mielőtt a másolatok és integrációk elszaporodnának.
16. A kiadás mind az információt, mind az ellenőrzést megváltoztatja.
17. A tényleges használat olyan hibákat tár fel, amelyeket egy mesterséges teszt esetleg elmulasztana, miközben minden új kapcsolat külső szoftverekkel újabb helyet teremt, ahová a javításnak el kell jutnia.
18. A megfigyelés ezért csak akkor értékes, ha valaki cselekedhet is az alapján.
19. A hiba felfedezése és kijavítása közötti különbség részben a szoftvertervezésben, részben pedig azokban a szabályokban rejlik, amelyek meghatározzák, ki láthatja a bizonyítékokat, ki követelhet intézkedést, és ki ellenőrizheti, hogy az intézkedés hatott-e.
20. Az, hogy ki kapja meg a bizonyítékokat, ki követelhet változtatást, és ki viseli a késedelem költségeit, mind fontos kérdés, mielőtt egy modell elhagyja a laboratóriumot.
21. A 2024-es gyakorlat a független tesztelés ígéretét és korlátait egyaránt megmutatja.
22. A külső szakértők olyan nézőpontot nyújtottak, amelyet a fejlesztő saját értékelése nem tudott teljes mértékben pótolni, ugyanakkor hozzáférésüket, idejüket és tesztkörnyezetüket olyan megállapodások korlátozták, amelyek egyben meghatározták, hogy mely kockázatokat vizsgálhatnak.
23. A függetlenség nem biztosít végtelen lefedettséget.
24. Hitelesebbé teheti egy állítást, ha az értékelők érdemi kérdéseket választhatnak, feltárhatják a korlátokat, és jelenthetik az eredményeket anélkül, hogy védeniük kellene a termék bevezetését.
25. Ehhez erőforrásokra, valamint hivatalos engedélyre is szükség van.
26. Az érzékeny tesztekhez biztonságos környezetre, szakértő személyzetre és gondosan kiválasztott összehasonlításokra lehet szükség, míg egy ismeretlen rendszer sietve meghívott ellenőrzése alig többet eredményezhet, mint egy adott konfiguráció pillanatfelvételét.
27. A brit intézet leírta egy többszintű megközelítést, amelyben a gyors ellenőrzések mélyebb vizsgálatot indíthatnak el, ha az eredmények indokolják, így az értékelők a költséges kézi vizsgálatokat oda koncentrálhatják, ahol az első eredmények azt igénylik.
28. Az ilyen sorrend a szűkös tesztelési időt ott fordítja, ahol a figyelmeztető jelek a legerősebbek, bár egy olyan kezdeti teszt, amely elmulaszt egy veszélyt, soha nem indíthatja el a következő szintet.
29. A tesztelés elhalaszthatja a hasznos hozzáférést.
30. A kutatók, a kisvállalkozások és a közszolgáltatások elveszíthetik a lehetőségeket, ha egy széles körben hasznos rendszert homályos vagy vitathatatlan okok miatt visszatartják.
31. A gyorsaság azonban nem jár ingyen, ha egy fel nem fedezett hiba költségei azokra hárulnak, akik nem ők választották a bevezetési ütemtervet.
32. A döntésnek olyan konkrét indokokra van szüksége, amelyek vizsgálhatók: melyik képességet tesztelték, milyen kárt okozhatna, mennyire hasonlít a teszt a tényleges használatra, és mennyire bizonytalan ez az összefüggés.
33. Az európai jog különálló kategóriákat alkalmaz.
34. Az Európai Unió 2024-ben elfogadott és 2026-ban módosított mesterséges intelligencia törvénye (AI Act) tilt bizonyos gyakorlatokat, követelményeket állapít meg meghatározott, magas kockázatú felhasználásokra, és további kötelezettségeket ró az általános , amelyek rendszerszintű kockázatot jelentenek.
35. Ezek a kategóriák különböző kérdésekre adnak választ.
36. A tilalom a rendelet szerint elfogadhatatlannak ítélt gyakorlatra vonatkozik, míg a magas kockázatú rendszerekre vonatkozó követelmények azt szabályozzák, hogy egy engedélyezett rendszert hogyan kell megtervezni, dokumentálni, ellenőrizni és használni.
37. A rendszerkockázatot jelentő általános célú modellekre vonatkozó kötelezettségek olyan, széles körben újrafelhasználható modellekre vonatkoznak, amelyek képességei számos utólagos alkalmazási környezetben kockázatot jelenthetnek.
38. A kategóriák nem minősítenek minden általános modellt magas kockázatú alkalmazássá.
39. Az a szervezet, amely egy modellt jelentős következményekkel járó szolgáltatásba épít be, döntéseket hoz a szolgáltatás céljáról, a felhasználókról, az adatokról, a biztonsági intézkedésekről és a rendelkezésre álló emberi felülvizsgálatról.
40. Az eredeti modellszolgáltató nem ismerheti minden jövőbeli integrációt, de a modellt bevezető szervezet sem tekintheti a modell örökölt viselkedését mások teljes felelősségének, amikor a környezetet és a biztonsági intézkedéseket választja.
41. A felelősség azokhoz a döntésekhez kapcsolódik, amelyekre az egyes szereplők ténylegesen hatással lehetnek.
42. A törvény értelmében a rendszerkockázattal járó, minősített általános célú modellek szolgáltatóinak értékelniük és csökkenteniük kell a rendszerkockázatokat, valamint a vonatkozó rendelkezések szerint be kell jelenteniük a súlyos incidenseket.
43. Az egyes magas kockázatú rendszerekre vonatkozó követelmények magukban foglalják a kockázatkezelést és az piaci utólagos nyomon követést, amelyek összekapcsolják a kezdeti értékelést a bevezetés után összegyűjtött bizonyítékokkal.
44. Egyik sem követeli meg hivatalos tesztelést minden kiadás előtt.
45. A törvény a hatóságoknak is szerepet szán a felügyeletben és a végrehajtásban, míg a független kutatók – amennyiben megfelelő hozzáféréssel rendelkeznek – ellenőrizhetik az állításokat és feltárhatják a vakfoltokat.
46. Szerepeik átfedik egymást, de nem olvadnak össze.
47. Egy értékelő azonosíthat egy aggasztó képességet, de nem feltétlenül rendelheti el a szolgáltatónak a szolgáltatás módosítását; egy hatóság rendelkezhet jogi hatáskörrel rendelkezik, de azok hatékony alkalmazásához szüksége van az értékelő műszaki bizonyítékaira és az üzemeltető gyakorlati megfigyeléseire.
48. Egy szolgáltató központilag módosíthatja az általa üzemeltetett modellt, míg egy utólagos üzemeltető lehet az egyetlen szereplő, aki látja, hogyan működik az adott modell egy konkrét munkahelyen.
49. Az érintett felhasználónak gyakran van a legegyértelműbb bizonyítéka egy konkrét meghibásodásra, ugyanakkor a legkevesebb hatalma van a háttérben működő rendszer megváltoztatására.
50. Egy incidensjelentés akkor válik hasznossá, ha eljuthat a felfedezés helyszínéről ahhoz, akinek kötelessége és képessége van beavatkozni, és amikor a válaszintézkedés eléri azokat az embereket, akiket már érintett a probléma.
51. Az időzítés bonyolítja az uniós szabályokat.
52. A törvény 2024 augusztusában lépett hatályba, de rendelkezései nem az elfogadás napján, hanem fokozatosan kezdtek alkalmazásra kerülni, így a jogi döntés dátuma és a kötelező kötelezettség dátuma eltér egymástól.
53. Az általános célú modellekre vonatkozó szabályok 2025 augusztusában léptek hatályba, a már forgalomban lévő modellekre vonatkozó átmeneti rendelkezések figyelembevételével.
54. A 2026-os módosítás a III. mellékletben felsorolt számos magas kockázatú rendszerre vonatkozó alapvető követelmények alkalmazását 2027. decemberéig, az I. mellékletben szereplő bizonyos szabályozott termékek esetében pedig 2028. augusztusáig halasztotta.
55. Ezek a dátumok azt jelzik, hogy mikor lépnek hatályba a meghatározott jogi kötelezettségek, nem pedig azt, hogy a modell mikor válik először képessé arra, hogy bárkinek segítséget nyújtson vagy kárt okozzon.
56. A módosítás a szabványok, iránymutatások és az intézményi felkészülés késedelmét hozta fel indokként a további időnyerésre, rámutatva a gyors védelem iránti igény és a bonyolult szabály következetes alkalmazására irányuló képesség közötti feszültségre.
57. Ez az aggodalom megalapozott: egy olyan követelmény, amelyet senki sem tud következetesen értelmezni, felesleges erőfeszítéseket igényelhet anélkül, hogy megbízható védelmet nyújtana, különösen akkor, ha egy kis szolgáltató nem engedheti meg magának, hogy kitalálja, hogyan fog szólni egy esetleges szabvány.
58. A halasztás emellett olyan időszakot hagy maga után, amelyben az önkéntes gyakorlat, a hatályos jog, a szakmai megítélés és a rendelkezésre álló felügyelet viselik a terhek nagyobb részét.
59. Egy szabály elfogadásának kijelentése tehát nem azonos azzal, hogy azt jelenleg minden érintett felhasználási területen végrehajthatónak nyilvánítanánk.
60. Ez a megkülönböztetés mind a fejlesztők, mind a felhasználók számára fontos.
61. A jogi kategóriák önmagukban nem biztosíthatnak hozzáférést.
62. A Stanford 2025-ös AI-indexe megállapította, hogy a 2024-ben figyelemre méltónak minősített modellek közül közel tízből kilenc az iparból származott, ami a jelentés által meghatározott mintán belül feltűnő koncentrációt jelent, nem pedig az összes AI-munkára kiterjedő felmérést.
63. Az adatnak egyértelmű határai vannak.
64. Mindazonáltal rámutat egy aszimmetriára a fejlesztés azon részében, amely a legtöbb figyelmet vonzza: azok a szervezetek, amelyek számos vezető modellt építenek, egyben a legközvetlenebb hozzáféréssel is rendelkeznek a súlyozásaikhoz – azaz a képzés során kialakított numerikus paraméterekhez –, valamint a képzési részletekhez és a belső tesztekhez.
65. Az egyetemek, a kisebb fejlesztők, az újságírók és az állami szervek esetleg csak azt a felületet láthatják, amelyet használniuk engedélyeznek, így a felület mögött rejtőző viselkedéssel kapcsolatos bizonyítékok tekintetében a szolgáltatótól függenek.
66. Ez a felület elegendő lehet bizonyos hibák feltárásához.
67. Lehet, hogy nem elegendő annak vizsgálatához, hogy egy rendszer hogyan változik finomhangolás, új eszközök vagy sokkal nagyobb léptékű bevezetés hatására, mivel a szűk felület korlátozza a külső csapat által elvégezhető kísérleteket.
68. A hasznos hozzáférés megkövetelése saját kérdéseket vet fel, mivel az érzékeny modelladatok vagy veszélyes tesztanyagok nyilvánosságra hozatala új lehetőségeket teremthet a visszaélésekre.
69. A hatékony felügyelethez ellenőrzött hozzáférésre van szükség.
70. Szükség van egyértelmű célokra, a kutatók védelmére, valamint arra, hogy a külső eredmények eltérése esetén megkérdőjelezhető legyen a szolgáltató állítása, anélkül, hogy feltételeznék, hogy minden tesztet vagy műszaki részletet korlátozás nélkül közzé kell tenni.
71. A bizonyítékok feletti ellenőrzés az egyes kockázatok felismerésének ellenőrzésévé válhat, különösen akkor, ha a külsősök nem tudják megismételni a tesztet, vagy nem tudják meg, hogy egy bejelentett sebezhetőség változáshoz vezetett-e.
72. A kérdés nem az, hogy a vállalatok rendelkeznek-e szakértelemmel; mérnökeik gyakran jobban értik a rendszert, mint bárki más a rendszeren kívülről.
73. A kérdés az, hogy kereskedelmi ütemtervüket és a bizonyítékok feletti ellenőrzésüket ellenőrizhetik-e olyan személyek, akiknek más ösztönzőik vannak és törvényes felhatalmazással rendelkeznek.
74. A tesztelés időt és pénzt igényel.
75. Ha minden frissítés kimerítő ellenőrzést igényelne, a kisebb szolgáltatók nehézségekbe ütközhetnek, míg a nagy, piacon már jelen lévő szereplők könnyebben tudnák fedezni a költségeket, így a felhasználók védelmét célzó szabály belépési korlátot jelentene.
76. Ha az ellenőrzés túl felületes, a költségek átterhelődhetnek a végfelhasználókra, az állami intézményekre és a hibáknak kitett emberekre.
77. A terheknek mind a hatókört, mind a kárt tükrözniük kell.
78. Éppen ezért a tesztnek döntési szabályhoz kell vezetnie, nem csupán egy nyugtató jelentéshez.
79. Egy megállapítás indokolhatja egy újabb teszt elvégzését, szűkebb körű bevezetést vagy szigorúbb biztonsági intézkedéseket; vagy éppen azt igényelheti, hogy megmagyarázzák, miért nem vezet a megfigyelt képesség még valószínű kárhoz a javasolt környezetben.
80. Minden válasz felülvizsgálható legyen, ha a bizonyítékok változnak.
81. Egy amerikai keretrendszer egy másik megközelítést kínál.
82. A 2023-ban közzétett AI Risk Management Framework (Mesterséges Intelligencia Kockázatkezelési Keretrendszer) önkéntes alapon működik, és különböző szektorokra és felhasználási területekre lett kialakítva .
83. Arra kéri a szervezeteket, hogy kezeljék a kockázatot, térképezzék fel a rendszer működési környezetét, mérjék fel a releváns tulajdonságokat, és kezeljék a megállapításaikat.
84. A keretrendszer útmutatást nyújthat egy csapatnak még mielőtt a jogi besorolás végleges lenne, vagy amikor egy rendszer egy adott joghatóságon kívül működik, mivel kérdései az alkalmazás céljához és környezetéhez igazíthatók.
85. Rugalmassága erősségnek bizonyul, ha az alkalmazások eltérőek.
86. Egy laboratóriumi asszisztens, egy íróeszköz és egy ipari folyamathoz kapcsolódó szoftver nem vet fel pontosan ugyanazokat a kérdéseket, és nem igényel ugyanazokat a bizonyítékokat, még akkor sem, ha mindhárom egy rokon modelltípus-családra épül.
87. Ugyanez a rugalmasság egyben korlátot is jelent, mivel a keretrendszer közzététele nem bizonyítja, hogy egy adott szervezet betartja azt, vagy kijavít egy ismert hibát.
88. Az önkéntes iránymutatás javíthatja a gyakorlatot, ha ösztönzők, szakmai normák, szerződések és a nyilvános ellenőrzés támogatja, de egy szkeptikus megfigyelőnek továbbra is bizonyítékra van szüksége ahhoz, hogy egy adott szervezet elvégezte az ígért munkát.
89. Nem helyettesítheti azt a hatóságot, amely képes információt kérni vagy érvényes szabályt érvényesíteni, ha az együttműködés meghiúsul.
90. A jog és az iránymutatás különböző problémákat old meg.
91. A jog kötelezettségeket és hatásköröket állapít meg; egy rugalmas keretrendszer segíthet az embereknek abban, hogy kitalálják, mely tesztek és ellenőrzések értelmesek az adott környezetben.
92. Egyik sem nyújt teljes áttekintést a jövőbeli felhasználásokról.
93. Egy adatbázishoz való váratlan kapcsolódás vagy egy új szoftvereszköz megváltoztathatja egy ismerős modell működését anélkül, hogy megváltoztatná annak alapjául szolgáló súlyozását, ami azt jelenti, hogy egy modellteszt önmagában elmulaszthatja a releváns változást.
94. Ez az egyik oka annak, hogy a kiadás utáni figyelemmel kísérésnek ki kell terjednie a környező alkalmazásra is, és nem csupán az eredeti modell benchmark-eredményének megismétlésére kell korlátozódnia.
95. A megfigyelőnek tudnia kell, melyik verzió futott, milyen eszközöket használhatott, és milyen emberi ellenőrzések voltak ténylegesen érvényben, mert a működő rendszer ismerete nélkül a hibát nem lehet megfelelően beazonosítani vagy kijavítani.
96. Ellenkező esetben egy látszólagos javulás egy biztonságosabb munkafolyamat eredménye lehet, vagy egy látszólagos hiba egy olyan integrációból származhat, amelyet az eredeti szolgáltató soha nem látott .
97. A javítás ezeken a megkülönböztetéseken múlik.
98. Egy központilag működtetett szolgáltatásban a szolgáltató letilthat egy funkciót, szűrőt módosíthat, vagy visszavonhatja a hozzáférést az általa ellenőrzött szolgáltatáson keresztül.
99. Ugyanez a beavatkozás nehezebb, ha a modell súlyait másoknak is átadták, vagy olyan termékekbe másolták, amelyek különböző ütemezés szerint frissülnek, mivel az eredeti szolgáltató már nem ellenőrzi az összes futó példányt.
100. Még egy sikeres technikai visszavonás sem tudja kitörölni azt a káros kimenetet, amely alapján már cselekedtek.
101. A visszafordíthatóságnak van tulajdonosa és tárgya.
102. Egy rendszergazda leállíthatja a jövőbeli lekérdezéseket , míg a korábbi döntés által károsított személynek továbbra is szüksége van értesítésre, jogorvoslatra és magyarázatot arra, hogyan történt.
103. Ezért kell a hibák nyilvántartását összekapcsolni egy javítási útvonalakkal, ahol a javítás lehetséges, valamint egy őszinte beszámolóval azokról a veszteségekről, amelyeket nem lehet egyszerűen visszacsinálni.
104. Ez magyarázza azt is, miért érdemel figyelmet a kiadás választása, mielőtt a terjesztés miatt egyes visszatérési útvonalak drágákká vagy elérhetetlenné válnának.
105. A kiadásnak több mint két beállítása van.
106. A hozzáférés szakaszosan valósítható meg, meghatározott felhasználókkal , eszközök és felhasználási módok számára, ahogy a bizonyítékok gyűlnek, feltéve, hogy a feltételek érvényesíthetők, hatásuk megfigyelhető, és a szűkebb első szakasz nem válik észrevétlenül állandóvá.
107. Az ilyen fokozatos hozzáférés lassíthatja a hasznos felfedezéseket, és túlzott ellenőrzést biztosíthat a szolgáltatónak azon felett, hogy ki kísérletezhet.
108. A független felülvizsgálat és a nyilvános indoklás különösen fontosakká válnak, amikor egy vállalat egyszerre ellenőrzi mind a modellt, mind azt a kaput, amelyen keresztül a versenytársak vagy a kutatók eljutnak hozzá.
109. A korlátozásoknak azonosítható kockázatokra kell válaszul szolgálniuk, és az érintetteknek lehetőséget kell biztosítani arra, hogy megtámadjanak egy olyan korlátozást, amely inkább a piaci szereplőt védi, mint a közérdeket – ez a lehetőség egyre nagyobbá válik, ha a tesztelési és a kereskedelmi hozzáférésnek ugyanaz a kapuőre van.
110. Az ellenkező veszélyt az a korlátlan ígéret jelenti, hogy figyelemmel kísérik, mi történik a széles körű bevezetés után, anélkül, hogy képesek lennének reagálni.
111. A nyomon követéshez felelősségteljes címzettre van szükség.
112. A 2024 Institute tesztje azért tanulságos, mert eredményei még a nyilvános kiadás előtt eljutottak a fejlesztőhöz, amikor egy esetleges reagálás még alakíthatta a használat kezdeti feltételeit.
113. A szerzők pontosan meg is határozták, hol ér véget a tudásuk: korlátozott idő, véges erőforrások és a tesztelt felállásra érzékeny eredmények – mindezt a későbbi olvasónak szem előtt kell tartania, mielőtt az eredményeket más felhasználási területekre kiterjesztené.
114. Ez az őszinteség az eredményt hasznosabbá teszi, mint amilyen egy biztonsági ítélet lett volna.
115. Megmutatja a későbbi megfigyelőknek, mely feltételezéseket kell felülvizsgálniuk, amikor a modell új eszközökkel és új felhasználókkal találkozik, így a későbbi tesztnek valami hasznosabbat ad, mint egy régi pontszámot, amellyel összehasonlíthatják az eredményeket.
116. Egy hatékony ellenőrzési rendszer megőrzi azt a láncot, amely a kérdéstől a bizonyítékon át a beavatkozásig terjed, a kiadás határain túl is.
117. A lánc bármelyik láncszeménél megszakadhat, ha egy tesztelőnek nincs hozzáférése, egy operátor eltitkol egy incidenst, vagy egy hatóságnak nincs eszköze cselekedni, mielőtt ugyanaz a gyengeség egy másik környezetet is elérne.
118. A sebesség meghatározza, milyen gyorsan válnak ezek a megszakadások jelentőssé, mert egy hiba számos integráción átterjedhet, mielőtt egyetlen felhasználó is felismerné a mintát.
119. A kiadás előtti rövid időintervallum fontos.
120. Ez az a pillanat, amikor a lehetséges felhasználások legnagyobb száma lehetséges felhasználás még előttünk áll, és a legkevesebb példány már elérhetetlen.
(aufklappen)német
1. Die britischen und amerikanischen Institute für KI-Sicherheit erhielten ein enges Zeitfenster, um ein neues Allzweckmodell vor dessen öffentlicher Veröffentlichung im Dezember 2024 zu testen.
2. Ihre Forscher probierten Aufgaben in den Bereichen Cybersicherheit, Biologie und Softwareentwicklung aus und teilten ihre Ergebnisse anschließend dem Entwickler mit, bevor Nutzer einen breiteren Zugang zu einem System erhielten, das bald in ganz unterschiedlichen Kontexten zum Einsatz kommen könnte.
3. Die Zeit drängte.
4. Die Institute konnten Tests auswählen und ihre Methoden anpassen, aber sie konnten nicht jede noch bevorstehende Nutzung beobachten oder jede Kombination aus Modell, Nutzer und eines Werkzeugs.
5. Nach der Veröffentlichung könnte dasselbe Modell mit neuen Werkzeugen kombiniert, in unbekannte Produkte integriert und für Zwecke eingesetzt werden, die seine Bewerter nicht ausgewählt hatten.
6. Diese Lücke ist die zentrale Schwierigkeit bei der Steuerung einer Technologie, die fast überall nützlich sein kann.
7. Der öffentliche Bericht bot keine Bestätigungsbescheinigung.
8. Er bezeichnete die Ergebnisse als vorläufig und erklärte, dass die getestete Version Probleme bei der Nutzung von Werkzeugen und der Erzeugung des erforderlichen Ausgabeformats hatte – Details, die die sinnvolle Interpretation einer Punktzahl veränderten.
9. Als die Bewerter die Rahmenbedingungen anpassten, um dem Modell zu helfen, sich von Fehlern zu erholen, änderte sich die gemessene Leistung – ein Hinweis darauf, dass die Fähigkeiten eines Modells zum Teil von dem System abhängen, das um es herum aufgebaut ist.
10. Die Forscher hatten die Fähigkeiten unter festgelegten Bedingungen getestet, nicht die in der realen Welt verhinderten Schäden gezählt.
11. Sie lernten vor der Freigabe dazu.
12. Sie konnten vor der Freigabe nicht alles lernen.
13. Auch die Entdeckung einer Fähigkeit bedeutet nicht, dass jemand sie nutzen wird, um Schaden anzurichten; bei einer Laboraufgabe fehlen möglicherweise die Fähigkeiten, die Motivation, die Ressourcen und die Gelegenheit, die erforderlich sind, um in der realen Welt Schaden anzurichten.
14. Dennoch kann ein Test vor der Veröffentlichung ein Problem aufdecken, während der Entwickler ungewöhnlich starke Kontrolle über den nächsten Schritt behält.
15. Der Entwickler kann Sicherheitsvorkehrungen ändern, den Zugriff einschränken, eine Funktion verzögern oder eine weitere Überprüfung veranlassen, bevor sich Kopien und Integrationen vermehren.
16. Die Veröffentlichung verändert sowohl die Informationen als auch die Kontrolle.
17. Der tatsächliche Einsatz deckt Fehler auf, die bei einem künstlichen Test möglicherweise übersehen werden, während jede neue Anbindung an externe Software eine weitere Stelle schafft, an der eine Korrektur ankommen muss.
18. Eine Beobachtung ist daher nur dann wertvoll, wenn jemand darauf reagieren kann.
19. Der Unterschied zwischen dem Auffinden eines Fehlers und dessen Behebung liegt teils im Software-Design und teils in den Regeln, die festlegen, wer Beweise einsehen, Maßnahmen einfordern und überprüfen kann, ob diese Maßnahmen gewirkt haben.
20. Wer die Beweise erhält, wer eine Änderung einfordern kann und wer die Kosten der Verzögerung trägt – all das spielt eine Rolle, bevor ein Modell das Labor verlässt.
21. Die Übung von 2024 zeigt sowohl das Potenzial als auch die Grenzen unabhängiger Tests auf.
22. Externe Spezialisten lieferten eine Perspektive, die die eigene Bewertung des Entwicklers nicht vollständig ersetzen konnte; dennoch waren ihr Zugang, ihre Zeit und ihre Testumgebung durch Vereinbarungen begrenzt, die auch bestimmten, welche Risiken sie untersuchen konnten.
23. Unabhängigkeit kann keine unbegrenzte Abdeckung gewährleisten.
24. Sie kann eine Behauptung glaubwürdiger machen, wenn Prüfer aussagekräftige Fragen wählen, Grenzen offenlegen und Ergebnisse berichten können, ohne eine Produkteinführung schützen zu müssen.
25. Das erfordert sowohl Ressourcen als auch eine formelle Genehmigung.
26. Sensible Tests erfordern möglicherweise sichere Umgebungen, fachkundiges Personal und sorgfältig ausgewählte Vergleiche, während eine überstürzte Einladung zur Überprüfung eines unbekannten Systems kaum mehr als eine Momentaufnahme einer einzigen Konfiguration liefern dürfte.
27. Das britische Institut hat einen mehrstufigen Ansatz beschrieben, bei dem Schnellprüfungen tiefgreifendere Untersuchungen auslösen können, wenn die Ergebnisse dies rechtfertigen, sodass sich die Prüfer auf kostspielige manuelle Untersuchungen konzentrieren können, wo ein erstes Ergebnis dies erfordert.
28. Eine solche Abfolge setzt die knappe Testzeit dort ein, wo die Warnzeichen am stärksten sind, obwohl ein erster Test, der eine Gefahr übersieht, möglicherweise nie die nächste Stufe auslöst.
29. Tests können den sinnvollen Zugang verzögern.
30. Forscher, kleine Unternehmen und öffentliche Dienste können Chancen verpassen, wenn ein allgemein nützliches System aus vagen oder nicht anfechtbaren Gründen zurückgehalten wird.
31. Doch Geschwindigkeit ist nicht umsonst, wenn die Kosten eines übersehenen Fehlers auf Menschen lasten, die den Zeitplan für die Freigabe nicht gewählt haben.
32. Die Entscheidung benötigt Gründe, die konkret genug sind, um überprüft zu werden: Welche Funktion wurde getestet, welchen Schaden könnte sie ermöglichen, inwieweit entspricht der Test der tatsächlichen Nutzung und wie unsicher ist dieser Zusammenhang noch?
33. Das europäische Recht verwendet unterschiedliche Kategorien.
34. Das KI-Gesetz der Europäischen Union, das 2024 verabschiedet und 2026 geändert wurde, verbietet bestimmte Praktiken, legt Anforderungen für bestimmte risikoreiche Anwendungen fest und erlegt Anbietern von Modellen für allgemeine Allzweckmodellen, die als systemisches Risiko eingestuft werden, zusätzliche Pflichten auf.
35. Diese Kategorien beantworten unterschiedliche Fragen.
36. Ein Verbot betrifft eine Praxis, die gemäß der Verordnung als inakzeptabel eingestuft wird, während Anforderungen an ein risikoreiches System regeln, wie ein zulässiges System gestaltet, dokumentiert, überwacht und genutzt wird.
37. Die Pflichten für ein Allzweckmodell mit systemischem Risiko betreffen ein weitgehend wiederverwendbares Modell, dessen Fähigkeiten in vielen nachgelagerten Anwendungsbereichen Risiken verursachen können.
38. Die Kategorien machen nicht jedes allgemeine Modell zu einer risikoreichen Anwendung.
39. Eine Organisation, die ein Modell in einen Dienst mit erheblichen Auswirkungen integriert, trifft Entscheidungen über den Zweck des Dienstes, die Nutzer, die Daten, die Sicherheitsvorkehrungen und die verfügbare menschliche Überprüfung.
40. Der ursprüngliche Modellanbieter kann nicht jede zukünftige Integration vorhersehen, aber die einsetzende Organisation darf das geerbte Modellverhalten nicht als alleinige Verantwortung eines anderen betrachten, wenn sie den Kontext und die Sicherheitsvorkehrungen festlegt.
41. Die Verantwortung richtet sich nach den Entscheidungen, auf die jeder Akteur tatsächlich Einfluss nehmen kann.
42. Nach dem Gesetz müssen Anbieter von qualifizierten Allzweckmodellen mit systemischem Risiko systemische Risiken bewerten und mindern sowie schwerwiegende Vorfälle gemäß den geltenden Bestimmungen melden.
43. Zu den Anforderungen für bestimmte risikoreiche Systeme gehören Risikomanagement und Marktüberwachung, die eine erste Bewertung mit den nach der Bereitstellung gesammelten Erkenntnissen verknüpfen.
44. Keine der beiden Anforderungen sieht offizielle Tests vor jeder Veröffentlichung vor.
45. Das Gesetz weist den Behörden zudem Aufgaben bei der Aufsicht und Durchsetzung zu, während unabhängige Forscher Behauptungen überprüfen und Schwachstellen aufdecken können, sofern sie über einen praktikablen Zugang verfügen.
46. Ihre Rollen überschneiden sich, ohne sich zu vermischen.
47. Ein Gutachter kann eine bedenkliche Funktion identifizieren, kann einem Anbieter jedoch nicht zwangsläufig anordnen, den Dienst zu ändern; eine Behörde verfügt zwar über gesetzliche Befugnisse besitzen, benötigt jedoch die technischen Nachweise des Gutachters und die Beobachtungen des Betreibers vor Ort, um diese Befugnisse sinnvoll anzuwenden.
48. Ein Anbieter kann ein von ihm zentral bereitgestelltes Modell ändern, während ein nachgelagerter Betreiber möglicherweise der einzige Akteur ist, der sieht, wie sich dieses Modell an einem bestimmten Arbeitsplatz verhält.
49. Der betroffene Nutzer verfügt oft über die eindeutigsten Nachweise für einen konkreten Fehler und hat gleichzeitig am wenigsten Einfluss darauf, die dahinterstehenden Abläufe zu ändern.
50. Ein Vorfallbericht wird dann nützlich, wenn er von diesem Ort der Feststellung zu jemandem weitergeleitet werden kann, der die Pflicht und die Befugnis zum Eingreifen hat, und wenn die Reaktion die bereits betroffenen Personen erreicht.
51. Der zeitliche Ablauf verkompliziert die EU-Vorschriften.
52. Das Gesetz trat im August 2024 in Kraft, doch seine Bestimmungen galten nicht ab dem Tag der Verabschiedung, sondern wurden schrittweise eingeführt, sodass sich das Datum einer rechtlichen Entscheidung und das Datum einer verbindlichen Verpflichtung unterscheiden.
53. Die Vorschriften für Allzweckmodelle galten ab August 2025, vorbehaltlich von Übergangsbestimmungen für bereits auf dem Markt befindliche Modelle.
54. Mit der Novelle von 2026 wurde die Anwendung der Kernanforderungen für viele in Anhang III aufgeführte Systeme mit hohem Risiko auf Dezember 2027 und für bestimmte regulierte Produkte in Anhang I auf August 2028 verschoben.
55. Diese Daten geben an, wann bestimmte gesetzliche Pflichten gelten, nicht wann ein Modell erstmals in der Lage ist, jemandem zu helfen oder zu schaden.
56. In der Novelle wurden verzögerte Normen, Leitlinien und institutionelle Vorbereitungen als Gründe für eine Fristverlängerung an und machte damit einen Konflikt zwischen dem Wunsch nach schnellem Schutz und der Fähigkeit, eine komplexe Vorschrift einheitlich anzuwenden, deutlich.
57. Diese Sorge ist berechtigt: Eine Anforderung, die niemand einheitlich auslegen kann, kann Aufwand verursachen, ohne zuverlässigen Schutz zu bieten, insbesondere wenn sich ein kleiner Anbieter nicht leisten kann, zu erraten, wie eine spätere Norm lauten wird.
58. Eine Verzögerung lässt zudem einen Zeitraum, in dem freiwillige Praktiken, bestehendes Recht, fachliches Urteilsvermögen und verfügbare Aufsicht einen größeren Teil der Last tragen.
59. Eine Vorschrift als verabschiedet zu bezeichnen, ist daher etwas anderes, als zu sagen, dass sie derzeit für jede erfasste Nutzung durchsetzbar ist.
60. Diese Unterscheidung ist sowohl für Entwickler als auch für Nutzer von Bedeutung.
61. Rechtliche Kategorien allein können keinen Zugang gewährleisten.
62. Der „Stanford AI Index 2025“ stellte fest, dass fast neun von zehn Modellen, die er im Jahr 2024 als bemerkenswert einstufte, aus der Industrie stammten – eine auffällige Konzentration innerhalb der im Bericht definierten Stichprobe und nicht Teil einer umfassenden Erhebung aller KI-Arbeiten.
63. Die Zahl hat klare Grenzen.
64. Dennoch verdeutlicht sie eine Asymmetrie in dem Teil der Entwicklung, der die größte Aufmerksamkeit auf sich zieht: Die Organisationen, die viele führende Modelle entwickeln, verfügen auch über den unmittelbarsten Zugang zu deren Gewichten – den während des Trainings festgelegten numerischen Parametern – sowie zu Trainingsdetails und internen Tests.
65. Universitäten, kleinere Entwickler, Journalisten und öffentliche Stellen sehen möglicherweise nur die Schnittstelle, die sie nutzen dürfen, und sind daher auf den Anbieter angewiesen, um Erkenntnisse über das hinter dieser Schnittstelle verborgene Verhalten zu erhalten.
66. Diese Schnittstelle kann ausreichen, um einige Mängel aufzudecken.
67. Es reicht möglicherweise nicht aus, zu untersuchen, wie sich ein System bei Feinabstimmung, durch neue Werkzeuge oder beim Einsatz in viel größerem Maßstab verändert, da eine eingeschränkte Schnittstelle die Experimente begrenzt, die ein externes Team durchführen kann.
68. Die Forderung nach einem sinnvollen Zugriff wirft eigene Fragen auf, da die Veröffentlichung sensibler Modelldetails oder gefährlichen Testmaterials neue Wege für Missbrauch eröffnen kann.
69. Eine gute Aufsicht erfordert einen kontrollierten Zugriff.
70. Sie benötigt klare Ziele, Schutz für Forscher und eine Möglichkeit, die Darstellung eines Anbieters anzufechten, wenn externe Ergebnisse davon abweichen – ohne davon auszugehen, dass jeder Test oder jedes technische Detail uneingeschränkt veröffentlicht werden sollte.
71. Die Kontrolle über Beweismittel kann zur Kontrolle darüber werden, welche Risiken erkannt werden, insbesondere wenn Außenstehende einen Test nicht wiederholen oder in Erfahrung bringen können, ob eine gemeldete Schwachstelle zu einer Änderung geführt hat.
72. Die Frage ist nicht, ob Unternehmen über Fachwissen verfügen; ihre Ingenieure verstehen das System oft besser als jeder Außenstehende.
73. Die Frage ist, ob ihr kommerzieller Zeitplan und ihre Kontrolle über die Beweismittel von Personen überprüft werden können, die andere Anreize und legitime Befugnisse haben.
74. Tests kosten Zeit und Geld.
75. Würde jedes Update eine umfassende Überprüfung erfordern, könnten kleinere Anbieter in Schwierigkeiten geraten, während große etablierte Unternehmen die Kosten leichter auffangen könnten, wodurch eine Vorschrift, die eigentlich den Nutzern Schutz bieten soll, zu einer Eintrittsbarriere würde.
76. Ist die Überprüfung zu oberflächlich, könnten die Kosten auf nachgelagerte Nutzer, öffentliche Einrichtungen und Personen abgewälzt werden, die von Ausfällen betroffen sind.
77. Die Belastung sollte sowohl die Reichweite als auch den Schaden widerspiegeln.
78. Aus diesem Grund sollte ein Test zu einer Entscheidungsregel führen und nicht lediglich zu einem beruhigenden Bericht.
79. Ein Befund könnte einen weiteren Test, einen eingeschränkteren Einsatz oder strengere Sicherheitsvorkehrungen rechtfertigen; er könnte stattdessen eine Erklärung erfordern, warum die beobachtete Fähigkeit in dem vorgeschlagenen Umfeld noch nicht mit einem plausiblen Schaden in Verbindung gebracht werden kann.
80. Jede Reaktion sollte überarbeitbar sein, wenn sich die Beweislage ändert.
81. Ein amerikanisches Rahmenwerk bietet einen anderen Ansatz.
82. Das 2023 veröffentlichte „AI Risk Management Framework“ ist freiwillig und für verschiedene Sektoren und Anwendungsbereiche konzipiert .
83. Es fordert Organisationen dazu auf, Risiken zu steuern, den Kontext zu erfassen, in dem ein System betrieben wird, relevante Eigenschaften zu messen und die gewonnenen Erkenntnisse zu verwalten.
84. Das Rahmenwerk kann einem Team als Orientierung dienen, bevor eine rechtliche Einstufung feststeht oder wenn ein System außerhalb einer bestimmten Rechtsordnung betrieben wird, da seine Fragen an den Zweck und den Kontext einer Nutzung angepasst werden können.
85. Seine Flexibilität ist eine Stärke, wenn sich die Anwendungsfälle unterscheiden.
86. Ein Laborassistent, ein Schreibwerkzeug und eine mit einem industriellen Prozess verbundene Software werfen nicht genau dieselben Fragen auf oder erfordern dieselben Nachweise, selbst wenn alle drei auf einer verwandten Modellfamilie basieren.
87. Dieselbe Flexibilität stellt zugleich eine Einschränkung dar, da die Veröffentlichung eines Rahmenwerks nicht belegen kann, dass eine bestimmte Organisation es befolgt oder einen bekannten Mangel behebt.
88. Freiwillige Leitlinien können die Praxis verbessern, wenn Anreize, berufliche Normen, Verträge und öffentliche Kontrolle dies unterstützen; ein skeptischer Beobachter benötigt jedoch nach wie vor Belege dafür, dass eine bestimmte Organisation die versprochene Arbeit geleistet hat.
89. Sie kann keine Behörde ersetzen, die in der Lage ist, Informationen einzufordern oder eine geltende Vorschrift durchzusetzen, wenn die Zusammenarbeit versagt.
90. Gesetz und Leitlinien lösen unterschiedliche Probleme.
91. Das Gesetz legt Pflichten und Befugnisse fest; ein flexibler Rahmen kann den Beteiligten helfen, herauszufinden, welche Tests und Kontrollen in ihrem Umfeld sinnvoll sind.
92. Keines von beiden liefert eine vollständige Übersicht über zukünftige Anwendungsfälle.
93. Eine unerwartete Anbindung an eine Datenbank oder ein neues Software-Tool kann die Leistungsfähigkeit eines vertrauten Modells verändern, ohne dessen zugrunde liegende Gewichtung zu ändern, was bedeutet, dass ein Modelltest allein die relevante Änderung möglicherweise übersieht.
94. Das ist ein Grund, warum die Überwachung nach der Freigabe die umgebende Anwendung einbeziehen muss und nicht nur eine Wiederholung des Benchmark-Ergebnisses des ursprünglichen Modells sein darf.
95. Der Beobachter muss wissen, welche Version ausgeführt wurde, welche Tools sie nutzen konnte und welche manuellen Überprüfungen tatsächlich stattfanden, denn ein Fehler kann nicht richtig zugeordnet oder behoben werden, wenn das funktionierende System unbekannt ist.
96. Andernfalls könnte eine scheinbare Verbesserung das Ergebnis eines sichereren Arbeitsablaufs sein, oder ein scheinbarer Fehler könnte von einer Integration herrühren, die der ursprüngliche Anbieter nie gesehen hat .
97. Die Korrektur hängt von diesen Unterscheidungen ab.
98. Bei einem zentral betriebenen Dienst kann ein Anbieter eine Funktion sperren, einen Filter ändern oder den Zugriff über den von ihm kontrollierten Dienst entziehen.
99. Derselbe Eingriff ist schwieriger, wenn Modellgewichte an andere verteilt oder in Produkte kopiert wurden, die nach unterschiedlichen Zeitplänen aktualisiert werden, da der ursprüngliche Anbieter nicht mehr jede laufende Kopie kontrolliert.
100. Selbst ein erfolgreicher technischer Entzug kann eine schädliche Ausgabe, auf die bereits reagiert wurde, nicht ungeschehen machen.
101. Reversibilität hat einen Verantwortlichen und ein Objekt.
102. Ein Administrator kann zukünftige Abfragen stoppen , während eine Person, die durch eine frühere Entscheidung geschädigt wurde, weiterhin eine Benachrichtigung, Abhilfe sowie eine Erklärung dafür, wie es dazu gekommen ist.
103. Aus diesem Grund muss eine Aufzeichnung von Fehlern mit einem Weg zur Behebung verbunden sein, sofern eine Behebung möglich ist, sowie mit einer ehrlichen Darstellung der Verluste, die nicht einfach rückgängig gemacht werden können.
104. Dies erklärt auch, warum die Wahl des Veröffentlichungszeitpunkts Beachtung verdient, bevor die Verbreitung bestimmte Rückwege kostspielig oder unzugänglich macht.
105. Die Veröffentlichung kennt mehr als zwei Stufen.
106. Der Zugriff kann stufenweise erfolgen, wobei sich die Anzahl der zugelassenen Nutzer , Tools und Verwendungszwecken schrittweise gewährt wird, je mehr Belege vorliegen – vorausgesetzt, die Bedingungen können durchgesetzt, ihre Auswirkungen beobachtet werden und eine eng gefasste erste Stufe nicht stillschweigend dauerhaft wird.
107. Eine solche stufenweise Freigabe kann nützliche Entdeckungen verlangsamen und einem Anbieter übermäßige Kontrolle darüber verschaffen, wer experimentieren darf.
108. Eine unabhängige Überprüfung und öffentliche Begründungen gewinnen besonders an Bedeutung, wenn ein Unternehmen sowohl das Modell als auch das Tor kontrolliert, durch das Wettbewerber oder Forscher Zugang dazu erhalten.
109. Einschränkungen sollten auf identifizierbare Risiken reagieren, und die Betroffenen sollten die Möglichkeit haben, eine Einschränkung anzufechten, die einen etablierten Anbieter stärker schützt als die Öffentlichkeit – eine Möglichkeit, die zunimmt, wenn Testzugang und kommerzieller Zugang denselben Gatekeeper haben.
110. Die gegenteilige Gefahr besteht in einem unbefristeten Versprechen, zu beobachten, was nach einer breiten Veröffentlichung geschieht, ohne die Fähigkeit zu haben, darauf zu reagieren.
111. Die Überwachung erfordert einen verantwortungsbewussten Adressaten.
112. Der Test des Instituts aus dem Jahr 2024 ist aufschlussreich, da seine Ergebnisse den Entwickler bereits vor der öffentlichen Veröffentlichung erreichten – zu einem Zeitpunkt, als eine Reaktion noch die anfänglichen Nutzungsbedingungen beeinflussen konnte.
113. Die Autoren wiesen zudem genau darauf hin, wo ihre Erkenntnisse an ihre Grenzen stießen: begrenzte Zeit, endliche Ressourcen und Ergebnisse, die von der getesteten Konfiguration abhängig waren – all dies muss ein späterer Leser berücksichtigen, bevor er die Ergebnisse auf andere Anwendungsfälle überträgt.
114. Diese Offenheit macht das Ergebnis nützlicher, als es ein Sicherheitsurteil gewesen wäre.
115. Es zeigt späteren Beobachtern, welche Annahmen überprüft werden müssen, wenn das Modell auf neue Werkzeuge und neue Nutzer trifft, und bietet einem späteren Test damit etwas Nützlicheres als eine alte Bewertung zum Vergleich.
116. Ein wirksames Kontrollsystem bewahrt diese Kette von der Fragestellung über den Nachweis bis hin zur Intervention über die Veröffentlichungsgrenze hinweg.
117. Die Kette kann an jedem Glied reißen, wenn einem Tester der Zugriff fehlt, ein Betreiber einen Vorfall verschweigt oder einer Behörde die Mittel fehlen, um zu handeln, bevor dieselbe Schwachstelle eine andere Umgebung erreicht.
118. Geschwindigkeit beeinflusst, wie schnell solche Brüche zur Folge haben, denn ein Fehler kann sich durch viele Integrationen ausbreiten, bevor ein einzelner Nutzer ein Muster erkennt.
119. Das kurze Intervall vor der Freigabe ist entscheidend.
120. Es ist der Moment, in dem die größte Anzahl möglicher Anwendungsfälle noch vor uns liegt und die geringste Anzahl von Kopien bereits außer Reichweite ist.
Dieser Text steht unter CC0 1.0 Universell. Eine Quellenangabe ist nicht erforderlich.
Er darf kostenlos kopiert, verändert, veröffentlicht und auch kommerziell genutzt werden.