Ugrás a tartalomra

Varga Zoltán / Editorial intelligence

A zaj mögött:
a döntés szerkezete.

Kutatás, AI és tudásrendszerek azoknak, akik nem több információt, hanem tisztább következtetéseket keresnek.

Kiemelt tudományos publikáció / 2026. augusztus 8. / v5

Ki validálja
a validátort?

Az AI-rendszer azt mondja, elvégezte a feladatot. De valóban megtette, vagy csak jól hangzó jelentést írt róla?

Tanulmány megnyitása a Zenodón →

DOI: 10.5281/zenodo.21812041

Amikor egy AI-ügynök több lépésben dolgozik, adatot keres, számol vagy külső rendszerből kér le információt, a végén rendszerint beszámol arról, mit tett. Ez a kutatás azt mutatja meg, hogyan lehet független naplók alapján ellenőrizni, hogy a jelentett lépések valóban megtörténtek-e. Vagyis: az AI azt csinálta, amit kértél tőle, vagy csak azt mondja, hogy megcsinálta?

Ellenőrzött AI-állítás

1 250

Ennyi jelentett műveletet vetett össze a kutatás független végrehajtási naplókkal, tételesen.

Auditmegállapítás

30

Ennyi dokumentált lelet tárja fel, hogyan lehet egy AI-rendszer mérését, működését és bizonyítékait is ellenőrizni.

Ez egy auditálási kérdés, nem pusztán egy AI-kérdés. Ha egy rendszer azt jelenti, hogy meghívott egy eszközt, ellenőrzött egy adatot vagy lefuttatott egy folyamatot, akkor ennek nyoma kell legyen a független naplóban. Ha nincs nyoma, a jelentés nem bizonyíték.

A kutatásban ugyanazt a rendszert kétféleképpen mérték. Az első mérőprogram túl sok hibát jelzett, és éppen azt a mintát mutatta, amit a kutató várt volna. A javított ellenőrzés után sokkal kisebb arány maradt. A tanulság egyszerű: nem elég egy szép dashboard vagy egy meggyőző összesítés. Magát az ellenőrző rendszert is tesztelni kell.

Ez a szemlélet vállalati AI-rendszerekre is alkalmazható: ellenőrizhető, hogy az ügynök tényleg elvégezte-e a kért munkát, a megfelelő adatot használta-e, és a döntése vagy jelentése visszavezethető-e konkrét műveletekre. Így a rendszer nem csak beszámol a működéséről, hanem bizonyítani is tudja azt.

A megbízható AI nem csak választ ad, hanem bizonyítani is tudja, mit tett. Kritikus üzleti folyamatokban vissza kell vezetni az eredményt a tényleges műveletekhez, a használt adatokhoz és az ellenőrizhető nyomvonalhoz. Ez az auditálható működés különbözteti meg a magabiztos állítást a valódi bizonyítéktól. Független kutatás, előregisztráció: OSF 4rgey.

18

publikált kutatás

210

elemzés

13 452+

feldolgozott forrás

285+

azonosított minta

Kiemelt esszé / EU AI Act / 2026. július 31.

A felmentési zóna:
amikor az állam kiírja magát a saját kánonjából.

Amikor egy AI-ügynök választ keres, nem kellene megállnia az első weboldalnál. A jó válasz addig követi a forrásokat, amíg el nem jut ahhoz a nyilvántartáshoz vagy hivatalos dokumentumhoz, amely végleg eldönti a kérdést. Egy cég létezik-e? Érvényes-e egy engedély? Valódi-e egy végzettség? Ezekben az esetekben az állami nyilvántartás a végső igazság forrása.

Mi a probléma?

Az EU AI Act 49. cikkének (4) bekezdése egyes magas kockázatú állami AI-rendszereket a nyilvános adatbázis helyett korlátozott hozzáférésű szekcióba tesz. Itt éppen azok az információk maradnak rejtve, amelyekből kiderülne, hogyan működik a rendszer és milyen kockázatot jelenthet.

Miért számít ez?

Ha a végső, hiteles forrás nem olvasható sem embernek, sem AI-ügynöknek, akkor a válaszok másodlagos oldalakra, régi adatokra vagy feltételezésekre épülnek. A bizonytalanság helyét gyakran egy magabiztos, de hibás válasz tölti ki.

Az állam rengeteg ilyen végső referenciát kezel: cégjegyzéket, engedélyeket, képesítéseket, hatósági döntéseket és nyilvántartásokat. Nem azt kell nyilvánossá tenni, ami biztonsági kockázatot okozna. A működési titkok védhetők. De annak átláthatónak kellene lennie, hogy egy rendszer létezik, mire használják, milyen alapjogi hatásai lehetnek, és milyen ellenőrzések történtek rajta. Ez teszi a világot érthetőbbé az embereknek és megbízhatóbbá az AI-rendszereknek is.

Olvasási térkép

Kérdések szerint rendezve.

A gyakorlati AI-megvalósítástól a figyelem és döntés emberi oldaláig.

Következő lépés

A láthatóság is döntési rendszer.

Nézd meg, mit érzékelnek rólad a generatív keresők, és hol érdemes először beavatkozni.

Ingyenes AI Scorecard