本站提供正體中文版。切換到正體中文本站提供简体中文版。切换到简体中文This site is available in English.View in Englishこのサイトには日本語版があります。日本語で表示이 사이트는 한국어로도 제공됩니다.한국어로 보기Diese Website ist auch auf Deutsch verfügbar.Auf Deutsch ansehenEste sitio web también está disponible en español.Ver en españolQuesto sito è disponibile anche in italiano.Visualizza in italianoCe site est également disponible en français.Afficher en françaisEste site também está disponível em português.Ver em portuguêsDeze website is ook beschikbaar in het Nederlands.In het Nederlands bekijkenЭтот сайт также доступен на русском языке.Смотреть на русскомयह वेबसाइट हिन्दी में भी उपलब्ध है।हिन्दी में देखेंهذا الموقع متاح أيضًا باللغة العربية.عرض بالعربيةSitus ini juga tersedia dalam bahasa Indonesia.Lihat dalam bahasa IndonesiaBu site Türkçe olarak da mevcut.Türkçe görüntüleTa strona jest dostępna także po polsku.Wyświetl po polskuTrang web này cũng có phiên bản tiếng Việt.Xem bằng tiếng Việtاین وب‌سایت به فارسی هم در دسترس است.مشاهده به فارسیЦей сайт також доступний українською.Переглянути українськоюTato stránka je k dispozici také v češtině.Zobrazit v češtiněAcest site este disponibil și în limba română.Vizualizare în românăเว็บไซต์นี้มีเวอร์ชันภาษาไทยดูเป็นภาษาไทย

A fejünkben lévő ítélet írásba foglalása: kontextusmérnökség és a modell engedelmessége

AI2026.06

Az elmúlt években, miután bevezettem a mesterséges intelligenciát (MI) a munkámba, fokozatosan lebontottam azokat az ítéleteket, amelyek eredetileg csak a fejemben léteztek, externalizáltam (externalize) őket, és egy kontrollálható „kontextusmérnöki dokumentummá” (Context Engineering Document) rendeztem.

Modellösszehasonlító infografika, amely a Claude-ot fő modellként, a GPT-t tartalékként tünteti fel, a Geminit pedig kizárva, mert egyszer kitalált forrásokat sorolt fel, azzal a megjegyzéssel, hogy ez a szerző jelenlegi, személyes tesztje, nem objektív végkövetkeztetés

Egy modellt három dolog alapján értékelek

Jelenleg, amikor azt értékelem, hogy egy modell alkalmas-e „magas fegyelmet, magas nyomon követhetőséget” igénylő munkára, elsősorban három dolgot nézek:

  1. hogy be tudja-e tartani a megállapított szabályokat;
  2. hiányos információ esetén magától „kitölti-e az űrt”;
  3. hogy a kimenete nyomon követhető és auditálható-e.

Egy jelenlegi gyakorlati tapasztalat

Az alábbiakban a legutóbbi gyakorlati tapasztalataim olvashatók – előre jelzem, hogy ez kizárólag az én jelenlegi, személyes használati tapasztalatom, a modellek pedig folyamatosan frissülnek, így nem feltétlenül érvényes mindenkire és minden verzióra:

  • Claude: a legmagasabb a kontextusnak való engedelmessége, jobban képes szorosan a megállapított szabályok szerint végrehajtani, ezért ezt tekintem fő modellnek, és erre bízom az ítéletréteget.
  • GPT: a következő. A nyomon követhetősége viszonylag jól kontrollálható, de hiányos információ esetén időnként a tanítóadatokkal tölti ki az űrt, ezért elsősorban tartalékként és bizonyos feladatokra használom.
  • Gemini: nehezebben boldogul az ilyen hosszú, magas fegyelmet igénylő munkával; egyszer egy lélegzetre kitalált forrásoknak egy egész kötegét sorolta fel, ezért egyelőre kikerült ebből a fővonalból.

Ami igazán szétnyitja a szakadékot: „az engedelmesség a már externalizált ítélet iránt”

Számomra a modellek közötti szakadékot igazán szétnyitó kulcs valójában nem csupán a modell saját képessége, hanem az, hogy „engedelmeskedni” tud-e annak a szakmai ítéletnek, amelyet már externalizáltam.

Az eszközök továbbra is frissülni fognak, de az, hogy előbb világosan leírjuk a fejünkben lévő ítéletet – ez ugyanolyan fontos, mint hogy melyik eszközt választjuk.