Tudnivalók

Mi ez?

Ez az eszköz a megadott magyar szövegrészletek helyesírását ellenőrzi az MTA helyesírási tanácsadó portálját lekérdezve. Eldönti, hogy mit érdemes ellenőrizni és hogyan kell a kapott eredményeket a szövegre alkalmazni, majd megindokolva javasol egy vagy több helyesnek vélt alakot.

De miért készült ez? Sok magyar, ha ugyan használja is az MTA eszközeit íráskor, mégsem figyel oda azok eredményeire, és sokszor rosszul bírálja el azok helyességét vagy szövegkörnyezeti alkalmazhatóságát. Bár az ellenőrzés itt is egy fontos lépés, a feladat nagy része átruházódik az eszközre. Ezen kívül sokkal egyszerűbb egy szövegrészt ellenőriztetni, mint külön-külön szószerkezetekre és kifejezésekre kézileg alkalmazni az MTA eszközeit.

Használat

  • Egyszerre legfeljebb 5000 karaktert lehet ellenőrizni.
  • Érdemes a lehető legpontosabb formában megadni az ellenőrizendő szöveget. Minél több a hiba, annál kisebb eséllyel kerül az összes javításra, és annál tovább tart a folyamat.
  • Minden lefutott ellenőrzés bekerül az Előzmények listájába, ahonnan újra meg lehet tekinteni vagy éppen törölni őket.
  • Eredményekkel kapcsolatos probléma a zászlóikonnal jelenthető, egyéb dolgokat a bal alsó sarokban található visszajelzésgombra kattintva lehet beküldeni.

Korlátok

  • A javaslatok nem helyettesítik A magyar helyesírás szabályai 12. kiadását. Ez az eszköz pusztán egy kísérlet egy jobb helyesírás-ellenőrző megalkotására, nem szolgál hivatkozási alapként.
  • A 12. kiadás megváltoztatott olyan szabályokat, amelyekre a kiadása előtt sűrűn hivatkoztak különböző internetes fórumokon. Helyenként maga a portál is keveri a két kiadást, így előfordulhatnak ebből adódó következetlenségek.
  • Vannak erősségei és gyengeségei az eszköznek, például központozást nem javít megbízhatóan.
  • A szolgáltatás bármikor kieshet vagy szünetelhet. Többek között ennek elkerülése érdekében adományokat gyűjtünk az oldal bal alsó sarkában.

Adatkezelés

  • A szöveg elhagyja ezt a gépet. Az ellenőrzéshez a beírt szöveg egy harmadik fél által üzemeltetett nyelvimodell-szolgáltatóhoz kerül (elképzelhető, hogy az EU-n kívülre), ezért nem érdemes olyan személyes adatot vagy titkot megadni, amelynek a kiszivárgása problémát jelentene.
  • Névtelen statisztikát gyűjtünk. Mérjük például, hogy hány ellenőrzés indul és mennyi ideig tartanak, illetve a dokumentáció melyik részét meddig olvassák. Felhasználói azonosítót, IP-címet, sütit vagy beírt szöveget nem tárolunk. A mért statisztikát 90 napig tároljuk az EU-ban.
  • A visszajelzés kivétel. Az önkéntesen elküldött hibajelentéseket és visszajelzéseket minden szándékosan megosztott információval együtt tároljuk.
  • Az előzmények helyben maradnak. Az ellenőrzési előzményeket a böngésző tárolja. Más gépen nem látszanak, a böngésző adatainak törlésekor pedig véglegesen eltűnnek. (Ezek az előzmények nem jelennek meg a böngészési előzmények között, csak a helyesírás-ellenőrző főoldalán.)

Technikai részletek

Ellenőrzési folyamat

Az ellenőrzés egy több lépésből álló folyamat. Így épül fel:

  1. Biztonsági lépés. A bemeneti szöveg átmegy egy szűrőn, ami személyes adatokat és titkokat keres: többek között címeket, banki részleteket, telefonszámokat. Ha ilyesminek tűnő szöveget talál, óvatosságra inti a felhasználót ahelyett, hogy belekezdene az ellenőrzésbe.
  2. Értelmezés. Egy nagy nyelvi modell (röviden LLM; hasonló a ChatGPT-hez vagy a Gemini-hoz) elolvassa a bemeneti szöveget, és átgondolja, hogy az mit jelent. Később ez alapján dönt az MTA eszközei által tett javaslatokról.
  3. A kifejezések összegyűjtése. Összeszedi, amire érdemes rákérdezni: a lehetséges összetételeket, a toldalékolt alakokat, a felsorolások tagjait, a tulajdonneveket, a dátumokat és a számokat. A számára helyesnek látszó dolgokkal is igyekszik számolni, mert sokszor éppen azok bizonyulnak hibásnak.
  4. Lekérdezés. Az összegyűjtött kifejezéseket egyszerre küldi el a portál hat eszközének (Külön vagy egybe?, Helyes-e így?, Elválasztás, Névkereső, Dátumok és Számok), mindegyiket abban a formában, amelyet az adott eszköz vár.
  5. Összevetés. Az eszközök eredményeit összeveti azzal, ahogyan a szöveg az adott alakot tartalmazza. Ha a magyarázat nem illik a használt alakra, elveti, és más megoldás felé néz. Abban az esetben, ha valamilyen információ további kérdéseket vet föl, a folyamat szabadon visszatérhet az előző lépésekre, futtathat további lekérdezéseket.
  6. Az eredmény összeállítása. A javított szöveg részekre bomlik, és a modell részletenként megindokolja, milyen változtatásokat miért végzett (ha végzett). Ezek után szűrők ellenőrzik a kimeneti szöveg formai követelményeit. Ha minden rendben van, megjelenik az eredmény.

Mindeközben a Források oszlopban az összes lekérdezés valós időben megjelenik, épp ahogyan a modell használja őket; a jobb oldalukon található linkre kattintva pedig megtekinthetjük a javaslatokat az eredeti oldalon.

Környezeti adatok

A szerver konfigurációja:

  • Provider: openrouter
  • Model: deepseek/deepseek-v4.1-flash
  • Reasoning effort: medium
  • Input limit: 5000 characters