Milyen modell fér el a gépeden?
Válassz gépet és modellt, majd számold ki a memóriaigényt.
A mezőket és a beolvasott fájlokat a böngésződ dolgozza fel. Az adatokat nem töltjük fel, és kilépéskor töröljük a tervezőből. A letöltést te indíthatod el; a külön letöltött fájl a gépeden marad.
A tervező betöltése…
Gyakori kérdések ehhez a kalkulátorhoz
Mit tud az AI 1, 10 vagy 100 paraméterrel?
Ennyi paraméterrel egyszerű matematikai modelleket lehet szemléltetni. Egyetlen tanulható szám például egy szorzótényező lehet. Beszélgetési vagy programozási képesség nem következik ebből. A kalkulátor a tárolást mutatja meg; értelmes feladathoz architektúra, tanítóadat és tanítás is kell.
Miért nincs automatikus token/másodperc vagy intelligenciapontszám?
A magszám és a paraméterszám ehhez kevés. A futtató, a memória-sávszélesség, a kvantálási formátum, a kontextus és a terhelés is számít. Saját, azonos feltételekkel mért token/másodperc értékből generálási időt számolunk. A felsorolt feladatok a konkrét modell készítőjének leírásából származnak.
Hogyan számol a Mac mini és Mac Studio memóriájával?
Az Apple-gépeknél egy közös memóriakeret van. A CPU és a GPU része nem adódik össze. A rendszertartalék levonása utáni memória és a megadott GPU-keret közül a kisebb áll rendelkezésre. A 75%-os példa saját tervezési feltételezés, módosítsd a futtató tényleges keretéhez. A GB és a GiB külön választható.
Ha a modell elfér, biztosan futni fog?
Az eredmény memóriafeltételt ellenőriz. A megfelelő modellformátum, CPU-utasításkészlet, GPU-meghajtó, futtatói támogatás és tényleges munkaterület szintén szükséges. A modellcsomag letöltése és betöltése közben további RAM kellhet. CPU/GPU közti részleges szétosztást és több GPU összevonását ez a becslés nem modellezi.
Miért nő a memóriaigény hosszabb beszélgetésnél?
A transzformer a korábbi tokenekhez tartozó kulcs- és értékvektorokat rétegenként eltárolja. A KV-cache mérete arányos a tokenek és a párhuzamos beszélgetések számával. Az egyes modellek fej- és rétegszáma eltér, ezért azonos paraméterszám mellett is más lehet a cache igénye.
A 30B-A3B modellhez elég 3 milliárd paraméter memóriája?
A Qwen3-30B-A3B tokenenként nagyjából 3,3 milliárd aktív paramétert használ, de a teljes, körülbelül 30,5 milliárd paraméter súlyait kell tárolni. A kalkulátor a teljes súlyállománnyal számol. A részleges aktivitásból nem vezet le automatikus sebességet.
Hová kerülnek a megadott hardveradatok?
A számítás a böngészőben fut. Nincs automatikus mentés vagy külső AI-szolgáltatáshoz küldés. A beállításokat saját JSON-fájlba, az összehasonlító táblázatokat CSV-be töltheted le, és a JSON később visszatölthető.
Hogyan hasonlíthatok össze több gépet ugyanazzal a modellel?
Számítás után a géptáblázat megmutatja a beállított gépet és mind a 17 Apple-példát. A modell, a pontosság, a kontextus, a párhuzamosság és a munkaterület közös. Az Apple-példáknál 4 GiB rendszertartalék és 75%-os GPU-keret szerepel, a saját gépnél a megadott értékek. Az Ezzel számolok gomb kitölti a választott gépet, törli a korábbi sebességmérést és újraszámol.
Mit mutat a 4, 8, 16 és 32 bites összehasonlítás?
A kiválasztott modell súlytárolását számoljuk újra a négy bitszámmal. A KV-cache és a munkaterület ugyanannyi marad. A táblázat mutatja a becsült helyigényt és kontextuskeretet. A tényleges kvantálási csomag mérete, minősége és támogatása eltérhet. A bitszám gombjával újraszámolhatsz; ehhez új sebességmérés szükséges.
Hogyan találom meg a gépemen elférő modelleket?
A modelllista kereshető név és leírás alapján, és bekapcsolható a Csak az elférő lehetőségek szűrés. Egy sor akkor marad bent, ha a memória- és kontextusfeltételt is teljesíti. Az Ezzel számolok gomb átvált a modellre és friss eredményt készít. A letöltött CSV mindig a teljes táblázatot tartalmazza, a felületi szűréstől függetlenül.
Hogyan értelmezd?
A kalkulátor a megadott adatokból számol, a fő érték mellett pedig a legfontosabb részleteket is megmutatja.
Képlet és példa
Súlyok = felfelé kerekítés(paraméterek × bitszám / 8) × (1 + többlet% / 100). KV-cache = 2 × rétegek × KV-fejek × fejdimenzió × tokenek × párhuzamos beszélgetések × cache-bájtok. Teljes becslés = súlyok + KV-cache + munkaterület. Egyesített keret = min(memória − rendszertartalék, memória × GPU-keret%).1 milliárd paraméter 4 biten 500 000 000 bájt nyers súlytárhelyet jelent. 15% többlettel ez 575 000 000 bájt, körülbelül 0,54 GiB. 32 réteg, 8 KV-fej, 128-as fejdimenzió, 4096 token és 16 bites cache egy beszélgetéshez további 0,5 GiB. A futtatói munkaterület ezen felül szükséges.
Mit nem igazol a kalkulátor?
A becslés meglévő szöveges modellek futtatására vonatkozik. A szoftveres támogatás, a tényleges csúcsmemória és a feladatonkénti minőség külön ellenőrzést igényel. Betanítást, finomhangolást, képi és hangmodelleket ez a változat nem méretez.
Módszertan és források
A modellkonfigurációkat rögzített Hugging Face revíziókból vettük át. A megosztott súlyokat egyszer, a MoE összes szakértőjének súlyait együtt számoljuk. Qwen3 esetén a modellkártya szerinti 32 768 tokenes natív kerettel dolgozunk. Az Apple-adatok 2026. szeptember 8-i pillanatképek. A tartalékok és a kvantálási többlet módosítható feltételezések.
A modellsúlyok tárolási pontossága és a puszta betöltési memória korlátai; a megadott többletek saját becslések.
Hugging Face · ellenőrizve: 2026-09-08Rétegenkénti kulcs- és értékcache, fejdimenzió, tokenszám és párhuzamos kérések szerinti alak.
Hugging Face · ellenőrizve: 2026-09-08A Qwen3 modellek dokumentált feladatai. A pontos paraméter- és KV-adatok a modellkatalógusban hivatkozott rögzített konfigurációkból származnak.
Qwen Team · ellenőrizve: 2026-09-08SmolLM2 feladatok és nyelvi korlátok; a méretenkénti konfigurációk külön hivatkozva.
HuggingFaceTB · ellenőrizve: 2026-09-08Helyi modellfuttatás CPU- és GPU-hátterekkel; a tényleges eszköz és modellformátum támogatását külön ellenőrizni kell.
ggml-org · ellenőrizve: 2026-09-08Az ellenőrzéskor megjelenített M6 és M5 Pro CPU-, GPU- és memóriakonfigurációk. A tartalék és a GPU-keret saját tervezési feltételezés.
Apple · ellenőrizve: 2026-09-08Az ellenőrzéskor megjelenített M5 Max és M5 Ultra CPU-, GPU- és memóriakonfigurációk. A tartalék és a GPU-keret saját tervezési feltételezés.
Apple · ellenőrizve: 2026-09-08Pontatlanságot találtál?
Küldd el közvetlenül az üzemeltetőnek. A jelzés a kalkulátor nevével együtt az üzemeltető ellenőrzési sorába kerül.