Az IBM bemutatta a Granite 4.2 nyílt súlyú nyelvi modelleket ügynök-alapú tréninggel

Hírek2026.08.27.13 megtekintés

  • Az IBM kiadta az új Granite 4.2 nyelvi modelleket 3B, 8B és 30B paraméterrel.
  • Az új modellek ügynök-alapú (agentic RL) tréninget alkalmaznak, fejlett eszközhasználati képességekkel.
  • Az összes modell elérhető nyílt forráskódú Apache-2.0 licenc alatt több platformon.
  • A Granite Speech 5.0 Turbo CTC modellek jelentősen gyorsabb beszédfelismerést kínálnak.

Az IBM új Granite 4.2 nyelvi modelljei jelentős előrelépést hoznak a mesterséges intelligencia területén, hiszen fejlett ügynök-alapú tréninggel és nyílt súlyokkal teszik elérhetővé a legmodernebb technológiát kutatók és fejlesztők számára. Az új modellek többféle méretben, korszerű funkciókkal és kiemelkedő teljesítménnyel érkeznek.

Az IBM Granite 4.2 nyelvi modellek fő jellemzői

Az IBM három új Granite 4.2 modellt mutatott be: 3 milliárd (3B), 8 milliárd (8B) és 30 milliárd (30B) paraméteres változatokat. Ezek a modellek 15 billió tokenen keresztül lettek tanítva, és akár 512 000 token hosszúságú kontextusablakot is támogatnak, ami különösen hasznos a nagyobb szövegek feldolgozásánál.

Különböző működési módok

Minden Granite 4.2 modellben található egy kapcsoló, amely lehetővé teszi a “Gondolkodó” (Thinking) és a “Nem gondolkodó” (Non-Thinking) mód közötti váltást. Ez szabályozza, hogy a modell mennyi számítási időt szánjon egy-egy feladatra. Továbbá egy “Low-Effort” mód is elérhető, amely egyszerű kérdések esetén jelentős erőforrás-megtakarítást eredményez[^1].

Ügynök-alapú tanulás és fejlett eszközhasználat

Az újítás lényege, hogy az 8B és 30B modellek további “agentic RL” (ügynök-alapú megerősítéses tanulás) tréningen mennek keresztül. Ez lehetővé teszi, hogy a modellek szimulált környezetekben tanulják meg az eszközhasználatot, a kódírást, a webes keresést és a különféle feladatok elvégzését. Az összes Granite 4.2 modell támogatja az OpenAI-formátumú natív eszközhívást, így könnyen integrálhatók különböző rendszerekbe, például vLLM vagy SGLang platformokra is[^1].

Benchmark eredmények és teljesítmény

A három Granite 4.2 modell közül a 30B-s változat minden tesztben vezető helyen végzett az ügynök-alapú feladatok és az eszközhasználat terén. Ez kiemeli a modell hatékonyságát komplex problémák megoldásában[^1].

Granite Speech 5.0 Turbo CTC – új szint a beszédfelismerésben

Az IBM egy új, kisebb paraméterszámú (470 millió) beszédmodell-családot is bejelentett: a Granite Speech 5.0 Turbo CTC-t. Ezek a modellek kétszer gyorsabbak, mint az eddigi Open-ASR-leaderboard vezetői, és képesek akár három órányi hanganyagot is egy másodperc alatt letranszkribálni[^1].

Nyílt forráskódú elérhetőség

Az összes Granite 4.2 és Speech 5.0 modell Apache-2.0 licenc alatt érhető el olyan platformokon, mint a Hugging Face, Ollama, és GitHub, így a kutatók és fejlesztők könnyedén hozzáférhetnek a legújabb AI technológiákhoz[^1].

Összefoglaló: Jelentőség és jövőbeli kilátások

Az IBM Granite 4.2 modelljei új távlatokat nyitnak a mesterséges intelligencia fejlesztésében, különösen az ügynök-alapú képességek, az eszközhasználat és a gyors beszédfelismerés terén. Az átlátható, nyílt forráskódú elérhetőség elősegíti a tudományos együttműködést és az innovációt, várhatóan új iparági alkalmazások és kutatási projektek előtt is megnyitva az utat.

Forrás:

[^1]: The Decoder (2026. 08. 26). “Granite 4.2: IBM bringt Open-Weight-Sprachmodelle mit agentenbasiertem Training”. Közzétéve [2026. 08. 26.].

Follow
Keresés Népszerű
Loading

Signing-in 3 seconds...

Signing-up 3 seconds...