Нещодавні дослідження свідчать, що малі мовні моделі, які працюють локально, можуть зрівнятися за продуктивністю з великими хмарними системами у більшості завдань. Ці моделі забезпечують значну економію енергії та ресурсів, стрімко скорочуючи відставання від LLM у складних логічних операціях.