Недавние исследования показывают, что малые языковые модели, работающие локально, могут соответствовать производительности крупных облачных систем в большинстве задач. Эти модели обеспечивают значительную экономию затрат и энергии, быстро сокращая разрыв в сложности логических рассуждений.