#llmПришел к выводу, что с 16Gb ram без gpu малютки 8-9b не способны выполнять задачи в агентных средах более чем 3 шага...

#llmПришел к выводу, что с 16Gb ram без gpu малютки 8-9b не способны выполнять задачи в агентных средах более чем 3 шага. Они просто забавют поставленную задачу. Испытаны были qwen3.5, ministral, lfm2.5, ornith1.0, gemma4. На фоне остальных хорошо выглядит гемма4:12b, но все равно и её использовать нельзя, упирается в ограниченность ресурсов. Неплохо себя показал дебютант ornith, скорость общения ~4.5т.сек. поговаривают, что он произошел от скрещивания qwen и gemma. К слову модель 35b работает быстро замечательно на соответствующем железа с gpu. Вывод: малыши пока ещё не умеют творить чудеса, но их вполне можно использовать как локальную википедию, советника или на не сложную задачу в 1-2 действия.

Read Original

Related