Ну 100 агентов на локальных мощностях довольно тяжело будет запустить. Если есть мощности для 100 агентов мелких, проще развернуть 10 агентов побольше и это будет ощутимо профитнее.По факту, можно в многопотоке посадить 100 агентов на 1 задачу, чтобы они её модерировали и усовершенствовали на выходе получим 1 качественный промт для следующего потока и по факту можно получается сделать что то +- норм
У меня, например, на моно батче может быть до 100-130 токенов в секунду на Qwen3.6-35b-a3b в Q8 + 262к контекста, но если я начинаю батчить по 4 запроса, то суммарная пропускная вырастет до 200-250 токенов в секунду, но каждый отдельный агент просядет на 30-40% по скорости. Нужно оно? Не всегда.














