Как это работает на практике при отправке многомерного тензора на слой nn.Linear? Он просто обрабатывает входной вектор за вектором или фактически выполняет умножение матриц сразу на весь ввод?
Если это первое, есть ли способ выполнить последнюю операцию ( умножая входной тензор на веса как есть, а не по одному вектору за раз)? Будет ли это быстрее, чем делать это вектор за вектором?
Подробнее здесь: https://stackoverflow.com/questions/789 ... layer-work