В своем проекте я использую NATS JetStream, для потокового запроса rps использую публикацию, это означает, что клиент будет ждать ответа от сервера, но часто возникает ошибка таймаута, в чем проблема, не ясно .
Я начал собирать метрики с помощью node_exporter и просматривать их в графане. на панели «Ошибки TCP» вы можете увидеть множество ошибок со следующим описанием: TCPOFOQueue — уровень TCP получает неупорядоченный пакет и имеет достаточно памяти для его постановки в очередь
График Grafana
Причём эти ошибки совпадают по времени с ошибками, возникающими в моём приложении.
Подскажите пожалуйста, куда копать, чтобы узнать и устранить эту проблему ?
Я отправляю обычный запрос через клиент Python для nats и получаю исключения nats: timeout
Код: Выделить всё
await connection.request(
message=b"some_message",
subject="order.cancel",
timeout=1
)
Я думаю, проблема не в Nats Server или VPS, потому что я перераспределил их, проблема все еще возникает. Перед переустановкой VPS я пытаюсь подключиться к Nats Server со своего локального ПК и отправлять запросы, иногда получаю таймауты

НО после переустановки VPS я пытаюсь сделать то же самое, но не получаю таймауты и не вижу ошибок в графике графаны ( Делаю ~100 rpc) После этого можно сделать вывод, что проблема не в nats-py (я думал, что отправка большого количества сообщений одновременно сопровождается ошибкой в реализации nats для python) Теперь я Я еще больше запутался, блин.
Подробнее здесь:
https://stackoverflow.com/questions/789 ... cpofoqueue