A primeira chamada é a lenta
A penalização média de arranque a frio é de 31,6 ms. A pior que registramos foi 14.586 ms. Se seu servidor MCP dorme, o seu agente espera.
Em cada ronda medimos duas coisas: quanto demora a responder um servidor quente e quanto custa a mais a primeiríssima chamada. A distância entre os dois números é onde o hospedagem serverless se revela.
Os números
latência moderna média 770,2 ms
arranque a frio médio 31,6 ms
pior arranque a frio 14.586 msA média é confortável. A cauda não é. Quase quinze segundos extra na primeira chamada chegam para a maioria das frameworks de agentes desistir antes de a resposta chegar.
Porque acontece
Muitos servidores MCP são publicados como funções que escalam para zero. É um padrão sensato num projeto pessoal: não pagas enquanto está parado. Mas um agente não tenta outra vez com paciência. Envia uma chamada, espera pelo tempo limite e trata o silêncio como ferramenta avariada.
Se você hospeda um
- Descubra se a tua plataforma escala para zero — muitas fazem-no por omissão.
- Mantenha uma instância quente se algo automatizado depender do servidor.
- Meça a primeira chamada depois de um período parado, não a décima de um ciclo.