让 Tailscale 更快:内存、多队列、writev 与 netmap 缓存的优化细节
Tailscale 团队介绍了多项性能优化:Linux/Android 上避免把小包反复拷入 64KiB 缓冲,节省内存并带来约 5% 提速;将原本单线程有序处理扩展为多队列并行,按机器资源而非 peer 数分配,降低 subnet router / app connector / exit node 的转发延迟;利用 Linux writev 减少拷贝和系统调用次数提升吞吐;netmap 缓存让设备在无法快速到达控制面时仍能靠本地缓存建立连接,启动速度在"坏网络"场景可快 1-2 个数量级。 这些优化预计陆续进入 v1.104 及之后的稳定版本,同时 Tailscale 还在探索原生性能测试/诊断工具,以弥补现有工具对 DERP、peer relay 和 QUIC/HTTP3 支持不足的空白。 









