我有一个响应时间约100毫秒的A接口,单线程下每秒最多处理10次请求,理论QPS为10。但实际调用由多个线程并发执行,我原以为系统会创建数十甚至上百个线程来支撑高并发,可日志中显示活跃线程ID始终集中在1–10范围内,并未出现大量线程编号。若仅靠这10个线程,QPS理应不超过100,但使用JMeter压测时却轻松达到数千QPS。这明显存在矛盾:在有限线程数的前提下,系统是如何实现如此高吞吐量的?背后是否涉及线程复用、异步处理、连接池、I/O多路复用或操作系统级调度优化等机制?需要厘清高并发请求的实际承载方式与线程模型之间的关系。