spark是一个分布式计算框架, 从他的作业调度可以看到,它的资源分配粒度很粗,CPU的核数进行分配的,集群的CPU资源是有限的同时spark sql资源计算时需要把大量数据加载到内存中,需要消耗集群大量的内存资源,再做shuffle的时候,又需要消耗大量的网络IO和磁盘IO, 如果同时多个job执行,那么每个job获得资源要么少,要么需要排队。而不能像关系型数据库那么提供高并发的服务。