中英文混合文本与声学联合增强:针对中英文混合场景下数据匮乏的问题,Spark-ASR-2.0在文本端通过挖掘英文专有词与热词,构建大规模中英文混合文本数据,提升了大模型在中英文复杂场景下的泛化性;声学编码端…...