请问下文中所说的中文副语言检测,是用BEATs ,这个模型是有做什么特别的微调吗,还是类似于AudioSet分类把副语言分类出来的??
请问下文中所说的中文副语言检测,是用BEATs ,这个模型是有做什么特别的微调吗,还是类似于AudioSet分类把副语言分类出来的??