Results for “caam”
3 skillscaa-eval
Benchmarks large audio-language models against adversarial audio attacks using the CAA dataset, computing WER, ROUGE-L, cosine similarity, and coherence scores to assess robustness in conversational settings.
3
cab-eval
Benchmarks LLM bias by scoring responses to automatically generated open-ended questions across sensitive attributes, producing a composite fitness score from 0 to 5.
3
cae
Performs finite element analysis, computational fluid dynamics, thermal analysis, modal analysis, and design optimization for validating designs against physical loads and predicting product behavior.
1