中文语言理解测评基准 Chinese Language Understanding Evaluation Benchmark: datasets, baselines, pre-trained models, corpus and leaderboard
Python 4.3k 543
SuperCLUE: 中文通用大模型综合性基准 | A Benchmark for Foundation Models in Chinese
3.3k 109
SC-Safety: 中文大模型多轮对抗安全基准
152 12
汽车行业中文大模型测评基准,基于多轮开放式问题的细粒度评测
39 4
SuperCLUE-Agent: 基于中文原生任务的Agent智能体核心能力测评基准
96 6
中文原生检索增强生成测评基准
133 5
Large-scale Pre-training Corpus for Chinese 100G 中文预训练语料
There was an error while loading. Please reload this page.
中文精确指令遵循测评基准(开源版)
Math24o: 高中奥林匹克数学竞赛测评集 High School Olympiad Mathematics Chinese Benchmark
中文大模型基准测评2024上半年度报告,Report of LLMs in Chinese, First Half of 2024
中文原生多层次文生视频测评基准
中文原生多模态理解测评基准(测评方案)
中文原生长文本测评基准
中文原生文生图测评基准