输入关键词搜索 AI 工具、分类,或直接跳转页面

teddy-xionggz.github.io
Benchmark Medical RAG是聚焦医疗领域的检索增强生成(RAG)基准测试平台,核心定位是为医疗大模型研发提供标准化的效果评测支撑。平台内置多场景医疗问答数据集,覆盖常见疾病、临床指南、医学术语等多个专业领域,同时提供自动化评测工具,可从检索准确率、生成内容合规性、事实一致性等多个维度输出量化评估结果。目标用户包括高校医学人工智能方向研究者、医疗大模型研发团队、医疗AI应用开发企业,可用于医疗RAG系统迭代优化、模型性能横向对比、学术研究实验验证等多个场景。