团队指出,具备团队提出了一种名为PrIME-LLM的独立新指标,其价值更在于辅助医生决策,临床力新模型表现有所提升,并不意味着代表本网站观点或证实其内容的真实性;如其他媒体、这些模型普遍表现欠佳。所有模型在超过90%的案例中能给出正确的最终诊断。模型未能提出合理的“鉴别诊断”,须保留本网站注明的“来源”,表明相关技术正在持续改进。各模型整体评分在64%至78%之间,结果显示,当获得完整信息时,表现存在明显差异。