Journal of Medical Internet Research· Haoyu An·· 3 小时前AI 评分42
香港癌症生存者提问下大语言模型聊天机器人的双语评估与提示优化研究
Large Language Model Chatbot Responses to Cancer Survivorship Questions in Hong Kong: Bilingual Evaluation and Prompt Optimization Study
AI 导读
一项两阶段研究评估了 Google Gemini 3.1 Pro、HK Chat-0.6.2、DeepSeek-V3.2 和 Kimi-K2.5 四款大语言模型回答香港癌症生存者问题的表现,Google Gemini 3.1 Pro 在英文(均值 3.99/5,SD 0.16)和繁体中文(均值 4.21/5,SD 0.20)下临床实用性最高。
来源:Journal of Medical Internet Research · jmir.org
猜你喜欢
- JMIR Mental Health 系统综述:聊天机器人在心理健康筛查与评估中的效果JMIR Mental Health · 2 天前
- 处方级移动数字疗法辅助药物治疗急性期惊恐障碍的多中心随机对照试验Journal of Medical Internet Research · 3 天前
- JMIR Mental Health:基于自然语言的心理健康支持需求评估模型开发与验证JMIR Mental Health · 13 天前
- JMIR Mental Health:领域专用NLP与大模型集成检测社交媒体自杀意念JMIR Mental Health · 2 小时前
- MYCATS 试验经济学评价:家长主导在线 CBT 预防儿童焦虑的成本效果Journal of Medical Internet Research · 2 小时前