热点事件持续更新
JMIR发表香港癌症生存者LLM问答双语评估研究
1 篇报道1 个报道来源2 小时前更新
先了解这件事
AI 综述
2026年10月9日,Journal of Medical Internet Research 发表一项两阶段研究,评估大语言模型聊天机器人回答香港癌症生存者提问的表现。研究测试了 Google Gemini 3.1 Pro、HK Chat-0.6.2、DeepSeek-V3.2 和 Kimi-K2.5 四款模型,并进行提示优化。结果显示,Google Gemini 3.1 Pro 的临床实用性最高,英文下均值 3.99/5(SD 0.16),繁体中文下均值 4.21/5(SD 0.20)。目前该研究已正式发表,为香港癌症生存者场景下的中英双语模型评估提供了结果。
AI 根据报道生成 · 1 小时前更新
最新进展10月9日 04:31
JMIR发表研究:Gemini 3.1 Pro在香港癌症生存者问答中临床实用性最高。报道时间线
沿着报道,了解事件的不同侧面。
10月9日
- Journal of Medical Internet Research香港癌症生存者提问下大语言模型聊天机器人的双语评估与提示优化研究
一项两阶段研究评估了 Google Gemini 3.1 Pro、HK Chat-0.6.2、DeepSeek-V3.2 和 Kimi-K2.5 四款大语言模型回答香港癌症生存者问题的表现,Google Gemini 3.1 Pro 在英文(均值 3.99/5,SD 0.16)和繁体中文(均值 4.21/5,SD 0.20)下临床实用性最高。
本事件热度走势
还没有足够的连续观测数据,暂不绘制趋势。