ITBEAR科技资讯
网站首页 科技资讯 财经资讯 分享好友

OpenAI发布SimpleQA新基准,助力语言模型准确性大提升!

时间:2024-10-31 21:32:18来源:ITBEAR编辑:快讯团队

【ITBEAR】为解决语言模型在回答问题时可能产生的“幻觉”问题,美国知名人工智能研究机构OpenAI近日开源了一款新基准——SimpleQA。

SimpleQA专注于评估模型在简短、事实性问题上的准确性,共包含4326个精心设计的问题。然而,它仅限于评估有确切答案的短查询。

OpenAI强调,虽然SimpleQA能有效衡量模型在短回答中的事实准确性,但其在处理长篇或多事实内容方面的表现仍需进一步探究。通过开源SimpleQA,OpenAI希望能推动AI研究的进步,提升语言模型的可靠性和信任度。

该基准的特点包括确保答案的正确性,问题的答案均经过两名独立AI训练师的严格验证;覆盖多元主题,从科技到娱乐,体现其广泛的适用性;以及对前沿模型的挑战性,如GPT-4等先进模型,在SimpleQA面前都将面临严峻的考验。

SimpleQA还注重用户体验,简洁明了的问题和答案设计使得用户能够轻松操作和评分。同时,借助OpenAI API等工具,用户可以快速评估模型的性能。

更多热门内容
讯飞医疗2025中期业绩亮眼:C端业务占35%,晓医APP咨询量飙升1.4亿
来源:格隆汇APP 格隆汇8月20日|医疗大模型第一股讯飞医疗(2506.HK)发布2025年中期业绩报告。报告显示,公司上半年实现总营收2.986亿元,同比增长30%;毛利1.539亿元,同比增长27%,毛…

2025-08-21

讯飞医疗科技2025中期业绩:营收近3亿,亏损收窄,基层解决方案增长超五成
人民财讯8月20日电,8月20日晚,讯飞医疗科技发布2025年中期业绩,公司上半年实现营收2.99亿元,同比增长30%;归母净利润为亏损7408.6万元,同比减亏;毛利1.54亿元,同比增长27%,毛利率达5…

2025-08-21