(资料图片仅供参考)
近日,清华大学新闻与传播学院沈阳团队发布《大语言模型综合性能评估报告》,报告本次评估选取了ChatGPT、文心一言、通义千问等7个大语言模型,围绕生成质量、使用与性能、安全与合规三大维度,全面考察大语言模型中文语义理解、逻辑推理等20项指标。
在这7款大模型中,GPT-4获得了毫无悬念的第一,第二名是百度的文心一言,其次是GPT-3.5,后面就是Claude、讯飞星火、阿里云的通义千问及昆仑的天工。
但对国内用户而言,中文理解能力也是关键指标。综合来看,文心一言语义理解能力突出。在部分中文语义理解方面,文心一言以92%的得分率排名榜首,超越讯飞星火、GPT-4。
凭借知识增强的核心特色,文心一言对本土语言特性把握更精准,能够更好处理与本土文化相关的主题和背景,如诗歌、方言等,具备更强的国内落地空间。
热推荐:《宝可梦》大陆官网更新TCG条目 国行卡或许要来了
天天消息!Xbox Elite无线控制器2代青春版开售 售价999元
当前短讯!Fami通周评分:《黎之轨迹2》、《北欧女神》均33分
今日要闻!博主实测iPhone 14/Pro刮擦摔砸 与iPhone 13的玻璃耐用性基本一致
环球快播:玩家喜爱的“自由交易”为何一度成了网游中的禁区?
世界微动态丨零售商免费送《巴比伦陷落》:如果你想要个杯垫的话
滚动:艾玛沃特森为汤姆费尔顿新书写序:我们是彼此的灵魂伴侣
每日视讯:《宝可梦》TCG卡牌简中版官宣 9月28日正式发布
全球热文:《高达:进化》Steam特别好评:免费机甲版守望先锋
头条焦点:万智牌机飞系列新卡发布:能改变数字的黑客大师