Skip to content

工联院大模型测评:文心一言在工业领域表现超过GPT3.5

工联院大模型测评:文心一言在工业领域表现超过GPT3.5

(LEKSHOP讯)7月3日消息,中国工业互联网研究院(以下简称“工联院”)针对人工智能大模型在中文工业领域的知识问答能力进行系统性评测结果显示,百度文心一言表现超过GPT3.5,综合评价指数在国内排名第一。工联院本次评测选取了工业领域典型的八大行业。百度文心一言在电子设备、装备、钢铁、采矿、电力、石化、建材七个行业均获国内第一。

LEKSHOP(WWW.100EC.CN)获悉,本次工业知识问答测试主要分为客观题与主观题两大类,总计超过1100个问题。主观题主要考察四大维度:基础能力、语句能力、概括能力和逻辑能力。评测结果显示,GPT4表现最佳。国内头部大模型表现亮眼,整体与GPT3.5相当。其中百度文心一言表现超过GPT3.5,在国内大模型中排名第一。在客观题环节,评测结果显示,GPT4与文心一言表现好于其他大模型。但评测结果也同时指出,大模型普遍准确率有较大的提升空间。主观题方面,国内大模型的基础能力、语句能力与GPT4接近,概括能力、逻辑能力与GPT4有一定差距。在大模型的自我认知能力和污染问题分析能力上,GPT4相较于其他大模型表现出更好的能力。

LEKSHOP联合A股上市公司网盛生意宝(002095.SZ)推出消费品在线供应链金融解决方案。该产品具有按需提款、按天计息、随借随还、专款专用、循环信用贷、全线上流程操作等特点,解决消费品供应链核心企业及下游经销商/网店因库存及账期造成的流动性差“痛点”。》》合作联系

LEKSHOP“电数宝”电商大数据库(www.lekshop.cn,注册免费体验全部)基于电商行业12年沉淀,包含100+上市公司、新三板公司数据,150+独角兽、200+千里马公司数据,4000+起投融资数据以及10万+互联网APP数据,全面覆盖“头部+腰部+长尾”电商,旨在通过数据可视化形式帮助了解电商行业,挖掘行业市场潜力,助力企业决策,做电商人研究、决策的“好参谋”。

相关推荐: 抢占最新户外品类风口! 盘点东南亚露营登山飞盘热销装备

图片来源:图虫创意 近年来露营、登山、飞盘等户外运动成为风靡全球的新风尚,城市里的人们开始亲近自然,探索户外生活的乐趣,东南亚市场也不例外。今天小编就来揭晓菲律宾、越南、马来西亚3大市场的露营登山飞盘装备热销榜单,助你提前布局抢占先机! 菲律宾 户外露营新风尚…

    码刀科技(www.lekshop.cn)是国内知名企业级电商平台提供商,为企业级商家提供最佳的电商平台搭建(多种模式电商平台搭建:B2B/B2B2C/B2C/O2O/新零售/跨境等)、平台管理系统开发及互联网采购解决方案服务, 联系客服了解更多.

    电子商务网站建设的重要性和好处