[E-DailyKim Hyun-ah 记者] 在作为韩国“AI国家队”选拔赛的“自主AI基础模型项目”(简称“独基模”)中,参与评选的4个模型中,Motif公司的“Motif 3”在全球人工智能(AI)评估机构Artificial Analysis的最新评估中获得了最高分。
据Artificial Analysis 13日公布的数据,在最新的“Artificial Analysis Intelligence Index v4.1.1”中,“Motif 3”获得了47分。 紧随其后的是Upstage的“Solar Open2 250B”(37分)、SKTelecom(017670)的“A.X-K2”(35分)以及LG Corp.(003550) AI研究院的“K-EXAONE 2.0 0803”(31分)。
Artificial Analysis是一家综合评估AI模型在数学、科学、编程、推理等各方面能力的全球AI分析机构。最新的Intelligence Index综合了GDPval-AA v2、τ³-Banking、Terminal-Bench 2.1、SciCode、Humanity’s Last Exam、GPQA Diamond等9项评估指标,据此计算出分数。
韩国科学技术信息通信部委托的“自主AI基础模型”评审相关AAII性能评估表。来源=Artificial Analysis
另一方面,在“自主AI基础模型”项目第三轮评估结果即将公布之际,作为全球基准的AAII分数预计将对最终评审产生重大影响。在此次第三轮评估中,LG AI研究院、Upstage、SK电信、Motif Technologies等4家企业中将有1家被淘汰。
据悉,AAII分数在“自主AI基础模型”第二轮评估的40分基准分中占25分。剩余15分则由韩国智能信息社会振兴院(NIA)的自主基准评估决定。鉴于AAII在总分100分中占比高达25%,预计将对最终排名产生相当大的影响。
AAII是一项评估推理、知识、编码等实际AI应用能力的全球基准测试。科技信息通信部相关人士表示:“通常AAII评估由各企业委托进行,但此次是政府直接委托Artificial Analysis公司进行的,因此分数得以公开。”
据Artificial Analysis 13日公布的数据,在最新的“Artificial Analysis Intelligence Index v4.1.1”中,“Motif 3”获得了47分。 紧随其后的是Upstage的“Solar Open2 250B”(37分)、SKTelecom(017670)的“A.X-K2”(35分)以及LG Corp.(003550) AI研究院的“K-EXAONE 2.0 0803”(31分)。
Artificial Analysis是一家综合评估AI模型在数学、科学、编程、推理等各方面能力的全球AI分析机构。最新的Intelligence Index综合了GDPval-AA v2、τ³-Banking、Terminal-Bench 2.1、SciCode、Humanity’s Last Exam、GPQA Diamond等9项评估指标,据此计算出分数。
另一方面,在“自主AI基础模型”项目第三轮评估结果即将公布之际,作为全球基准的AAII分数预计将对最终评审产生重大影响。在此次第三轮评估中,LG AI研究院、Upstage、SK电信、Motif Technologies等4家企业中将有1家被淘汰。
据悉,AAII分数在“自主AI基础模型”第二轮评估的40分基准分中占25分。剩余15分则由韩国智能信息社会振兴院(NIA)的自主基准评估决定。鉴于AAII在总分100分中占比高达25%,预计将对最终排名产生相当大的影响。
AAII是一项评估推理、知识、编码等实际AI应用能力的全球基准测试。科技信息通信部相关人士表示:“通常AAII评估由各企业委托进行,但此次是政府直接委托Artificial Analysis公司进行的,因此分数得以公开。”