国产精品天干天干,亚洲毛片在线,日韩gay小鲜肉啪啪18禁,女同Gay自慰喷水

歡迎光臨散文網(wǎng) 會(huì)員登陸 & 注冊(cè)

ChatGLM2-12B 效果怎么樣?官方公布

2023-07-28 00:03 作者:ChatGLM  | 我要投稿

ChatGLM2 系列模型發(fā)布月余,大家對(duì) ChatGLM2-6B 的效果已經(jīng)有較多認(rèn)知。我們現(xiàn)在公布 ChatGLM2-12B 在部分中英文典型數(shù)據(jù)集上的評(píng)測(cè)效果,供大家參考。這些數(shù)據(jù)集包括 MMLU(英文)、C-Eval(中文)、GSM8K(數(shù)學(xué)) 和 BBH(英文) 等。

ChatGLM2-12B 模型在這些數(shù)據(jù)集上取得了不錯(cuò)的成績(jī)。我們將繼續(xù)不斷改進(jìn)和優(yōu)化模型,以提供更優(yōu)質(zhì)的模型效果。

具體信息請(qǐng)參考:https://github.com/THUDM/ChatGLM2-6B


MMLU

Chat 模型使用 zero-shot CoT (Chain-of-Thought) 的方法測(cè)試,Base 模型使用 few-shot answer-only 的方法測(cè)試。

C-Eval

Chat 模型使用 zero-shot CoT 的方法測(cè)試,Base 模型使用 few-shot answer only 的方法測(cè)試。

GSM8K

所有模型均使用 few-shot CoT 的方法測(cè)試,CoT prompt 來(lái)自??http://arxiv.org/abs/2201.11903

* 我們使用翻譯 API 翻譯了 GSM8K 中的 500 道題目和 CoT prompt 并進(jìn)行了人工校對(duì)。

BBH

所有模型均使用 few-shot CoT 的方法測(cè)試,CoT prompt 來(lái)自?

https://github.com/suzgunmirac/BIG-Bench-Hard/tree/main/cot-prompts

ChatGLM2-12B 效果怎么樣?官方公布的評(píng)論 (共 條)

分享到微博請(qǐng)遵守國(guó)家法律
重庆市| 镇雄县| 凤翔县| 桦甸市| 双柏县| 镇雄县| 霍邱县| 林周县| 雷山县| 仁怀市| 大悟县| 青田县| 静海县| 洪泽县| 章丘市| 资源县| 上栗县| 郑州市| 扎赉特旗| 桃园县| 贵阳市| 漳州市| 息烽县| 赞皇县| 岚皋县| 东山县| 醴陵市| 鄂伦春自治旗| 清原| 岳阳市| 清河县| 鹤山市| 高碑店市| 廉江市| 东兰县| 榆社县| 中山市| 吴桥县| 漯河市| 利川市| 武功县|