最美情侣中文字幕电影,在线麻豆精品传媒,在线网站高清黄,久久黄色视频

歡迎光臨散文網(wǎng) 會(huì)員登陸 & 注冊(cè)

ChatGLM2-12B 效果怎么樣?官方公布

2023-07-28 00:03 作者:ChatGLM  | 我要投稿

ChatGLM2 系列模型發(fā)布月余,大家對(duì) ChatGLM2-6B 的效果已經(jīng)有較多認(rèn)知。我們現(xiàn)在公布 ChatGLM2-12B 在部分中英文典型數(shù)據(jù)集上的評(píng)測(cè)效果,供大家參考。這些數(shù)據(jù)集包括 MMLU(英文)、C-Eval(中文)、GSM8K(數(shù)學(xué)) 和 BBH(英文) 等。

ChatGLM2-12B 模型在這些數(shù)據(jù)集上取得了不錯(cuò)的成績(jī)。我們將繼續(xù)不斷改進(jìn)和優(yōu)化模型,以提供更優(yōu)質(zhì)的模型效果。

具體信息請(qǐng)參考:https://github.com/THUDM/ChatGLM2-6B


MMLU

Chat 模型使用 zero-shot CoT (Chain-of-Thought) 的方法測(cè)試,Base 模型使用 few-shot answer-only 的方法測(cè)試。

C-Eval

Chat 模型使用 zero-shot CoT 的方法測(cè)試,Base 模型使用 few-shot answer only 的方法測(cè)試。

GSM8K

所有模型均使用 few-shot CoT 的方法測(cè)試,CoT prompt 來(lái)自??http://arxiv.org/abs/2201.11903

* 我們使用翻譯 API 翻譯了 GSM8K 中的 500 道題目和 CoT prompt 并進(jìn)行了人工校對(duì)。

BBH

所有模型均使用 few-shot CoT 的方法測(cè)試,CoT prompt 來(lái)自?

https://github.com/suzgunmirac/BIG-Bench-Hard/tree/main/cot-prompts

ChatGLM2-12B 效果怎么樣?官方公布的評(píng)論 (共 條)

分享到微博請(qǐng)遵守國(guó)家法律
柳河县| 思南县| 遂平县| 麻阳| 出国| 碌曲县| 吉林市| 呼玛县| 清流县| 贵定县| 香港 | 上思县| 襄汾县| 怀仁县| 克拉玛依市| 琼海市| 泰安市| 萝北县| 高尔夫| 乐至县| 宜阳县| 金山区| 镇原县| 潮安县| 丰城市| 富裕县| 宜川县| 古交市| 色达县| 宿迁市| 隆子县| 肥西县| 五家渠市| 东兰县| 通化县| 平原县| 屏边| 宜昌市| 阿图什市| 临颍县| 库尔勒市|