微软发布13亿参数小模型phi-1.5:AGIEval跑分优于70亿参数
时间:2023-09-13 10:58 | 来源: IT之家 | 阅读量:11752 |
,微软研究院昨日发布了名为 phi-1.5 的全新预训练语言模型,共有 13 亿个参数,适用于 QA 问答、聊天格式和代码等等场景。
phi-1.5 采用来自 StackOverflow 平台关于 Python 板块的 Qamp;A 内容、code_contests 中的竞争代码、合成 Python 教科书,gpt-3.5-turbo-0301 生成等各种数据集,此外还包括各种 NLP 合成文本组成的新数据源。
微软表示在测试常识、语言理解和逻辑推理的基准下,phi-1.5 的表现超出了大部分参数低于 100 万的模型。phi-1.5 在 AGIEval 得分上超过了拥有 70 亿参数、来自 Meta 的 llama-2;在带 LM-Eval Harness 的 GPT4AL 跑分套件中,可以媲美 70 亿参数的 llama-2。
IT之家在此附上链接,感兴趣的用户可以点击阅读。
广告声明:文内含有的对外跳转链接,用于传递更多信息,节省甄选时间,结果仅供参考,IT之家所有文章均包含本声明。
声明:以上内容为本网站转自其它媒体,相关信息仅为传递更多企业信息之目的,不代表本网观点,亦不代表本网站赞同其观点或证实其内容的真实性。投资有风险,需谨慎。