DataLearner 标志
GP

GPT-3.5

聊天大模型GPTGPT-3.5

Generative Pre-trained Transformer 3.5

发布时间: 2022-11-30更新于: 2024-02-12浏览量: 1,188
在线体验GitHubHugging Face对比
模型参数
1750亿
上下文长度
4K
多语言支持
支持
推理能力
暂无数据

Generative Pre-trained Transformer 3.5 是由 OpenAI 发布的 AI 模型,发布时间为 2022-11-30,定位为 聊天大模型,参数规模约为 1750亿,上下文长度为 4K,模型文件大小约 0,采用 不开源 许可,在 MMLU 上取得 70.00 分。

数据优先来自官方发布(GitHub、Hugging Face、论文),其次为评测基准官方结果,最后为第三方评测机构数据。 了解数据收集方法

GPT-3.5

模型基本信息

推理过程
暂无数据
思考模式
不支持思考模式
上下文长度
4K tokens
最大输出长度
暂无数据
模型类型
聊天大模型
输入/输出模态
暂无数据
发布时间
2022-11-30
模型文件大小
0
MoE架构
总参数 / 激活参数
1750亿 / 不适用
知识截止
暂无数据
GPT-3.5

开源和体验地址

代码开源状态
不开源
预训练权重开源
不开源
GitHub 源码
暂无
Hugging Face
暂无
在线体验
GPT-3.5

官方介绍与博客

官方论文
DataLearnerAI博客
暂无
GPT-3.5

API接口信息

接口速度
暂无数据
暂无公开的 API 定价信息。
GPT-3.5

评测结果

GPT-3.5 当前已收录的代表性评测结果包括 GSM8K(38 / 71,得分 57.10)、C-Eval(27 / 48,得分 54.40)、MMLU(73 / 124,得分 70)。 本页还汇总了参数规模、上下文长度与 API 价格,便于结合评测结果与部署约束一起判断模型适配度。

思考模式

综合评估

共 2 项评测
评测名称 / 模式
得分
排名/总数
MMLU
常规模式
70
73 / 124
C-Eval
常规模式
54.40
27 / 48

数学推理

共 1 项评测
评测名称 / 模式
得分
排名/总数
GSM8K
常规模式
57.10
38 / 71

编程与软件工程

共 2 项评测
评测名称 / 模式
得分
排名/总数
MBPP
常规模式
52.20
63 / 96
HumanEval
常规模式
48.10
87 / 140
GPT-3.5

发布机构

Generative Pre-trained Transformer 3.5

模型解读

GPT-3.5是GPT-3之后OpenAI的下一代大语言预训练模型。2022年12月1日,OpenAI公布了ChatGPT,提到这是基于GPT-3.5微调的AI对话系统。首次对外证明了GPT 3.5的存在。目前,暂无其它消息!

GPT系列模型

GPT模型:https://datalearner.com/ai-resources/pretrained-models/gpt 

GPT-2模型:https://datalearner.com/ai-resources/pretrained-models/gpt-2 

GPT-3模型:https://datalearner.com/ai-resources/pretrained-models/gpt-3 

ChatGPT信息:https://datalearner.com/blog/1051669904657253 

-----2023/03/12更新------

根据Ahmed Mandour的消息,GPT-3.5是基于GPT-3微调的模型版本,参数量分成1750亿、60亿、13亿三个版本。

来源: https://iq.opengenus.org/gpt-3-5-model/ 

但是存疑

基础模型

DataLearner 官方微信

欢迎关注 DataLearner 官方微信,获得最新 AI 技术推送

DataLearner 官方微信二维码