MODEL INDEX
模型索引
当前页显示 20 个模型,可按输入、输出、交互方式、机构与发布日期组合筛选。
- OR
Orca
文本已发布微软推出的模型,通过学习 GPT-4 的推理轨迹进行知识蒸馏与微调。 参数规模:13B;开放方式:开源;主要架构:自回归 Transformer。
1 EVENTS - FA
Falcon 40B
文本已发布TII 发布 Falcon 40B 开放权重模型,采用面向高效推理优化的自回归架构。 参数规模:40B;开放方式:开源;主要架构:自回归 Transformer。
1 EVENTS - PA
PaLM 2
文本 → 文本已发布PaLM 2 是 Google 的闭源语言模型系列,采用 Transformer 架构和混合预训练目标。官方发布页将产品规格分为 Gecko、Otter、Bison 和 Unicorn,技术报告则评估 Small、Medium、Large 三种研究版本,但没有披露任何一档的实际参数量。模型重点提升多语言、推理和代码能力,训练数据覆盖一百多种语言。
1 EVENTS - MU
MusicLM
文本 → 音频普通请求限量预览MusicLM 是 Google Research 开发的实验性文本生成音乐模型。用户输入音乐构想或文字描述后,模型生成两段音乐供试听和反馈。
1 EVENTS - MP
MPT-7B
文本已发布支持较长的上下文窗口,并采用允许免费商业使用的开源协议。 参数规模:7B;开放方式:开源;主要架构:自回归 Transformer。
1 EVENTS - ST
StarCoder
文本已发布专为代码生成与编程任务训练的开源大模型。 参数规模:15.5B;开放方式:开源;主要架构:自回归 Transformer。
1 EVENTS - ST
StableLM
文本已发布Stability AI 推出的基础语言模型开源系列。 参数规模:7B;开放方式:开源;主要架构:自回归 Transformer。
1 EVENTS - SE
Segment Anything Model
文本 + 图像 → 图像实时交互已发布Segment Anything Model(SAM)是 Meta 发布的通用提示式图像分割基础模型。模型可根据点、框、掩码或文本等提示生成目标区域掩码,并可零样本迁移到新的图像分布和任务。
1 EVENTS - VI
Vicuna
文本已发布基于用户共享的高质量对话数据微调,表现接近早期的 ChatGPT。 参数规模:13B;开放方式:开源;主要架构:自回归 Transformer。
1 EVENTS - GP
GPT-4
文本 + 图像 → 文本普通请求限量预览GPT-4 是 OpenAI 发布的多模态大语言模型,可接收文字和图像并输出文字。首发时,文字能力通过 ChatGPT Plus 和 API 候补名单逐步开放;图像输入仍处于有限 alpha,只与单一合作伙伴测试。标准 API 上下文为 8192 token,另有受限开放的 32768-token 版本。OpenAI 明确没有披露模型规模和具体架构,因此不能据一手资料将 GPT-4 标成 1.8T 参数或 MoE。
1 EVENTS - CL
Claude 1
文本已发布采用“宪法 AI”方法训练,强调模型输出的安全性与无害性。 参数规模:未知;开放方式:闭源;主要架构:自回归 Transformer。
1 EVENTS - AL
Alpaca
文本已发布基于 LLaMA 微调,证明可通过低成本数据实现较好的指令遵循能力。 参数规模:7B;开放方式:开源;主要架构:自回归 Transformer。
1 EVENTS - LL
LLaMA
文本已发布Meta 发布的开源基础模型系列,成为后续众多开源生态的基础。 参数规模:65B;开放方式:部分开源;主要架构:自回归 Transformer。
1 EVENTS - CH
ChatGPT
文本 → 文本普通请求限量预览ChatGPT 是 OpenAI 在 2022 年推出的对话式产品与持续更新的模型系统。首发版本由 GPT-3.5 系列模型经过监督微调和人类反馈强化学习(RLHF)训练,支持多轮文字对话。OpenAI 没有披露首发 ChatGPT 的参数规模,不能把它直接等同于 175B 的 GPT-3。
1 EVENTS - ST
Stable Diffusion 2.0
文本 + 图像 → 图像普通请求已发布Stable Diffusion 2.0 是 Stability AI 发布的图像生成模型系列,改用 OpenCLIP 文本编码器,提供 512 与 768 像素文本生成图像模型,并加入深度条件生成、超分辨率和修复模型。
1 EVENTS - FL
Flan-T5
文本 → 文本已发布Flan-T5 是在 T5 系列基础上进行多任务指令微调的开放模型。Google 使用 1,836 个任务组成的混合数据,并加入 9 个带思维链标注的数据集。公开系列包括 Small(80M)、Base(250M)、Large(780M)、XL(3B)和 XXL(11B),均采用文本输入、文本输出的编码器—解码器结构。
1 EVENTS - WH
Whisper
音频 → 文本普通请求已发布Whisper 是 OpenAI 发布的自动语音识别模型系列。模型支持多语言语音转写、语言识别和非英语语音到英语的翻译,采用端到端编码器—解码器 Transformer 架构。
1 EVENTS - ST
Stable Diffusion
图像生成已发布Stable Diffusion 的公开发布把可本地运行、可二次开发的文本生成图像能力带入主流开源生态,成为后续图像模型、插件和工作流工具的重要基础。
1 EVENTS - MI
Midjourney
文本生成图像已发布Midjourney 是 Midjourney 公司推出的商业图像生成服务,用户通过文本提示生成并迭代图像。它以鲜明的视觉风格、较低使用门槛和快速版本更新受到广泛关注,并推动生成式图像进入设计、广告和内容创作流程。
1 EVENTS - CH
ChatGLM
文本已发布针对中英双语优化,且支持单卡部署的对话模型。 参数规模:130B;开放方式:开源;主要架构:自回归 Transformer。
1 EVENTS