MODEL INDEX
模型索引
当前页显示 20 个模型,可按输入、输出、交互方式、机构与发布日期组合筛选。
- GP
GPT-4 Turbo
文本 + 图像 → 文本限量预览OpenAI 发布的 GPT-4 Turbo 模型,在发布时提供 128K 上下文窗口;视觉预览版本支持图像和文本输入并生成文本输出。
1 EVENTS - YI
Yi
文本已发布零一万物发布的基础开源模型,支持最高 20 万 token 的上下文长度。 参数规模:34B;开放方式:开源;主要架构:自回归 Transformer。
1 EVENTS - DE
DeepSeek Coder
代码生成已发布DeepSeek Coder 从头训练于 2T tokens,覆盖 1.3B、5.7B、6.7B 与 33B 等规模,并支持 16K 上下文和代码补全。
1 EVENTS - CH
ChatGLM3
文本已发布第三代 ChatGLM,增强了原生工具调用(Function Calling)和代码执行功能。 参数规模:6B;开放方式:开源;主要架构:自回归 Transformer。
1 EVENTS - ZE
Zephyr
文本已发布结合直接偏好优化(DPO)算法微调,提升了对话意图的对齐效果。 参数规模:7B;开放方式:开源;主要架构:自回归 Transformer。
1 EVENTS - ER
ERNIE 4.0
文本 + 图像 → 文本 + 图像 + 视频受限百度发布的基础模型。官方发布说明,其在文心一言中的部署可接收文本提示和图像输入,并生成文本、图像和视频内容。
1 EVENTS - MI
Mistral 7B
文本已发布引入滑动窗口注意力机制,在同参数级别基准测试中表现优异。 参数规模:7B;开放方式:开源;主要架构:自回归 Transformer。
1 EVENTS - QW
Qwen
文本已发布阿里云推出的支持多种语言的开源基础模型系列。 参数规模:72B;开放方式:开源;主要架构:自回归 Transformer。
1 EVENTS - DA
DALL·E 3
文本 → 图像普通请求已弃用DALL·E 3 是 OpenAI 的文生图系统。官方论文把提示词遵循的主要改进归因于训练数据重标注:先用专用图像描述器生成更详细的合成说明,再用这些说明训练图像生成模型。论文披露的组件包括 T5-XXL 文本编码器、文本条件 U-Net 潜空间扩散模型,以及经一致性蒸馏压缩到两步去噪的扩散解码器;参数量和文本上下文长度未公开。其公开接口接收文本并输出图像,不提供 DALL·E 2 式的图像编辑或变体输入。
4 EVENTS - BA
Baichuan 2
文本已发布百川智能发布的第二代开源模型,提升了垂直领域任务表现。 参数规模:53B;开放方式:开源;主要架构:自回归 Transformer。
1 EVENTS - WI
WizardCoder
文本已发布采用 Evol-Instruct 方法微调的开源代码生成模型。 参数规模:34B;开放方式:开源;主要架构:自回归 Transformer。
1 EVENTS - HY
HyperCLOVA X
文本已发布面向企业级商业应用优化的新一代韩语大规模模型。 参数规模:未知;开放方式:闭源;主要架构:自回归 Transformer。
1 EVENTS - CO
Code Llama
文本 → 文本已发布Code Llama 是基于 Llama 2 继续训练的代码模型系列。2023 年首发包含 7B、13B、34B 三种规模,以及基础、Python 和 Instruct 版本;7B 与 13B 的部分版本支持填充中间代码。模型使用 16000-token 序列训练,Meta 报告它在最长 100000-token 输入上仍有改进。基础版和 Python 版不是通用指令模型。
1 EVENTS - QW
Qwen-VL
文本 + 图像 → 文本普通请求已发布Qwen-VL 是阿里云发布的视觉语言模型,可接收图像和文本输入并输出文本或以文本编码的边界框,支持图像描述、视觉问答、文档文字理解和目标定位。
1 EVENTS - SD
SDXL 1.0
文本 + 图像 → 图像普通请求已发布SDXL 1.0 是 Stability AI 发布的图像生成模型。模型原生生成 1024 × 1024 图像,采用基础模型与精炼模型组成的两阶段潜空间扩散架构,并支持文本生成图像及图像条件生成。
1 EVENTS - LL
Llama 2
文本已发布Llama 2 覆盖 7B、13B 与 70B 参数规模,并提供对话版本,使企业和开发者能够在自有环境中部署开放权重模型。
1 EVENTS - CL
Claude 2
文本已发布原生支持最高 10 万 token 的上下文窗口,并提升了代码能力。 参数规模:未知;开放方式:闭源;主要架构:自回归 Transformer。
1 EVENTS - CH
ChatGLM2
文本已发布第二代 ChatGLM,升级了架构,支持更长的上下文窗口和更快的推理速度。 参数规模:6B;开放方式:开源;主要架构:自回归 Transformer。
1 EVENTS - IN
Inflection-1
文本已发布Inflection AI 的底层语言模型,主要用于驱动对话应用 Pi。 参数规模:未知;开放方式:闭源;主要架构:自回归 Transformer。
1 EVENTS - BA
Baichuan-7B
文本已发布百川智能推出的中英双语开源大模型。 参数规模:7B;开放方式:开源;主要架构:自回归 Transformer。
1 EVENTS