MODEL INDEX
模型索引
当前页显示 20 个模型,可按输入、输出、交互方式、机构与发布日期组合筛选。
- CL
Claude 3.5 Sonnet
多模态已发布Claude 3.5 Sonnet 在中端模型成本档位达到更强能力,同时通过 Artifacts 改变用户与模型生成内容协作的方式。
1 EVENTS - GE
Gen-3 Alpha
视频生成已宣布Gen-3 Alpha 是 Runway 新一代视频基础模型,支持文本生成视频、图像生成视频与更细粒度的结构、风格和运动控制。
1 EVENTS - DE
DeepSeek Coder V2
文本已发布基于 V2 架构推出的专门优化编程与数学逻辑计算能力的 MoE 模型。 参数规模:236B (MoE);开放方式:开源;主要架构:混合专家 Transformer(MoE)。
1 EVENTS - MA
Mamba Codestral 7B
文本已发布Mistral AI 尝试基于非 Transformer(即 Mamba)架构研发的代码生成模型。 参数规模:7B;开放方式:开源;主要架构:状态空间模型(Mamba)。
1 EVENTS - NE
Nemotron-4 340B
文本已发布英伟达开源的 3400 亿参数模型,配套发布且允许用于生成合成数据。 参数规模:340B;开放方式:开源;主要架构:自回归 Transformer。
1 EVENTS - ST
Stable Diffusion 3 Medium
文本 → 图像普通请求已发布Stable Diffusion 3 Medium 是 Stability AI 发布的 20 亿参数文本生成图像模型。模型采用 Diffusion Transformer 架构、三个文本编码器和 16 通道 VAE,重点改进复杂提示词理解、排版和消费级硬件部署。
1 EVENTS - QW
Qwen2
文本已发布阿里云第二代 Qwen 系列,重点优化了多语言支持与长文本处理能力。 参数规模:72B;开放方式:开源;主要架构:自回归 Transformer。
1 EVENTS - GL
GLM-4
文本已发布智谱发布的第四代语言模型,整体评测指标较上代大幅度提升。 参数规模:9B;开放方式:开源;主要架构:自回归 Transformer。
1 EVENTS - CO
Codestral
文本已发布Mistral AI 推出的专门针对代码生成与编程任务优化的开源模型。 参数规模:22B;开放方式:部分开源;主要架构:自回归 Transformer。
1 EVENTS - IM
Imagen 3
文本生成图像已发布Imagen 3 是 Google 推出的第三代 Imagen 图像生成模型,重点提升照片级质量、细节、复杂提示理解和画面内文字表现。Google 将它接入 ImageFX、Gemini 和 Vertex AI,覆盖消费级与企业级场景。
1 EVENTS - GP
GPT-4o
多模态已发布GPT-4o(o 代表 omni)在单一模型中处理文本、视觉和音频,降低语音交互延迟,并改善成本与非英语表现。
1 EVENTS - DE
DeepSeek V2
文本已发布DeepSeek 第二代 MoE 模型,通过创新底层架构有效降低了推理与训练成本。 参数规模:236B (MoE);开放方式:开源;主要架构:混合专家 Transformer(MoE)。
1 EVENTS - SN
Snowflake Arctic
文本已发布Snowflake 推出的 MoE 模型,主要针对 SQL 查询和企业代码生成任务优化。 参数规模:480B (MoE);开放方式:开源;主要架构:混合专家 Transformer(MoE)。
1 EVENTS - PH
Phi-3
文本已发布微软小参数模型 Phi 系列的第三代迭代,优化了端侧设备的运行效率。 参数规模:14B;开放方式:开源;主要架构:自回归 Transformer。
1 EVENTS - LL
Llama 3
文本已发布Meta 第四代基座,扩大了训练数据量,同参数级别下综合性能有显著提升。 参数规模:70B;开放方式:开源;主要架构:自回归 Transformer。
1 EVENTS - MI
Mixtral 8x22B
文本已发布Mistral AI 扩增参数规模至 1760 亿的 MoE 开源版本。 参数规模:176B (MoE);开放方式:开源;主要架构:混合专家 Transformer(MoE)。
1 EVENTS - WI
WizardLM-2
文本已发布微软推出的新一代开源模型系列,指令遵循和复杂任务表现较好。 参数规模:8x22B;开放方式:开源;主要架构:自回归 Transformer。
1 EVENTS - RE
Reka Core
文本 + 图像 + 音频 + 视频 → 文本已发布Reka AI 研发的多模态模型,支持文本、图像、视频及音频联合输入。 参数规模:67B;开放方式:闭源;主要架构:自回归 Transformer。
1 EVENTS - CO
Command R+
文本已发布Cohere 推出的针对检索增强生成(RAG)和工具调用优化的企业级模型。 参数规模:104B;开放方式:开源;主要架构:自回归 Transformer。
1 EVENTS - JA
Jamba
文本已发布AI21 Labs 推出的结合了 Mamba 与 Transformer 架构的混合模型。 参数规模:52B;开放方式:开源;主要架构:Mamba–Transformer 混合架构。
1 EVENTS