MODEL INDEX
模型索引
当前页显示 20 个模型,可按输入、输出、交互方式、机构与发布日期组合筛选。
- MI
Ministral
文本已发布Mistral 针对端侧设备算力与边缘计算场景设计的低参数规模模型系列。 参数规模:8B;开放方式:开源;主要架构:自回归 Transformer。
1 EVENTS - GL
GLM-4-Voice
音频已发布智谱开源的原生支持端到端语音特征交互和基础情感识别的模型。 参数规模:9B;开放方式:开源;主要架构:自回归 Transformer。
1 EVENTS - IN
Inflection 3
文本已发布Inflection AI 发布的面向企业级定制场景的语言模型,兼顾陪伴与生产效率。 参数规模:未知;开放方式:闭源;主要架构:自回归 Transformer。
1 EVENTS - PA
Palmyra X 004
文本已发布Writer 推出的专注企业工作流自动化、工具联合调用的基础模型。 参数规模:未知;开放方式:闭源;主要架构:自回归 Transformer。
1 EVENTS - YI
Yi-Lightning
文本已发布零一万物采用 MoE 架构的高性能闭源模型,公开评测榜单表现良好。 参数规模:未知 (MoE);开放方式:闭源;主要架构:混合专家 Transformer(MoE)。
1 EVENTS - LL
Llama 3.2
文本 + 图像 → 文本已发布Meta 发布的 Llama 模型系列,包含 1B、3B 文本模型和 11B、90B 视觉语言模型。视觉模型支持文本和图像输入,并生成文本。
1 EVENTS - QW
Qwen2.5
文本已发布阿里通义千问 2.5 代版本,提供多规格参数量,全面提升了基础能力与指令遵循。 参数规模:72B;开放方式:开源;主要架构:自回归 Transformer。
1 EVENTS - MI
Mistral Small 2409
文本已发布针对低成本部署和轻量化需求推出的架构升级微调版本。 参数规模:22B;开放方式:开源;主要架构:自回归 Transformer。
1 EVENTS - PI
Pixtral 12B
多模态已发布Mistral AI 推出的原生支持图像特征输入的多模态视觉语言模型。 参数规模:12B;开放方式:开源;主要架构:自回归 Transformer。
1 EVENTS - O1
o1-preview
文本已发布OpenAI 首次发布的具备内在思维链(Chain-of-Thought)与强化学习对弈机制的模型。 参数规模:未知;开放方式:闭源;主要架构:自回归 Transformer。
1 EVENTS - JA
Jamba 1.5
文本已发布升级版的混合架构模型,扩大规模并支持最高 25 万 token 的长文本处理。 参数规模:398B (MoE);开放方式:开源;主要架构:Mamba–Transformer 混合架构。
1 EVENTS - GR
Grok-2
文本 + 图像 → 文本限量预览Grok-2 是 xAI 的闭源模型,首发能力覆盖聊天、代码、推理和图像理解,并可结合 X 的实时信息。xAI 没有公开参数规模、上下文长度或网络架构。发布同期,X 产品还接入了 Black Forest Labs 的 FLUX.1 试验性图像生成功能;FLUX.1 是外部模型,不属于 Grok-2 的输出模态。
1 EVENTS - FL
FLUX.1
文本生成图像已发布FLUX.1 是 Black Forest Labs 发布的文本生成图像模型系列,包括 pro、dev 和 schnell 三个版本。该系列采用约 120 亿参数的生成架构,突出提示词遵循、图像细节、人物表现和画面内文字能力。
1 EVENTS - MI
Mistral Large 2
文本已发布Mistral AI 的第二代旗舰模型,增强了代码、数学及多语言推理能力。 参数规模:123B;开放方式:开源;主要架构:自回归 Transformer。
1 EVENTS - LL
Llama 3.1
文本已发布Meta 开源的 4050 亿参数模型,大幅扩展了上下文长度和多语言适用性。 参数规模:405B;开放方式:开源;主要架构:自回归 Transformer。
1 EVENTS - MI
Mistral NeMo
文本已发布Mistral 与英伟达合作研发,使用了全新分词器以提升多语言处理效率。 参数规模:12B;开放方式:开源;主要架构:自回归 Transformer。
1 EVENTS - GP
GPT-4o mini
文本 + 图像 → 文本已发布GPT-4o mini 是 OpenAI 发布的小型模型,支持文本和图像输入,并生成文本输出。
1 EVENTS - IN
InternLM 2.5
文本已发布2.5 版本升级,进一步强化了长上下文推理和 Agent 智能体调用能力。 参数规模:20B;开放方式:开源;主要架构:自回归 Transformer。
1 EVENTS - GE
Gemma 2
文本已发布谷歌第二代 Gemma 模型,通过内部架构改进提升了同参数条件下的性能表现。 参数规模:27B;开放方式:开源;主要架构:自回归 Transformer。
1 EVENTS - SE
Seed-TTS
文本 + 音频 → 音频普通请求已发布ByteDance Seed 的语音生成基础模型,可根据参考语音和文本生成新语音,并控制音色、情绪、口音、方言及说话习惯。
1 EVENTS