MODEL INDEX
模型索引
当前页显示 20 个模型,可按输入、输出、交互方式、机构与发布日期组合筛选。
- QW
Qwen2.5-VL
文本 + 图像 + 视频 → 文本普通请求Qwen2.5-VL 是阿里云 Qwen 团队发布的视觉语言模型系列,包含 3B、7B 和 72B 型号。模型支持文本、图像和视频输入,可生成文本,并具备文档解析、视觉定位、结构化输出和长视频理解能力。
已发布1 个事件 - DO
Doubao Realtime Voice Model
音频 → 音频实时交互面向实时语音对话的端到端语音理解与生成模型。
已发布1 个事件 - DE
DeepSeek R1
文本DeepSeek-R1 通过强化学习形成长链式推理能力,并发布模型、蒸馏版本与技术论文,推动开放推理模型快速发展。
已发布1 个事件 - MI
Mistral Small 3.0
文本Mistral 推出的第三代轻量级基座,进一步优化了低硬件资源下的性能。 参数规模:24B;开放方式:开源;主要架构:自回归 Transformer。
已发布1 个事件 - DE
DeepSeek V3
文本DeepSeek-V3 使用混合专家架构与多项训练优化,在发布权重的同时披露训练方法和成本信息,引发行业对模型效率路线的关注。
已发布1 个事件 - GE
Gemini 2.0 Flash Thinking
多模态在 2.0 Flash 架构上引入显性思维推理机制的衍生模型,注重逻辑推演。 参数规模:未知;开放方式:闭源;主要架构:自回归 Transformer。
已发布1 个事件 - FA
Falcon 3
文本TII 迭代推出的新一代基础模型家族,涵盖多个较小的参数规模量级。 参数规模:10B;开放方式:开源;主要架构:自回归 Transformer。
已发布1 个事件 - PH
Phi-4
文本微软第四代小参数模型,大量采用合成数据进行训练以强化基础推理能力。 参数规模:14B;开放方式:开源;主要架构:自回归 Transformer。
已发布1 个事件 - GE
Gemini 2.0 Flash
多模态谷歌第二代轻量级基座,提升了模型响应速度并优化了多任务并发处理能力。 参数规模:未知;开放方式:闭源;主要架构:自回归 Transformer。
已发布1 个事件 - AU
Aurora
文本 + 图像 → 图像Aurora 是 xAI 自研的自回归混合专家图像模型,使用交错的文本与图像数据进行下一 token 预测。xAI 称其训练数据包含数十亿个互联网样本,能力重点包括写实图像、文字与标志、现实世界实体和人像生成;模型原生接受图像输入,可用于参考生成和编辑。参数规模未公开。
限量预览1 个事件 - EX
EXAONE 3.5
文本LG AI Research 推出的中等规模模型,主要针对韩语与英语双语处理进行优化。 参数规模:32B;开放方式:开源;主要架构:自回归 Transformer。
已发布1 个事件 - LL
Llama 3.3
文本Meta 发布的 700 亿参数版本,整合并统一了长上下文和多语言能力。 参数规模:70B;开放方式:开源;主要架构:自回归 Transformer。
已发布1 个事件 - O1
o1-pro
文本o1 系列的高级版本,投入更多计算资源增加系统“思考”时长,以提高推理准确度。 参数规模:未知;开放方式:闭源;主要架构:自回归 Transformer。
已发布1 个事件 - HU
HunyuanVideo
文本 → 视频普通请求HunyuanVideo 是腾讯发布的超过 130 亿参数文本生成视频基础模型。模型采用双流转单流扩散 Transformer、因果 3D VAE 和多模态大语言模型文本编码器。
已发布1 个事件 - AM
Amazon Nova
多模态亚马逊 AWS 全新发布的多模态基础模型系列矩阵。 参数规模:未知;开放方式:闭源;主要架构:自回归 Transformer。
已发布1 个事件 - SO
SOLAR Pro
文本Upstage 发布的 220 亿参数模型,针对文档内容解析与长文本任务进行了优化。 参数规模:22B;开放方式:闭源;主要架构:自回归 Transformer。
已发布1 个事件 - OL
OLMo 2
文本艾伦研究所发布的开源模型,保持了其训练数据集和底层代码的完全公开。 参数规模:13B;开放方式:开源;主要架构:自回归 Transformer。
已发布1 个事件 - DE
DeepSeek-R1-Lite-Preview
文本生成R1-Lite-Preview 在网页端展示实时思维过程,官方称其在 AIME 与 MATH 基准达到 o1-preview 水平,并明确预告开放模型与 API 即将到来。
限量预览1 个事件 - PI
Pixtral Large
多模态Mistral 发布的大参数量多模态模型,强化了对图像视觉特征的理解能力。 参数规模:124B;开放方式:开源;主要架构:自回归 Transformer。
已发布1 个事件 - SM
SmolLM2
文本HuggingFace 设计的微型参数量系列,适用在智能手机等硬件上纯本地运行。 参数规模:1.7B;开放方式:开源;主要架构:自回归 Transformer。
已发布1 个事件