MODEL INDEX
模型索引
当前页显示 20 个模型,可按输入、输出、交互方式、机构与发布日期组合筛选。
- QW
Qwen2.5-VL
文本 + 图像 + 视频 → 文本普通请求已发布Qwen2.5-VL 是阿里云 Qwen 团队发布的视觉语言模型系列,包含 3B、7B 和 72B 型号。模型支持文本、图像和视频输入,可生成文本,并具备文档解析、视觉定位、结构化输出和长视频理解能力。
1 EVENTS - DO
Doubao Realtime Voice Model
音频 → 音频实时交互已发布面向实时语音对话的端到端语音理解与生成模型。
1 EVENTS - DE
DeepSeek R1
文本已发布DeepSeek-R1 通过强化学习形成长链式推理能力,并发布模型、蒸馏版本与技术论文,推动开放推理模型快速发展。
1 EVENTS - MI
Mistral Small 3.0
文本已发布Mistral 推出的第三代轻量级基座,进一步优化了低硬件资源下的性能。 参数规模:24B;开放方式:开源;主要架构:自回归 Transformer。
1 EVENTS - DE
DeepSeek V3
文本已发布DeepSeek-V3 使用混合专家架构与多项训练优化,在发布权重的同时披露训练方法和成本信息,引发行业对模型效率路线的关注。
1 EVENTS - GE
Gemini 2.0 Flash Thinking
多模态已发布在 2.0 Flash 架构上引入显性思维推理机制的衍生模型,注重逻辑推演。 参数规模:未知;开放方式:闭源;主要架构:自回归 Transformer。
1 EVENTS - FA
Falcon 3
文本已发布TII 迭代推出的新一代基础模型家族,涵盖多个较小的参数规模量级。 参数规模:10B;开放方式:开源;主要架构:自回归 Transformer。
1 EVENTS - PH
Phi-4
文本已发布微软第四代小参数模型,大量采用合成数据进行训练以强化基础推理能力。 参数规模:14B;开放方式:开源;主要架构:自回归 Transformer。
1 EVENTS - GE
Gemini 2.0 Flash
多模态已发布谷歌第二代轻量级基座,提升了模型响应速度并优化了多任务并发处理能力。 参数规模:未知;开放方式:闭源;主要架构:自回归 Transformer。
1 EVENTS - AU
Aurora
文本 + 图像 → 图像限量预览Aurora 是 xAI 自研的自回归混合专家图像模型,使用交错的文本与图像数据进行下一 token 预测。xAI 称其训练数据包含数十亿个互联网样本,能力重点包括写实图像、文字与标志、现实世界实体和人像生成;模型原生接受图像输入,可用于参考生成和编辑。参数规模未公开。
1 EVENTS - EX
EXAONE 3.5
文本已发布LG AI Research 推出的中等规模模型,主要针对韩语与英语双语处理进行优化。 参数规模:32B;开放方式:开源;主要架构:自回归 Transformer。
1 EVENTS - LL
Llama 3.3
文本已发布Meta 发布的 700 亿参数版本,整合并统一了长上下文和多语言能力。 参数规模:70B;开放方式:开源;主要架构:自回归 Transformer。
1 EVENTS - O1
o1-pro
文本已发布o1 系列的高级版本,投入更多计算资源增加系统“思考”时长,以提高推理准确度。 参数规模:未知;开放方式:闭源;主要架构:自回归 Transformer。
1 EVENTS - HU
HunyuanVideo
文本 → 视频普通请求已发布HunyuanVideo 是腾讯发布的超过 130 亿参数文本生成视频基础模型。模型采用双流转单流扩散 Transformer、因果 3D VAE 和多模态大语言模型文本编码器。
1 EVENTS - AM
Amazon Nova
多模态已发布亚马逊 AWS 全新发布的多模态基础模型系列矩阵。 参数规模:未知;开放方式:闭源;主要架构:自回归 Transformer。
1 EVENTS - SO
SOLAR Pro
文本已发布Upstage 发布的 220 亿参数模型,针对文档内容解析与长文本任务进行了优化。 参数规模:22B;开放方式:闭源;主要架构:自回归 Transformer。
1 EVENTS - OL
OLMo 2
文本已发布艾伦研究所发布的开源模型,保持了其训练数据集和底层代码的完全公开。 参数规模:13B;开放方式:开源;主要架构:自回归 Transformer。
1 EVENTS - DE
DeepSeek-R1-Lite-Preview
文本生成限量预览R1-Lite-Preview 在网页端展示实时思维过程,官方称其在 AIME 与 MATH 基准达到 o1-preview 水平,并明确预告开放模型与 API 即将到来。
1 EVENTS - PI
Pixtral Large
多模态已发布Mistral 发布的大参数量多模态模型,强化了对图像视觉特征的理解能力。 参数规模:124B;开放方式:开源;主要架构:自回归 Transformer。
1 EVENTS - SM
SmolLM2
文本已发布HuggingFace 设计的微型参数量系列,适用在智能手机等硬件上纯本地运行。 参数规模:1.7B;开放方式:开源;主要架构:自回归 Transformer。
1 EVENTS