MODEL INDEX
模型索引
当前页显示 20 个模型,可按输入、输出、交互方式、机构与发布日期组合筛选。
- GP
GPT Image 1
图像生成GPT Image 1 把原生多模态图像生成能力带给开发者和企业,可用于设计、营销、教育、游戏和电商等图像生成与编辑场景。
已发布1 个事件 - O4
o4-mini
文本OpenAI 将复杂推理及思维链能力迁移至小参数规模量级的轻量化低成本版本。 参数规模:未知;开放方式:闭源;主要架构:自回归 Transformer。
已发布1 个事件 - O3
o3
文本OpenAI 专注于深度强化推理的新一代模型,强化了深层数学运算与逻辑推证能力。 参数规模:未知;开放方式:闭源;主要架构:自回归 Transformer。
已发布1 个事件 - GP
GPT-4.1
文本GPT-4 架构的维护性更新,重点在于小幅优化日常任务性能及 API 成本控制。 参数规模:未知;开放方式:闭源;主要架构:自回归 Transformer。
已发布1 个事件 - LL
Llama 4
文本Meta 的第四代开源模型,采用更大参数规模并引入优化的混合专家(MoE)结构。 参数规模:400B+ (MoE);开放方式:开源;主要架构:混合专家 Transformer(MoE)。
已发布1 个事件 - GE
Gemini 2.5 Pro
多模态谷歌 Gemini 原生多模态架构的中期进阶迭代版本,提升了基准表现。 参数规模:未知;开放方式:闭源;主要架构:自回归 Transformer。
已发布1 个事件 - GP
GPT-4o Transcribe
音频 → 文本流式输出OpenAI 的 GPT-4o 语音转文本模型,相比 Whisper 改善词错误率、语言识别和复杂声学条件下的准确性。语音能力:streaming=true(API);localDeploy=false;speakerDiarization=none;speakerIdentification=none;overlappingSpeech=unknown;timestamps=segment。
已发布1 个事件 - NE
Nemotron Ultra
文本英伟达开源的具备高吞吐特性的 MoE 模型,主要优化大规模数据处理效率。 参数规模:253B (MoE);开放方式:开源;主要架构:混合专家 Transformer(MoE)。
已发布1 个事件 - CO
Command A
文本Cohere 针对企业自动化工作流和深度 API 集成调用的需求开发的新一代模型。 参数规模:111B;开放方式:开源;主要架构:自回归 Transformer。
已发布1 个事件 - GE
Gemma 3
多模态谷歌全系换代的 Gemma 系列,首次在轻量开源梯队加入原生多模态支持。 参数规模:27B;开放方式:开源;主要架构:自回归 Transformer。
已发布1 个事件 - MI
Mistral Small 3.1
文本Mistral Small 的小版本迭代,主要修复已知缺陷并优化部分细节功能。 参数规模:24B;开放方式:开源;主要架构:自回归 Transformer。
已发布1 个事件 - QW
QwQ-32B
文本阿里云开源的中等规模模型,重点使用强化学习提升其逻辑计算与推断能力。 参数规模:32B;开放方式:开源;主要架构:自回归 Transformer。
已发布1 个事件 - GP
GPT-4.5
文本OpenAI 在 GPT-4 基础上改进的版本,提升了知识储备、泛化表现与安全性。 参数规模:未知;开放方式:闭源;主要架构:自回归 Transformer。
已发布1 个事件 - ME
Mercury
文本Inception Labs 推出的尝试全新技术架构与网络底层设计的基础模型。 参数规模:未知;开放方式:闭源;主要架构:扩散式语言模型。
已发布1 个事件 - WA
Wan2.1
视频与图像生成Wan2.1 提供 1.3B 与 14B 等不同规模的开放视频模型,支持文生视频、图生视频、视频编辑、文生图和视频转音频;其中较小版本可在消费级 GPU 上运行。
已发布1 个事件 - CL
Claude 3.7 Sonnet
文本Anthropic 的升级版本,支持在常规输出和长链路深度思考模式间平滑切换。 参数规模:未知;开放方式:闭源;主要架构:自回归 Transformer。
已发布1 个事件 - GR
Grok-3
文本 + 图像 + 视频 → 文本Grok-3 是 xAI 在 Colossus 集群上训练的闭源模型系列,包含标准版、Grok-3 mini 和使用测试时计算的 Think 版本。官方给出 100 万 token 上下文,并报告图像与视频理解基准;参数规模和网络架构未公开。首发产品还提供 DeepSearch,结合互联网检索、代码解释器和模型推理生成研究摘要。
限量预览1 个事件 - DE
Deepgram Nova-3
音频 → 文本流式输出Deepgram 的实时与批量 ASR 模型,支持 Keyterm Prompting、噪声和重叠语音场景,并可集成流式或批量 diarizer。语音能力:streaming=true;localDeploy=true(企业自托管);speakerDiarization=integrated;speakerIdentification=none;overlappingSpeech=supported;timestamps=word。
已发布1 个事件 - PE
Perplexity Sonar
文本Perplexity 针对自有 AI 搜索与精准问答场景微调内部核心模型。 参数规模:未知;开放方式:闭源;主要架构:自回归 Transformer。
已发布1 个事件 - O3
o3-mini
文本 → 文本流式输出OpenAI 的小型推理模型,面向科学、数学和编程等 STEM 任务。
受限1 个事件