MODEL INDEX
模型索引
当前页显示 20 个模型,可按输入、输出、交互方式、机构与发布日期组合筛选。
- CO
Cogito v2.1
文本Deep Cogito 推出的以复杂逻辑和宏观系统性思维推演为主要方向的大型开源基础模型。 参数规模:671B MoE;开放方式:开源;主要架构:混合专家 Transformer(MoE)。
已发布1 个事件 - GE
Gemini 3 Pro
多模态谷歌第三代原生多模态架构的专业级基座,整体提升了各模态处理性能的均衡度。 参数规模:未知;开放方式:闭源;主要架构:自回归 Transformer。
已发布1 个事件 - GE
Gemini 3 Deep Think
多模态融合搜索树算法机制的衍生推理模型,通过延长计算时间换取复杂逻辑推演过程的准确率。 参数规模:未知;开放方式:闭源;主要架构:自回归 Transformer。
已发布1 个事件 - GR
Grok 4.1
文本Grok 4 系列迭代版,进一步强化对高并发实时数据流处理和复杂社交网络语料的提取能力。 参数规模:未知;开放方式:闭源;主要架构:自回归 Transformer。
已发布1 个事件 - GP
GPT-5.1
文本GPT-5 的维护性更新,重点改善了模型对复杂嵌套指令的遵循率及降低部分任务的幻觉现象。 参数规模:未知;开放方式:闭源;主要架构:自回归 Transformer。
已发布1 个事件 - AM
Amazon Nova Premier
文本亚马逊为处理复杂商业决策链与高级企业功能推出的高级闭源商用模型方案。 参数规模:未知;开放方式:闭源;主要架构:自回归 Transformer。
已发布1 个事件 - AL
Alice AI
多模态Yandex 发布 Alice AI 模型家族,覆盖文本、视觉与图像生成,并将能力整合到搜索、浏览器和城市服务中。 参数规模:未知;开放方式:闭源;主要架构:自回归 Transformer。
已发布1 个事件 - MI
MiniMax M2
文本MiniMax 的新一代底层基础模型,增加了子专家网络的数量及整体参数规模。 参数规模:230B MoE;开放方式:开源;主要架构:混合专家 Transformer(MoE)。
已发布1 个事件 - GP
GPT-4o Transcribe Diarize
音频 → 文本普通请求OpenAI 的内置说话人分离 ASR,输出带说话人标签和起止时间的片段,并可提供参考语者片段辅助已知语者标注。语音能力:streaming=false;localDeploy=false;speakerDiarization=native;speakerIdentification=reference_audio;overlappingSpeech=unknown;timestamps=segment。
已发布1 个事件 - MU
Multitalker Parakeet Streaming 0.6B v1
音频 → 文本流式输出NVIDIA 的流式多说话人 ASR,接收流式 diarizer 的说话人活动并为每名说话人运行独立实例,无需 enrollment audio,重点处理严重重叠语音。语音能力:streaming=true;localDeploy=true;speakerDiarization=external;speakerIdentification=none;overlappingSpeech=supported;timestamps=segment。
已发布1 个事件 - GR
Granite 4.0
文本IBM 推出的第四代基座,主要侧重满足企业数据安全合规与物理隔绝的私有化部署要求。 参数规模:未知;开放方式:开源;主要架构:自回归 Transformer。
已发布1 个事件 - SO
Sora 2
视频与音频生成Sora 2 是 OpenAI 的视频与音频生成模型,强化复杂运动、物理、可控性、真实感、同步对白和音效生成。
已发布1 个事件 - GL
GLM-4.6
文本第四代 GLM 架构周期的后期更新版本,整合了此前的部分专项优化成果。 参数规模:未知;开放方式:开源;主要架构:自回归 Transformer。
已发布1 个事件 - CL
Claude Sonnet 4.5
文本Anthropic 发布 Claude Sonnet 4.5,重点提升编码、复杂智能体、计算机使用、推理与数学能力。 参数规模:未知;开放方式:闭源;主要架构:自回归 Transformer。
已发布1 个事件 - QW
Qwen3-Omni
文本 + 图像 + 音频 + 视频 → 文本 + 音频实时交互Qwen 团队发布的原生端到端全模态模型,理解文本、图像、音频和视频,并以文本或自然语音实时流式响应;采用 MoE Thinker–Talker 设计。
已发布1 个事件 - QW
Qwen3-Next
文本阿里探索新颖路由筛选策略的实验性版本,大幅降低了单次前向推理的参数激活比例。 参数规模:80B MoE (激活3B);开放方式:开源;主要架构:混合专家 Transformer(MoE)。
已发布1 个事件 - MA
Magistral Small 1.2
文本Magistral Small 序列的小幅迭代维护版本。 参数规模:24B;开放方式:开源;主要架构:自回归 Transformer。
已发布1 个事件 - MA
Magistral Medium 1.2
文本专门针对企业级高并发 API 请求场景优化吞吐量与队列处理的闭源模型版本。 参数规模:约45B;开放方式:闭源;主要架构:自回归 Transformer。
已发布1 个事件 - HE
Hermes 4
文本社区开发者基于大参数量开源底座进行指令微调训练的第四代对话模型版本。 参数规模:405B;开放方式:开源;主要架构:自回归 Transformer。
已发布1 个事件 - GP
gpt-realtime
文本 + 图像 + 音频 → 文本 + 音频实时交互OpenAI 面向生产语音 Agent 发布的实时 speech-to-speech 模型,增强自然语音、复杂指令遵循和函数调用,并配套远程 MCP、图像输入与 SIP 电话接入。
已发布1 个事件