MODEL INDEX
模型索引
当前页显示 20 个模型,可按输入、输出、交互方式、机构与发布日期组合筛选。
- MI
MiMo V2 Pro
文本小米通过 API 发布面向复杂 Agent 工作流的旗舰基座,支持 100 万 token 上下文与混合注意力。 参数规模:1T+ MoE(42B 激活);开放方式:闭源;主要架构:混合专家 Transformer(MoE)。
已发布1 个事件 - MI
MiMo V2 Omni
多模态小米通过 API 发布统一文本、视觉与语音感知及工具执行能力的全模态 Agent 基座,支持 256K 上下文。 参数规模:未公开;开放方式:闭源;主要架构:自回归 Transformer。
已发布1 个事件 - GP
GPT-5.4
多模态OpenAI 面向 ChatGPT、API 与 Codex 正式发布 GPT-5.4,将主线推理、编码、工具调用与文档、表格和演示文稿等专业工作能力整合进同一旗舰模型。
已发布1 个事件 - GE
Gemini 3.1 Flash Image
图像生成Gemini 3.1 Flash Image(Nano Banana 2)面向更高质量、更快的图像生成与编辑,并通过 Gemini API 和 Google AI Studio 提供。
已发布1 个事件 - GP
GPT-Realtime-1.5
文本 + 图像 + 音频 → 文本 + 音频实时交互OpenAI 面向实时语音应用提供的闭源多模态模型,支持文本、图像和音频输入,以及文本和音频输出。
已发布1 个事件 - GP
gpt-audio-1.5
文本 + 音频 → 文本 + 音频流式输出OpenAI 的音频输入与输出模型,支持文本和音频输入输出,可通过 Chat Completions 与 Responses API 使用。
已发布1 个事件 - GE
Gemini 3.1 Pro
多模态谷歌 3.1 代 Pro 版本更新,针对跨模态的长链条逻辑推理计算流程进行了二次优化。 参数规模:未知;开放方式:闭源;主要架构:自回归 Transformer。
已发布1 个事件 - LY
Lyria 3
音乐生成Lyria 3 可根据文字或图片生成带人声的短音乐,并通过 SynthID 标记生成内容。
已发布1 个事件 - CL
Claude Sonnet 4.6
文本Sonnet 4.6 版本更新,维持推理速度的同时拉高了基础逻辑推理的表现。 参数规模:未知;开放方式:闭源;主要架构:自回归 Transformer。
已发布1 个事件 - QW
Qwen 3.5
多模态阿里通义千问 3.5 代基座,优化了参数前向激活比例并进一步加强了全模态原生融合能力。 参数规模:397B MoE(17B 激活);开放方式:部分开源;主要架构:混合专家 Transformer(MoE)。
已发布1 个事件 - SE
Seedance 2.0
音视频生成Seedance 2.0 支持文字、图片、音频和视频输入,可生成、编辑和延长多镜头音视频内容,并强化运动、物理、主体一致性、运镜和双声道音频。
已发布1 个事件 - MI
MiniMax M2.5
文本M2 的改进迭代,优化了 MoE 底层的专家路由调度算法,改善了超长语境连贯性表现。 参数规模:230B MoE;开放方式:开源;主要架构:混合专家 Transformer(MoE)。
已发布1 个事件 - GL
GLM-5
文本智谱发布的第五代基础大模型,采用全新迭代架构全面提升了各类综合评测指标。 参数规模:未知;开放方式:开源;主要架构:自回归 Transformer。
已发布1 个事件 - MI
MiniCPM-o 4.5
多模态针对端侧芯片底层算子及离线计算能力进行深入优化的全模态开源效能模型。 参数规模:9B;开放方式:开源;主要架构:自回归 Transformer。
已发布1 个事件 - KL
Kling AI 3.0
视频与图像生成Kling AI 3.0 系列覆盖 Video 3.0、Video 3.0 Omni、Image 3.0 和 Image 3.0 Omni,支持视频理解、生成、编辑、原生多语言音频和叙事控制。
已发布1 个事件 - GP
GPT-5.3-Codex
文本将 GPT-5 基础通用能力与专有高级代码生成技术相整合的高级开发专用封闭版本。 参数规模:未知;开放方式:闭源;主要架构:自回归 Transformer。
已发布1 个事件 - CL
Claude Opus 4.6
文本Opus 版本定型后期的细微升级,针对部分长尾垂直细分领域任务进行了精细化专项微调。 参数规模:未知;开放方式:闭源;主要架构:自回归 Transformer。
已发布1 个事件 - VO
Voxtral Mini Transcribe Realtime
音频 → 文本流式输出Mistral 的低延迟实时转写模型,权重以 Apache-2.0 开放。语音能力:streaming=true;localDeploy=true;speakerDiarization=none(Realtime 当前与 diarize 参数不兼容);speakerIdentification=none;overlappingSpeech=unknown;timestamps=segment。
已发布1 个事件 - VO
Voxtral Mini Transcribe 2
音频 → 文本普通请求Mistral 的批量转写专用模型,支持转写、diarization 与词级时间戳。语音能力:streaming=false;localDeploy=false;speakerDiarization=native;speakerIdentification=none;overlappingSpeech=unknown;timestamps=word。
已发布1 个事件 - ST
Step-3.5-Flash
文本阶跃星辰推出的千亿规模开源模型,着重优化了生成延迟与推理出词效率。 参数规模:196B MoE;开放方式:开源;主要架构:混合专家 Transformer(MoE)。
已发布1 个事件