MODEL INDEX
模型索引
当前页显示 20 个模型,可按输入、输出、交互方式、机构与发布日期组合筛选。
- GE
Gemini 3.5 Flash Cyber
文本 → 文本普通请求已宣布Gemini 3.5 Flash Cyber 是 Google 面向代码安全场景的模型版本,基于 Gemini 3.5 Flash 微调并与 CodeMender 配合,用于发现、验证和修复漏洞。
2 EVENTS - QW
Qwen3.8-Max-Preview
文本限量预览阿里千问开放 Qwen3.8-Max-Preview 限量预览,现可通过 Token Plan、Qoder 与 QoderWork 试用;官方同时预告 Qwen3.8 将开放权重,但尚未发布权重、许可证、模型卡或完整基准。参数规模:2.4T;开放方式:闭源;主要架构:自回归 Transformer。
1 EVENTS - KI
Kimi K3
多模态已发布月之暗面于 2026 年 7 月 16 日发布 Kimi K3 旗舰多模态模型,采用 Kimi Delta Attention、Attention Residuals 与 Stable LatentMoE,原生支持视觉理解和 100 万 token 上下文,面向软件工程、知识工作与深度推理;完整模型权重于 7 月 27 日在 Hugging Face 公开,官方代码仓库与权重采用 Kimi K3 License。参数规模:2.8T;开放方式:开源;主要架构:Kimi Delta Attention、Attention Residuals 与 Stable LatentMoE。
2 EVENTS - GR
Grok 4.5
多模态已发布xAI 正式发布面向编码、智能体任务与知识工作的 Grok 4.5,支持文本和图像输入、50 万 token 上下文;发布当日已在 Grok Build、Cursor 与 xAI API 上线。
1 EVENTS - GP
GPT-Live-1 mini
音频 → 音频实时双向已发布GPT-Live 系列的小型全双工语音模型,面向自然连续的听说交互,并可把复杂工作委托给后端前沿模型。
1 EVENTS - GP
GPT-Live-1
音频 → 音频实时双向已发布OpenAI 面向自然连续对话推出的全双工语音模型,可在说话时持续监听,并把搜索、推理或复杂任务委托给后端前沿模型。
1 EVENTS - GP
GPT-Realtime-2.1 mini
文本 + 图像 + 音频 → 文本 + 音频实时交互已发布面向低延迟语音交互的蒸馏推理模型,支持文本、图像和音频输入,以及文本和音频输出;可经 WebRTC、WebSocket 或 SIP 使用。
1 EVENTS - GP
GPT-Realtime-2.1
文本 + 图像 + 音频 → 文本 + 音频实时交互已发布OpenAI 面向实时语音与多模态交互发布的推理模型,支持文本与音频输入输出、图像输入、可配置推理强度和函数调用。
1 EVENTS - CL
Claude Sonnet 5
多模态已发布Claude Sonnet 5 是 Anthropic 面向高性价比智能体工作负载的 Sonnet 代际升级,重点提升规划、工具使用、编码、知识工作与长周期自主执行;支持 100 万 token 上下文和最高 128K 输出。
1 EVENTS - GP
GPT-5.6 Sol
文本已发布GPT-5.6 引入 Sol、Terra、Luna 三个能力层级。官方说明该系列先通过 API 和 Codex 向少量可信合作方开放,并计划随后扩大到 ChatGPT、Codex 与 API 用户。
4 EVENTS - GP
GPT-5.6 Luna
多模态已发布GPT-5.6 Luna 是 OpenAI GPT-5.6 家族中低延迟、低成本的型号。
1 EVENTS - GP
GPT-5.6 Terra
多模态已发布GPT-5.6 Terra 是 OpenAI GPT-5.6 家族的均衡型号,在能力、速度和成本之间取得平衡。
3 EVENTS - GR
Grok Imagine Video 1.5
视频与音频生成已发布Grok Imagine Video 1.5 在 API 正式可用,改进运动、物理、音频与语音同步,并提供更快版本。
1 EVENTS - GL
GLM-5.2
文本已发布Z.ai 发布 GLM-5.2,面向长周期智能体任务,提供原生 100 万 token 上下文并以 MIT 许可证开放权重。 参数规模:未知;开放方式:开源;主要架构:自回归 Transformer。
1 EVENTS - CL
Claude Fable 5
文本已发布Anthropic 将 Fable 5 描述为可面向公众使用的 Mythos 级模型。发布时 API 与按量计费企业方案可用,订阅方案分阶段开放。
4 EVENTS - QW
Qwen3.7 Plus
文本 + 图像 + 视频 → 文本已发布阿里云 Model Studio 提供的 Qwen3.7 Plus 系列商业多模态推理模型,支持文本、图像和视频输入,并输出文本。
1 EVENTS - MI
MiniMax M3
文本 + 图像 + 视频 → 文本已发布MiniMax 的原生多模态模型,支持文本、图像和视频输入,并以文本生成方式提供输出;官方披露其支持最长100万 token 上下文。
1 EVENTS - CL
Claude Opus 4.8
多模态已发布Anthropic 正式发布 Claude Opus 4.8,继续提升编码、智能体、视觉与专业知识工作表现,并降低长任务中的无依据结论;发布当日即在 Claude 产品、API 与云平台公开可用。
1 EVENTS - GE
Gemini 3.5 Flash
多模态已发布Google 发布 Gemini 3.5 Flash,作为 Gemini 3.5 系列首个公开型号,面向智能体、编码和工具调用工作流。 参数规模:未知;开放方式:闭源;主要架构:自回归 Transformer。
1 EVENTS - GP
GPT-Realtime-Translate
音频 → 文本 + 音频实时交互已发布面向实时多语言语音翻译的流式语音到语音模型。模型在输入音频仍持续到达时返回译音频和文本转写增量,支持 70 多种输入语言到 13 种输出语言。
1 EVENTS