MODEL INDEX
模型索引
当前页显示 20 个模型,可按输入、输出、交互方式、机构与发布日期组合筛选。
- LY
Lyria 3.5
文本 → 文本 + 音频普通请求Lyria 3.5 是 Google DeepMind 的音乐生成系统,可根据文本提示合成高质量音乐音频,并生成歌词文本。
已发布1 个事件 - QW
Qwen3.7 Flash
文本 + 图像 + 视频 → 文本阿里云模型服务平台提供的原生视觉语言模型,支持文本、图片和视频输入,并输出文本。
已发布1 个事件 - CL
Claude Opus 5
多模态Anthropic 的 Opus 5 是 Opus 4.8 的代际升级,重点提升深度推理、长周期智能体编码、视觉、专业知识工作与多智能体协作;支持 100 万 token 上下文、最高 128K 输出,并默认启用自适应思考。
已发布1 个事件 - SO
Solar Open 2
文本 → 文本Upstage 发布的开放权重大语言模型,面向工具调用、代码和办公等代理任务。
已发布1 个事件 - GE
Gemini 3.6 Flash
文本 + 图像 + 音频 + 视频 → 视频普通请求Gemini 3.6 Flash 是 Google 面向大规模 Agent 工作流推出的快速模型,重点提升编码、知识工作和多模态任务表现,并通过更少输出 token 与更低输出价格改善任务效率。
已发布1 个事件 - GE
Gemini 3.5 Flash-Lite
文本 + 图像 + 音频 + 视频 → 视频普通请求Gemini 3.5 Flash-Lite 是 Google 定位为 Gemini 3.5 系列中最快且最具成本效率的模型,面向高吞吐 Agent 搜索、文档处理和低延迟工作流。
已发布1 个事件 - GE
Gemini 3.5 Flash Cyber
文本 → 文本普通请求Gemini 3.5 Flash Cyber 是 Google 面向代码安全场景的模型版本,基于 Gemini 3.5 Flash 微调并与 CodeMender 配合,用于发现、验证和修复漏洞。
已宣布2 个事件 - QW
Qwen3.8-Max-Preview
文本阿里千问开放 Qwen3.8-Max-Preview 限量预览,现可通过 Token Plan、Qoder 与 QoderWork 试用;官方同时预告 Qwen3.8 将开放权重,但尚未发布权重、许可证、模型卡或完整基准。参数规模:2.4T;开放方式:闭源;主要架构:自回归 Transformer。
限量预览1 个事件 - KI
Kimi K3
多模态月之暗面于 2026 年 7 月 16 日发布 Kimi K3 旗舰多模态模型,采用 Kimi Delta Attention、Attention Residuals 与 Stable LatentMoE,原生支持视觉理解和 100 万 token 上下文,面向软件工程、知识工作与深度推理;完整模型权重于 7 月 27 日在 Hugging Face 公开,官方代码仓库与权重采用 Kimi K3 License。参数规模:2.8T;开放方式:开源;主要架构:Kimi Delta Attention、Attention Residuals 与 Stable LatentMoE。
已发布2 个事件 - GR
Grok 4.5
多模态xAI 正式发布面向编码、智能体任务与知识工作的 Grok 4.5,支持文本和图像输入、50 万 token 上下文;发布当日已在 Grok Build、Cursor 与 xAI API 上线。
已发布1 个事件 - GP
GPT-Live-1 mini
音频 → 音频实时双向GPT-Live 系列的小型全双工语音模型,面向自然连续的听说交互,并可把复杂工作委托给后端前沿模型。
已发布1 个事件 - GP
GPT-Live-1
文本 + 图像 + 音频 → 文本 + 音频实时双向OpenAI 的生产级全双工多模态语音模型,可持续接收文本、图像和音频,同时流式输出文本与音频,并在不中断聆听的情况下自然插话。
已发布1 个事件 - GP
GPT-Realtime-2.1 mini
文本 + 图像 + 音频 → 文本 + 音频实时交互面向低延迟语音交互的蒸馏推理模型,支持文本、图像和音频输入,以及文本和音频输出;可经 WebRTC、WebSocket 或 SIP 使用。
已发布1 个事件 - GP
GPT-Realtime-2.1
文本 + 图像 + 音频 → 文本 + 音频实时交互OpenAI 面向实时语音与多模态交互发布的推理模型,支持文本与音频输入输出、图像输入、可配置推理强度和函数调用。
已发布1 个事件 - CL
Claude Sonnet 5
多模态Claude Sonnet 5 是 Anthropic 面向高性价比智能体工作负载的 Sonnet 代际升级,重点提升规划、工具使用、编码、知识工作与长周期自主执行;支持 100 万 token 上下文和最高 128K 输出。
已发布1 个事件 - GP
GPT-5.6 Sol
文本GPT-5.6 引入 Sol、Terra、Luna 三个能力层级。官方说明该系列先通过 API 和 Codex 向少量可信合作方开放,并计划随后扩大到 ChatGPT、Codex 与 API 用户。
已发布7 个事件 - GP
GPT-5.6 Luna
多模态GPT-5.6 Luna 是 OpenAI GPT-5.6 家族中低延迟、低成本的型号。
已发布1 个事件 - GP
GPT-5.6 Terra
多模态GPT-5.6 Terra 是 OpenAI GPT-5.6 家族的均衡型号,在能力、速度和成本之间取得平衡。
已发布3 个事件 - GR
Grok Imagine Video 1.5
视频与音频生成Grok Imagine Video 1.5 在 API 正式可用,改进运动、物理、音频与语音同步,并提供更快版本。
已发布1 个事件 - GL
GLM-5.2
文本Z.ai 发布 GLM-5.2,面向长周期智能体任务,提供原生 100 万 token 上下文并以 MIT 许可证开放权重。 参数规模:未知;开放方式:开源;主要架构:自回归 Transformer。
已发布1 个事件