MODEL INDEX
模型索引
当前页显示 20 个模型,可按输入、输出、交互方式、机构与发布日期组合筛选。
- QW
Qwen3.8-27B
文本 + 图像 + 音频 + 视频 → 视频普通请求已发布Qwen3.8-27B 是 Qwen3.8 系列的紧凑型密集模型,面向编码、专业工作、研究和长周期 Agent 任务,支持图像与视频理解、可调思考深度以及多种部署框架。
1 EVENTS - GL
GLM-5.3
文本 → 文本普通请求限量预览GLM-5.3 是 Z.ai 基于 GLM-5.2 大规模基座继续进行后训练的模型版本,重点面向长周期智能体执行、可验证编码流程和自动漏洞发现。
1 EVENTS - QW
Qwen3.8-2.4T-A95B
文本 → 文本普通请求已发布Qwen3.8-2.4T-A95B 是 Qwen3.8 旗舰系列的开放版本,采用稀疏 MoE 与混合注意力,总参数 2.4 万亿、每步约激活 950 亿,面向编码、生产力、研究和长周期 Agent 任务。
1 EVENTS - GE
Gemini 3.7 Flash
文本 + 图像 + 音频 + 视频 → 文本普通请求已发布Gemini 3.7 Flash 是 Google DeepMind Gemini 3 系列的快速模型,基于 Gemini 3.6 Flash 进行算法改进,支持可配置的思考设置,面向编码、智能体工作流和多模态任务。
1 EVENTS - GR
Grok 4.6
文本 + 图像 → 文本已发布xAI 发布 Grok 4.6,重点提升长时运行智能体、编码、知识工作与交互式视觉任务能力;官方开发者文档提供 grok-4.6 API 使用与 500K 上下文说明。
1 EVENTS - DE
DeepSeek-V4-Pro-0813
文本 → 文本已发布DeepSeek 官方 API 文档确认 deepseek-v4-pro 的服务模型已更新为 DeepSeek-V4-Pro-0813,调用名称保持不变。官方列出 100 万 token 上下文、最大 38.4 万 token 输出,并支持思考与非思考模式、Responses API、JSON Output 和 Tool Calls。
1 EVENTS - MU
Muse Glimmer 30B
文本 + 图像 → 文本已发布Meta 发布的 300 亿参数公开权重模型,模型仓库提供主模型、视觉投影文件和 DFlash 草稿模型。
1 EVENTS - MU
Muse Spark 1.2
文本 → 文本已发布Meta 推出的面向编程任务的模型更新,与 Muse Code 联合训练,可通过 Meta Model API 使用。
1 EVENTS - K-
K-EXAONE 2.0
文本 → 文本已发布LG AI Research 发布的开放权重多语言基础语言模型,由上一代 K-EXAONE 经架构扩展和持续训练得到。
1 EVENTS - AL
Alpamayo 2 Super
文本 + 图像 + 音频 + 视频 → 视频普通请求已发布Alpamayo 2 Super 是 NVIDIA 面向自动驾驶和机器人出租车的开放模型,支持轨迹规划、因果链推理、自动标注以及带二维视觉定位的问答。
1 EVENTS - SE
Seedance 2.5
文本 + 图像 + 音频 + 视频 → 音频 + 视频普通请求已发布Seedance 2.5 是字节跳动 Seed 团队发布的音视频生成模型。模型支持文本、图像、音频和视频作为输入,可单次生成最长 30 秒的音视频,并支持多轮延长、多模态参考和按时间戳编辑。
1 EVENTS - MI
MiniMax H3
文本 + 图像 + 音频 + 视频 → 音频 + 视频已发布MiniMax 发布的通用全模态生成模型。官方称其可统一理解文本、图像、视频和声音上下文,并生成带原生双声道的音视频,最高支持 15 秒、2K 分辨率。
1 EVENTS - DE
DeepSeek V4 Flash
文本 → 文本限量预览DeepSeek V4 Flash 的 0731 正式版保持预览版架构和规模,通过重新后训练显著增强智能体与编码能力,并原生支持 Responses API。
2 EVENTS - GE
Gemini Robotics ER 2
文本 + 图像 + 音频 + 视频 → 文本流式输出限量预览Gemini Robotics ER 2 是 Google DeepMind 面向实体智能的视觉语言模型,强化空间、时间和物理推理、工具编排、视频理解及多机器人协作。
1 EVENTS - LY
Lyria 3.5
文本 → 文本 + 音频普通请求已发布Lyria 3.5 是 Google DeepMind 的音乐生成系统,可根据文本提示合成高质量音乐音频,并生成歌词文本。
1 EVENTS - QW
Qwen3.7 Flash
文本 + 图像 + 视频 → 文本已发布阿里云模型服务平台提供的原生视觉语言模型,支持文本、图片和视频输入,并输出文本。
1 EVENTS - CL
Claude Opus 5
多模态已发布Anthropic 的 Opus 5 是 Opus 4.8 的代际升级,重点提升深度推理、长周期智能体编码、视觉、专业知识工作与多智能体协作;支持 100 万 token 上下文、最高 128K 输出,并默认启用自适应思考。
1 EVENTS - SO
Solar Open 2
文本 → 文本已发布Upstage 发布的开放权重大语言模型,面向工具调用、代码和办公等代理任务。
1 EVENTS - GE
Gemini 3.6 Flash
文本 + 图像 + 音频 + 视频 → 视频普通请求已发布Gemini 3.6 Flash 是 Google 面向大规模 Agent 工作流推出的快速模型,重点提升编码、知识工作和多模态任务表现,并通过更少输出 token 与更低输出价格改善任务效率。
1 EVENTS - GE
Gemini 3.5 Flash-Lite
文本 + 图像 + 音频 + 视频 → 视频普通请求已发布Gemini 3.5 Flash-Lite 是 Google 定位为 Gemini 3.5 系列中最快且最具成本效率的模型,面向高吞吐 Agent 搜索、文档处理和低延迟工作流。
1 EVENTS