MODEL INDEX
模型索引
当前页显示 20 个模型,可按输入、输出、交互方式、机构与发布日期组合筛选。
- GE
Gemini 3.8 Flash Cyber
未公开Gemini 3.8 Flash Cyber 是 Google 面向网络安全防御的专用模型,用于漏洞发现和自动修补。
受限1 个事件 - GE
Gemini 3.8 Flash
文本 + 图像 + 音频 + 视频 → 文本普通请求Gemini 3.8 Flash 是 Google DeepMind Gemini 3 系列的快速模型,基于 Gemini 3.7 Flash,面向长程软件工程、自治智能体和复杂企业知识工作流,并支持可调思考级别。
已发布1 个事件 - CL
Claude Fable 5.1
文本 + 图像 → 文本Claude Fable 5.1 是 Anthropic 面向公众提供的前沿模型,面向高难度推理、长周期智能体编码、多步研究及文档、表格和幻灯片工作。官方文档列出 100 万 token 上下文窗口、最高 128K 输出和自适应思考;输入支持文本与图像,输出为文本。
已发布1 个事件 - DE
DeepSeek-V4-Flash-Vision-Exp
文本 + 图像 → 文本DeepSeek V4 系列首个实验性多模态模型,在 DeepSeek-V4-Flash 架构中加入视觉模块并继续训练以获得视觉理解能力。官方模型卡提供 tokenizer、提示编码参考、最小 PyTorch 推理实现和模型权重。
已发布1 个事件 - HY
Hy4 preview
文本 → 文本腾讯混元团队发布的文本生成 MoE 模型。主干总参数770B、每个 token 激活49B,支持100万 token 上下文;权重已公开。
已发布1 个事件 - GL
GLM-5.3-Flash
文本 + 图像 + 视频 → 文本流式输出Z.ai 发布的原生多模态大语言模型,支持文本、图像和视频输入及文本输出,具备 100 万 token 上下文窗口。
已发布2 个事件 - QW
Qwen3.8-27B
文本 + 图像 + 音频 + 视频 → 视频普通请求Qwen3.8-27B 是 Qwen3.8 系列的紧凑型密集模型,面向编码、专业工作、研究和长周期 Agent 任务,支持图像与视频理解、可调思考深度以及多种部署框架。
已发布1 个事件 - GL
GLM-5.3
文本 → 文本普通请求GLM-5.3 是 Z.ai 基于 GLM-5.2 大规模基座继续进行后训练的模型版本,重点面向长周期智能体执行、可验证编码流程和自动漏洞发现。
限量预览1 个事件 - QW
Qwen3.8-2.4T-A95B
文本 → 文本普通请求Qwen3.8-2.4T-A95B 是 Qwen3.8 旗舰系列的开放版本,采用稀疏 MoE 与混合注意力,总参数 2.4 万亿、每步约激活 950 亿,面向编码、生产力、研究和长周期 Agent 任务。
已发布1 个事件 - GE
Gemini 3.7 Flash
文本 + 图像 + 音频 + 视频 → 文本普通请求Gemini 3.7 Flash 是 Google DeepMind Gemini 3 系列的快速模型,基于 Gemini 3.6 Flash 进行算法改进,支持可配置的思考设置,面向编码、智能体工作流和多模态任务。
已发布1 个事件 - GR
Grok 4.6
文本 + 图像 → 文本xAI 发布 Grok 4.6,重点提升长时运行智能体、编码、知识工作与交互式视觉任务能力;官方开发者文档提供 grok-4.6 API 使用与 500K 上下文说明。
已发布1 个事件 - DE
DeepSeek-V4-Pro-0813
文本 → 文本DeepSeek 官方 API 文档确认 deepseek-v4-pro 的服务模型已更新为 DeepSeek-V4-Pro-0813,调用名称保持不变。官方列出 100 万 token 上下文、最大 38.4 万 token 输出,并支持思考与非思考模式、Responses API、JSON Output 和 Tool Calls。
已发布1 个事件 - MU
Muse Glimmer 30B
文本 + 图像 → 文本Meta 发布的 300 亿参数公开权重模型,模型仓库提供主模型、视觉投影文件和 DFlash 草稿模型。
已发布1 个事件 - MU
Muse Spark 1.2
文本 → 文本Meta 推出的面向编程任务的模型更新,与 Muse Code 联合训练,可通过 Meta Model API 使用。
已发布1 个事件 - K-
K-EXAONE 2.0
文本 → 文本LG AI Research 发布的开放权重多语言基础语言模型,由上一代 K-EXAONE 经架构扩展和持续训练得到。
已发布1 个事件 - AL
Alpamayo 2 Super
文本 + 图像 + 音频 + 视频 → 视频普通请求Alpamayo 2 Super 是 NVIDIA 面向自动驾驶和机器人出租车的开放模型,支持轨迹规划、因果链推理、自动标注以及带二维视觉定位的问答。
已发布1 个事件 - SE
Seedance 2.5
文本 + 图像 + 音频 + 视频 → 音频 + 视频普通请求Seedance 2.5 是字节跳动 Seed 团队发布的音视频生成模型。模型支持文本、图像、音频和视频作为输入,可单次生成最长 30 秒的音视频,并支持多轮延长、多模态参考和按时间戳编辑。
已发布1 个事件 - MI
MiniMax H3
文本 + 图像 + 音频 + 视频 → 音频 + 视频MiniMax 发布的通用音视频生成模型。它接受文本、图像、视频和音频上下文,生成带原生双声道音频的视频;公开的 H3-Base 提供 FL2VA 与 Ref2VA 两类检查点。
已发布1 个事件 - DE
DeepSeek V4 Flash
文本 → 文本DeepSeek V4 Flash 的 0731 正式版保持预览版架构和规模,通过重新后训练显著增强智能体与编码能力,并原生支持 Responses API。
限量预览2 个事件 - GE
Gemini Robotics ER 2
文本 + 图像 + 音频 + 视频 → 文本流式输出Gemini Robotics ER 2 是 Google DeepMind 面向实体智能的视觉语言模型,强化空间、时间和物理推理、工具编排、视频理解及多机器人协作。
限量预览1 个事件