Kimi K3 是月之暗面推出的 AI 助手,专为智能体编程与知识工作打造。支持 Swarm 智能体集群与 Goal 模式并行执行任务,可构建可玩的多人与3D游戏,生成咨询级 PPT,处理 Excel 和 PDF 文档,提供深度研究与建站能力。
Capability Timeline
长文本处理
处理长文档、长上下文、多轮复杂推理与摘要。
相关工具
17Claude 是由 Anthropic 开发的 AI 助手,专为应对复杂挑战与高效工作协同而设计。它能够协助开发者完成代码编写、调试与逻辑优化,并提供深度的数据分析与可视化图表生成服务。用户可通过自然语言直接下达指令、上传复杂文档进行智能解析,或连接外部数据源。Claude 支持设定每日、每周或每月定时任务,自动产出格式化的报告、演示文稿或电子表格,实现从问题拆解到自动化交付的全流程协同
MiniCPM是面壁智能(OpenBMB)自主研发的端侧大模型系列,包括文本基座模型MiniCPM5-1B、稀疏注意力模型MiniCPM-SALA等。专为端侧部署和资源受限场景设计,支持本地助手、编码代理、工具调用和长上下文推理。
Bonsai 27B 是 PrismML 发布的开源多模态模型,基于 Qwen3.6 27B。提供三元(5.9GB)和1-bit(3.9GB)两个变体,后者首次将27B级模型装入 iPhone 17 Pro。支持多步推理、结构化工具调用、视觉任务和智能体循环,262K上下文窗口,支持推测解码。三元变体保留全精度95%性能,1-bit保留90%,数学与编码能力几乎无损。Apache 2.0开源。
Gemini 3.5 Flash 是一款面向智能体与编程领域的前沿多模态AI模型。它能够在极速响应下提供媲美旗舰模型的智能水平,支持文本、音频、图像、代码和视频的深度融合理解。该模型擅长长周期任务的自主推理与多智能体协同调度,可在编码迭代中快速生成并优化界面,同时具备针对提示注入等网络威胁的主动拦截能力。凭借百万级长上下文支持与企业级安全标准,它为开发者构建高效自动化工作流提供核心支持
通义千问(Qwen)是阿里巴巴云开发的大语言模型系列,提供对话助手、代码生成、智能体工具调用、256K至100万token长文本理解、多语言翻译和创意写作等能力。模型涵盖Dense和MoE架构,支持思考与非思考模式切换,可通过Qwen Chat、API及多种推理框架使用。
Claude Fable 5是专为解决复杂编程与高难度知识工作打造的第五代人工智能模型。它能够处理持续数天的长周期异步任务,自动进行多阶段规划与自我验证。该模型支持深度解析文件与PDF中的图表及表格内容,可自主编写测试代码并校验输出结果,适用于金融、法律、数据分析及架构设计等领域的重度文档处理场景,团队可交付大型项目并直接审核最终成果
Grok 是由 xAI 构建的 AI 助手,支持聊天对话、图像创建、代码编写,并能从网络和 X 平台获取实时信息回答用户问题。订阅用户可通过 Grok Heavy 等套餐获得 X Premium+ 等增值权益。
Hy3是由腾讯混元团队研发的295B参数混合专家大模型。该工具具备强大的复杂推理与智能体执行能力,支持256K超长上下文与多轮意图跟踪。通过高稳定的工具调用和格式输出,Hy3可无缝接入智能体框架,为代码生成、前端设计及数据处理等开发任务提供高效可靠的推理服务,并支持完整的微调与量化部署
Inkling 是 Thinking Machines Lab 发布的首个开源权重 MoE 模型,总参数量975B、活跃参数41B,支持100万token上下文窗口。模型原生支持文本、图像和音频理解,具备代码生成、智能体工具调用等能力,可通过 Tinker 平台进行微调定制。
MiniCPM5-1B-Claude-Opus-Fable5-Thinking 是社区开发者 GnLOLot 发布的 1B 参数本地语言模型,在 OpenBMB MiniCPM5-1B 基座上使用 Claude Fable 5 推理轨迹微调,保留原生 Thinking 对话模板与 XML 工具调用格式,强化代码生成、调试与指令跟随能力。支持 128K 长上下文,提供 GGUF 量化(最小约 657MB),可在 llama.cpp、Ollama、LM Studio 等本地运行时部署,无需 API Key 与云端调用。
MiniMax Code 是 MiniMax 旗下 Coding Agent 产品,底层基于 MiniMax 自研大模型,具备前沿编程与智能体能力,支持超长上下文处理、工具调用链路、文件预览与图表交互,桌面端支持会话管理与长任务执行。
MiniMax M3 是 MiniMax 自研的前沿大语言模型,采用全新注意力架构 MSA(MiniMax Sparse Attention),支持最高 1M tokens 上下文窗口。模型具备编码、智能体、多模态理解等能力,可自主完成论文复现、CUDA 算子优化等长线程任务。M3 已在 HuggingFace 和 GitHub 开源,支持私有集群部署和微调,同时通过 API、Token Plan 订阅和 MiniMax Code 平台向开发者开放。
Agents-A1是一个35B混合专家(Mixture-of-Experts)智能体模型,通过扩展智能体边界而非参数量来达到万亿参数级性能。它擅长将复杂任务拆解为可执行子步骤、提前规划并根据中间结果调整策略。原生支持函数调用与工具集成,可与API、代码解释器、搜索引擎等外部工具无缝交互。能够处理长对话与长文档,在长上下文中保持强连贯性与召回能力,并精确遵循多约束指令。模型在长程搜索、工程任务、科学研究、指令遵循、通用智能体任务和科学智能体任务六个方向均展现出色表现,在多个基准测试中达到SOTA水平
Gemma 4 是 Google DeepMind 推出的开源权重模型家族,包含 2B/4B 小模型、31B 稠密模型、26B MoE 与 12B 统一多模态模型四种架构。支持文本、图像、视频、音频输入与文本输出,上下文窗口最高 256K,内置函数调用与系统提示词支持,强化编码与 Agent 能力,可在手机、浏览器到云端服务器多环境部署,Apache 2.0 许可允许商用微调。
Qwen3.7-Max 是阿里云百炼平台提供的千问(Qwen)系列旗舰模型,适合处理复杂、多步骤任务。它通过百炼平台以兼容 OpenAI 接口规范的 API 形式对外提供服务,开发者可几行代码调用大模型实现内容创作、摘要生成等功能,也可在可视化界面中构建智能体应用和工作流应用。该模型支持文本生成、长文本处理、智能体构建、代码生成等能力,面向开发者和科研人员提供推理能力全面的旗舰级大模型服务,可满足高并发、低延迟等性能要求的部署需求
Soofi S 是一项德国研究项目,旨在开发开放且主权的欧洲大型语言与推理模型及基于代理的智能系统。该平台具备高度透明性,支持在欧洲云端与边缘基础设施上进行本地化部署。此外,它通过初步验证实际使用场景,致力于将先进模型能力平滑迁移至真实业务环境,以支持欧洲AI生态的实际落地与自主可控


