DeepSeek Harness(dsh)是 DeepSeek AI 开发的开源 Agent harness,采用“万物皆插件(everything is a plugin)”的架构,基于 Cordis 框架构建,目前处于开发者预览阶段。可通过 npx @deepseek-ai/dsh web 启动默认运行在 127.0.0.1:3080 的 Web UI,也支持从源码构建运行,采用 MIT 许可证,并开放 GitHub Discussions 与 Discord 社区。
Capability Timeline
函数调用
把自然语言请求映射为带类型参数的函数/工具调用,用于设备控制与智能体执行
相关工具
18Ante 是 Antigma Labs 推出的自包含终端编码代理,以约 15MB 的单个 Rust 二进制文件分发,零运行时依赖。它以客户端-守护进程架构运行结构化回合循环(提示、工具调用、确认、执行),支持交互式 TUI、无头 CLI 与 ante serve 长驻服务,可自带 API Key 在 12 个以上模型供应商或本地模型间自由切换,并提供多智能体协同、自定义技能、子智能体、MCP 与跨会话持久记忆。
Gemini是Google打造的生成式AI助手,能够帮助用户完成写作、规划与头脑风暴等核心任务。该工具支持70种以上语言的实时语音到语音翻译,具备流式连续音频生成与自动语种检测功能,可精准保留原始语调、语速和音调,并拥有出色的强抗噪能力。借助生成式AI技术,用户可流畅开展跨语言交流、内容生成及多场景智能协作
Nemotron 3.5 Lightning 是 NVIDIA Nemotron 系列中的开源 30B MoE 模型,官方定位为面向常驻在线智能体完成专项高频任务的最快 30B MoE 模型。它可被便捷地进行后训练以获得领域专用精度与效率,并支持从本地基础设施到云端的任意环境部署,适合需要长时间持续运行的智能体工作流。
通义千问(Qwen)是阿里巴巴云开发的大语言模型系列,提供对话助手、代码生成、智能体工具调用、256K至100万token长文本理解、多语言翻译和创意写作等能力。模型涵盖Dense和MoE架构,支持思考与非思考模式切换,可通过Qwen Chat、API及多种推理框架使用。
Grok Build 是一款强大且可扩展的编程智能代理。用户可通过交互式终端界面获得全屏编码体验,或在脚本与自动化流程中以无头模式运行,亦能借助 Agent Client Protocol 集成至其他应用中。该工具支持通过 API 密钥或浏览器进行身份验证,允许在配置文件中添加并切换任意自定义模型,并提供指令直接解析代码库架构与文件逻辑,满足开发者在本地项目中的高效辅助编码需求
Microsoft Agent Framework(MAF)是微软推出的开源多语言智能体框架,支持在 .NET 与 Python 中构建、编排和部署生产级 AI 智能体及多智能体工作流,并提供 Agent Harness 运行时、托管部署模式,可对接 Microsoft Foundry、Azure OpenAI、OpenAI 与 GitHub Copilot SDK 等生态。
Claude Sonnet 5 是 Anthropic 于 2026 年 6 月 30 日推出的混合推理模型,具备 100 万 token 上下文窗口,主打编程、工具调用与日常工作场景,并面向实时智能体与高并发任务。用户可在 Claude.ai 的网页、iOS 与 Android 端直接对话使用;开发者可通过 Claude API 调用 claude-sonnet-5,也可在 AWS、Google Cloud 与 Microsoft Foundry 上接入。API 用户还能精细控制模型的思考过程。
DeepSeek 是杭州深度求索公司开发的大语言模型及 AI 助手,网页端、App 与 API 均已上线,支持编程开发、创意写作、文件上传分析与长文本对话,并提供 DeepSeek-V4、R1 等开源模型与开发者 API 平台。
Embabel 是面向 JVM 的智能体(Agentic AI)开发框架,由 Spring 之父 Rod Johnson 等人共同打造。Java 与 Kotlin 开发者可用 @Action 方法把智能体定义为带类型的领域组件,由框架规划从当前状态到目标的执行步骤,并在过程中调用模型、工具或其它智能体作为子流程;同时支持用 Embabel 构建交互式 MCP 工具,把 AI 能力嵌入既有企业级 JVM 应用。
GitHub Copilot SDK for Java 是面向服务端 Java 的客户端库,可通过程序化方式创建 Copilot 智能体会话、注册工具、发送提示词并接收结构化响应。它以 CompletableFuture、注解、lambda 和虚拟线程等惯用 Java 方式提供 API,可运行在 Jakarta EE、Spring 等服务端环境,并支持 BYOK 接入 OpenAI、Azure、Anthropic 或兼容 OpenAI 的端点,以 Maven 依赖形式分发。
IBM Granite 4.2 是 IBM 开源的大语言模型家族,提供 3B、8B、30B 三种稠密规模,基于约 15 万亿 token 训练,支持最长 512K token 上下文,并引入原生推理能力。针对企业智能体工作流,IBM Granite 4.2 具备强工具调用与代码能力,8B/30B 变体经 agentic RL 训练学会自主使用工具、编写运行代码和联网搜索。全部以 Apache 2.0 开源,支持 OpenAI 格式工具调用,可运行于 vLLM 或 SGLang。
LFM2.5-VL-3B 是 Liquid AI 面向端侧部署的视觉语言模型,以 LFM2.5-2.6B 为语言骨干并搭配 SigLIP2 NaFlex 400M 视觉编码器,支持 32768 token 上下文与 16 种语言。可处理文本与图像输入,具备整页 OCR 带版面标注、自然语言指代的目标定位与检测、多图推理、屏幕 UI 理解与函数调用能力,并提供 GGUF、ONNX、MLX 量化版本用于 CPU、移动与 Apple Silicon 推理。
MAI-Code-1.1-Flash 是微软 MAI 团队推出的小型高效编程模型,相比 6 月发布的 1.0 版本可生成更高质量代码,token 效率提升 25%,成本降至四分之一。官方称其在 GitHub Copilot CLI 的 Terminal-Bench 2.1 上提升 22%,.NET 任务提升 15%,在 Copilot 中 token 流式输出快 25% 且完成同一任务少用 25% token,目前已在 GitHub Copilot 中投入生产。
Mistral AI 是法国前沿 AI 公司,提供自研大语言模型、面向长周期任务的 AI 智能体与企业级 AI 平台,支持企业知识搜索、结构化数据分析、文档与报告合成、异步代码生成、自动化 CI/CD,以及自定义模型训练与蒸馏,可在自托管环境、Mistral 云或第三方云上部署。
Needle 2 是 Cactus 推出的开源 45M 参数端侧模型,专注工具调用、设备操作与结构化抽取。整个模型是单个 14MB 二进制文件,单次会话约占 28MB 内存,可在树莓派 5、ESP32 级微控制器、VR 头显及 200 美元以下手机上离线运行;输出由 schema 编译的字节级语法约束,并带置信度分数决定本地执行或升级云端,仓库支持本机 LoRA 微调。
将 1200+ AI 模型接入 VS Code Copilot Chat 的开源免费扩展
OmniCopilot 是一款 MIT 开源的 VS Code 扩展,将 OmniRoute 网关汇聚的 1200+ 模型(Kimi、Claude、GPT、Gemini、GLM、DeepSeek、Qwen 等,覆盖 330+ 提供商)注入用户现有 Copilot Chat 的模型选择器,无需 Copilot 订阅。支持 Agent 模式、工具调用、MCP 与图像附带,具备组合与配额感知自动回退、连接状态面板,并可一键为 Codex CLI、Claude Code、Cline 等配置 OmniRoute。
toolcontract 是一个专注于 LLM 智能体工具调用(tool-calling)的契约测试 Python 库。当模型厂商发布新模型版本时,智能体的工具调用行为可能悄然变化——参数被新增、删除或改名、同一输入选择了不同工具、返回值不再符合下游 schema。它让你固定一组期望的工具调用轨迹黄金集,对真实模型运行并给出通过/失败/不确定判定与 diff,类似微服务契约测试的 Pact,或视觉回归的 Percy,用于在 CI 中提前捕获生产前的工具调用回归。






