GitHub Copilot SDK for Java 是面向服务端 Java 的客户端库,可通过程序化方式创建 Copilot 智能体会话、注册工具、发送提示词并接收结构化响应。它以 CompletableFuture、注解、lambda 和虚拟线程等惯用 Java 方式提供 API,可运行在 Jakarta EE、Spring 等服务端环境,并支持 BYOK 接入 OpenAI、Azure、Anthropic 或兼容 OpenAI 的端点,以 Maven 依赖形式分发。
Capability Timeline
结构化抽取
按声明的 schema 从文本抽取带类型字段、枚举与数组,输出结构化 JSON
相关工具
6GLiNER2.5 是 Fastino 发布的 schema 驱动的信息抽取与文本分类模型,用边界预测取代跨度枚举,使实体跨度不再随长度消耗算力,推理随文档长度线性扩展。模型原生支持最长4096词长上下文抽取与分类、任意长度实体跨度、实体与关系联合抽取以构建知识图谱、约束分类以及带跨度属性的富抽取上下文,并提供原生分块与字符偏移重映射的批处理长文档接口。官方在 Apache 2.0 许可下发布 base(0.2B)、multi(0.3B)、small(74M) 三个可本地运行模型版本。
Messora 是一款网页内容提取 API,接收公开 URL 并返回干净 Markdown、按 schema 结构化的 JSON 或原始 HTML,避免把大量无关的 HTML 标记、导航和脚本喂给大模型,显著节省上下文 token。官方提供免费账号与每月 1000 额度积分,无需信用卡,并有无需注册的在线 playground 供测试。当前处于 founder beta,LinkedIn/Instagram 及强反爬目标会被拒绝或受限,暂未提供官方 SDK,仅通过 REST API 调用。
Needle 2 是 Cactus 推出的开源 45M 参数端侧模型,专注工具调用、设备操作与结构化抽取。整个模型是单个 14MB 二进制文件,单次会话约占 28MB 内存,可在树莓派 5、ESP32 级微控制器、VR 头显及 200 美元以下手机上离线运行;输出由 schema 编译的字节级语法约束,并带置信度分数决定本地执行或升级云端,仓库支持本机 LoRA 微调。
TwIL-LM 是 webAI 推出的形式逻辑推理模型家族,包含 1.7B 与 3B 两个版本,可完全在消费级硬件上运行。它专注自动形式化:把自然语言翻译成形式逻辑、判断结论是否由前提推出,并完成多步演绎推理,适用于合规规则、合同条款与科研推理场景,也可作为校验层检查其它模型输出。
WebLLM 是一个高性能的浏览器端 LLM 推理引擎,让大语言模型推理直接在浏览器内运行,全程无需服务器支持,通过 WebGPU 获得硬件加速。它完全兼容 OpenAI API,可在本地任意开源模型上使用流式、JSON 模式、函数调用等功能,支持 Llama、Phi、Gemma、Mistral、Qwen 等模型,并支持自定义 MLC 格式模型集成。以 npm 包形式提供,开发者可在其之上构建 AI 助手等 Web 应用,兼顾 GPU 加速效果与数据隐私。

