Capability Graph
功能图谱
先按一级能力域组织,再在每个域下查看具体能力、相关工具与更新时间轴。图谱只使用受控能力,不接收临时标签。
开发与工程
代码生成、补全、审查、测试、部署与开发工作流。
对话与智能体
通用对话、长文本、Agent、任务执行与个人/团队助手。
知识与检索
联网搜索、企业搜索、资料整理、数据分析与知识库问答。
图像与设计
图像生成、图像编辑、UI 生成、设计辅助与视觉创意。
视频与音频
视频生成/处理、实时视频、语音合成、换脸与音视频工作流。
内容与商业
文案、翻译、营销、电商素材与办公协作。
模型与研究
大模型、多模态、世界模型、训练学习与模型基础能力。
平台与生态
开源、本地运行、资源合集、插件生态与系统集成。
能力域
8 个一级域,119 个可追踪能力
开发与工程
代码生成、补全、审查、测试、部署与开发工作流。
代码生成
从自然语言、上下文或设计稿生成可运行代码。
访问控制策略
企业级访问控制与策略管理:SSO身份认证、集中化策略下发、角色与群组权限管控。
安全检测
AI 驱动的代码安全漏洞扫描与检测能力
应用构建
通过自然语言或低代码方式构建可运行的应用和交互体验。
用量与费用管控
AI工具用量监控与费用上限管理:按组织/群组/用户设置日/周/月支出上限,超限自动阻断请求。
性能基准
对AI模型推理速度、量化精度、GPU利用率等性能指标进行基准测试与诊断分析
代码沙箱执行
为智能体或应用提供隔离的代码执行沙箱环境,可运行 shell 命令、脚本或不受信代码
代码审查
自动发现代码问题、风险与可改进点。
隐私防护
为开发工具和 CLI 提供隐私加固、遥测关闭、数据上传防护等安全配置能力。
可观测性追踪
自动采集调用链 span、时序与错误日志,供人或智能体查询定位故障的追踪调试能力
代码补全
在 IDE 或代码编辑器中补全函数、片段与上下文代码。
静态分析
对源码或补丁做静态检测,识别重复实现、多余依赖、反模式等问题
测试生成
生成单元测试、集成测试或测试用例。
持续集成
运行 CI/CD 流水线,自动执行构建、检查、测试与部署步骤
内容审核
对文本、图像等内容做安全合规判定、有害内容分类与拒答检测的护栏能力
代码重构
在不改变预期行为的前提下重组、简化和改进现有代码。
编程语言编译器
提供编程语言语法、类型系统与编译器工具链,用于编写和编译程序
数据版本控制
对数据库或数据集提供分支、合并、提交等版本控制能力
自动更新升级
工具自身检测新版本并按安装渠道自动升级、校验版本与失败自修复的能力
代码仓库托管
提供 Git 远程仓库托管与协作服务,支持代码推送、克隆与仓库管理。
GPU内核编程
编写和优化在 GPU 等加速器上运行的计算内核,替代 CUDA 等专用方案
故障根因分析
对系统或网络故障进行自动诊断与根因定位,输出修复与架构建议,缩短故障恢复时间
欺诈风险检测
识别欺诈攻击模式、团伙作案与高风险设备,输出风险判定的能力
向量数据库客户端
以 SDK/客户端方式连接向量数据库,执行向量存储、相似度检索与过滤查询
硬件设计
生成电路原理图、BOM 物料清单与装配说明等硬件设计产物的能力
文档站点生成
从 Markdown 或 MDX 文件自动生成生产级文档网站,包含导航、搜索、主题等功能。
芯片设计EDA
用于芯片/SoC 规划、架构探索、物理实现与 PPA 优化的电子设计自动化软件能力
虚拟机运行
在 Mac 等宿主机上运行 Windows/Linux 虚拟机的虚拟化能力,含图形加速、CPU 指令集支持与本地 AI 工作负载运行。
CAD 建模
生成或重建可编辑的参数化 CAD 模型与特征树,用于机械设计与逆向工程
模型识别
对任意 OpenAI 兼容 API 端点运行基础设施探针,识别真实背后模型,防别名与伪装
身份核验
对证件与人脸进行真实性核验,完成实名认证/eKYC 流程的能力
同态加密计算
在加密数据上直接进行计算与推理的能力,无需解密,用于隐私保护计算
对话与智能体
通用对话、长文本、Agent、任务执行与个人/团队助手。
智能体
能拆解任务、调用工具、执行多步骤流程的 Agent 能力。
对话助手
面向问答、写作、分析和任务协助的通用对话能力。
AI记忆
记录用户屏幕、音频等行为数据并生成可搜索记忆的 AI 记忆层能力。
长文本处理
处理长文档、长上下文、多轮复杂推理与摘要。
浏览器操作代理
代理直接操作浏览器页面,点击、输入并在无 API 的网站上完成任务
函数调用
把自然语言请求映射为带类型参数的函数/工具调用,用于设备控制与智能体执行
游戏AI角色
为游戏NPC或playerbot注入LLM驱动的角色性格、记忆与交互能力。
自适应学习辅导
面向学生的 AI 自适应课程与一对一辅导,含诊断、个性化学习路径与掌握度评估
知识与检索
联网搜索、企业搜索、资料整理、数据分析与知识库问答。
文件分析
读取 PDF、表格、文档或用户上传文件并提取、总结和分析内容。
数据分析
面向表格、指标、文本和业务数据的分析与洞察生成。
联网搜索
检索实时网页信息,并将搜索结果用于问答或分析。
知识库
将企业分散知识整理编译为结构化知识层,供智能体查询复用
深度研究
围绕复杂问题进行多步检索、资料综合和带依据的研究整理。
企业搜索
搜索企业内部文档、知识库、消息与业务数据。
数据可视化
生成交互式图表与数据可视化视图,支持缩放、悬停与导出
文本向量化
将文本转换为稠密向量嵌入,用于检索、语义搜索和RAG系统的基础组件
结构化抽取
按声明的 schema 从文本抽取带类型字段、枚举与数组,输出结构化 JSON
网页抓取提取
抓取网页并把 HTML 转为干净的 Markdown/JSON 结构化内容,用于 RAG 与数据采集
地理空间分析
基于卫星影像、3D 地形与地理数据图层进行选址、规划与空间洞察分析的能力
图像与设计
图像生成、图像编辑、UI 生成、设计辅助与视觉创意。
图像理解
识别、描述和分析用户上传图片中的文字、对象、结构与视觉信息。
图像生成
根据文字、参考图或结构生成图片素材。
图像编辑
对图片进行局部修改、扩图、风格调整或商品图处理。
UI 生成
生成界面原型、组件、页面结构或设计稿。
PPT 生成
根据主题、资料或指令生成演示文稿结构与页面。
OCR 文字识别
从图片或扫描内容中识别并提取文字。
图像增强
通过超分辨率、放大、去噪、锐化或修复提升已有图像的清晰度与质量。
开放世界3D生成
生成可探索、可编辑并可直接用于游戏引擎的三维资产与开放世界场景,含几何与纹理
目标检测
识别图像中的目标并定位其位置或边界。
图像分割
识别并分离图像中的目标、区域或前景背景。
关键点检测
定位人脸、姿态或物体上的关键位置。
字体生成
使用 AI 从提示词或图像生成可安装的字体文件(如 TTF),用于品牌、设计与排版工作流。
视频与音频
视频生成/处理、实时视频、语音合成、换脸与音视频工作流。
视频生成
根据文字、图片或素材生成视频内容。
语音转录
将音频、语音内容自动转录为文字的能力,包括本地或云端 AI 转录
视频处理
剪辑、成片、视频增强、模板化处理或视频工作流自动化。
语音对话
通过语音输入与语音回复进行实时或连续对话。
语音合成
生成语音、配音、旁白或音频内容。
音频生成
AI 生成音效、环境声或配乐等音频内容的能力
视频理解
对已有视频内容进行分析、识别与问答,输出对画面与情节的理解结果
音乐生成
根据指令、参数或交互生成音乐、节拍、旋律或音频片段的能力。
屏幕演示
屏幕共享、实时演示、录屏及直播画面控制,用于产品演示或远程会议展示。
视频换脸
面向换脸、人脸生成或实时视频形象处理的能力。
声音克隆
用少量参考音频复刻指定音色并生成同音色语音的能力
电话外呼导航
智能体自动拨打电话并穿越 IVR 语音菜单、发送 DTMF 按键音、识别接通真人
视频投屏
将音视频流或屏幕内容投射到电视、投影仪等显示设备,支持DLNA/UPnP等协议。
手语转文本
识别摄像头中的手语动作并实时转换为文字,用于无障碍输入与转写
音源分离
将音频分离为人声、鼓、贝斯、钢琴、吉他等独立音轨的音频处理能力
语音转录文本规范化
对ASR转录后的原始文本进行清洗整理,去除填充词、规范化标点数字等能力
内容与商业
文案、翻译、营销、电商素材与办公协作。
文案生成
生成营销文案、商品描述、文章内容或脚本。
办公协作
面向团队沟通、会议、文档、审批和日常办公的协作能力。
文档生成
根据指令和资料生成报告、表格、文档或其他可交付文件。
翻译
跨语言翻译、本地化和多语言内容处理。
会议记录
自动记录会议、生成转录、摘要与行动项的会议助手能力
内容水印
在 AI 生成的文本、图像或视频中嵌入不可见水印标识,并提供检测工具用于内容溯源
AI内容检测
检测文本内容是否由 AI 生成,并给出人类撰写与 AI 辅助的比例估算
文本人性化
移除AI生成文本中的写作痕迹,包括词汇、排版、结构层面的AI风格标记,使文本读起来更像人类书写。
末端配送优化
利用 AI 决策引擎在自有车队、快递、包裹承运商等配送方式间选择最低成本方案,用于最后一公里配送优化。
模型与研究
大模型、多模态、世界模型、训练学习与模型基础能力。
模型训练学习
训练教程、模型机制、深度学习和模型构建资料。
复杂推理
模型进行多步逻辑与数学推理、解答竞赛级难题的能力
世界模型
理解或预测世界状态,用于机器人、仿真或具身智能。
机器人操作
视觉-语言-动作(VLA)模型驱动的机器人操控与动作生成
模型量化压缩
对模型权重做量化/压缩以降低显存与算力占用,产出可本地推理的低比特构建
强化学习训练
为具身智能和智能体提供强化学习训练流程、算法和基础设施支持。
具身导航
使机器人通过视觉感知和语言指令在物理环境中自主导航的能力。
合成数据生成
按已知真值生成带噪声的合成数据集,用于可复现基准测试与算法验证
模型可解释性
分析 LLM 内部表示、激活值、层间贡献,可视化模型内部机制。
训练数据清洗
对预训练/训练语料做质量过滤、噪声删除与改写清洗,输出可用于模型训练的数据集
材料发现
使用 AI 加速新材料的发现、设计与合成路径规划
时序预测
对时间序列数据进行未来数值预测,如销量、需求、指标走势预测
表格数据预测
对表格/结构化数据直接做分类与回归预测,无需为每个数据集单独训练调参
目标跟踪
对视频或视觉流中的目标进行持续跟踪,可用于机器人具身感知
三维重建
从图像或视频流实时重建三维场景、几何与相机轨迹的技术能力
天气预报
基于AI模型预测天气变量与极端天气事件(如台风路径与强度)的能力
运动传感分析
基于加速度计、陀螺仪等穿戴传感器信号进行人体动作识别、步态检测与健康监测的能力
冰川冰量估算
用机器学习按点重建冰川冰厚并估算冰体积、生成全球冰厚分布图的能力
基因组序列设计
用 DNA/基因组语言模型对核酸序列建模、预测并生成设计新基因组或噬菌体等生物序列
模型权重编辑
通过 token 方向编辑、消融、替换等方式修改模型权重,导出可部署的 checkpoint。
脑电信号处理
EEG/脑电等生物信号的去噪、重建与上采样处理能力
无人机自主飞行
无人机/小型无人系统的自主飞行控制与末段自主制导能力,含机载AI与计算机视觉推理
显微应变分析
对显微/晶格图像做几何相位分析,输出位移场与应变代理量及质量指标
平台与生态
开源、本地运行、资源合集、插件生态与系统集成。
自动化工作流
通过任务编排、触发器和多步骤流程自动完成工作。
工具协议集成
通过 MCP、CLI、API 等协议接入模型和外部工具。
模型推理服务
通过托管 API 提供开源或商业模型的在线推理调用,通常兼容 OpenAI 接口
模型路由
在多个大模型之间按请求自动选择最优模型的路由端点
智能体支付
让 AI 智能体以机器原生方式完成付款、结算与稳定币微支付的能力
网络访问优化
通过 DoH 加密 DNS 解析或智能代理对模型 API 域名做网络访问优化,规避 DNS 污染与网络异常
站点一键部署
将本地构建产物一键发布到静态托管平台如 Netlify,自动识别构建目录并管理已发布链接
AI课程学习
面向用户提供 AI 工具与技能的系统化课程、教程和学习路径