Capability Graph
功能图谱
先按一级能力域组织,再在每个域下查看具体能力、相关工具与更新时间轴。图谱只使用受控能力,不接收临时标签。
开发与工程
代码生成、补全、审查、测试、部署与开发工作流。
对话与智能体
通用对话、长文本、Agent、任务执行与个人/团队助手。
知识与检索
联网搜索、企业搜索、资料整理、数据分析与知识库问答。
图像与设计
图像生成、图像编辑、UI 生成、设计辅助与视觉创意。
视频与音频
视频生成/处理、实时视频、语音合成、换脸与音视频工作流。
内容与商业
文案、翻译、营销、电商素材与办公协作。
模型与研究
大模型、多模态、世界模型、训练学习与模型基础能力。
平台与生态
开源、本地运行、资源合集、插件生态与系统集成。
能力域
8 个一级域,66 个可追踪能力
开发与工程
代码生成、补全、审查、测试、部署与开发工作流。
代码生成
从自然语言、上下文或设计稿生成可运行代码。
应用构建
通过自然语言或低代码方式构建可运行的应用和交互体验。
代码审查
自动发现代码问题、风险与可改进点。
安全检测
AI 驱动的代码安全漏洞扫描与检测能力
用量与费用管控
AI工具用量监控与费用上限管理:按组织/群组/用户设置日/周/月支出上限,超限自动阻断请求。
隐私防护
为开发工具和 CLI 提供隐私加固、遥测关闭、数据上传防护等安全配置能力。
访问控制策略
企业级访问控制与策略管理:SSO身份认证、集中化策略下发、角色与群组权限管控。
代码补全
在 IDE 或代码编辑器中补全函数、片段与上下文代码。
性能基准
对AI模型推理速度、量化精度、GPU利用率等性能指标进行基准测试与诊断分析
测试生成
生成单元测试、集成测试或测试用例。
代码重构
在不改变预期行为的前提下重组、简化和改进现有代码。
文档站点生成
从 Markdown 或 MDX 文件自动生成生产级文档网站,包含导航、搜索、主题等功能。
数据版本控制
对数据库或数据集提供分支、合并、提交等版本控制能力
芯片设计EDA
用于芯片/SoC 规划、架构探索、物理实现与 PPA 优化的电子设计自动化软件能力
对话与智能体
通用对话、长文本、Agent、任务执行与个人/团队助手。
智能体
能拆解任务、调用工具、执行多步骤流程的 Agent 能力。
对话助手
面向问答、写作、分析和任务协助的通用对话能力。
长文本处理
处理长文档、长上下文、多轮复杂推理与摘要。
AI记忆
记录用户屏幕、音频等行为数据并生成可搜索记忆的 AI 记忆层能力。
游戏AI角色
为游戏NPC或playerbot注入LLM驱动的角色性格、记忆与交互能力。
自适应学习辅导
面向学生的 AI 自适应课程与一对一辅导,含诊断、个性化学习路径与掌握度评估
知识与检索
联网搜索、企业搜索、资料整理、数据分析与知识库问答。
文件分析
读取 PDF、表格、文档或用户上传文件并提取、总结和分析内容。
联网搜索
检索实时网页信息,并将搜索结果用于问答或分析。
数据分析
面向表格、指标、文本和业务数据的分析与洞察生成。
深度研究
围绕复杂问题进行多步检索、资料综合和带依据的研究整理。
企业搜索
搜索企业内部文档、知识库、消息与业务数据。
知识库
将企业分散知识整理编译为结构化知识层,供智能体查询复用
文本向量化
将文本转换为稠密向量嵌入,用于检索、语义搜索和RAG系统的基础组件
图像与设计
图像生成、图像编辑、UI 生成、设计辅助与视觉创意。
图像理解
识别、描述和分析用户上传图片中的文字、对象、结构与视觉信息。
图像生成
根据文字、参考图或结构生成图片素材。
图像编辑
对图片进行局部修改、扩图、风格调整或商品图处理。
UI 生成
生成界面原型、组件、页面结构或设计稿。
OCR 文字识别
从图片或扫描内容中识别并提取文字。
PPT 生成
根据主题、资料或指令生成演示文稿结构与页面。
目标检测
识别图像中的目标并定位其位置或边界。
图像增强
通过超分辨率、放大、去噪、锐化或修复提升已有图像的清晰度与质量。
图像分割
识别并分离图像中的目标、区域或前景背景。
关键点检测
定位人脸、姿态或物体上的关键位置。
字体生成
使用 AI 从提示词或图像生成可安装的字体文件(如 TTF),用于品牌、设计与排版工作流。
视频与音频
视频生成/处理、实时视频、语音合成、换脸与音视频工作流。
视频生成
根据文字、图片或素材生成视频内容。
视频处理
剪辑、成片、视频增强、模板化处理或视频工作流自动化。
语音对话
通过语音输入与语音回复进行实时或连续对话。
语音转录
将音频、语音内容自动转录为文字的能力,包括本地或云端 AI 转录
语音合成
生成语音、配音、旁白或音频内容。
屏幕演示
屏幕共享、实时演示、录屏及直播画面控制,用于产品演示或远程会议展示。
视频换脸
面向换脸、人脸生成或实时视频形象处理的能力。
音乐生成
根据指令、参数或交互生成音乐、节拍、旋律或音频片段的能力。
视频投屏
将音视频流或屏幕内容投射到电视、投影仪等显示设备,支持DLNA/UPnP等协议。
内容与商业
文案、翻译、营销、电商素材与办公协作。
模型与研究
大模型、多模态、世界模型、训练学习与模型基础能力。
模型训练学习
训练教程、模型机制、深度学习和模型构建资料。
世界模型
理解或预测世界状态,用于机器人、仿真或具身智能。
具身导航
使机器人通过视觉感知和语言指令在物理环境中自主导航的能力。
强化学习训练
为具身智能和智能体提供强化学习训练流程、算法和基础设施支持。
材料发现
使用 AI 加速新材料的发现、设计与合成路径规划
机器人操作
视觉-语言-动作(VLA)模型驱动的机器人操控与动作生成
模型可解释性
分析 LLM 内部表示、激活值、层间贡献,可视化模型内部机制。
模型权重编辑
通过 token 方向编辑、消融、替换等方式修改模型权重,导出可部署的 checkpoint。
目标跟踪
对视频或视觉流中的目标进行持续跟踪,可用于机器人具身感知
脑电信号处理
EEG/脑电等生物信号的去噪、重建与上采样处理能力
运动传感分析
基于加速度计、陀螺仪等穿戴传感器信号进行人体动作识别、步态检测与健康监测的能力
平台与生态
开源、本地运行、资源合集、插件生态与系统集成。