ZDTaichu5.0-9B

紫东太初开源9B多模态基座,兼顾通用视觉与空间具身推理

ZDTaichu5.0-9B 是紫东太初(Taichu-AI)团队开源的90亿参数多模态基座模型,采用 Qwen3.5-9B 语言骨干与 C-RADIOv4-H 视觉编码器,支持文本、单图/多图与视频的任意分辨率输入,上下文最长128K。模型在保持图像、文档、图表、OCR、视觉数学等通用视觉能力第一梯队的同时,强化细粒度2D关系、多视角关联、三维场景理解与具身VLA规划,支持多步多轮智能体工具调用,并内置熵门控自适应循环推理,已开放权重与工业级数据生产管线,面向具身智能科研与制造场景

OCR 文字识别函数调用图像理解复杂推理智能体机器人操作视频理解
访问官网
收录动态

1

最近更新

2026-09-04

评价样本

未收录

GitHub Stars

753

工具功能

这个工具能做什么、适合谁用,以及目前已识别的核心能力。

工具简介

ZDTaichu5.0-9B 是紫东太初(Taichu-AI)团队开源的90亿参数多模态基座模型,采用 Qwen3.5-9B 语言骨干与 C-RADIOv4-H 视觉编码器,支持文本、单图/多图与视频的任意分辨率输入,上下文最长128K。模型在保持图像、文档、图表、OCR、视觉数学等通用视觉能力第一梯队的同时,强化细粒度2D关系、多视角关联、三维场景理解与具身VLA规划,支持多步多轮智能体工具调用,并内置熵门控自适应循环推理,已开放权重与工业级数据生产管线,面向具身智能科研与制造场景

核心功能

7 项已整理
OCR 文字识别
函数调用
图像理解
复杂推理
智能体
机器人操作
视频理解

价格信息

暂无可验证价格信息

暂无足够准确的价格信息。

基础信息

更新频率
近 7 天暂无收录动态
最近更新
2026-09-04
覆盖行业
科研

更新日志

按时间记录功能更新、版本发布、新工具入库等重要变化。

  1. 2026-09-04开源

    紫东太初开源90亿参数多模态大模型 ZDTaichu5.0-9B,基于 Qwen3.5-9B 与 C-RADIOv4-H,支持文本/单图/多图/视频输入与128K上下文,在保持通用视觉、OCR、视觉数学第一梯队的同时,新增空间推理、具身VLA规划与多步智能体工具调用能力,并内置熵门控自适应循环推理,权重与工业级数据生产管线一并开放。

ZDTaichu5.0-9B 常见问题

关于 ZDTaichu5.0-9B 的定位、核心功能、价格与最近更新。

ZDTaichu5.0-9B 是什么?

ZDTaichu5.0-9B 是紫东太初(Taichu-AI)团队开源的90亿参数多模态基座模型,采用 Qwen3.5-9B 语言骨干与 C-RADIOv4-H 视觉编码器,支持文本、单图/多图与视频的任意分辨率输入,上下文最长128K。模型在保持图像、文档、图表、OCR、视觉数学等通用视觉能力第一梯队的同时,强化细粒度2D关系、多视角关联、三维场景理解与具身VLA规划,支持多步多轮智能体工具调用,并内置熵门控自适应循环推理,已开放权重与工业级数据生产管线,面向具身智能科研与制造场景。

ZDTaichu5.0-9B 有哪些核心功能?

ZDTaichu5.0-9B 当前已核验的核心功能包括:OCR 文字识别、函数调用、图像理解、复杂推理、智能体、机器人操作、视频理解。

ZDTaichu5.0-9B 如何收费?

AI Equal 当前没有收录 ZDTaichu5.0-9B 的可验证价格信息。

ZDTaichu5.0-9B 最近有什么更新?

2026-09-04:紫东太初开源90亿参数多模态大模型 ZDTaichu5.0-9B,基于 Qwen3.5-9B 与 C-RADIOv4-H,支持文本/单图/多图/视频输入与128K上下文,在保持通用视觉、OCR、视觉数学第一梯队的同时,新增空间推理、具身VLA规划与多步智能体工具调用能力,并内置熵门控自适应循环推理,权重与工业级数据生产管线一并开放。

ZDTaichu5.0-9B:功能、价格、更新日志与同类对比 | AI Equal