deepseek-v4-flash-mi300x

单卡 AMD MI300X 部署 DeepSeek V4 Flash 的生产配置

deepseek-v4-flash-mi300x 是一个开源仓库,收录在单颗 AMD MI300X(192GB HBM3)上生产运行 deepseek-ai/DeepSeek-V4-Flash-0731 所需的 Docker Compose 部署栈、SHA-256 锁定文件覆盖、对上游的参考补丁与调优表格。模型按原样加载,无需额外量化或权重卸载,并给出解码、预填充、并发吞吐与 256K 上下文实测数据

性能基准模型推理服务
访问官网
收录动态

1

最近更新

2026-08-04

评价样本

未收录

GitHub Stars

56

工具功能

这个工具能做什么、适合谁用,以及目前已识别的核心能力。

工具简介

deepseek-v4-flash-mi300x 是一个开源仓库,收录在单颗 AMD MI300X(192GB HBM3)上生产运行 deepseek-ai/DeepSeek-V4-Flash-0731 所需的 Docker Compose 部署栈、SHA-256 锁定文件覆盖、对上游的参考补丁与调优表格。模型按原样加载,无需额外量化或权重卸载,并给出解码、预填充、并发吞吐与 256K 上下文实测数据

核心功能

2 项已整理
性能基准
模型推理服务

价格信息

暂无可验证价格信息

暂无足够准确的价格信息。

基础信息

更新频率
近 7 天 1 条收录动态
最近更新
2026-08-04
覆盖行业

更新日志

按时间记录功能更新、版本发布、新工具入库等重要变化。

  1. 2026-08-04开源

    开源仓库 deepseek-v4-flash-mi300x 发布,提供在单颗 AMD MI300X(192GB HBM3)上生产运行 DeepSeek-V4-Flash-0731 的 Docker Compose 部署栈、SHA-256 锁定文件覆盖、上游参考补丁与调优表。304B 参数模型权重占 156.67 GiB HBM,无需额外量化或权重卸载;实测单流解码 168.6 tok/s、8 并发流聚合 542 tok/s、并验证 256K 上下文。

deepseek-v4-flash-mi300x 常见问题

关于 deepseek-v4-flash-mi300x 的定位、核心功能、价格与最近更新。

deepseek-v4-flash-mi300x 是什么?

deepseek-v4-flash-mi300x 是一个开源仓库,收录在单颗 AMD MI300X(192GB HBM3)上生产运行 deepseek-ai/DeepSeek-V4-Flash-0731 所需的 Docker Compose 部署栈、SHA-256 锁定文件覆盖、对上游的参考补丁与调优表格。模型按原样加载,无需额外量化或权重卸载,并给出解码、预填充、并发吞吐与 256K 上下文实测数据。

deepseek-v4-flash-mi300x 有哪些核心功能?

deepseek-v4-flash-mi300x 当前已核验的核心功能包括:性能基准、模型推理服务。

deepseek-v4-flash-mi300x 如何收费?

AI Equal 当前没有收录 deepseek-v4-flash-mi300x 的可验证价格信息。

deepseek-v4-flash-mi300x 最近有什么更新?

2026-08-04:开源仓库 deepseek-v4-flash-mi300x 发布,提供在单颗 AMD MI300X(192GB HBM3)上生产运行 DeepSeek-V4-Flash-0731 的 Docker Compose 部署栈、SHA-256 锁定文件覆盖、上游参考补丁与调优表。304B 参数模型权重占 156.67 GiB HBM,无需额外量化或权重卸载;实测单流解码 168.6 tok/s、8 并发流聚合 542 tok/s、并验证 256K 上下文。