J-Wash 是基于 Anthropic Jacobian Lens 的本地 LLM 内部表示分析与编辑工具。用户可在聊天界面中实时查看各层读取的 token 方向,通过 token 编辑器添加消融、替换等规则来重塑模型身份和行为,然后将编辑导出为完整 checkpoint、修改层权重或 LoRA,导出的 safetensors 权重可在任意 transformers 环境中加载运行,还支持转换 GGUF 格式。无需训练、数据集或微调。
模型可解释性模型权重编辑
近7天 1 动态186 Stars
