Downloads · 30 days
40
6% of all-time downloads
ljsysfurry/DeepSeek-R1-Distill-Qwen-7B
DeepSeek-R1-Distill-Qwen-7B is a text generation model from ljsysfurry. Use it when you need the model to write or continue text. The card lists the license as mit.
Cloud LTE Studio 推理生态的核心基座模型 — 完整权重备份 + AgentFrame 官方基座。
Downloads · 30 days
40
6% of all-time downloads
All-time downloads
644
Public
Parameters
7.6B
15.2 GB on disk
Likes
1
Public
Click a slice to open those files.
.safetensors15.2 GB · 70%
From the Hugging Face model README
Cloud LTE Studio 推理生态的核心基座模型 — 完整权重备份 + AgentFrame 官方基座。
Mirror of DeepSeek R1 Distill Qwen 7B weights, hosted by ljsysfurry.
Original: deepseek-ai/DeepSeek-R1-Distill-Qwen-7B
from transformers import AutoModelForCausalLM, AutoTokenizer
model = AutoModelForCausalLM.from_pretrained("ljsysfurry/DeepSeek-R1-Distill-Qwen-7B")
tokenizer = AutoTokenizer.from_pretrained("ljsysfurry/DeepSeek-R1-Distill-Qwen-7B")
本模型是 AgentFrame(Agent 专用 DeepSeek 推理框架)的默认本地基座。
AgentFrame 四层架构:
认知层 MetaCog — 任务分解 + 置信度追踪 + 信息缺口分析
路由层 LandmarkRouter — 块级稀疏检索 (HiLS 思路)
存储层 AbsorbedMLA — 吸收式 KV 缓存 + 分层量化 (270KB → 7.6KB, 35.6×)
物理层 KVPager — 热/温/冷三级换页 + 遗忘曲线驱逐
用 AgentFrame + 本基座,单卡 L40S 即可获得 138 万 token 上下文。
# AgentFrame 四层融合示例 (numpy 可跑)
git clone https://huggingface.co/ljsysfurry/AgentFrame
python3 agentframe_quad.py
相关资源:
基于本基座微调的 LoRA 适配器:
| LoRA | 内容 | 链接 |
|---|---|---|
| 小说续写 | 260K 字中文小说(空间折越)风格续写 | deepseek-r1-7b-novel-lora |
| 福瑞小说 | 《霄山》狼兽人教师原创故事,温暖治愈风 | deepseek-r1-7b-xiaoshan-lora |
from peft import PeftModel
model = PeftModel.from_pretrained(model, "ljsysfurry/deepseek-r1-7b-novel-lora")
model-00001-of-000002.safetensors / model-00002-of-000002.safetensors — 完整权重config.json / generation_config.json — 模型配置tokenizer.json — 分词器本仓库为 DeepSeek R1 7B 的完整权重备份,遵循原模型 MIT 许可。
Cloud LTE Studio · 2026-08-10