KNOWLEDGE DOMAIN / AI模型训练AI模型训练FRAMEWORK MAP知识框架如何训练一个原生 Computer Use 模型 0 篇文章模型微调技术全景:LoRA、QLoRA、全参数微调与实战选型指南 0 篇文章应急响应大模型微调:基于 Qwen2.5-7B 的 QLoRA 训练实践 0 篇文章模型量化与压缩技术:GPTQ、AWQ、GGUF与FP8的工程实践指南 0 篇文章合成数据工程:大模型时代的数据飞轮与质量保障 0 篇文章自主研究循环续跑 144 轮:97 连败与四个真实杠杆 0 篇文章让 Agent 自己跑研究循环:45 轮 Muon 调参实战复盘 0 篇文章LATEST SIGNALS最近更新自主研究循环续跑 144 轮:97 连败与四个真实杠杆 2026-10-04自主研究循环续跑 144 轮:97 连败与四个真实杠杆Agent自主研究循环MuonMLX注意力窗口Value EmbeddingLLM训练调参让 Agent 自己跑研究循环:45 轮 Muon 调参实战复盘 2026-10-02让 Agent 自己跑研究循环:45 轮 Muon 调参实战复盘Agent自主研究循环MuonMLXApple SiliconLLM训练优化器调参模型量化与压缩技术:GPTQ、AWQ、GGUF与FP8的工程实践指南 2026-08-17模型量化与压缩技术:GPTQ、AWQ、GGUF与FP8的工程实践指南量化QuantizationGPTQAWQGGUFFP8模型压缩LLM部署合成数据工程:大模型时代的数据飞轮与质量保障 2026-07-20合成数据工程:大模型时代的数据飞轮与质量保障合成数据Synthetic DataSelf-InstructEvol-Instruct数据蒸馏模型训练应急响应大模型微调:基于 Qwen2.5-7B 的 QLoRA 训练实践 2026-07-09应急响应大模型微调:基于 Qwen2.5-7B 的 QLoRA 训练实践模型微调QLoRA应急响应Qwen2.5数据构建安全运营模型微调技术全景:LoRA、QLoRA、全参数微调与实战选型指南 2026-07-09模型微调技术全景:LoRA、QLoRA、全参数微调与实战选型指南LoRAQLoRAPEFT全参数微调DORA模型训练微调如何训练一个原生 Computer Use 模型 2026-07-03如何训练一个原生 Computer Use 模型Computer UseGUI Agent模型训练强化学习视觉语言模型视觉定位DOMAIN TAGS领域标签模型训练3Agent2LLM训练2MLX2Muon2QLoRA2调参2自主研究循环2Apple Silicon1AWQ1Computer Use1DORA1