四大知识模块
概念 → 工具 → 方法 → 图谱,闭环的 AI 全栈生态
最新内容
📘 模型学院
全部 →Transformer 原理图解:自注意力、位置编码、Encoder-Decoder
从第一性原理拆解 Transformer 架构:它为什么能取代 RNN,自注意力在算什么,位置编码解决什么问题。
模型微调全解:全参 vs 参数高效,深解 LoRA / QLoRA / Adapter
微调不是只有一条路。全参微调、LoRA、QLoRA、Adapter 各适合什么场景?为什么现在几乎都用 LoRA?
RAG 检索增强生成:架构、向量库、分块策略(与微调对比)
RAG 是让大模型'会查资料'的技术。讲清架构、向量检索、分块策略,以及它和微调到底该怎么选。
Agent 思维框架:规划-执行-反思与工具调用原理
Agent 不是'更聪明的聊天',而是一套'想-做-查-改'的循环。拆解规划-执行-反思框架和工具调用的本质。
🧠 知识库指南
全部 →想本地开发智能体?2026开源Agent框架选型指南,看这一篇就够了
最近经常收到很多开发者的私信提问:
DeepSeek-Harness 框架详解:Agent = 大模型 + Harness
先说个容易踩的坑:网上搜“DeepSeek-Harness“,很容易搜到一个叫 lm-evaluation-harness 的大模型评测框架,很多人就把这俩混为一谈。
DeepSeek 开源了「Agent 界的 Android」,和字节的 TRAE Work 根本不是一回事
最近总有人把几件事混在一起问:豆包是不是出了个编程助手?DeepSeek 是不是也做办公软件了?TRAE Work 和 TRAE IDE 有啥区别?
DeepSeek 涨价 3~11 倍,平替怎么选?线上、批量、本地三条路直接抄作业
8 月 17 日起,DeepSeek V4 启用峰谷定价:工作日上午 9:00-12:00、下午 14:00-18:00 算高峰,价格直接飙到原来的 3~11 倍。