创业思考博客

本地跑大模型:Ollama 入门与常用命令

刚接触本地大模型时,我犯过一个看似很蠢的错误:我的显卡有 12GB 显存,看到一个模型文件只有 8GB,心想”12 大于 8,肯定能跑”。结果一跑就卡成 PPT,查了半天才发现自己完全理解错了。 这篇文章就把我踩过的坑和最终沉淀下来的用法整理出来,给同样想在自己电脑上跑大模型的你。 为什么”显存大于模型文件”还不够这是新手最容易踩的直觉误区:模型文件的大小,不等于运行时占的显存。 跑模型时,...

DeepSeek 技术架构全景:从 V3 到 V4 的演进与核心创新

为什么值得花时间理解 DeepSeek 的架构2026 年 8 月,当我打开 Hugging Face 的排行榜时,DeepSeek 家族的身影几乎占据了整个视野。DeepSeek-V3 下载量超过 105 万,DeepSeek-V4-Flash 超过 188 万,DeepSeek-R1 更是突破 690 万——这还不包括那些基于它们蒸馏出来的小模型。 作为一个每天要和 AI 打交道的程序员...