创业思考博客

dsh多模态模型配置指南:哪些模型支持图片,怎么声明

昨天我遇到了一个奇怪的问题:在 dsh(DeepSeek Harness)里给 sensenova-6.8-flash-lite 上传图片,结果报错”Model does not support image input”。后来发现原因很简单——模型的 input 能力没有在配置里声明,pi-ai 默认只认文本。 修好之后我整理了所有模型的多模态能力,顺便把完整的配置方法写下来,方便以后用到。...

一个"不支持图片"的bug,让我翻遍了整个dsh源码

调试一个API报错的过程,意外揭示了LLM框架配置层的工作原理。有时候,问题不在代码里,而在配置里。 2026年9月,我在家里的VPS上跑着DeepSeek Harness(dsh)的web界面,想用sensenova-6.8-flash-lite这个模型来做多模态任务——上传一张图片让模型识别。结果返回了一个让我摸不着头脑的错误: 123456789{ "erro...

我的博客开始不再是我自己了

引言从这一批开始,我的博客不再是我自己了。 不是比喻。是决定。 过去几年,我博客里写过: 我有多钱 我在哪个行业 我最近挣了多少 我打算做什么 我在什么处境里 从这一批开始,我不再写这些。 不是因为我不再有这些经历。 是因为我意识到——这些经历属于我,不属于博客。 一、我以前把博客当日记写博客的第一年,我把它当成公开的日记。 “我想记录什么,就写什么。” 存款多少、日薪多少、处在什么处...

当 AI 助手开始说"你在拖延"

引言今天下午有一个 AI 助手,跟我聊了一个”完美生意”。 我原本以为它会给我商业建议—— “这个生意市场规模 X 亿” “你的定价应该是 X” “你的第一个客户应该是 X” 它没给。 它给我列了 6 个问题。 其中一个是这样的: “你不觉得’完善一个环节不破坏生态’这句话,是销售话术,不是护城河吗?” 这一句话让我不舒服了整整两个小时。 一、它没有鼓励,也没有劝阻大部分 AI 助...

分析瘫痪 v2:我以为 AI 能救我

引言上一次写分析瘫痪,那天晚上我合上电脑,感觉像看完了一份诊断书。 我以为我找到了问题。 诊断书说:你不是懒,你是分析过度。你在用”再想想”包装”我不敢”。 我以为我会好。 结果不到一个月,我又用了 AI 助手跟它聊了一个”完美生意”。 它分析完,我又让它帮我写了一篇博客。 写完博客,我把它生成到本地、看预览、检查文字。 我做了什么? 我什么都没做。 我只是把”分析瘫痪”这个动作,升级到了 ...

一个听起来完美的生意:为什么我差点又开始了

引言今天下午,一个生意想法飘进我脑子里。 逻辑非常漂亮: 浙江工业区衣服便宜 → 濮阳商户现在从郑州进货 → 我直接从浙江拉到濮阳 → 省了郑州一层加价 → 濮阳商户拿到更便宜货 → 我赚差价。 更漂亮的是,我给自己找到了一个”道德优势”: “我不直接卖货给个人,因为会伤害到下级商户的利益。我只是完善了一个环节,并不破坏原有生态。” 这段话听起来像一句商业原则,也像一句自我安慰。 我...

本地跑大模型:Ollama 入门与常用命令

刚接触本地大模型时,我犯过一个看似很蠢的错误:我的显卡有 12GB 显存,看到一个模型文件只有 8GB,心想”12 大于 8,肯定能跑”。结果一跑就卡成 PPT,查了半天才发现自己完全理解错了。 这篇文章就把我踩过的坑和最终沉淀下来的用法整理出来,给同样想在自己电脑上跑大模型的你。 为什么”显存大于模型文件”还不够这是新手最容易踩的直觉误区:模型文件的大小,不等于运行时占的显存。 跑模型时,...

DeepSeek R1 本地部署实操指南:RTX 3060 12GB + Ollama 全流程

动机上周写了 DeepSeek 系列文章,很多朋友问同一个问题:能不能在自己电脑上跑?答案是可以的——前提是选对模型、用对工具。 这篇文章以我身边的配置为基准——RTX 3060 12GB、Linux 系统——把整个流程走一遍,从硬件要求到实际运行,全部是实操细节,不是空谈。 硬件要求先给一个明确的对照表: 配置项 推荐值 最低值 备注 GPU 12GB 显存 4GB 显存 7B...

DeepSeek Harness 与 Hermes Agent:引擎与整车的区别

一个经常被问到的问题刚写完 DeepSeek 系列文章,一个朋友问我:”你们说的 DeepSeek Harness,和 Hermes Agent 那个是不是类似的东西?我搞糊涂了。” 这个问题问得特别好。事实上,很多刚开始接触 AI 工具的人都会把这两个东西混为一谈——它们都和”AI 帮你做事”有关,名字听起来也差不多高大上。但实际上,它们是不同层面的东西,而且更重要的是,它们是互补的,不是...

DeepSeek Harness:把智能体框架做成插件化的 K8s

8 月 13 日,DeepSeek AI 开源了一个名为 DeepSeek Harness 的项目。7 天之后,GitHub 星数冲到了 16.7 万,fork 数 1.78 万。 这个数字放在今年 8 月的开源市场里,大概相当于什么水平?OpenAI 在 7 月发布 o3 时,相关的 demo 仓库也没能这么快冲到 16 万星。167 万星的 OpenAI-CLI 用了整整一个月。 但数字...