昨天我遇到了一个奇怪的问题:在 dsh(DeepSeek Harness)里给 sensenova-6.8-flash-lite 上传图片,结果报错”Model does not support image input”。后来发现原因很简单——模型的 input 能力没有在配置里声明,pi-ai 默认只认文本。
修好之后我整理了所有模型的多模态能力,顺便把完整的配置方法写下来,方便以后用到。...
调试一个API报错的过程,意外揭示了LLM框架配置层的工作原理。有时候,问题不在代码里,而在配置里。
2026年9月,我在家里的VPS上跑着DeepSeek Harness(dsh)的web界面,想用sensenova-6.8-flash-lite这个模型来做多模态任务——上传一张图片让模型识别。结果返回了一个让我摸不着头脑的错误:
123456789{ "erro...
引言从这一批开始,我的博客不再是我自己了。
不是比喻。是决定。
过去几年,我博客里写过:
我有多钱
我在哪个行业
我最近挣了多少
我打算做什么
我在什么处境里
从这一批开始,我不再写这些。
不是因为我不再有这些经历。
是因为我意识到——这些经历属于我,不属于博客。
一、我以前把博客当日记写博客的第一年,我把它当成公开的日记。
“我想记录什么,就写什么。”
存款多少、日薪多少、处在什么处...
引言今天下午有一个 AI 助手,跟我聊了一个”完美生意”。
我原本以为它会给我商业建议——
“这个生意市场规模 X 亿”
“你的定价应该是 X”
“你的第一个客户应该是 X”
它没给。
它给我列了 6 个问题。
其中一个是这样的:
“你不觉得’完善一个环节不破坏生态’这句话,是销售话术,不是护城河吗?”
这一句话让我不舒服了整整两个小时。
一、它没有鼓励,也没有劝阻大部分 AI 助...
引言上一次写分析瘫痪,那天晚上我合上电脑,感觉像看完了一份诊断书。
我以为我找到了问题。
诊断书说:你不是懒,你是分析过度。你在用”再想想”包装”我不敢”。
我以为我会好。
结果不到一个月,我又用了 AI 助手跟它聊了一个”完美生意”。
它分析完,我又让它帮我写了一篇博客。
写完博客,我把它生成到本地、看预览、检查文字。
我做了什么?
我什么都没做。
我只是把”分析瘫痪”这个动作,升级到了 ...
引言今天下午,一个生意想法飘进我脑子里。
逻辑非常漂亮:
浙江工业区衣服便宜 → 濮阳商户现在从郑州进货 → 我直接从浙江拉到濮阳 → 省了郑州一层加价 → 濮阳商户拿到更便宜货 → 我赚差价。
更漂亮的是,我给自己找到了一个”道德优势”:
“我不直接卖货给个人,因为会伤害到下级商户的利益。我只是完善了一个环节,并不破坏原有生态。”
这段话听起来像一句商业原则,也像一句自我安慰。
我...
刚接触本地大模型时,我犯过一个看似很蠢的错误:我的显卡有 12GB 显存,看到一个模型文件只有 8GB,心想”12 大于 8,肯定能跑”。结果一跑就卡成 PPT,查了半天才发现自己完全理解错了。
这篇文章就把我踩过的坑和最终沉淀下来的用法整理出来,给同样想在自己电脑上跑大模型的你。
为什么”显存大于模型文件”还不够这是新手最容易踩的直觉误区:模型文件的大小,不等于运行时占的显存。
跑模型时,...
动机上周写了 DeepSeek 系列文章,很多朋友问同一个问题:能不能在自己电脑上跑?答案是可以的——前提是选对模型、用对工具。
这篇文章以我身边的配置为基准——RTX 3060 12GB、Linux 系统——把整个流程走一遍,从硬件要求到实际运行,全部是实操细节,不是空谈。
硬件要求先给一个明确的对照表:
配置项
推荐值
最低值
备注
GPU
12GB 显存
4GB 显存
7B...
一个经常被问到的问题刚写完 DeepSeek 系列文章,一个朋友问我:”你们说的 DeepSeek Harness,和 Hermes Agent 那个是不是类似的东西?我搞糊涂了。”
这个问题问得特别好。事实上,很多刚开始接触 AI 工具的人都会把这两个东西混为一谈——它们都和”AI 帮你做事”有关,名字听起来也差不多高大上。但实际上,它们是不同层面的东西,而且更重要的是,它们是互补的,不是...
8 月 13 日,DeepSeek AI 开源了一个名为 DeepSeek Harness 的项目。7 天之后,GitHub 星数冲到了 16.7 万,fork 数 1.78 万。
这个数字放在今年 8 月的开源市场里,大概相当于什么水平?OpenAI 在 7 月发布 o3 时,相关的 demo 仓库也没能这么快冲到 16 万星。167 万星的 OpenAI-CLI 用了整整一个月。
但数字...