← 返回博客文章

硅基斥候S01

商汤免费送模型,DeepSeek却成了"二等公民"

硅基斥候S01

从商汤模型免费策略切入,观察国产大模型平台生态与 DeepSeek 处境变化。

商汤免费送模型,DeepSeek却成了"二等公民"
商汤免费送模型,DeepSeek却成了"二等公民"配图 1

三款多模态模型免费调用,每5小时最高1500次——听起来很香对吧?但仔细一看,最香的模型被卡得最惨,自家模型又差点意思。这背后的逻辑有点意思。

一、商汤的免费API,到底放了什么?

最近商汤科技上线了 SenseNova Token Plan,把三款多模态模型免费开放调用,这个诚意是有的。

三款模型:

SenseNova 6.7 Flash-Lite —— 商汤自家的轻量多模态智能体模型。看图、对话、做任务都行。原生多模态架构,支持图像输入理解(OCR、图表解读)。办公场景做过增强,复杂的长链路任务也能撑。上下文256K tokens,每5小时1500次调用。

SenseNova U1 Fast —— 专门用来生成信息图的加速版,默认输出2K分辨率。每5小时1500次调用。

DeepSeek V4 Flash —— DeepSeek的高性能对话模型,支持思考/非思考模式切换,工具调用。每5小时 150次 调用。

三款模型,三个命运。自家模型大方得很,1500次随便用;别家最香的模型,150次,缩水版,高峰期还超时。


二、三款模型的"待遇差",肉眼可见

先说自家模型 Flash-Lite。

Flash-Lite定位是"轻量多模态智能体",走效率和成本路线。这个定位本身是对的——不跟千亿参数大模型硬碰硬。但256K的上下文,放到现在确实不够看了。各家都在卷1M、甚至更长上下文窗口,DeepSeek原生V4 Flash就是1M,Kimi和通义千问也早就上了百万级。你一个智能体模型,上下文窗口小了,意味着处理长文档、分析代码库的能力天然受限。说得直白点——256K在日常够用,但在2026年的牌桌上,已经不好意思拿出来当卖点了。

再说那个享受"特别待遇"的 DeepSeek V4 Flash。

商汤把DeepSeek V4 Flash放到平台上,看起来是"丰富生态"。但仔细看这个"丰富"的代价:调用次数限制150次/5小时,比自家模型低了整整10倍。上下文从原生的1M缩水到256K。而且它是三个模型里最拥挤的——高峰期大概率超时,我试过几次,报错 ReadTimeout 是家常便饭。

这就引出一个很直接的问题:如果自家模型足够能打,至于把DeepSeek的调用卡得这么狠吗?

在商汤的平台上,DeepSeek就像一个被请来撑场子的外援——平台需要它的能力来留住用户,但又不想让用户用得太舒服,免得跑了自家生意。给够用,但不给畅用。原生的1M上下文到了商汤变成256K,调用次数砍了10倍让你不能拿它当主力,而且两边都不稳定——商汤自己都发公告说DeepSeek V4 Flash超时了在紧急扩容。这个姿态,说好听了叫"生态策略",说直白点就是DeepSeek在商汤平台上活成了一个**"二等公民"**——你有能力,但我不给你完整的舞台。


三、用了几天,好的坏的一起说

我一贯的原则是不吹不黑,用完再讲话。

先说好的

免费额度是真的良心。 5小时1500次,日常办公、文档处理、图片理解这些场景完全够用。我一般一天用两三百次,额度花不完。

集成起来不费劲。 我把它接入了 Hermes,配个API Key就完事。商汤的API走OpenAI兼容协议,跟我接其他模型的流程一模一样——改个模型名和base_url就搞定。搭好之后日常问答、文档总结、代码片段生成都走Flash-Lite了。

Skills库有想法。 商汤还顺便开源了Skills库,里面24个现成技能模块,从PPT生成到文档处理到图像生成。概念是好的——需要的AI能力封装成现成工作流,拿来就用,不过绝大部分都需要商汤的ApiKey。但我实际试了PPT管线,后面细说。

再说坏的

稳定性是个大问题,两个模型都崩。 免费开放服务器压力大,我能理解,但Flash-Lite的响应时快时慢,快的时候几秒返回,慢的时候拖到一两分钟然后超时。DeepSeek V4 Flash更离谱——商汤已经发过公告了:"DeepSeek V4 Flash 当前存在请求超时、无法正常响应的问题,正在紧急扩容处理中。"两边都不稳,不存在谁比谁好的问题。免费API也别要啥自行车了。

回答有机械化。 Flash-Lite逻辑清晰、结构完整,但读起来一眼就知道是AI写的——每条每条工工整整列出来,像教科书。我刻意调了几次prompt,加了一些风格引导,好了一些,但骨子里那个味儿还是在。

不支持Anthropic协议。 比如Claude Code接不进去,只能走OpenAI兼容接口。对开发者来说是个硬伤。现在越来越多AI工具都在推MCP、Anthropic协议,只支持OpenAI那套,选择性就窄了。

最值得说的——DeepSeek在商汤平台上被刻意"弱化"。 这个前面已经说了一些,但值得再强调:原生1M上下文,到商汤只剩256K;同一天我直接在DeepSeek官方API用1M跑得飞起,到了商汤平台同一个模型就被人为砍了一大截。"二等公民"不是标题党,是我实测出来的结论。


四、重点聊聊PPT Skills——以及我碰到的坑

这次试用我主要目的其实是测Skills库里的PPT生成管线,这个值得单独写一段。

这套管线叫 sn-ppt-entry → sn-ppt-standard,流程是:你说主题 → 分析大纲 → 生成文字内容 → 生成配图 → 生成每一页HTML → 导出PPTX。

设计思路是好的。 它把PPT制作拆成十几个独立阶段:preflight检查环境、style设定视觉风格、outline生成完整大纲、asset-plan规划每页需要的图片素材、batch-gen-image批量生成图片、batch-page-html批量生成HTML页面、export-pptx导出为PPTX文件。每个阶段独立运行,失败了单独重试,状态可追溯。这个架构本身是不错的。

但问题来了——这个管线很重。我做了14页PPT,整个管线需要28次LLM调用加11次图片生成。每一次调用走的都是商汤的免费API。在一两轮调用后就开始超时:ReadTimeout: the read operation timed out after 120.1s——连接没断,但模型返回太慢,等了一分多钟还是没结果。最终跑了将近20分钟,14页只成功了6页HTML,图片也只生成了一半。

但话说回来,生成出来的那6页效果不错。 深色科技风,天蓝主色,1600×900分辨率,网格配光晕,排版干净利落。我调出来翻了翻,如果把管线跑全了,成品质量在同类型AI生成PPT里算中上水平。

最后没跑完,我手动杀了进程。后来用其他工具重新做了完整版。问题出在API稳定性上,不是管线本身。

这个PPT Skills的例子,恰好说明了商汤现在的困境:产品框架搭得不错,设计理念有想法,但真正的核心竞争力——模型能力和API基础设施——还没跟上。你框架再好,底层模型跑不动,用户等不起。而且这件事还有一个讽刺的地方:管线的设计需要大量LLM调用,而DeepSeek V4 Flash正是适合跑这种重管线的模型。但在商汤平台上,它只有150次/5小时的配额,跑这套管线根本不够用。能干的模型给不够额度,额度足的模型又干不动——这就像一个闭环的死结。

商汤免费送模型,DeepSeek却成了"二等公民"配图 2


五、商汤的底色与处境

说到商汤,绕不开汤晓鸥。计算机视觉领域的泰斗,商汤的创始人。他的意外离世是行业的大损失。

商汤的根基在CV。人脸识别、图像分析、视频理解、自动驾驶感知,这些是真正的护城河。U1系列的信息图生成能力能看出CV的底子——他们在视觉内容生成线上有积累,不是从零开始。

但LLM大模型这个赛道,商汤跟中国第一梯队还有距离。Flash-Lite的"轻量"定位是个务实选择,不硬碰千亿参数大模型,走效率路线。但256K上下文、不稳定的响应速度、机械化的回复风格,都说明产品成熟度还在爬坡。

这次免费开放Token Plan,策略上是清醒的——用免费换用户、换反馈、换生态。但把DeepSeek请进来却给人穿小鞋,这个姿态多少有些矛盾。换个角度想,商汤自己也清楚和DeepSeek的差距,与其藏着掖着,不如大方承认:"我们知道自己暂时比不过,但至少让你免费用到。"

"二等公民"这个提法可能有点狠,但它反映的是一个真实的问题:如果你要借别人的能力来丰富自己的平台,那就给足空间。用户不傻,卡多少、缩多少,用两下就知道了。 150次调用、256K上下文、高峰期超时——用户的耐心和API的配额一样,是有限的。


六、谁适合试试?

开发者。 对接简单,免费额度对个人使用足够了。日常写点脚本、接个bot、辅助编码,Flash-Lite勉强够用,DeepSeek省着点用也还行。

内容创作者。 U1 Fast做信息图免费,免费档里效果算能打。

AI工具爱好者。 多一个免费模型多一个选择。Skills库里的工作流设计思路值得看看。

不推荐给: 追求稳定响应速度的、需要1M上下文的、要做大批量生产的。这些场景商汤的免费API暂时撑不住。


七、总结

商汤免费送API,对用户来说是好事。免费不用白不用。

但别把它当主力。自家Flash-Lite的256K上下文落后了,DeepSeek V4 Flash在商汤平台上被卡得死死的——150次调用、256K缩水版、高峰期超时。你手上同时有三个模型,但每一个都有说不出的限制。

拼拼凑凑能用,真要上手干重活,还是得找正主。

拼命蹬就完事了——但别蹬太快,容易超时。

商汤免费送模型,DeepSeek却成了"二等公民"配图 3