免费 AI 时代结束!豆包收费背后是 AI 产业成本逻辑的胜利?

一张烧到沸腾的算力账单

2026 年 6 月 3 日,字节跳动旗下 AI 应用豆包发布措辞谨慎的官方声明,计划推出专业版,面向有生产力需求的用户群体,覆盖软件开发、数据分析等服务,日常搜索问答等功能仍免费。此前媒体报道,豆包付费内容预计 6 月下旬上线,与火山引擎 Force 大会同步解锁。5 月 4 日,App Store 页面更新三档订阅价格,标准版连续包月 68 元,年费 688 元;加强版 200 元,年费 2048 元;专业版 500 元,年费 5088 元,最高一档年费超 5000 元,被网友与 ChatGPT Pro 的 200 美元月费比较。

社交媒体上,“收费就卸载”和“天下没有免费的午餐”两派争论激烈。但更值得关注的是,截至 2026 年 3 月,豆包大模型日均 Token 调用量突破 120 万亿,是 2024 年 5 月上线初期的 1000 倍。按每百万 Token 约 2 至 4 元输入成本粗算,字节每天有 2 亿到 5 亿元在 GPU 机房消耗,年度算力开支保守超 300 亿元。这不是字节想收钱,而是算力账单扛不住了。

要理解豆包此时收费,得看清大模型生意的成本结构。大模型和传统互联网产品本质不同,微信、抖音等每多一个用户,服务器分摊成本趋近于零,这是互联网免费模式的经济学根基。但大模型不同,用户每次提问等背后都是 GPU 实打实运算。成本拆解显示,豆包单次推理成本中硬件折旧占 58%,电力消耗占 29%,每次对话近九成成本是真实资源消耗,而非一次投入无限复用的基础设施。

用户越多,烧钱越快,豆包用户增长曲线几乎是成本指数曲线。2024 年 5 月上线时,日均 Token 消耗 4 万亿;2024 年 12 月,变为 4 万亿的 10 倍多;2025 年 3 月,日均调用量冲到 12.7 万亿;2026 年 3 月,三个月内翻一倍,达 120 万亿。据 QuestMobile 统计,同期豆包月活用户 3.45 亿,一季度人均月使用 54.8 次。当几亿用户每天用几十次免费 AI,以百亿 Token 为单位消耗算力时,免费不再是战略选择,而是失血。

字节为此付出沉重代价。浙商证券测算,2025 年字节跳动资本开支约 1500 亿元,其中 900 亿专项用于 AI 算力采购。2026 年,该数字上调至 1600 亿元,多家媒体称实际可能接近 2000 亿元。知情人士透露,2025 年字节全年净利润同比下滑超 70%,核心原因是下半年大幅追加 AI 芯片采购和底层模型研发,导致四季度账面利润急剧收窄。抖音副总裁李亮称这是国际会计准则下的账面波动,剔除期权成本等非经营因素后,公司实际营收和核心业务利润仍在增长。但即便如此,AI 业务零营收、高亏损格局是客观事实。第三方测算显示,豆包单月净亏损在 2.1 亿至 2.7 亿元区间。2025 年,国内面向 C 端的通用大模型应用整体亏损超 180 亿元,中金预测 2026 年将突破 200 亿元。

为什么是豆包?

在几乎所有国产大模型都喊免费的市场里,豆包第一个挂出价目表,承受诸多争议。横向对比,豆包压力不小。腾讯元宝相关负责人表示目前无收费计划,商业化重心在混元 API 与 MaaS 企业服务,用企业收入支撑个人用户免费。阿里千问延续免费策略,旗舰模型 Qwen3.7 - Max 全场景免费开放,千问基础模型团队未设 DAU 等商业化 KPI。Kimi 会员 49 元每月,智谱清言 49 元每月,百度文心一言会员 30 元每月,豆包最低 68 元每月的标准版,起步价高出同行。

为什么用户规模最大的豆包先扛不住?原因在于规模本身。其他竞品不是不想收费,而是用户体量未到不收就撑不住的临界点。元宝月活约 1.09 亿,千问约 2.03 亿,和豆包的 3.45 亿差一个数量级。当用户体量突破 3 亿、日均 Token 消耗突破百万亿时,每多拖一天免费,就多烧掉数亿元。

豆包有如今规模,是字节快速推进的结果。2023 年 8 月,豆包以 Grace 名字公测,2024 年 5 月正式上线,最初几个月不起眼,2024 年 2 月月活不过 173 万。但字节调集集团流量资源,抖音开放两个入口,剪映、火山引擎、抖音电商和本地生活等助力,豆包迅速渗透字节生态。字节内部称,要让豆包到用户身边,而非用户到豆包身边。

这一策略见效快。2024 年 11 月,豆包月活冲到 5998 万,仅次于 ChatGPT,位居全球第二。2025 年 12 月,DAU 正式突破 1 亿,字节内部人士称这是公司历史上推广费用最低的破亿 DAU 产品。2026 年 3 月,3.45 亿月活体量接近半个抖音。但抖音靠广告和电商赚钱,豆包不仅无营收,还以指数级速度吞噬算力资源。流量越大,账单越厚,豆包成了国内 AI 行业规模与亏损同步放大的典型样本。

不止是回血

如果豆包收费只是为补字节财务缺口,那就小看这件事了。三档定价有其设计逻辑。标准版 68 元每月,覆盖长文档总结等,面向轻度办公人群;加强版 200 元每月,解锁深度数据分析等,对准自媒体和资深职场用户;专业版 500 元每月,提供专属算力等,面向企业和重度使用者。基础免费版保留日常聊天等功能,承诺永久免费、不阉割、不限次数、不降速。

这套定价体系核心是让消耗最多算力的人承担成本。简单文字问答 Token 消耗少,但 PPT 生成、高清视频产出等算力消耗是日常对话数百倍。豆包收费瞄准高算力、高价值的复杂生产力场景,谁用得多,谁付得多。这不是传统互联网的流量变现,而是算力账单的精准再分配。

更进一步,豆包商业化不指望靠订阅会员撑起全部利润。据 36 氪报道,若进展顺利,豆包三季度结合电商功能完善付费场景,通过补贴为抖音商城引流,四季度进入运行期,为 2027 年及更长期商业化回报做准备。2026 年豆包不把付费用户渗透率作为核心考核指标。字节清楚,3.45 亿用户哪怕 1%付费转化率,按最低 68 元每月测算,也能带来约 23 亿元年度订阅收入。但更重要的增量在电商导流、B 端 API 调用、火山引擎的企业级服务。有分析师测算,豆包年化订阅收入中性情景下约在 4 亿至 7 亿美元区间。对比字节全年 AI 投入的千亿级规模,这只是小部分,但说明 C 端 AI 用户愿意为价值付费,只要价值足够清晰。

结语

人民日报曾评论“免费”:所谓“免费”,并非无成本,只是成本暂时悬置,等待落地时刻。当算力账单膨胀到结构性亏损地步,免费成了行业隐患。豆包第一个收费,本质不是字节收割用户,而是 AI 产业成本逻辑压过补贴逻辑。互联网时代烧钱换规模、规模换广告的公式,在大模型这里失效,每多一个用户就多一份刚性算力支出,规模越大,亏损越深。

竞争格局也在变化。阿里千问和腾讯元宝按兵不动,有免费抢用户考量,但迟早要面对算力账单。中金预测 2026 年行业亏损将突破 200 亿元,没人能永远替用户垫钱。豆包第一个收费,挨了骂,也可能最先摸索出可持续商业化路径。

中国 AI 正离开单纯靠补贴抢用户阶段。接下来,每份服务将标上价格,每个价格需用真实价值兑现。豆包 68 元到 500 元的价目表,既是字节必须迈出的一步,也是国产 AI 行业的转折点。免费 AI 时代结束了,但好的 AI 时代,可能刚刚开始。

已经博主授权,源码转载自 https://pan.quark.cn/s/a4b39357ea24 在信息技术领域,特别是软件编程行业,微软公司推出的集成开发环境(IDE)Visual Studio,凭借其卓越的功能和广泛的适用范围,成为了众多程序员的常用工具。不过,在实际操作期间,用户可能会遭遇各种挑战,其中一种较为普遍的挑战是“Visual Studio遭遇了异常情况,这或许与某个附加组件有关”。本文将详细研究这一现象的成因、潜在后果以及最终的应对措施。 ### 原因剖析 Visual Studio通过支持多种插件和附加组件来扩展其功能,这些组件通常由第三方开发者设计,旨在为用户提供更多个性化和专业化的工具。然而,这些插件的质量良莠不齐,部分可能未经过充分的测试或与特定版本的Visual Studio存在兼容性难题,从而在执行时引发异常。异常的出现可能源于以下几个因素: 1. **代码缺陷**:若附加组件中的代码存在逻辑问题或资源管理不当,就可能导致运行时异常。 2. **资源竞争**:多个插件同时占用相同的资源(例如内存、文件句柄等),可能会产生资源冲突,进而触发异常。 3. **依赖不匹配**:插件可能需要特定版本的库或框架,如果系统中安装的版本不一致,也可能导致异常。 4. **安全隐患**:部分插件可能存在安全漏洞,一旦被恶意利用,可能会导致更严重的问题,包括但不限于异常崩溃。 ### 后果分析 当Visual Studio遇到由附加组件引发的异常时,不仅会中断当前的工作进程,降低开发效能,还可能带来以下潜在风险: 1. **数据遗失**:若异常发生在保存操作之前,可能会导致未保存的工作内容遗失。 2. **稳定性减弱**:频繁的异常会导致Visual Stud...
内容概要:本文围绕有源中点箝位(ANPC)三电平并网逆变器,提出并深入研究了一种融合双极性倍频脉宽调制(DPWMA)、正负序分离锁相控制与电网电压前馈控制的高性能一体化并网策略。研究首先系统分析了ANPC三电平逆变器在开关损耗均衡、中点电位稳定、输出谐波含量低等方面的拓扑结构优势,为实现高质量并网奠定了坚实的硬件基础。在此基础上,通过引入DPWMA调制策略,有效提升了等效开关频率,显著优化了输出电压电流的波形质量,降低了谐波畸变。为应对电网电压不平衡、畸变等复杂工况,研究采用了正负序分离锁相技术,实现了对电网正序和负序分量的精确分离与独立控制,从而保障了在非理想电网条件下的精准相位同步。同时,通过叠加电网电压前馈控制,构建了前馈-反馈复合控制体系,提前补偿电网扰动,极大地增强了系统的动态响应速度和抗干扰能力。最终,通过Simulink仿真平台对稳态、电网不平衡及动态扰动等多种工况进行了全面验证,结果表明该复合控制策略能显著提升并网系统的电能质量、稳定性和工况适应性,为新能源发电等大功率并网应用提供了先进的技术解决方案。; 适合人群:具备电力电子、自动控制理论或新能源并网技术等相关专业知识背景,从事相关领域科研或工程开发工作的研究人员,尤其适合高校研究生、青年教师及电力系统仿真与设计工程师。; 使用场景及目标:①应用于对电能质量要求严苛的大功率并网逆变器控制系统设计与优化;②解决电网电压不平衡、谐波畸变等复杂非理想工况下的并网稳定性与同步精度问题;③为ANPC三电平逆变器的先进控制策略开发与性能提升提供详尽的仿真验证方案和技术参考;④支持高水平科研论文的复现、学位论文的课题研究以及重大工程项目前期的技术预研与论证。; 阅读建议:建议读者结合文中详述的系统拓扑、控制架构图及仿真模型,循序渐进地理解各控制模块的设计原理与协同工作机制,重点关注DPWMA调制的实现细节、正负序分离的数学原理与实现方法,以及前馈控制的嵌入方式与参数整定策略,并通过仿真实验与传统控制策略进行对比分析,以深刻掌握该复合控制策略的性能优势与工程应用价值。
内容概要:本文围绕“爆破载荷参数”主题,基于UFC 3-340-02与TM 5-855-02标准,系统研究爆炸冲击波在空气中的传播规律及其压力效应的理论建模与数值仿真方法,并通过Matlab代码实现关键参数的计算与分析。研究聚焦于峰值超压、正压持续时间、冲量等核心爆炸参数的工程估算模型,结合经验公式与简化物理假设,构建适用于防护结构设计与毁伤评估的爆炸载荷输入模型。重点在于将复杂的爆炸物理过程转化为可编程的数学表达式,利用Matlab平台完成数据可视化、参数敏感性分析及多工况仿真对比,从而为军事防护工程、建筑抗爆设计等领域提供科学依据和技术支持。; 适合人群:具备一定Matlab编程能力与力学基础知识,从事安全工程、防护结构设计、爆炸力学、武器效应分析及相关领域的科研人员、工程师与高校研究生。; 使用场景及目标:①掌握UFC/TM标准中爆炸压力参数的工程计算原理与应用方法;②学习如何将爆炸力学理论模型转化为可执行的Matlab代码;③应用于爆炸载荷下结构动力响应仿真、毁伤效能评估、安全距离判定等科研与工程实践任务; 阅读建议:建议读者结合UFC 3-340-02原始文献进行对照学习,重点关注代码中物理公式的单位一致性与参数量纲处理,动手调试并扩展代码以深入理解爆炸波传播特性,并尝试将其应用于多因素耦合(如地形、障碍物)的实际场景仿真中。
已经博主授权,源码转载自 https://pan.quark.cn/s/a4b39357ea24 在iOS应用开发过程中,构建语音通信功能是一项普遍的应用需求,特别是在社交平台和即时消息软件中。本指南将阐释如何借助Speex音频压缩格式来设计一个基础的语音通信程序。Speex是一种专为语音设计的开源音频压缩方案,特别适用于低带宽的网络环境。 一、Speex音频压缩技术概述 Speex是一种无成本的、开放源代码的音频编解码方案,由Jean-Marc Valin首创,目前归属于Xiph.Org基金会旗下。其核心优势在于能够提供卓越的语音清晰度同时降低带宽的消耗,非常适合网络电话和实时交流场景。Speex支持多种压缩等级,使得开发者能够在音质与带宽使用之间进行灵活的调配。 二、在iOS平台中整合Speex 1. 获取资源:必须将Speex库纳入你的项目架构中。这可以通过CocoaPods实现,在Podfile文件中添加`pod speex`声明,随后执行`pod install`指令。 2. 导入头文件:在需要运用Speex的源代码部分,需要引入相关的头文件,例如`#import <speex/speex.h>`。 3. 启动和设置:初始化Speex的编码器和解码器实例,设定恰当的采样频率、比特率等配置参数。例如: ```objc SpeexBits bits; SpeexEncoder *encoder = speex_encoder_init(speex_lib_get_mode(SPEEX_MODEID_NB)); //窄带模式 SpeexDecoder *decoder = speex_decoder_init(speex_lib_get_mode(SPEEX_MODE...
打开链接下载源码: https://pan.quark.cn/s/a4b39357ea24 STM32F407是一种采用ARM Cortex-M4内核的微控制器,在嵌入式系统开发领域具有广泛的应用。本文将详细研究如何运用STM32F407芯片达成SD卡模拟U盘的功能,并且结合FATFS文件系统以及HAL库进行深入分析。 我们必须熟悉FATFS文件系统。FATFS是由ChaN软件公司开发的一种轻量级文件系统解决方案,能够支持多种文件系统类型,例如FAT12、FAT16以及FAT32。该文件系统被设计成可以移植到多种嵌入式系统中,包括STM32系列的微控制器。FATFS使得在嵌入式设备上执行文件读写操作变得简便,用户能够执行文件建立、删除、读取和写入等多种操作。 HAL库(Hardware Abstraction Layer)是由STMicroelectronics推出的一种驱动层软件,用于STM32系列微控制器,它提供了一套标准化的API接口,简化了开发者与硬件之间的交互,降低了代码的复杂程度,提升了开发工作的效率。在我们的项目中,HAL库将用于SD卡的初始化以及数据传输等底层工作。 实现STM32F407 SD卡模拟U盘的重要步骤如下: 1. **硬件连接**:STM32F407一般通过SPI或SDIO接口与SD卡进行数据交换。确保SD卡的CS、MISO、MOSI和SCK引脚与STM32的对应引脚正确连接。 2. **HAL库配置**:在HAL库中,使用`HAL_SD_Init()`函数对SD卡进行初始化。依据硬件的配置设定SPI或SDIO的时钟、模式及其他相关参数。 3. **FATFS配置**:在工程中集成FATFS的源代码,设定相关的宏定义,如`FF_FS_R...
下载代码方式:https://pan.quark.cn/s/a4b39357ea24 微信小程序是一种轻量级的应用开发环境,主要目的在于微信内部提供方便快捷的服务以及提升用户的使用体验。在“微信小程序电影列表”这一项目中,开发者通过实时获取豆瓣电影API的信息,建立了一个展示电影清单的功能,并且融合了微信地图的定位服务,让用户能够便捷地查找周边的电影院。 我们将深入探讨微信小程序的开发流程。微信小程序主要运用JavaScript、WXML(WeChat Markup Language)以及WXSS(WeChat Style Sheets)这三种核心技术。JavaScript承担着逻辑处理的角色,WXML负责定义界面结构,而WXSS则类似于CSS,用于进行界面样式的设定。开发者需要在微信开发者工具中编写代码,随后在实体设备或模拟器上进行调试和测试。 豆瓣电影API是开发者获取电影资讯的重要渠道。这个API一般包含了电影的基本资料,例如电影名称、评分、剧情简介、演员构成以及上映时间等。通过向指定的API端点发送HTTP请求,开发者可以获得JSON格式的应答信息,再对这些信息进行解析并将其呈现在小程序的界面中。值得注意的是,在运用第三方API时,可能需要遵守相关的授权条款和规范,以确保数据的合规使用。 在这个小程序中,实时获取数据指的是当用户开启或刷新页面时,会即时从服务器获取最新的电影清单。这需要借助小程序的网络请求模块,比如wx.request()函数,它可以非同步地向服务器发起请求,并在接收到应答后执行数据处理。 微信地图定位功能的实现需要调用微信小程序的地理位置接口。通过wx.getLocation()方法,能够获取到用户的当前经纬度,将这些坐标传递给腾讯地...
内容概要:本文围绕基于模型预测控制(MPC)的波浪能转换器(WEC)展开系统性研究,旨在通过先进的控制策略提升波浪能捕获效率。研究首先建立了波浪能转换系统的精确数学模型,并据此构建适用于MPC的状态空间表达式;随后设计了具有实时优化能力的预测控制器,使其能够在复杂多变的海洋环境中有效响应波浪激励力,实现最大功率点跟踪与能量吸收最优化。借助Matlab平台完成完整的仿真验证,充分展示了MPC在动态响应速度、控制精度及能量转化效率方面的显著优势,同时深入分析了关键控制参数对系统性能的影响机制。该研究成果为海洋可再生能源的高效开发利用提供了坚实的理论依据与可行的技术路径。; 适合人群:具备自动控制理论基础、熟悉Matlab/Simulink仿真环境,从事新能源控制、海洋能开发或相关领域研究的研发人员及研究生。; 使用场景及目标:①掌握模型预测控制在非传统能源系统中的应用方法;②学习如何将物理系统建模与先进控制策略相结合以提高能量利用率;③为波浪能装置的实际控制系统设计提供仿真验证基础与技术参考; 阅读建议:此资源侧重于控制算法的设计与仿真实现,建议读者结合Matlab代码深入理解MPC的实现细节,重点关注系统建模、代价函数构造与约束处理等核心环节,并可通过调整海况参数进行多场景仿真对比,以深化对控制策略鲁棒性的认识。
下载代码方式:https://pan.quark.cn/s/a4b39357ea24 "OpenCV 骨架提取算法(基于查表索引)" OpenCV 骨架提取算法是一种基于查表索引的图像处理技术,用于从图像中提取骨架。该算法主要应用于图像细化、骨架提取以及图像处理等相关领域。骨架提取算法的基本原理是将图像转换为二值形态,随后借助查表索引技术来提取骨架。该算法的实现过程主要涉及Mat类型和iplimage类型的操作。 Mat类型实现: Mat类型是OpenCV库中的一种矩阵结构,用于储存图像数据。基于Mat类型的骨架提取算法主要包括以下几个环节: 1. 图像载入:载入原始图像,并将其转化为灰度图像。 2. 图像二值化:将灰度图像转化为二值图像。 3. 查表索引技术:运用查表索引技术来提取骨架。 4. 细化处理:对提取的骨架进行细化。 iplimage类型实现: iplimage类型是OpenCV库中的一种图像结构,用于储存图像数据。基于iplimage类型的骨架提取算法主要包括以下几个环节: 1. 图像载入:载入原始图像,并将其转化为灰度图像。 2. 图像二值化:将灰度图像转化为二值图像。 3. 查表索引技术:运用查表索引技术来提取骨架。 4. 细化处理:对提取的骨架进行细化。 查表索引技术是骨架提取算法的核心,该方法利用一个查表来储存骨架的详细信息,并借助该查表来提取骨架。此方法的优点在于速度快、效率高,但缺点是需要占用较大的存储空间。 骨架提取算法在图像处理领域具有广泛的应用,包括图像细化、骨架提取、图像分割等方面。该算法同样适用于机器视觉、图像识别、计算机视觉等领域能力。 在实际应用过程中,骨架提取算法需要根据具体的应用环境进行适配和优化。例如,在图像细化过...
内容概要:本文档是AUTOSAR经典平台中CRC库模块的规范说明,定义了用于汽车电子系统的多种CRC(循环冗余校验)算法的实现标准。文档详细描述了8位、16位、32位和64位CRC计算函数的功能、参数配置与API接口,包括基于不同生成多项式的具体实现,如SAE J1850、CCITT-FALSE、CRC-16/ARC、Ethernet CRC32以及E2E专用的CRC32P4和CRC64等。所有函数均支持同步调用、可重入性,并允许分步计算大块数据。同时提供了版本信息查询接口Crc_GetVersionInfo,并明确了各函数的输入输出参数、返回值及使用方式。此外,文档还列出了配置参数容器及其取值范围,支持表驱动、运行时计算等方式优化性能。值得注意的是,在R23-11版本中已移除硬件加速CRC计算的支持。; 适合人群:从事汽车电子软件开发的工程师,特别是参与AUTOSAR架构下嵌入式系统开发、需要实现或集成CRC校验功能的研发人员,具备一定的C语言编程能力和对通信协议有一定了解者更为合适。; 使用场景及目标:①为AUTOSAR环境中实现可靠的数据完整性校验提供标准化的CRC算法支持;②指导开发者正确配置和调用CRC库函数,确保跨平台兼容性和功能一致性;③适用于车载网络通信、ECU间数据传输、安全相关的端到端保护(如E2E Profile 4/7)等高可靠性应用场景。; 阅读建议:此文档属于技术规范类文件,应结合AUTOSAR基础软件通用规范(BSW General)及相关配置工具使用,重点关注各CRC函数的参数定义、反射规则、初始值与异或值设置,建议配合实际代码示例进行测试验证,特别注意“magic check”机制在完整性验证中的应用。
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值