格局打开,Meta 发布免费商业应用的开源 AI 模型 Llama 2,网友:微软又赢麻了!...

GBDT算法详解 本文详细介绍了GBDT算法的原理和特点,并展示了其在回归和分类任务中的应用。首先介绍了GBDT算法的基本思想和公式,然后展示了如何在回归数据集使用GBDT进行回归任务,以及如何在分类数据集上使用GBDT进行文本分类任务。 阅读详情

5ed35903ff937b3bb90b335e4e46a8bf.gif

整理 | 屠敏

出品 | CSDN(ID:CSDNnews)

  • 昔日的竞争对手,今日的合作盟友;

  • 忽如一夜春风来,开源大模型迎来新局面;

  • 今天是 OSS AI 胜利的一天;

随着 Meta 最新发布一个新的开源 AI 模型——Llama 2,网上盛赞的声音不绝于耳,甚至图灵奖得主、卷积网络之父、Meta 首席人工智能科学家 Yann LeCun 更是直言,「这将改变 LLM 市场的格局」。

3a9a943a92478cec146e8983aff39d34.png

而 Llama 2 之所以能引起这么大的反响,不仅是因为它是开源的,更主要的原因便是它可以被免费地用于研究和商业用途。与此同时,Meta 还与微软强强联手,旨在驱动 OpenAI 的 ChatGPT、Bing Chat 和其他现代聊天机器人等应用程序。

在 Meta 看来,「开放的方法是当今人工智能模型开发的正确方法,特别是在技术快速发展的生成领域。通过公开提供人工智能模型,它们可以使每个人受益。为企业、初创企业、企业家和研究人员提供其开发的工具,这些工具的开发规模是他们自己难以构建的,并以他们可能无法获得的计算能力为后盾,将为他们以令人兴奋的方式进行实验。」

仅是这一点,便是当前很多专注于大模型开发的企业无法做到的,也如网友评价的那番,格局一下被打开。

db8bc3c5f23ac3ef1d361d1608e591a1.png

Llama 2 的前身

今日发布的 Llama 2 是 Llama(大羊驼)的后续版本。

今年 2 月,Meta 首次公开发布 LLaMA,作为具有非商业许可证的开源版本。这是一种先进的基础大型语言模型,旨在帮助研究人员推进 AI 这一子领域的工作。更小、性能更高的模型(例如 LLaMA)使研究界中无法访问大量基础设施的其他人能够研究这些模型,从而进一步实现这一重要且快速变化的领域的访问民主化。

彼时,Meta 提供多种尺寸的 LLaMA(7B、13B、33B 和 65B 参数)。仅从功能上来看,Llama 可以根据提示生成文本和代码,与其他类似聊天机器人的系统相当。

然而,当时由于担心被滥用,Meta 决定限制对模型的访问,所以也只是对具有一定资格的研究者开放,还需要写申请表格等。

不过,令人没想到的是,不久之后便有人将 LLaMA 的权重(包括经过训练的神经网络的参数值文件)泄露到了 torrent 网站,使得并没有完全开放的 LLaMA 大模型短时间内在 AI 社区大规模扩散开。

很快,经过微调的 LLaMA 的诸多模型如雨后春笋般涌现,“羊驼”家族一时太过拥挤,如斯坦福发布了 Alpaca(羊驼)、UC 伯克利开源了 Vicuna(小羊驼)、华盛顿大学提出了 QLoRA 还开源了 Guanaco(原驼)...国内哈工大还基于中文医学知识的 LLaMA 模型指令微调出了一个“华驼”。

时下,Llama 2 的发布将这款开源大模型推向一个新的高度。相比上一代 Llama 模型,经过混合公开数据的训练,Llama 2 的性能有了显著提高。

e4c7004ed4e33d36bf6ea9f174c45aee.png

Llama 2:从 7B 到 70B 参数不等

为此,Meta 发布了一篇长达 76 页的论文《Llama 2: Open Foundation and Fine-Tuned Chat Models》详述 Llama 2 大模型的预训练、微调、安全性等相关的工作。

320f16f6aed4dc882b092d35a904ebf3.png

  • 论文地址:https://scontent-lax3-2.xx.fbcdn.net/v/t39.2365-6/10000000_663429262362723_1696968207443577320_n.pdf?_nc_cat=101&ccb=1-7&_nc_sid=3c67a6&_nc_ohc=5ol-jUSglG4AX_EKgWk&_nc_ht=scontent-lax3-2.xx&oh=00_AfC4pQWErthyr1jwgSScKeyjXW3wwEUnqvIh7MNeb-Et3g&oe=64BBB691

据论文显示,Llama 2 有两种版本:Llama 2 Llama 2-Chat,后者针对双向对话进行了微调。Llama 2 和 Llama 2-Chat 进一步细分为不同复杂程度的版本:70 亿个参数、130 亿个参数和 700 亿个参数。

5bb0b9e7877b6bf99e3ca29654a59504.png

Meta 将 Llama 2 预训练语料库的规模增加了 40%,这一款模型(基本模型)接受了 2 万亿个 token 的训练,上下文窗口包含了 4096 个 token,相比上一代,提升了一倍。上下文窗口决定了模型一次可以处理的内容的长度。在硬件方面,Meta 都使用了 NVIDIA A100。

Meta 还表示,Llama 2 微调模型是为类似于 ChatGPT 的聊天应用程序开发的,已经接受了“超过 100 万条人工注释”的训练。

b62c82592483be55ebb14844d05a4fae.png

不过,Meta 在论文中并没有透露训练数据的具体来源,只是说它来自网络,其中不包括来自 Meta 的产品或服务的数据。

根据官方基准测试,Llama 2 在开源模型领域,一马当先。其中,Llama 2 70B 模型的性能优于所有开放源码模型。

eda008f382bbf572e37e88e708584ef2.png

和闭源的大模型相比,Llama 2 70B 在推理任务上接近 GPT-3.5,但在编码基准上存在显著差距。同时,其在性能上还无法与 OpenAI 的 GPT-4、PaLM-2-L 相媲美,在计算机编程方面 Llama 2 明显落后于 GPT-4。

bcea79f21f64cb4d6cf31c4095a31277.png

论及 Llama 2 此次真正的优势,Nvidia 高级 AI 科学家 Jim Fan 高度评价道:

  • Llama-2 的训练费用可能超过 2000 万美元。Meta 通过发布具有商业友好许可的模型,为社区提供了令人难以置信的服务。由于许可证问题,大公司的人工智能研究人员对 Llama-1 持谨慎态度,但现在我认为他们中的很多人都会加入进来,贡献自己的力量。

  • Meta 的团队对 4K 提示进行了人类研究,以评估 Llama-2 是否有用。他们使用 "胜率 "作为比较模型的指标,其精神与 Vicuna 基准类似。70B 模型与 GPT-3.5-0301 大致持平,表现明显强于 Falcon、MPT 和 Vicuna。

    与学术基准相比,我更相信这些真实的人类评级。

  • Llama-2 还没有达到 GPT-3.5 的水平,主要是因为它的编码能力较弱。在 "HumanEval"(标准编码基准)上,它还不如 StarCoder 或其他许多专门为编码而设计的模型。尽管如此,我毫不怀疑 Llama-2 将因其开放的权重而得到显著改善。

  • Meta 团队在人工智能安全问题上不遗余力。事实上,这篇论文几乎有一半的篇幅都在谈论安全、红线和评估。我们要为这种负责任的努力鼓掌!

    在之前的研究中,帮助性和安全性之间存在着棘手的权衡问题。Meta 通过训练两个独立的 reward 模型来缓解这一问题。这些模型还没有开源,但对社区来说非常有价值。

  • 我认为 Llama-2 将极大地推动多模态人工智能和机器人研究。这些领域需要的不仅仅是黑盒子访问 API。

    到目前为止,我们必须将复杂的感官信息(视频、音频、三维感知)转换为文本描述,然后再输入到 LLM,这样做既笨拙又会导致大量信息丢失。将感官模块直接嫁接到强大的 LLM 上会更有效。

  • Llama 2 的论文本身就是一部杰作。GPT-4 的技术详解论文只分享了很少的信息,而 Llama-2 则不同,它详细介绍了整个细节,包括模型细节、训练阶段、硬件、数据管道和注释过程。例如,论文对 RLHF 的影响进行了系统分析,并提供了漂亮的可视化效果。

  • 引用第 5.1 节:"我们认为,LLMs 在某些任务中超越人类注释者的超强写作能力,从根本上说是由 RLHF 驱动的"。

269ade7fb46e7d393cf485f58c521ee9.png

来源:https://twitter.com/DrJimFan/status/1681372700881854465

不过,值得注意的是,Llama 2 虽然允许了商业使用,但是它在社区许可协议中还添加了一条附加商业条款:

如果在 Llama 2 版本发布之日,被许可方或被许可方的关联公司提供的产品或服务的每月活跃用户数在上一个日历月中超过 7 亿,则您必须向Meta申请许可,Meta 可以自行决定向您授予该权利,并且您无权行使本协议项下的任何权利,除非或直到 Meta 明确授予您此类权利。

c0f65a9b3ea8872e27de17baaeafcd5b.png

这意味着一些大厂,譬如亚马逊、Google 这样的巨头想要使用 Llama 2,还存在一定限制。

ff930e1cc1290c7dd30c82881764af13.png

433507e05a1176beaa8f5a66b62aa383.png

Meta 与微软强强联手

当然,Meta 也并没有将所有大厂拒绝门外。在此次官方公告中,Meta 宣布了和微软的深度合作。

其中,作为 Llama 2 的首选合作伙伴微软,Meta 表示,从今天开始,Llama 2 可在 Azure AI 模型目录中使用,基于此,使用 Microsoft Azure 的开发人员能够使用 Llama 2 进行构建,并利用其云原生工具进行内容过滤和安全功能。

83ba0ccedcb934844034a873823a58d4.png

与此同时,Llama 2 还经过优化,可以在 Windows 上本地运行,为开发人员提供无缝的工作流程,为跨不同平台的客户带来生成式 AI 体验。Llama 2 也可通过 Amazon Web Services (AWS)、Hugging Face 和其他提供商获取。

有网友评论,微软这一波又赢了!

8e03e00a19beeccb82a774b2ba7bb769.png

除了与微软合作之外,Meta 也与高通进行了合作。高通宣布,“计划从 2024 年起,在旗舰智能手机和 PC 上支持基于 Llama 2 的 AI 部署,赋能开发者使用骁龙平台的 AI 能力,推出激动人心的全新生成式 AI 应用。”

037ec24b13e392f95548031f8c8da536.png

没有 100% 完美的大模型

不过,对于 Llama 2,Meta 公司也承认它并非绝对的完美,因为其测试不可能捕获所有现实世界场景,并且其基准测试可能缺乏多样性,换句话说,没有充分涵盖编码和人类推理等领域。

Meta 还承认,Llama 2 与所有生成式 AI 模型一样,在某些层面存在偏差。例如,由于训练数据的不平衡以及训练数据中存在“有毒”文本,它可能会制造“幻觉”、生成“有毒性”的内容。

针对这一点,Meta 选择和微软合作的一部分,也包括使用 Azure AI Content Safety,该服务旨在检测 AI 生成的图像和文本中的“不当”内容,以减少 Azure 上有毒的 Llama 2 输出。

同时,Meta 在论文中强调 Llama 2 用户除了遵守有关“安全开发和使用”的准则外,还必须遵守 Meta 的许可条款和可接受的使用政策,在一定程度上减少有偏差性的内容。

a22a7bff708d203723beca8fa38a01af.png

开源大模型的未来

最后,如果说 OpenAI 引领大模型赛道,那么 Meta 则开辟了开源大模型的新大门。

以开源的方式,汇聚更多的创新,Llama 2 的开源也为众人预测中的“未来,开源大模型会主导整个大模型的发展方向”带来更多可能性。

这也正如 Ars Technica 总结的:开源人工智能模型的到来,不仅鼓励透明度(用于制作模型的训练数据而言),而且促进经济竞争(不将技术限制于大公司)、鼓励言论自由(没有审查制度),并使人工智能的访问民主化(没有付费专区限制)。

同时,为了避免 Llama 2 开源存在的潜在争议,Meta 还同时发布了一封主题为《支持 Meta 对当今人工智能的开放方法的声明》的声明,其写道:

“我们支持对人工智能采取开放式创新方法。负责任和开放式创新为我们所有人提供了参与人工智能开发过程,为这些技术带来可见性、审查和信任。今天开放的 Llama 模型将使每个人都从这项技术中受益。”

截至目前,已有近百位 AI 专家参与签名,其中包括 Drew Houston(Dropbox 首席执行官)、Matt Bornstein(Andreessen Horowitz 合伙人)、Julien Chaumond(Hugging Face 首席技术官)、Lex Fridman(麻省理工学院研究科学家)和 Paul Graham(Y Combinator 的创始合伙人)等。

当然,也不容忽视的是,无论是开源还是闭源大模型,其都面临着复杂的法律问题,因为他们需要判别用于训练的数据池中是否存在受版权保护的资源。如何有效避免这些问题,也成为这些大模型开发公司下一阶段需要解决的事情。

目前,任何人都可以通过在 Meta 网站上填写表格(https://ai.meta.com/resources/models-and-libraries/llama-downloads/)来请求下载 Llama 2 ,想要尝鲜的小伙伴不妨一试!

更多资料详见:

  • 论文地址:https://scontent-lax3-2.xx.fbcdn.net/v/t39.2365-6/10000000_663429262362723_1696968207443577320_n.pdf?_nc_cat=101&ccb=1-7&_nc_sid=3c67a6&_nc_ohc=5ol-jUSglG4AX_EKgWk&_nc_ht=scontent-lax3-2.xx&oh=00_AfC4pQWErthyr1jwgSScKeyjXW3wwEUnqvIh7MNeb-Et3g&oe=64BBB691

  • Llama 2:https://ai.meta.com/llama/

  • Llama 2申请地址:https://ai.meta.com/resources/models-and-libraries/llama-downloads/

  • Meta 官方公告:https://about.fb.com/news/2023/07/llama-2/

  • 公开信:https://about.fb.com/news/2023/07/llama-2-statement-of-support/

推荐阅读:

微软赢疯了,Office AI工具定价破天花板,每人每月30美元!

身价翻 300 倍!4GB 的初代 iPhone 拍出 136 万天价!

女下属拒绝性骚扰后遭到死亡威胁?字节跳动回应 :已劝退

AI黑话日日新】Day 010|System Prompt(系统提示词) 系统提示词不是给模型加能力的咒语,而是开发者写下的“行为宪法”——它定身份、划红线、约格式,但终究要配护栏才站得住。 阅读详情

相关推荐

Python 爬虫实战:爬取 GitHub 热门项目(星数 / 语言 / 作者)

本文系统介绍了使用Python爬虫技术获取GitHub热门项目数据的完整方案。通过分析GitHub Trending页面和官方API两种数据源,详细讲解了HTML解析、JSON数据处理、反爬应对策略等关键技术。采用requests、BeautifulSoup、pandas等工具链,实现了项目信息(名称、星数、语言等)的结构化爬取,并配套数据清洗、统计分析及可视化功能。特别强调遵守GitHub API使用规范,包括Token认证、请求频率控制等合规要求。该方案为开发者提供了一种高效、合法的数据采集方法,适用于

2503_91057718的博客 2302

微软了!联合 Meta 发布免费商业应用开源 AI 模型 Llama 2

整理 |屠敏出品 | CSDN(ID:CSDNnews)昔日的竞争对手,今日的合作盟友;忽如一夜春风来,开源模型迎来新局面;今天是 OSS AI 胜利的一天;随着 Meta 最新发布一个新的开源 AI 模型——Llama 2,网上盛赞的声音不绝于耳,甚至图灵奖得主、卷积网络之父、Meta 首席人工智能科学家 Yann LeCun 更是直言,「这将改变 LLM 市场的格局」。而Llama 2 ...

AI科技大本营 836

SunPositionCalc:计算给定时间和位置的太阳在地球上的位置

position_predictor 太阳的位置预测器

51c大模型~合集111

OpenAI 的某发言人表示:「为了提高清晰度和安全性,我们增加了一个额外的后处理步骤,其中模型会审查原始的思维链,删除任何不安全的内容,然后简化某些复杂的思维。可以看到,虽然 ChatGPT 确实完成了任务并展示了总结版的思维链,但似乎并未如 OpenAI 发言人说的那样给出与提示词语言同样语言的总结版。北大-灵初联合实验室表示,Align-DS-V的多模态强推理能力是VLA模型大脑端的核心,接下来的研究训练计划,是利用多模态推理模型的跨模态穿透能力,实现action穿透,最终实现真正高效的VLA模型

whaosoft~aiotの开发板商城 2185

WAIC论坛现场|网易智企分享企业AI“上岗之路“

在世界人工智能大会(WAIC)2026上,网易智企举办了"用可信AI构建企业新智生产力"专题论坛。会上,网易智企副总经理段毓铮带来了题为《从能聊、到能干、到越干越好:企业AI的上岗之路》的演讲,抛出了一个核心观点:不把AI当工具,而是当作"AI员工"来看待。

weixin_43099039的博客 196

如何借助 AI 实现自动化测试:让 Agent 帮你写测试、跑测试、修测试

上下文工程优先:维护(页面结构、账号、业务规则),AI 输出质量立竿见影;AI 生成 + 人审 + 入库:测试代码是资产,必须 code review,禁止「AI 跑完就当真」;定位器纪律:全程getByRolegetByLabel,从源头减少失效;分层使用:单元/接口测试用传统框架,UI 探索性测试用 Agent,回归用固化脚本;成本控制:批量生成用便宜模型(DeepSeek / 本地 Ollama),关键修复用强模型;安全红线:测试 Agent 只能连测试环境;

篮球界最会写bug的人;程序猿中打球最菜的人。 421

83.85% vs 17.91%:FormStruct-Bench 揭开表单解析的错觉

文章摘要 FormStruct-Bench论文提出了一个针对表单类文档结构识别的新型分层评测基准,解决了传统方法在结构化评估上的不足。研究团队通过"导演-美术-质检"的合成流程构建了7,000个带精确标注的表单实例,并设计了分层评估指标,包括内容读取(Value-nED)、结构重建(Schema-nED)和路径正确率(TSR-path)等。实验结果显示,当前最佳系统在内容读取上达到83.85%,但结构路径正确率仅17.91%,区域检测和关系识别指标更低。研究表明,视觉退化主要影响结构绑定而非内容识别,且合成

liferecords的博客 597

Alexa Fluor568标记豌豆凝集素,适配多色荧光成像体系的橙红通道标记需求

AF 568 PSA是将Alexa Fluor568橙红荧光基团与豌豆凝集素(Pisum sativum agglutinin,PSA)定向偶联制备的糖链靶向特异性荧光探针,完整保留豌豆凝集素对α-甘露糖、α-葡萄糖的高亲和力识别特性,依托Alexa Fluor568染料优异的光学性能,在578nm处呈现明亮的橙红特征发射荧光,荧光亮度高、抗光漂白性能优异,是多色荧光标记体系中橙红通道靶向标记α-甘露糖/α-葡萄糖糖链的经典科研工具。(上述信息均由陕西新研博美生物科技小编木木所整理)性能参数与核心优势‌。

2601_96201972的博客 318

工业级温控机组赋能数据中心与ICT基础设施低碳化运营

阿尔西在全球布局的三大制造基地为工业级温控机组的产能协同提供了坚实保障,各基地在工业冷水机、医疗制冷、3D打印技术、组装、钣金、焊接等环节形成专业化分工与技术互补。阿尔西集团凭借近三十年的技术积累,将工业级温控机组的应用边界从传统制造业拓展至超大规模数据中心、电信基础设施及边缘计算场景,为全球ICT行业提供从芯片级到系统级的全方位温控解决方案。包括针对边缘计算场景的水平式整装空调型工业级温控机组,以及适用于中大型数据中心的远程温控型工业级温控机组,制冷能力覆盖多种规格,在保证可靠性的同时实现高效运行。

Jay150124的博客 293

Qwen3.8双模型开源引爆AI新热潮

Hugging Face报告显示,2026年以来中国开源模型参数规模达7540亿至2.78万亿,远超美国同期的1300亿以下。Qwen已成为开源生态重要基础模型,衍生模型数量超15万个。阿里千问团队宣布Qwen3.8-27B正式开源,可在高端手机和消费级显卡流畅运行;同时首次开放Max级别旗舰模型Qwen3.8-2.4T-A95B权重,总参数2.4万亿,采用稀疏MoE架构。

AI时代,你可能就如黑客帝国的neo。用心理学第一性原理拆解产品设计。好奇心、多巴胺、信息缺口——理解这些,你也能做出让人停不下来的好产品。关注我,成为AI时代产品大脑。 312

AI网关和API网关区别在哪?MAI Gateway统一治理方案深度解析

API网关转发请求,不关心内容。AI网关处理消费,不只转发。这是两类网关的根本区别。调用方不需要知道服务在哪,网关负责路由。请求体内容在网关层透传,网关不碰。企业要知道AI调用的内容安不安全、花了多少钱、归谁的部门、模型说了什么。请求体内容在网关层被检查、脱敏、计费、记录。差异的根源在于:大模型调用是按次消费,每次调用花钱;传统API调用是基础设施服务,部署了就能用。

youdiyunan的博客 284

FunASR 语音识别本地部署实录(下):34 分钟录音实测,踩过的坑、上线前要补的事

自建语音转写,门槛不高,但要做得稳,坑都在细节里。我实测下来的结论:环境坑比模型坑多,官方标了"生产验证"的路径可以放心走,但认证、限流、监控这三件事,官方明确留给你自己补,别指望示例代码替你解决。再说句心里话:自建最值钱的不是省下的服务费,是我想要什么能力都能自己加,不用求人。转写量大、音频敏感的朋友,值得自己搭一套;偶尔用几回的,云 API 更省心。觉得有用的话,顺手点个关注,后面我会继续写本地 AI 服务落地的实测。【欢迎访问我的个人博客主页,这里有我的精选文章和AI模型日报专栏。👇)本文用到。

qq_31429225的博客 408

AI编程实战:让 AI 写测试,一次到位

本文介绍如何利用AI生成高质量的Python单元测试(以pytest为例)。关键步骤包括:1)使用结构化Prompt模板指定测试要求;2)通过三类输入(正常、边界、异常)确保覆盖全面;3)采用"改坏代码"法验证测试有效性。文章强调测试需满足:断言具体、行为导向、能捕获错误。文末提供实践作业,并预告下期将探讨AI生成文档的技术。全文150字,完整呈现AI测试生成的核心方法论。

用沸腾的热血,支付我们的人生吧! 259

AI Gateway 与直连 LLM API 的应该怎么选,一篇文章说明白

引入 AI Gateway 作为所有 LLM 流量的统一入口。配置提供商凭证、路由规则和 Fallback 链。在这个阶段,ServBay AI Gateway 的一键安装特性降低了不少门槛。相比 LiteLLM 等自托管方案需要 Python、PostgreSQL 和 YAML 配置文件的前置依赖,ServBay 用户只需要在应用内启用 AI Gateway 功能,像安装 PHP 或 MySQL 一样完成部署。网关已配置所有活跃的提供商渠道。只抽象新服务,遗留的老服务继续直连。

Sammyyyyy的博客 391

AI Agent 基础理解

文章摘要:本文解释了AI模型的本质是基于文本输入输出的工具,自身不具备执行能力。通过引入Agent(智能体)概念,结合工具说明书和循环机制,模型可以间接完成复杂任务。详细演示了游客查询游玩路线的7步流程,包括前端请求、后端组装、模型工具调用与执行、结果返回等关键环节。重点强调了模型只负责自然语言处理,精确数据由后端直接控制的设计原则,确保系统可靠性。同时比较了手动操作与AI交互的两种实现路径及成本差异。

哆啦A梦的百宝袋的博客 318

AI Agent 技术架构深度解析与选型指南

AI Agent代表了企业AI应用从"问答"到"任务执行"的关键跃迁,也为管理软件行业带来了新的产品可能性。用友YonClaw、金蝶灵基等企业级AI Agent产品的推出,标志着国产管理软件在AI Agent方向的正式布局。对于企业而言,理解AI Agent的技术架构与能力边界,是做出正确选型决策的基础。本文面向技术架构人员与IT管理者,供技术评估参考。

likeylau的博客 299

python神经网络编程入门(三十七)——Decoder 内部——掩码自注意力与交叉注意力

上一章我们把编码器(Encoder)内部的"残差、LayerNorm、前馈"三块承重墙拆了个底朝天;这一章轮到另一半——解码器(Decoder)。解码器比编码器多两样东西:一张**"不许偷看未来"的掩码**,和一种**"去查编码器记忆"的交叉注意力**。文章先把这两样东西的来龙去脉讲透:为什么生成第 t 个词时不能看第 t+1 个词?那张"上三角遮罩"到底长什么样、为什么必须填 -1e9 而不是 0?交叉注意力里"解码器问、编码器答"的 Q/K/V 到底从哪来、为什么它们的长度可以不同?然后用 9 张图、若

qq_65148539的博客 861

技术拆解(十七)具身智能:机器人动作生成为何走向Diffusion Policy?

本文系统拆解Diffusion Policy的动作扩散、训练推理与滚动时域控制,并对比ACT和π0,厘清具身智能动作生成范式。

Zyzyzyzyzzzz的博客 408

2026-08-19 GitHub 热点项目精选

* 全局样式 */padding: 0;body {/* 标题样式 *//* 链接样式 *//* 引用样式 *//* 表格样式 */table {th, td {th {/* 代码块样式(pygments 高亮) */pre {/* 列表样式 *//* 图片样式 */

m0_65659549的博客 209

Python 3.9 · Flask 火灾监测识别系统 与 钉钉告警机器人 集成说明文档

本文介绍如何将钉钉群机器人告警功能集成到基于Python 3.9和Flask的火灾监测系统中。主要内容包括:系统架构设计(YOLOv11检测火灾/烟雾后触发钉钉告警)、环境配置说明、钉钉机器人创建与安全设置(推荐使用加签验证)、钉钉推送模块代码实现(支持重试机制)、Flask后端集成改造方法,以及告警去重与冷却控制机制。文档提供了完整的实施步骤,从环境准备到测试验证,并包含常见问题解答和进阶功能建议(如图片告警)。该方案实现了火灾检测的实时预警功能,同时避免了消息刷屏问题。

isoft888的专栏,致力于C#/python分享物联网、大数据,神经网络的等领域,欢迎讨论交流! 248
上一篇: 唯品会投1.2亿建公寓,员工租金300元/月,网友:“又是别人家的公司!”
下一篇: 谷歌软件工程师基本年薪达 71.8 万美元,此外还有股权和奖金!
CSDN 程序人生
CSDN 程序人生 领域专家: 数据科学与机器学习技术领域 领域专家: 数据科学与机器学习技术领域
博客等级 码龄9年 2万+粉丝 · 1019原创
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值