
Litefuse:从发布到开源
在前一篇文章中,介绍了 Agent 时代需要新的方法论 EDD,通过 "观测 - 评估 - 优化" 闭环应对 Agent 特有的不确定性问题,以及 Litefuse 如何将实践 EDD 方法论的能力产品化。过去一个月,Litefuse SaaS 服务受到很多 Agent 开发者欢迎,注册用户超 200 人,还被应用到多个场景中。如今,Litefuse 开源,并推出业界第一个极致轻量的单机单进程模式。只需运行一条命令,大约 25 秒就能完成 Litefuse 单机版下载、安装和部署。
为啥要做单机版?
大家体验 Agent 可观测平台时,在私有化环境中基本都得用 Docker 启动,看似简单实则麻烦。没有 Docker 环境得先下载安装,拉取 Docker image 一般几个 GB,默认从 docker hub 下载要按小时计,配置好国内镜像站点下载也得好几分钟,启动后一堆容器,看着就笨重。后续维护问题也多,数据存储、端口映射等一系列 Docker 和多进程问题接踵而至。要是部署到用户或客户环境中,笨重的代价更明显,用户可能没 Docker 环境、网络可能隔离没法拉取镜像等。有些场景用户只需单机系统,却不得不和 Docker 及 5 - 6 个进程打交道,复杂度比被观测系统还高。这就是 Litefuse 推出极致轻量单进程模式的原因,让用户在单机场景下用最简单方式运行 Agent 可观测与评估。视频显示,左边 Litefuse 单进程版本用 curl 和 sh 命令,25 秒从零完成部署(12 秒下载完 358MB 安装包、11 秒解压安装),而右边 Langfuse 基于 Docker 花了 2 分 18 秒,慢了 5.5 倍,这还是在提前准备好 Docker 环境、配置好国内镜像的前提下,否则会慢几十倍。Litefuse 单进程版支持 macOS (Apple silicon) 和 Linux (x64) ,它有以下架构和特点:一个二进制包,体积不到 400MB ,包含 Litefuse 程序、Node.js 和 JVM 运行时环境,PGlite 嵌入式 Postgres,DorisLite 嵌入式 Doris ;没有其他运行时依赖,只依赖内置的 Node.js 和 JVM 运行时,无需外部依赖,无需 Docker 环境;运行起来只有一个进程,数据库 PGlite 和 DorisLite 以库的方式加载而不需要额外的进程。
为啥选 Apache Doris 作为存储分析引擎?
Agent 可观测的核心数据是 Trace,它与传统可观测有本质区别,几个量变引起了质变:MB 长文本,Agent 依赖的 LLM 能生成长文本,一次请求的输入和输出可能有 MB 级别的长文本,传统可观测中一般只有百字节或者 KB 级别的文本。长文本给检索 Trace 和查询时的内存消耗带来挑战;跨度几天、GB 大小的超长 Trace,复杂的 Agent 任务可能运行数小时甚至数天,一个 Trace 可能有几万个 Span 加起来高达几百 MB 甚至 GB,导致分析 Agent 轨迹时获取一个 Trace 的所有 Span 很慢;大量半结构化数据,Agent Trace 中不仅元数据中有 JSON,主数据如 input output 中也有大量 JSON,若没有对半结构化 JSON 的 Native 支持和优化,Trace 分析将会很慢;数据量提升一个量级,单个 Span 变大、一个 Trace 中的 Span 变多,数据总量有数量级的变化,带来存储成本的大幅增加。过去几年在与 MiniMax、阶跃星辰等大模型公司构建可观测系统的过程中,发现 Apache Doris 正好匹配上了 Agent 可观测的技术挑战:成熟的倒排索引加速全文检索 10x,Apache Doris 早在 2023 年开始支持倒排索引,被数百家公司大规模应用于生产环境,功能丰富,性能强大,能应对长文本检索挑战;延迟物化等解决降低长文本查询时内存占用,Doris 在存储、检索、查询等环节为长文本进行了大量优化,延迟物化技术避免了大量资源消耗,查询响应快且稳定;分桶、排序、索引机制将 Trace 聚簇存储解决超长 Trace 分析问题,Apache Doris 的分区分桶、数据排序等机制可用于优化基于超长 Trace,能快速拿到结果;VARIANT 数据类型 Native 支持和优化半结构化 JSON 数据存储分析,Apache Doris 为半结构化 JSON 数据设计的 VARIANT 数据类型,提升压缩率降低存储空间,查询速度通常能提升 10 倍,对 Agent 可观测中 input output 字段大量的 JSON 数据效果更明显;存算分离架构、列式存储降低存储空间和成本 75% ~ 80% 以上,Apache Doris 通过列式存储、ZSTD 压缩和存算分离架构降低存储空间和成本,而 Langfuse 背后的 Clickhouse 开源版本不支持存算分离架构,用户需用本地磁盘多副本来保证可靠性,代价是多份的存储成本,Apache Doris 开源就支持存算分离架构,用户可免费享受到 75% 到 88% 的成本降低。
现在就加入社区
基于上述原因,Litefuse 基于 Langfuse 和 Apache Doris 构建,在 Langfuse 丰富的功能基础之上,利用 Doris 优化存储成本和分析性能,并推出极简的单进程模式简化架构和维护成本。Litefuse 已在 GitHub 开源,采用 MIT 协议。在 macOS (Apple Silicon) 或 Linux (x64) 服务器上,一行命令、约 25 秒即可跑起来。不想自己部署,也可直接使用云端服务。Litefuse 开源只是新起点,接下来一方面会在架构层面发力提升性能和降低成本,另一方面会在 Agent 评估层面增强产品能力,帮助开发者更高效评估和迭代 Agent。那么,你是否会尝试使用 Litefuse 呢?

463

被折叠的 条评论
为什么被折叠?



