【笔记】用cursor手搓cursor(七)

AI 时代程序员必备技能

Codex、Claude Code、Cursor、Hermes Agent、OpenClaw等工程化实战专栏 ,讲透 AI 如何接管脏活累活

为了实现 neural symbolic,让genimi和glm合作写了一个js sandbox,因为用mac,直接jsc就能用,不需要v8。其实我们知道LLM在生产上不可靠,是因为你压根控制不住它,即使有各种prompt去限制,它依旧可以因为某些case导致“越狱”。所以,为什么不把它当成字符串处理的扩展呢?

我们以前写程序,然后让它按规矩运行;现在有了LLM,我们可以处理更复杂的用户指令,把用户指令转译成程序状态,给不同变量赋值,最后组成更复杂的系统,这个就是一个一下子就能实现的neural symbolic系统了,何乐而不为?

js sandbox首先可以运行javascript代码,我们只要给这个sandbox添加一些api,就可以完成和外部交互。比如调用LLM,读文件,写文件,运行脚本,访问网页,加载js动态模块…为了安全性,我们可以添加一个确认队列,危险操作都需要人的确认,然后有一个规则引擎可以自动允许自定义操作。最后再写一个LLM的指导文件,告诉它这些api如何使用。

有了这样的js sandbox,我们就会发现,不管模型是否弱小,比如在写代码的时候,有一个很长的base path;我们直接是 baseDir=<path> 然后我们可以join baseDir,就不会出现幻觉拼错path了。这就可以逐渐减少LLM的幻觉,把它限制起来。当然,我们可以有不同模式,比如我们调用 api.llm(plan + questionGuide) 我们可以让LLM根据plan产生问题,然后我们可以用array维护list,然后一个一个question解决问题,就不会有LLM本来plan的好好的,然后突然忘了某些item了。

这样LLM就加入了普通程序的过程。为了更加智能,我们需要继续探索:如何根据if组装这些function,如何维护function的库便于检索,如何让LLM在后台自动更新这些function,让它们越来越好用越来越模块化…所以最终的prod还是具体的过程,LLM做一些复杂的parse,以及在智能系统里做后台学习,更新js代码库。

这样我们离将voyager从minecraft (voyager是nvidia使用gpt4做了一个自动玩minecraft,从学习一般课程,到规划下一步并且执行操作的开源项目)泛化成通用agent就不远了。只是方法和时间问题,要建立function的搜索引擎,要建立meta learning的过程function描述…

AI 时代程序员必备技能

Codex、Claude Code、Cursor、Hermes Agent、OpenClaw等工程化实战专栏 ,讲透 AI 如何接管脏活累活

评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值