OpenAI开源Codex Agent Harness、GPT Image新检查点曝光、腾讯灰测混元Hy4 | 8月21日 AI日报

💡 今日趋势速览:OpenAI开源Codex背后的Agent Harness,官方强调harness设计直接影响模型表现;腾讯元宝App灰测专家级旗舰模型混元Hy4,多模态能力将升级;GPT Image新检查点luna-lisa-alpha曝光,图像输出更干净。厂商竞相迭代智能体框架与多模态模型,竞争加速。

🎯 今日要点

  1. OpenAI 开源 Codex 背后的 Agent Harness
  2. GPT Image 新检查点 luna-lisa-alpha 曝光
  3. 腾讯元宝 App 灰测新旗舰模型混元 Hy4

📋 今日内容汇总

🤖 AI动态

  1. OpenAI 开源 Codex 背后的 Agent Harness
  2. GPT Image 新检查点 luna-lisa-alpha 曝光
  3. 腾讯元宝 App 灰测新旗舰模型混元 Hy4
  4. OpenAI 预览 Private Safety Processing 安全服务
  5. 阿里推出 GUI 智能体基座模型 Qwen-UI-Agent
  6. Claude Code 新增 Concise 输出风格
  7. Unsloth Desktop 新版上线:支持自动压缩
  8. Hugging Face 发布 LFM2.5 系列 DSpark 草稿模型
  9. MiniMax 发布多模态创作 Agent MiniMax Design
  10. 隐形前沿模型 Ox Alpha 上线:百万 token 上下文
  11. Cursor 上线 /goal:给 Agent 一个长期目标
  12. 商汤开源 8B 统一多模态模型 SenseNova U1.5 Lite
  13. Slack 推出 Slack Code,频道内直接协作编程智能体
  14. 豆包视频通话升级,可同时处理音视频文本三路输入

🦾 机器人具身智能

  1. AGIBOT 发布新一代全尺寸人形机器人 A3

📦 开源项目

  1. Claude 文本水印被破解,相关项目 Star 超 1.5 万

📌 模型排行榜

  1. Artificial Analysis AI 模型能力排行榜

🤖 AI动态

1. OpenAI 开源 Codex 背后的 Agent Harness

OpenAI开源Agent Harness,Codex App、CLI与IDE扩展背后运行该框架,官方强调harness设计直接影响模型表现,ARC-AGI-3上GPT-5.6 Sol加入retained reasoning后分数从13.3%涨至38.3%集成方式分三种:codex exec适合脚本、CI Job等非交互任务

OpenAI 开源 Codex 背后的 Agent Harness

OpenAI 开源 Codex 背后的 Agent Harness

🔗 https://x.com/linxiaobei888/status/2090240944536994014


2. GPT Image 新检查点 luna-lisa-alpha 曝光

LMArena 上出现代号 luna-lisa-alpha 的 GPT Image 新检查点,被多个追踪者独立发现,属预发布版本且不可选用,来源实验室未知。早期输出显示图像更干净,颗粒噪点基本消失,角色一致性与文本渲染提升,知识截止时间较前代 mona-lisa-1 更新。

GPT Image 新检查点 luna-lisa-alpha 曝光

🔗 https://x.com/Adidotdev/status/2090405864335462895


3. 腾讯元宝 App 灰测新旗舰模型混元 Hy4

腾讯元宝App模型列表中出现混元Hy4,标注为专家级模型,排在Hy3与DeepSeek上方。腾讯上周在Q2财报确认Hy4即将上线,提升性能与多模态能力;目前尚未正式发布,或为小范围灰测。

腾讯元宝 App 灰测新旗舰模型混元 Hy4

腾讯元宝 App 灰测新旗舰模型混元 Hy4

🔗 https://x.com/MaxForAI/status/2090386754633421110


4. OpenAI 预览 Private Safety Processing 安全服务

OpenAI推出Private Safety Processing服务,面向符合条件的企业与API客户,使用前沿模型时保持零数据保留:系统跨多轮对话检查潜在滥用,OpenAI员工无法查看客户的提示词或模型响应。Sam Altman在推文中表示支持商业隐私,OpenAI为前沿模型提供零数据保留服务

OpenAI 预览 Private Safety Processing 安全服务

OpenAI 预览 Private Safety Processing 安全服务

🔗 https://x.com/0xLogicrw/status/2090282580625314202


5. 阿里推出 GUI 智能体基座模型 Qwen-UI-Agent

阿里巴巴发布Qwen-UI-Agent,能直接操作手机、电脑、网页,遇命令行任务可运行CLI。阿里做GUI Agent已两年多,2024年Mobile-Agent靠截图控制点击Qwen-UI-Agent覆盖移动端、桌面端、浏览器、DeepSearch及CLIQwen-UI-Agent在MobileWorld-Real等评测中获92.2%成绩

阿里推出 GUI 智能体基座模型 Qwen-UI-Agent

阿里推出 GUI 智能体基座模型 Qwen-UI-Agent

阿里推出 GUI 智能体基座模型 Qwen-UI-Agent

🔗 https://x.com/0xLogicrw/status/2090387625979031686


6. Claude Code 新增 Concise 输出风格

新版输出风格 Concise 已上线 Claude Code:先直接给出结果、保持回复简短,被追问时仍会提供完整细节。用户可以在 /config 设置菜单的 Output style 选项中开启。

Claude Code 新增 Concise 输出风格

🔗 https://x.com/ClaudeDevs/status/2090245922685063634


7. Unsloth Desktop 新版上线:支持自动压缩

Unsloth Desktop 发布新版本:带来面向所有模型的实验性自动压缩(结合 RAG、强制首轮 RAG 与尾部保留策略)、局域网和远程访问选项卡以及更流畅的聊天体验,本版还合并了 200 多个 PR。

Unsloth Desktop 新版上线:支持自动压缩

🔗 https://x.com/danielhanchen/status/2090499172118241668


8. Hugging Face 发布 LFM2.5 系列 DSpark 草稿模型

DSpark 草稿模型通过投机解码在不改变输出质量的前提下加速推理,GPU 吞吐最高提升 3.18 倍,端侧最高 2.87 倍;草稿模型约 300M 参数,LFM2.5-2.6B 的函数调用延迟平均降低 57%,已开源并支持 llama.cpp 与 SGLang以下是官方给出的 demo

Hugging Face 发布 LFM2.5 系列 DSpark 草稿模型

Hugging Face 发布 LFM2.5 系列 DSpark 草稿模型

🔗 https://huggingface.co/blog/LiquidAI/lfm25-dspark


9. MiniMax 发布多模态创作 Agent MiniMax Design

它能自主拆解任务、写脚本、做分镜,生成图片和视频后完成剪辑、配音与字幕,直接交付成片。MiniMax 把视频模型 H3 深度整合进 Agent 与 Skills,按任务判断素材取舍并整理成适合 H3 执行的输入,复杂镜头还可先用 3D 导演台编排以下是官方给出的 demo

MiniMax 发布多模态创作 Agent MiniMax Design

🔗 https://mp.weixin.qq.com/s?__biz=MzE5MTA3NzcxMQ==&mid=2247489087&idx=1&sn=2691288eb8cddac6c2e86483ccff7eb5


10. 隐形前沿模型 Ox Alpha 上线:百万 token 上下文

一款未公开厂商的隐形模型 Ox Alpha 发布,定位高效编程、持续性智能体工作与真实生产环境,提供 100 万 token 上下文窗口,输入支持 Text、image 与 video 三类模态,官方邀请用户试用并反馈。

隐形前沿模型 Ox Alpha 上线:百万 token 上下文

🔗 https://x.com/OpenRouter/status/2090544970923184269


11. Cursor 上线 /goal:给 Agent 一个长期目标

Cursor刚刚推出/goal功能,给智能体设定长期目标后可持续工作直至真正完成,示例为打造超越《使命召唤》的AAA级FPS游戏。/goal还能搭配/loop进行定期检查,再结合Custom Mode制定执行手册。

Cursor 上线 /goal:给 Agent 一个长期目标

Cursor 上线 /goal:给 Agent 一个长期目标

🔗 https://x.com/minchoi/status/2090233324727832638


12. 商汤开源 8B 统一多模态模型 SenseNova U1.5 Lite

SenseNova U1.5 Lite参数量仅80亿,是轻量级原生统一多模态模型,支持视觉理解、生成与编辑。SenseNova系列在图像生成与编辑的多个基准测试中表现领先。它支持原生4K生成与复杂指令遵循,可按主体、数量、文本、布局和风格控制输出,目前代码已开源

商汤开源 8B 统一多模态模型 SenseNova U1.5 Lite

商汤开源 8B 统一多模态模型 SenseNova U1.5 Lite

商汤开源 8B 统一多模态模型 SenseNova U1.5 Lite

🔗 https://x.com/SenseTime_AI/status/2090483079412580442


13. Slack 推出 Slack Code,频道内直接协作编程智能体

面向编程智能体的 Code channels 现已上线,这套功能被命名为 Slack Code,首批合作方包括 Anthropic、GitHub、Cognition 和 Vercel。用户可以在频道中直接与 Coding Agent 协作干活,这类智能体自 2024 年 Devin 起已能从 Slack 接收任务

Slack 推出 Slack Code,频道内直接协作编程智能体

🔗 https://x.com/Benioff/status/2090240159115853956


14. 豆包视频通话升级,可同时处理音视频文本三路输入

升级后的豆包视频通话能在连续变化的真实场景中自然连续交互,底层由火山引擎多模态传输系统提供技术支撑。看到路牌会提醒方向,也不被旁人对话带偏。用户能边看边听边说,AI同时接收音频、视频、文本三路输入,不必等它说完才开口。

豆包视频通话升级,可同时处理音视频文本三路输入

豆包视频通话升级,可同时处理音视频文本三路输入

🔗 https://mp.weixin.qq.com/s?__biz=MzI1MzYzMjE0MQ==&mid=2247521377&idx=1&sn=3d2f9e30616aa074c8d574c568903ba8


🦾 机器人具身智能

15. AGIBOT 发布新一代全尺寸人形机器人 A3

AGIBOT 摘下面具正式发布新一代全尺寸人形机器人 A3,官方演示强调其动作强劲、反应迅捷且精准毫厘不差,并让一位深谙如何逼近极限的大师担任陪练,以一场挑战赛展示 A3 的全身控制实力以下是官方给出的 demo

AGIBOT 发布新一代全尺寸人形机器人 A3

🔗 https://x.com/AGIBOTofficial/status/2090438452990857376


📦 开源项目

16. Claude 文本水印被破解,相关项目 Star 超 1.5 万

Anthropic已宣布8月2日之后新发布的Claude模型会在生成文本中嵌入肉眼不可见的水印标识,最初是为应对欧盟相关要求,其他AI厂商也有类似做法。如今有项目实现对这层水印的破解,在GitHub上收获超过15000个Star

Claude 文本水印被破解,相关项目 Star 超 1.5 万

Claude 文本水印被破解,相关项目 Star 超 1.5 万

🔗 https://mp.weixin.qq.com/s?__biz=MzAxOTcxNTIwNQ==&mid=2457995251&idx=1&sn=1d8e787f39931afc3cb37af299c2c20a


📌 模型排行榜

17. Artificial Analysis AI 模型能力排行榜

最后是今日的 AI 模型能力排行榜单,智力榜上,Claude Opus 5 (max) 以63分居首,Claude Fable 5 与 GPT-5.6 Sol、Grok 4.6 紧随其后。

Artificial Analysis AI 模型能力排行榜

Artificial Analysis AI 模型能力排行榜

🔗 https://artificialanalysis.ai/?intelligence=artificial-analysis-intelligence-index#intelligence-tabs

以上是今天的AI 风向标,欢迎在评论区提出建议,我们明天见。

内容概要:本文档名为《赵家湾学校后大门一百三十六栋.txt》,实则是一份综合性科研仿真资源索引,集中展示了多个技术领域的Matlab/Simulink与Python代码实现项目。内容涵盖风光互补制氢合成氨系统容量-调度优化、微电网能量管理、无人机三维路径规划、图像分割、信号处理、电力系统建模、模型预控制(MPC)、深度学习预模型(如LSTM、Transformer)、联邦学习、强化学习应用等多个前沿方向。文档不仅列出具体研究题目和算法模型,还整合了智能优化算法(如PSO、GWO、DBO等)、路径规划、车间调度、通信优化、雷达跟踪、元胞自动机模拟等通用技术模块,并附有网盘链接提供完整代码与仿真模型下载,旨在为科研人员提供可复现的技术支持与开发参考。; 适合人群:具备一定编程基础,从事电气工程、自动化、计算机科学、人工智能、控制工程、能源系统等相关领域的研究生、科研人员及工程技术开发者。; 使用场景及目标:①辅助高水平学术论文复现与科研项目开发;②为硕士/博士论文、课程设计、学科竞赛提供算法实现与仿真建模支持;③提升在能源并网、智能控制、路径规划、负荷预、故障诊断等领域的工程实践与创能力。; 阅读建议:此文档为资源导航型材料,建议结合个人研究方向筛选对应主题,通过提供的百度网盘链接获取完整代码包,并配合相关文献进行仿真实验与参数调试,以实现高效复用、二次开发与技术创
内容概要:本文深入解析了AI Agent(智能体)的技术原理与系统架构,阐述其如何通过“思考-行动-观察”的闭环循环,使大语言模型(LLM)从被动应答的对话系统进化为能主动完成复杂任务的智能实体。文章详细介绍了Agent四大核心模块:作为决策中枢的LLM(大脑)、实现外部交互的工具调用(双手)、支持状态延续的记忆模块(记忆),以及驱动自主执行的规划与协调机制(协调)。同时对比了Agent与传统聊天机器人在任务规划、工具使用、记忆能力和执行闭环等方面的本质差异,并探讨了从单智能体到多智能体系统的架构演进趋势,强调专业分工对处理复杂任务的重要性。最后,文章分析了Agent模式与预设工作流模式的应用权衡,指出前者适用于灵活探索类任务,后者更适合确定性高的固定流程。; 适合人群:对人工智能、大模型应用开发感兴趣的技术人员、产品经理及研究人员,尤其适合具备一定AI基础知识、希望深入了解Agent系统设计的专业人士; 使用场景及目标:①理解AI Agent的核心架构与关键技术组件;②掌握ReAct等主流执行范式;③区分Agent与传统聊天机器人的能力边界;④判断在实际业务中应采用Agent模式还是工作流模式; 阅读建议:本文理论性强且结构清晰,建议结合实际Agent案例(如AutoGPT、LangChain应用)进行对照学习,重点关注各模块间的协同机制与设计权衡,以深化对Agent系统级思维的理解。
内容概要:本文针对三相并网逆变器在瞬态过程中的全局最优控制问题,提出一种基于有限字符集预控制(FCS-MPC)的渐进式调控策略,旨在实现从电流畸变抑制到功率无差拍响应的平滑过渡。通过构建电流与功率双模态预控制框架,结合Simulink仿真与Matlab代码实现,系统分析了有限控制集对系统动态响应、谐波含量及功率调节性能的影响机理,深入探讨了预模型构建、代价函数设计与控制参数优化的关键技术路径,验证了该策略在提升并网电能质量、增强动态响应能力和实现多目标协同控制方面的优越性与可行性; 适合人群:具备电力电子、自动控制理论基础,熟悉Matlab/Simulink仿真环境,从事能源发电并网、逆变器先进控制策略研究等相关领域的研究生、科研人员及工程技术人员; 使用场景及目标:①深入研究有限集模型预控制在三相并网系统中的理论与应用;②掌握电流与功率双模态预控制策略的设计方法与实现流程;③实现高动态性能、低谐波畸变与功率快速无差拍响应的综合控制目标; 阅读建议:建议结合文中提供的Matlab代码与Simulink仿真模型进行复现实验,重点剖析预时域设定、代价函数权重配置及开关状态枚举策略对系统性能的影响,以全面理解FCS-MPC的核心原理及其在工程实践中的优化技巧。
内容概要:本文系统阐述了多层感知机(MLP)神经网络的底层原理、从零手写代码实现、工程化框架落地及超参数优化的完整体系。内容涵盖MLP的理论基础、前向传播与反向传播的数学推导、激活函数与损失函数的选择、NumPy原生实现与PyTorch/TensorFlow工业级封装,并深入解析了网络结构、训练优化、正则化等超参数的系统化调参策略。通过构建“数学原理→代码实现→调参优化→故障排查→工业实战”的闭环体系,提供可复用的标准化模型开发流程,结合分类与回归实战案例,全面指导模型评估、可视化与部署落地。; 适合人群:具备一定Python和机器学习基础,从事AI研发、数据科学、工程建模的1-5年经验技术人员,以及高校科研人员与企业AI落地团队。; 使用场景及目标:①掌握MLP神经网络的数学本质与代码实现机制;②系统学习超参数调优策略,解决过拟合、欠拟合、梯度异常等常见问题;③实现从学术理解到工业级模型部署的全流程落地;④提升在结构化数据建模任务中的模型性能与鲁棒性。; 阅读建议:建议结合文中提供的NumPy与PyTorch代码边学边练,重点理解反向传播推导与调参逻辑,对照实战案例进行调试与优化,建议按章节顺序学习,尤其重视第5章超参体系与第9章故障排查,以建立系统性调参思维与问题解决能力。
内容概要:本文研究了基于UPML的三维有限差分时域法(3D FDTD)在微带低通滤波器分析中的应用,通过Matlab代码实现对平面微带电路电磁特性的精确仿真。文章系统阐述了3D FDTD方法的核心原理,包括麦克斯韦方程的离散化处理、Yee网格的空间配置、时间步进迭代算法以及数值稳定性条件(如Courant-Friedrichs-Lewy条件)。重点介绍了UPML(单轴各向异性完全匹配层)吸收边界条件的数学建模与编程实现,有效抑制了计算域边界的非物理反射,提升了高频电磁仿真精度。通过建立微带低通滤波器的三维几何模型,进行精细网格剖分,并施加端口激励,计算获得了S参数曲线、电磁场分布云图等关键结果,验证了该方法在高频电路设计中对信号完整性与电磁兼容性分析的有效性与高精度优势。; 适合人群:具备电磁场与微波技术理论基础、熟悉Matlab编程,从事高频/高速电路设计、天线工程、PCB信号完整性分析及相关领域的研究生、科研人员及电子系统研发工程师。; 使用场景及目标:①掌握3D FDTD方法在平面微波器件仿真中的全流程实现技术;②深入理解UPML边界条件的物理机制及其在减少截断误差中的关键作用;③为微带滤波器、功率分配器、耦合器等无源器件及高速互连结构的设计优化提供可靠的数值仿真手段; 阅读建议:建议读者结合所提供的Matlab代码逐行调试,重点关注差分格式的离散过程、UPML区域的参数设置与场量更逻辑,并尝试调整介质基板参数或滤波器拓扑结构,观察S参数和场分布的变化,以深化对电磁波传播特性、谐振行为及边界吸收机制的理解。
内容概要:本文聚焦于有源中点箝位(ANPC)三电平并网逆变器的高性能控制策略研究,针对传统逆变器在电网不平衡、谐波扰动等复杂工况下存在的谐波含量高、动态响应慢、稳定性差等问题,提出了一种融合双极性倍频脉宽调制(DPWMA)、正负序分离锁相技术与电网电压前馈控制的一体化控制方案。通过深入分析ANPC三电平拓扑的结构优势,结合DPWMA调制策略优化开关动作以改善输出波形质量,利用正负序分离锁相实现电网相位的精确跟踪,并引入电网电压前馈有效抑制外部扰动对系统的影响,从而全面提升并网电能质量与系统鲁棒性。研究在Simulink环境中搭建了完整的仿真模型,对稳态运行、电网不平衡及动态切换等多种工况进行了验证,结果表明该控制策略能显著降低电流谐波、提高锁相精度和动态响应速度,具备良好的工程应用前景。此外,文档还整合了大量基于Matlab/Simulink的科研资源,覆盖微电网优化、电动汽车接入、风光储协同调度、路径规划、神经网络预等多个前沿方向。; 适合人群:具备电力电子、自动控制或能源系统背景,从事相关科研工作的研究生、工程师及高校教师,尤其适合有一定Matlab/Simulink仿真基础的研发人员。; 使用场景及目标:①用于能源并网逆变器控制系统的设计与优化;②支撑高水平论文复现、科研项目开发与工程仿真验证;③为电力系统、智能控制、无人机路径规划等领域的算法研究提供代码参考和技术路线借鉴。; 阅读建议:建议结合文中提供的仿真模型与代码资源,按照目录结构系统学习控制策略设计逻辑,并通过实际仿真实验加深对DPWMA调制、正负序分离、前馈补偿等核心技术的理解与掌握。
代码下载地址: https://pan.quark.cn/s/1065f510e03d Hackerrank是一个国际性的技术人才招聘平台,它借助一系列的编程挑战和练习活动,旨在帮助求职者提升编程能力并为职业发展做好准备。本解析涵盖了多种编程语言和算法的核心内容,以下将从所提供的文档资料中归纳出相关学习要点。 ## 学习要点总结 ### 关于Hackerrank - Hackerrank是一个面向程序开发者的在线编程学习平台。 - 通过攻克具有难度的编程任务,能够促进程序员精通不同的编程语言和算法技术。 - 该平台既适合准备进入北美就业市场的求职者,也适合在中国寻求工作机会的人群。 ### 编程语言应用 - C++11:这是一种C++编程语言的版本,引入了多项增强功能。 - Scala:一种支持多种编程范式的语言,融合了面向对象和函数式编程的特点。 ### 算法与数据结构 - 该资料包含了HackerRank上所有题目的解题方案。 - 适合读者深入研究和学习,有助于增强对数据结构和算法的理解程度。 ### 编程风格与规范 - 采取较为简洁的代码编写方式,以快速完成功能实现为主。 - 递归方法优先于栈的使用,采用STL(标准模板库)而非自行构建数据结构。 - 不提倡防御式编程,不进行指针和参数的有效性检查。 ### 算法竞赛与北美就业 - 对于初次接触ACM算法竞赛的手,该书提供了理想的入门训练。 - 对于准备进入北美就业市场的求职者,书中内容同样具有参考价值。 ### 学习要点详细说明 接下来,将详细阐释书中涉及到的关于链表和排序的各个学习内容。 #### 链表 - **链表元素的输出**:设计一个函数来遍历并展示链表中所有节点的值。需要处理头节点为空的情况...
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包

打赏作者

一只云卷云舒

你的鼓励将是我创作的最大动力

¥1 ¥2 ¥4 ¥6 ¥10 ¥20
扫码支付:¥1
获取中
扫码支付

您的余额不足,请更换扫码支付或充值

打赏作者

实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值