首页 > 渴望 > 正文

天黑请闭眼

10k Star!开源Coding Agent Harness仅用117MB运行10个会话,还能修改自身源码_我的网站

家政妇三田

A |       目前,以大语言模型为核心的生成式人工智能技术正加速融入消费生活各类场景。人工智能在提升消费便利和服务效率的同时,因信息生成具有一定不确定性,也可能出现信息不准确、表述不严谨、承诺与实际情况不一致等问题。例如,提供与实际不符的费率信息、作出难以兑现的赔付表述、提供片面或欠审慎的法律建议等,可能影响消费者判断和选择,甚至造成经济损失。  根据相关舆情和全国消协组织近期接收的相关投诉情况,人工智能服务引发的消费问题,在不同应用场景下具有不同特点。    智猩猩AI整理     编辑:没方               最近在折腾几款 AI 编程工具,很多人第一反应都是问背后用的是GPT-5.6 Sol还是Claude Fable 5。                   但相同模型,放进不同的编程工具里,表现可能完全不一样。                   有的 Agent 能连续工作几个小时,写完代码还知道运行测试、检查结果、继续优化。消费者日常接触的人工智能大体可分为两类:一类是面向公众的通用生成式人工智能服务,主要根据公开信息、模型训练数据和用户提问生成回答,一般不代表具体经营者的官方意见;另一类是经营者部署使用的人工智能客服工具,直接参与商品介绍、费用说明、活动解释、售后处理等经营服务环节。                   有的写了几十行代码,就告诉你任务已经完成。等真正运行项目,才发现测试没跑、依赖没装,甚至文件都改错了。  一、通用生成式人工智能:应明确参考属性,防止误导消费决策  面向公众的通用生成式人工智能服务并非特定经营者的代言主体,其生成内容一般不能直接视为平台或商家的正式承诺,也不能替代合同约定及权威机构意见,主要发挥信息辅助和参考作用。实践中,一些通用生成式人工智能在消费咨询和维权辅助过程中,可能出现对消费者遭受的损失作出缺乏依据的兜底承诺,对诉讼结果作出过度确定性判断、提供错误的诉讼管辖等法律指引,甚至生成并不存在的款项缴存、案件办理等虚假信息。如果消费者对上述生成内容缺乏必要辨别,未通过经营者官方渠道、合同文本或者有关权威渠道进一步核实,可能据此作出错误的退费、维权、诉讼等决定,不仅影响正常消费决策和依法维权,还可能造成经济损失。

B | 《生成式人工智能服务管理暂行办法》明确规定,人工智能服务提供者应基于服务类型特点,采取有效措施,提升生成式人工智能服务的透明度,提高生成内容的准确性和可靠性。                   模型明明没有变,差距从哪来?                    答案可能藏在模型外面的那层 Agent Harness 里,可以理解为包裹在大模型外部的“智能体运行系统”。明确并公开其服务的适用人群、场合、用途,指导使用者科学理性认识和依法使用生成式人工智能技术。                   它负责把模型、上下文、记忆、工具、权限、终端界面、任务调度和多智能体协作串联起来。  中国消费者协会建议,面向公众的通用生成式人工智能服务提供者进一步强化重点场景风险提示和信息质量管理。                   模型决定 Agent 的能力下限,而 Harness 则在很大程度上决定模型能够稳定工作多久、一次能处理多复杂的任务,以及最终能把多少智能转化成真实生产力。

C | 在涉及金融理财、生活服务、维权决策等与消费者重要权益密切相关的场景中,应通过适当方式提示人工智能生成内容的局限性,提醒消费者对重要信息进一步核实;同时,持续优化模型准确性,完善内容审核、风险预警和纠错机制,提升答复质量,尽可能减少错误信息和容易引发误解的内容,降低消费者因过度依赖人工智能生成信息而遭受损失的风险。

D |                    今天刷github日趋榜,看到了个名叫 jcode 的开源项目,正试图把 Agent 这层外壳推到更远。

E |                              它是一套使用 Rust 构建的终端 Coding Agent Harness,主打多会话工作流、持久记忆、多智能体协作、高度自定义和低资源占用。在github上已经收获10k stars。         项目链接:           https://github.com/1jehuang/jcode                         01          从单次对话,走向          长期运行的Agent工作系统                    记忆系统是jcode的一大杀手锏,下面这段演示视频可以直观看到它的记忆召回效果:                    播放          下一个          打开循环播放          00:00     /     00:00          倍速          3.0X     2.0X     1.5X     1.25X     1.0X     0.75X     0.5X          多音轨          AirPlay          0          静音播放中,点击 恢复音量          画中画          网页全屏          全屏          你可以 刷新 试试          视频信息     1.33.6          播放信息 上传日志 调试信息 [X]          视频ID     VID     -          播放流水     Flowid     -          播放内核     Kernel     -          显示器信息     Res     -          帧数     -          缓冲健康度     -          网络活动     net     -          视频分辨率     -          编码     Codec     -          mystery     mystery     -          按住画面移动小窗          jcode 记忆功能演示                    它会将每轮对话转换为语义向量,并利用记忆图谱管理这些信息。当新任务到来时,系统会通过余弦相似度检索与当前对话有关的记忆,再将命中的信息注入上下文。                   为了降低“相似但不相关”的记忆干扰,jcode还可以调用独立的Memory Sideagent,对召回内容进行二次判断。  二、经营者部署的人工智能客服:不能因技术介入弱化经营者责任  经营者自行部署的人工智能客服工具,是其经营服务链条的组成部分。                   这个Sideagent既可以验证记忆是否真正相关,也可以继续执行信息检索,再把整理后的结果交给主Agent。实践中,一些人工智能客服可能出现价格费用说明与实际不一致、优惠活动规则解释不准确、重要限制条件提示不足等问题;在发生争议后,个别经营者还可能以“人工智能自动生成”“系统自动回复”等为由,与相关答复进行责任切割,逃避应承担的责任。                   记忆的写入也不完全依赖用户操作。

F | 上述问题容易使消费者对交易价格、费用构成和售后服务等产生错误认识,影响消费者的知情权和公平交易权。                   当对话发生明显语义漂移、间隔一定轮次或者会话结束时,记忆Sideagent可以从对话中抽取值得长期保存的信息,写入记忆图谱。

G |                    在后台模式(Ambient Mode)下,系统还会定期整理和整合记忆,检查过期信息与潜在冲突。                   jcode将多会话工作流作为核心设计目标。                   用户可以让jcode作为后台服务器持续运行,再从不同终端连接到同一服务。

H | 《消费者权益保护法》规定,消费者享有知悉其购买、使用的商品或者接受的服务的真实情况的权利。经营者对消费者就其提供的商品或者服务的质量和使用方法等问题提出的询问,应当作出真实、明确的答复。多个会话可以复用同一个后台服务,并由服务端统一管理会话连接、Agent通信和协作状态,而不需要为每个终端都重新启动一套完整的运行环境。                   根据项目公布的自测结果,按照PSS内存指标计算,在关闭本地嵌入功能时,jcode运行一个活跃会话的内存占用约为27.8MB。  中国消费者协会敦促部署人工智能客服工具的经营者加强审核和管理,确保人工智能客服提供的信息与商品服务实际情况、价格费用、活动规则、合同约定和售后政策保持一致,并提供便捷有效的人工客服和纠纷解决渠道。

I | 而Claude Code约为386.6MB,约是 jcode 的13.9倍。

J | 经营者利用人工智能提高经营服务效率的同时,应建立相应的责任承接机制;对于人工智能客服在经营服务过程中向消费者作出的涉及价格、费用、售后等重要答复,不能仅以“算法自动生成”等理由简单免责,更不能通过相关声明不合理减轻或者免除依法应承担的责任。  中国消费者协会呼吁有关部门进一步完善人工智能在消费领域应用的相关规范,结合不同服务类型和应用场景,进一步明晰服务提供者、经营者等主体的责任边界和治理要求,推动形成权责清晰、规范有序的人工智能消费服务环境。同时提醒广大消费者理性认识通用生成式人工智能的信息辅助和参考属性,对涉及价格费用、合同条款、售后服务、法律责任等重要消费信息,不宜仅依据人工智能生成内容作出决定,应通过经营者官方渠道、合同文本、监管部门及其他权威渠道进行核实确认。                             当活跃会话增加到10个时,两者的资源差距更加明显:jcode的内存占用约为117MB,Claude Code则达到约2300.6MB,约为jcode的19.7倍。                   从会话扩展成本来看,jcode每增加一个会话,额外内存占用约为9.9MB;Claude Code每增加一个会话则需要约212.7MB,约为jcode的21.5倍。                             jcode的另一项重要能力,是原生Swarm多智能体协作。

K |                    当Agent A修改了Agent B此前读取过的文件,服务器会主动通知Agent B,提醒它当前代码已经发生变化。Agent B可以根据任务相关性忽略提醒,也可以查看Diff,确认自己的修改是否需要调整。

L |                    Swarm协作文件变更通知                    不同Agent之间还可以发送私信、广播消息和同步任务状态。主Agent也能够自主创建新的Agent团队,把工作拆分给不同成员并行处理,自己则转变为负责规划、调度和汇总结果的协调者。                   为了降低大仓库中的上下文消耗,jcode还开发了面向Agent的代码搜索工具Agent Grep。                   该工具会在搜索结果中加入文件结构、函数列表和函数所在位置等信息,让模型在不读取全文的情况下,大致判断相关代码承担什么作用。                   还会根据Agent已经看过的内容,自适应地截断重复搜索结果。                   Skills也采用了类似的按需加载思路。jcode不会在启动时把所有Skill完整写入上下文,而是对当前对话进行语义匹配,在检索到相关Skill时再自动注入。                   用户和Agent仍然可以通过工具或斜杠命令手动激活Skill,但无关的说明不会长期占据上下文窗口。

M |                    浏览器能力同样纳入了Harness设计。目前jcode内置的浏览器工具主要通过Firefox Agent Bridge工作,可以执行打开页面、获取内容、点击、输入、填写表单、截图、滚动和上传文件等操作。                   jcode最有趣的功能是Self-Dev模式。

N |                    进入这一模式后,Agent可以直接修改jcode自身的源代码,随后完成构建和测试,重新加载生成的二进制程序,并继续处理原有的一个或多个会话。                   如果用户不满意界面布局、工具行为或者某项工作流,可以让Agent直接修改Harness本身,而不必完全等待项目维护者提供新功能。                   这让人想到翁荔最近提出的一个判断,在模型能够稳定修改自身权重之前,AI的自我改进可能会率先发生在Harness层。《DeepSeek崔添翼力挺翁荔最新长文:AI自进化先从Harness开始》                    jcode的Self-Dev正是提供了象征意义的工程样本。                   02          安装教程                    (1)macOS 和 Linux          `curl -fsSL https://jcode.sh/install | bash`                    (2)Windows 11          `irm https://jcode.sh/install.ps1 | iex`                    安装完成后,在终端输入 `jcode` 即可启动交互式界面。                   03          总结                    总的来说,jcode能够为Coding Agent搭建一套更完整的工作系统,让智能体记得更久、协作得更好,也能在用户授权下按需改造自己的运行环境。

Current article:http://rwex2ep.liaoenxingunchuanglou.buzz/mnl8gf/20260826/3669482.html

Published on:08:46:47