暂无搜索历史
腾讯开源 Hy4 preview,Qwen3.8-Flash-Next 提前放出了 Qwen4 的架构方向,智谱揭晓匿名跑了一周的 Ox Alpha 就是 GL...
前几期,我们更多是在告诉 Codex“要做什么”。至于哪些设计不能改、哪些事实不用重新调查、遇到信息缺口时该停在哪里、做到什么程度才算完成,这些规则一直作为实践...
上一篇拆 Agent Loop 时,我们看到一次 Turn 会被拆成多个 Step。用户的消息会先进入 Session,模型生成的内容也会持续地写入 Sessi...
上一期我们讲了 Skill Agent 小知识 | Skill 的设计与生命周期:从工具接口到能力模块。一套做事方法被封装以后,Agent 可以在需要时发现、加...
本文基于 @deepseek-ai/dsh 0.1.1-rc.2(npm latest 标签),对应仓库标签 dsh-v0.1.1-rc.2,commit b1...
Embedding 模型从文本扩展到图片、视频和视觉文档之后,训练需要处理的数据类型和任务也变得更加复杂。如何把不同模态、不同任务的数据组织进同一套训练体系,并...
围绕让 Agent 根据执行轨迹自动修改 Skill,近期已经出现了一批相似思路的方法:先执行任务,分析成功与失败轨迹,再生成 Skill 修改,并通过验证集决...
Coding Agent 的代码写得越来越好之后,开发者还要花时间学习软件工程基础吗?吴恩达就这个问题更新了他的 AI Engineering Skills M...
小七准备开个新坑,找些好用的 Skill,实测跑一跑,看看它们到底是真提效,还是 README 看起来很美。第 1 期本来想走一个经典的剧本:先让 AI 裸跑出...
DeepSeek Harness 发布才两周,但翻看它的 Git 历史,会发现它在第一个公开 rc 出现之前,其实就在内部打磨了两个月。
上一期我们聊了 Agent 的环境,承载文件、网页、进程和数据库等真实对象,工具则构成 Agent 的观察空间与行动空间。
长程任务给 Coding Agent 堆积了冗长的交互轨迹,但操作流水账不等于执行状态:早期读取的代码在多轮修改后早已失效,系统却无法阻止模型拿着过时信息决策或...
前一篇讨论 Cordis 插件架构「解读 Cordis:dsh 一切皆插件背后的运行时设计」时,我们看到 dsh 把工具、模型适配器、会话、Agent Loop...
上一期「dsh 拆解系列 Vol.01:没有固化内核的 Agent 运行时」最后留下了一个问题:插件可以挂进运行时,卸载时又怎么把它带来的变化清理干净?
随着 LLM 进入真实业务环境,LLM Serving 面临的问题正从单纯的单次推理加速,扩展到集群层面的资源调度与运行效率。一次请求的计算成本不仅取决于模型参...
现在 Agent Skill 已然成为扩展 Agent 能力的重要方式之一。将某个领域的操作说明、示例和工具用法整理成 Skill,在 Agent 遇到相关任务...
Cursor 开始托管代码,Warp 把多个 Coding Agent 组织成“软件工厂”,Vercel 也开源了轻量 Agent Harness。写代码只是开...
本文基于 @deepseek-ai/dsh 0.1.0-rc.7(npm latest 标签),文中的包名与依赖数据都可以用文末命令复现。dsh 目前处于 de...
上一期我们聊了 Agent 的三种编排方式:ReAct、Plan-and-Execute 与 Workflow Graph。编排解决的是任务接下来往哪里走,工具...
暂未填写公司和职称
暂未填写个人简介
暂未填写技能专长
暂未填写学校和专业
暂未填写个人网址
暂未填写所在城市