120.9k
DietrichGebert/ponytail
让 agent 像「房间里最懒的高级工程师」。
哲学一句话:最好的代码是你没写的那部分。Skill 包在写码前强制走七级决策梯(YAGNI → 复用 → 标准库 → 原生能力 → 已有依赖 → 一行解 → 最小安全实现),压住 AI 过度工程。公开基准称约 −54% LOC、−20% token,且安全性不丢。今日日榜最凶,社区正把「反 bloating」写进默认技能栈。
周三:ponytail 一天 +1,364,Atlas 把「agent 的 git」推上热榜。LocalLLaMA 还在为 Qwen3.8 与硬件溢价吵;公开讨论里 OpenClaw 2.0、OrcaReplay,以及 Mistral 默认训练用户输入一并上场。
让 agent 像「房间里最懒的高级工程师」。
哲学一句话:最好的代码是你没写的那部分。Skill 包在写码前强制走七级决策梯(YAGNI → 复用 → 标准库 → 原生能力 → 已有依赖 → 一行解 → 最小安全实现),压住 AI 过度工程。公开基准称约 −54% LOC、−20% token,且安全性不丢。今日日榜最凶,社区正把「反 bloating」写进默认技能栈。
「真工程师」技能包,直接从 .agents 目录掏出来。
Matt Pocock 系技能库继续霸榜体量。和 ponytail、academic-research-skills、ECC 同日出现:行业叙事已从「再训一个模型」切到「给 agent 装什么技能」。日增过千说明技能目录本身成了分发面。
给 coding agent 用的源控:checkpoint 连回会话。
Rust / Tauri。每次 agent 跑出的 commit 会绑回 prompt、工具调用与推理;Claude Code、Codex 与 ACP 注册表里的其他 agent 可并行开在同一代码库,共享本地记忆。相对基数日增近九百,说明「谁改了什么、为什么改」正在变成多 agent 协作的刚需,而不只是 diff 好看。
全本地开源 ElevenLabs 替代,昨天也在榜。
克隆、音色设计、视频配音、听写、转写与有声书;16 TTS + 11 ASR,语言目录写 646。桌面端 + 本地 API + MCP。连续两天日增数百,本地语音工作流没有退潮,仍在跟 skills / harness 抢注意力。
Claude Code 学术流水线:research → write → review → revise → finalize。
把论文写作拆成可安装步骤包。r/MachineLearning 上「Claude Code for Research Papers」同题材帖仍热(258↑ / 63c),仓库日增八百说明「科研 agent」不再停在 demo,而在沉淀成可复用 skill。
开源 coding-agent CLI:云端与本地 provider 一把梭。
一套终端工作流接 OpenAI 兼容、Gemini、Ollama、Codex OAuth 等;带工具循环、MCP、slash、后台会话。社区用它躲开单一厂商锁定。日增七百多,和 hermes-agent、ECC 同榜:harness 层仍在军备竞赛。
Rust PDF 分流:扫描件还是可抽文本。
先分类再路由,避免 OCR 与纯文本解析混跑。连续多日上榜:文档 agent / RAG 的瓶颈从「能不能读」变成「怎么读得聪明」。boring infra 进日榜,通常意味着生产路径已经卡住。
「会自己长」的 agent,和 OpenClaw 2.0 正打对台。
程序化记忆把成功工作流收成可复用 skill;安全默认更硬。体量已近二十四万星,今天仍日增五百。公开评测与博文一边劝人跑双栈:OpenClaw 做网关,Hermes 做深执行。
Fable 发布帖引爆 r/ClaudeAI。
官方相关帖 1,426↑ / 403c;同板还有「被 nerf 了吗」(821↑)、Max 本地配置指南(1,240↑)、以及「$20 订阅还被不当回事」(574↑ / 280c)。社区在同时吵能力、配额与档位开放——新模型日的标准三件套。
元帖:这个版本身成了情报源。
853↑。和「Keeping up with model launches」(231↑)叠在一起,说明信息过载已经产品化——大家不只追权重,还在追「怎么追得过来」。本地社区的自我认知从硬件论坛扩成了实时雷达。
Qwen 系吃满热榜后,胃口开始要更大权重。
同板「Qwen will be the king?」(333↑)、「Everyone is t/s maxing 3.8」(124↑ / 118c,有人想退回 3.6)、Kaitchup 的 Qwen3.8-27B 量化基准(149↑)。吞吐狂欢之后,质量与工作流适配开始回潮。
Arena 风吹草动,评论区比发权重还热闹。
248 条评论:盲测榜仍是「今天该下哪个权」的信号灯。和 Spark-X2.5 小模型发布帖(208↑)并列,说明本地玩家一边盯巨头 Arena,一边扫可塞进边缘卡的新小模型。
r/MachineLearning 的清醒剂帖。
483↑。提醒圈子:不是所有榜首都需要更大的 transformer。同板还有「Claude Code for Research Papers」(258↑)、「Implementing Kimi K3 from scratch」(71↑)——研究向与工程复现帖仍比纯炒作耐读。
跨版文化冲击帖,评论比正文还长。
375c。LocalLLaMA 玩家撞上 r/singularity 的语气与先验,讨论迅速变成「什么叫严肃 AI 讨论」。信息茧房之间的摩擦本身,成了今天社区气象的一部分。
硬件帖:内存叙事一动,本地玩家就竖耳朵。
同日还有 CMP 170HX 故障率吐槽(130↑)、DGX Spark / GB10 涨价讨论。本地推理的真实约束仍是显存、带宽与单价,而不是又一个聊天榜分数。
安装与浏览器改造拖成全面重写;多人大云会话成头条。
版本号 2026.8.1,933 贡献者。创始人 Peter Steinberger 公开说团队改用 team.openclaw.ai 共享 agent,「本地 harness 像文物」。Vincent Koc 称本版吞掉项目有史以来约一半 PR。社区反馈两极:有人丝滑升级,有人网关与自动化翻车。安全加固在,但沙箱与审批默认仍关。
两周双开结论:重用户别二选一。
OpenClaw 赢在通道与权限审计;Hermes 赢在记忆深度与自生成 skill。作者建议 OpenClaw 做编排层、Hermes 做深执行,并用 hermes claw migrate 降低切换成本。和今日 GitHub 上 hermes-agent 仍日增五百互相印证:叙事已从「谁取代谁」变成「怎么叠」。
「AI agents need a debugger。」今天刚发。
OrcaRouter 开源引擎:把一次 agent 执行收成可回放 trace,可从任意步重放、调试或分叉换模型 / prompt / 工具结果。对 shell、API、文件系统等有副作用步骤,可复用录制输出而非盲目重跑。GitHub 已公开。可观测性从日志迈向时间线调试。
欧洲「更隐私」叙事撞上默认开关。
标题党争议很大:页面允许 opt-out,但 Team 档是否能组织级统一关闭、默认是否打开,评论区吵成一团。对照 Claude Team 默认不训练的说法,讨论迅速扩成「付费是否该换来默认关闭」。和 AI 产品信任绑定,值得盯。
GEO / AI SEO 的脏战公开化。
报告称海量程序化「best of」页被 AI 搜索当信源引用;同日还有「三分之一 Perplexity 引用对不上数字」的审计帖。评论区把这条连到广告激励与模型偏爱「像自己写的」文本。检索质量危机,正在从 SEO 圈溢进主流 HN。
日榜 +1,364 背后,是一整套「少写才是高级」的传播。
DEV 长文把七级决策梯与基准数字讲清楚,Cursor / Claude Code 安装路径一并给出。和 caveman(少 token 说话)对照:一个砍输出文风,一个砍实现复杂度。技能层军备正在细分——不是更多工具,而是更狠的约束。