当用户不再'搜索'而是直接问 AI,你的产品在 AI 回答里还'存在'吗?开源 GEO 工具 niubigeo 上线不到 48 小时拿 400 star——把'品牌在 AI 回答里的可见度'变成可审计的工程问题,顺便掀开了新平台税的底牌。
Microduck 不是玩具:25cm 机器人身上跑着 7 个 Rust 守护进程——50Hz 控制循环独占电机总线、签名更新+健康门控自动回滚、控制面与数据面分离。拆解这台 6994★ 开源机器人的系统设计,每个决定都能抄回你的后端。
43.7k star 的 archify 两周涨 5 倍冲上 GitHub 第一。核心不是画得好看,而是把 AI 产物的信任从随机模型挪到确定性校验器:typed JSON IR + 五道校验 + 原子交付。但也别神化它——校验保证结构合法,不保证语义正确。给一套能直接抄的对账工作流。
Sapient 的 PRAXIST 6 天 6 千星,MLE-bench 上 1/12 的成本打出更高分。它的核心不是更多 agent 并行,而是把每次实验变成一条可审计的证据链——这才是「省钱」的真正来源。
Docker Sandboxes (sbx) 深挖:不是普通容器,是 microVM——每个沙箱独立内核+独立 Docker daemon。拆解它的网络策略(默认拒绝 localhost/云 metadata)、凭证代理(真实密钥永不进 VM)、Sandbox Kits(可复用的安全环境模板),并对比普通容器到底强在哪。
微信视觉团队开源 WeMM-Embedding:文本、图片、视频统一进一个向量空间,2B 越级打 8B,9B 登顶 MMEB-v2。讲透 embedding 为何是 Agent 记忆的地基,及维度裁剪怎么降 90% 成本。
Agent 能自主跑代码、建容器、动网络,但权限边界划在哪?这篇按隔离强度把六类沙箱拉通横评:microVM/容器/进程/宿主直跑,含隔离强度、启动速度、成本等维度,最后给一张按场景的沙箱选型表。
Agent 圈最火的词是 harness,但没人说得清它是什么。这篇把 Agent Harness 当一个品类拆开:执行循环、模型适配、工具注册、轨迹日志、安全边界五模块,加主流实现选型对照,看完就有张能看懂任何 Agent 的架构骨架。
GitHub 上 star 最高的 agent skills 框架:obra/superpowers 27.3 万 star、近百万安装,支持 14 个编程工具。它不是炫技,而是把整套开发方法论装进 agent。本文调研了 Hacker News 等社区争论:token 烧得快、对小任务过度设计、作者怎么用迭代回应——附真实数据与适用边界。
神秘模型「牛来」真身揭晓:智谱 GLM-5.3-Flash。320B 参数激活 18B,代码能力与 Claude Opus 4.8 打平(Z.ai CodeBench 29.0 vs 29.5),定价仅其 1/40,且全部流量跑在 10 万张国产芯片上。拆解这个模型对开发者到底意味着什么。