最新文章
讲清 Claude Code Auto Mode 与 Telegram Channels 的工作方式、安装配置、权限取舍和远程开发边界,帮助你在手机上驱动本地会话完成写码、测试和调试。
规格驱动开发(Spec-Driven Development)用 spec → plan → code 三份文档串起来,每个阶段之间插入人工审查。本文对比 Superpowers、GitHub Spec Kit、BMAD-METHOD 三套开源框架,并给出三个问题就能定的选型决策树。
Anthropic 官方总结:Claude Code 在百万行 monorepo、几十年遗留系统、上千开发者组织里能跑成什么样,取决于围绕模型搭建的"脚手架"——CLAUDE.md、hooks、skills、plugins、LSP、MCP、subagents 该怎么配,以及谁来负责维护。
通过一个 Python 私人训练助手示例,演示如何用 Supermemory 为 AI Agent 增加跨进程、跨会话的持久记忆,并理解记忆系统与 RAG 的分工。
HuggingFace 详解异步 Continuous Batching:通过 CUDA Streams、CUDA Events、双缓冲和 Carry-Over Mask,让 CPU 批次准备与 GPU 计算完全并行,将 GPU 空闲率从 24% 降至 0.6%,实测提速 22%。
NGINX Rift(CVE-2026-42945)是 nginx rewrite 模块中的严重堆溢出漏洞,影响 0.6.27 到 1.30.0 版本,攻击者通过一个精心构造的请求即可让 worker 进程崩溃,未启用 ASLR 的系统还可能被远程代码执行。本文整理漏洞原理、受影响范围、升级与临时缓解方案。
GitHub 团队把内部 12 个 Agentic Workflow 跑出了一个共性问题:未用的 MCP 工具、被反复调用的 LLM 数据获取、错误的 bash 白名单。他们用两个"自我审计 + 自我优化"的工作流去诊断和重构,9 个工作流拿到了显著的 token 节省,最高 62%。本文记录他们的方法论:ET 指标、CLI 替代 MCP、相关性门控等。
阿里通义万相 Wan 2.2 是目前性价比最高的开源文生/图生视频模型,TI2V-5B 单卡 24G 就能跑 720P。本文记录在阿里云 GPU 实例上从零部署的完整过程,包含实例选型、环境安装、模型下载、推理命令与常见坑。
从实例选型、CUDA 环境、Conda 与 PyTorch 安装、Flash Attention 编译,到 HuggingFace 模型下载与首次推理,完整记录在阿里云 GPU 服务器上跑通腾讯开源视频生成模型 HunyuanVideo 的全过程。
讲清 OpenAI Agents SDK 的沙箱执行模式,演示如何结合 Modal 创建隔离工作区,让智能体读取文件、执行命令、修改代码并返回结果。OpenAI Agents SDK 的新一代沙箱工作流,把智能体的编排层与实际执行环境拆开了。 应用本身负责智能体逻辑、模型调用和决策;真正的文件读写、命令执行、代码运行。