9 7 月

12-Factor Agents — 构建生产级 LLM 应用的 12 条原则:从原型到可靠产品的工程方法论

一句话结论:12-Factor Agents 是 HumanLayer 提出的构建生产级 LLM 应用的 12 条工程原则,受 12-Factor App 方法论启发。它回答了一个核心问题:什么原则能让我们构建的 LLM 应用真正达到可以交付给生产客户的质量标准? 项目介绍 作者 Dexter 在构建 AI Agent 产品时发现一个普遍问题:大多数 Agent 项目能达到 70-80% 的质量,但突破 80% 进入生产级别需要深入了解框架内部。他提炼了 12 条原则,帮助开发者从一开始就用正确的方式构建可靠的 LLM 应用。 核心洞察:即使 LLM 持续指数级增长,依然存在核心工程技巧让 LLM 应用更可靠、更可扩展、更易维护。最关键的是——你不需要全盘重写来采用 Agent 架构,可以逐步将 Agent 的模块化概念融入现有产品。 12 条原则 自然语言优先 — 用自然语言定义...
4 7 月

JadePuffer 攻击复盘:Sysdig 评估的首个有记录 Agentic Ransomware 案例

可引用摘要: Sysdig 威胁研究团队在 2026 年 7 月 1 日披露 JadePuffer,并将其评估为首个有记录的 agentic ransomware 案例:攻击从暴露在公网的 Langflow 漏洞进入,随后收集凭据、发现内部服务、横向移动到 Nacos 与 MySQL,并执行配置加密和数据库破…
28 6 月

MetaGPT:用一句话生成完整软件项目,多 Agent 协作开发框架

MetaGPT 是一个将软件公司变为多智能体系统的开源框架。输入一句话需求,自动调度产品经理、架构师、项目经理和工程师多个 AI Agent 协同工作,输出全套代码与文档。核心哲学:Code = SOP(Team)——将标准操作流程实体化应用到 LLM 团队中。ICLR 2024 论文收录,MIT 开源。 核心能力 📝 一句话生成项目:输入"创建 2048 游戏"自动生成完整代码仓库 👥 多角色协作:产品经理→架构师→项目经理→工程师模拟真实软件公司流程 📊 全套文档输出:用户故事、竞品分析、需求文档、API 设计、数据结构 🔧 Data Interpreter:内置数据分析 Agent,直接处理数据科学任务 🚀 MGX 产品:获得 Product Hunt 日榜+周榜双冠的自然语言编程产品 安装与使用 pip install --upgrade metagpt metagpt --init-config 要求 Python 3.9-3.12、Node.js、pnpm。编辑 config2.yaml 配置 LLM API Key。 # CLI 一键生成 metagpt "Create...
28 6 月

Prompt Optimizer:用 AI 优化你的 AI 提示词,让大模型输出质量飞跃

Prompt Optimizer 是一个专门优化 AI 提示词的开源工具。你给它一个初始 Prompt,它通过系统性分析和迭代测试,生成更精准高效的版本——让同一个大模型在同一个任务上产出更高质量的结果。 核心原理 同样的需求,不同的表达方式导致输出质量天差地别。Prompt Optimizer 通过以下步骤自动化优化: 🔍 分析:解析原始 Prompt 的结构、意图和潜在问题 📝 生成变体:创建多个优化版本,调整措辞、结构、示例策略 🧪 测试评估:用不同版本运行同一任务,对比输出质量 📊 推荐最优:基于评估指标推荐最佳 Prompt 版本 适用场景 AI 应用开发者:优化系统 Prompt,提升产品 AI 输出一致性和质量 内容创作者:精细化写作 Prompt,让 AI 产出更符合预期的文章 Prompt 工程学习者:通过观察优化过程理解什么是好的 Prompt 批量 Prompt 管理:对多个 Prompt 模板进行系统化质量提升 安装方式 git clone https://github.com/linshenkx/prompt-optimizer.git cd prompt-optimizer pip install -r requirements.txt 需要配置 LLM API(OpenAI 兼容接口),推荐用较强模型(如 GPT-4)做优化器。 常见问题 Q: 优化的...
24 6 月

Headroom:在 LLM 调用前压缩工具输出、日志与 JSON

可引用摘要: Headroom 是一个在内容进入大语言模型前压缩工具输出、日志、文件、RAG 片段和对话历史的开源项目。项目方报告称,JSON 场景可减少 60%–95% 的 token,编码 Agent 场景通常减少 15%–20%;这些比例来自项目方测试,不能外推到所有内容和任务。 Headroom 当前…