site logo

Marico's space

最近折腾了一下在单块 TPU 上跑轻量级 Agent 后端,踩了几个坑,这篇把问题说清楚。实测跑 google/gemma-4-E2B-it 在 vLLM 下能到 1,496 tokens/秒 的聚合吞吐,单流延迟 8.02 ms,还自带原生 tool-calling。算下来支撑 8-16 个并发轻量 Agent,每百万输出 tokens 成本大概 $0.107。 这是一篇带数据的复盘文,所有数
最近折腾 Claude Code Agent,踩了几个坑,这篇把调试方法说清楚。 大多数 Agent 调试问题源于把 AI 执行当成同步代码来对待。开发者习惯性地加 console.log、单步调试,然后纳闷为什么本地好好的 Agent 上线就挂了。执行模型根本不一样:Agent 在多次 LLM(大语言模型)调用中做出非确定性决策,每次决策都受到上下文影响,而上下文在每次运行之间是变化的。 传
前面折腾过 .NET 版本的仓库维护智能体,能检查代码、提出修复方案、运行测试、报告结果,所有写操作和 shell 命令都需要人工确认。这篇来用 Python 实现同样的功能。 安全策略和实现目标故意保持一致——不想因为 Python 实现起来更方便就悄悄选个更简单的演示。两个版本使用相同的测试用例、相同的指令、在相同的审批节点停下、必须通过相同的测试。唯一不同的是宿主语言。 最终得到的是一个
最近折腾 AI Agent 的权限控制,踩了几个坑才想明白一件事:把安全边界写在 Prompt 里,就像把门禁密码贴在门框上——不是没用,是完全不够用。这篇把问题说清楚,顺便给个能跑的具体方案。 你代码库里大概率有个系统 Prompt 写着"不要修改项目目录以外的文件"。然后某天这个 Agent 欢快地改了你 $HOME 下的文件,只因为用户请求换了个说法。这两个事实之间的差距,就是整个问题的核
最近在系统性地把 AWS 基础打扎实,准备从传统运维往云/DevOps方向转。CloudFormation 是 AWS 基础设施自动化的地基——把"在控制台点点点"变成"可以 review、版本化、可复现的代码",这是云工程师的必备技能。 TOPICS COVERED # Topic Type 1 What is IaC and Why It Exists Concept + Intervi
最近折腾了 ServiceNow 和物理报警灯的集成,把 IT 故障直接变成红灯闪烁加蜂鸣,踩了几个坑,这篇把实现方案说清楚。 这篇聊聊 ServiceNow Incident Management(事件管理)与物理塔灯/堆栈灯集成的架构、实现方案、安全控制和运营价值。核心目标是把 ServiceNow 里的关键和高优先级事件自动转成物理的视觉和声音报警,减少人工盯着仪表盘的情况。 实现概述
过去十年,网络安全的玩法彻底变了。 传统杀毒软件基本靠已知病毒特征库吃饭。但现在的攻击手法已经进化到勒索软件、凭证窃取、无文件攻击、横向渗透、云工作负载,动不动就是APT级别的对手。 CrowdStrike Falcon 就是这个背景下冒出来的平台。 这篇聊聊 Falcon 是什么、底层怎么跑的、为什么这么多企业在用,以及怎么自己动手试试。 CrowdStrike 是什么公司 Crowd
能不能测出一个 AI 编程 Agent 越过工具边界的频率有多高——在免费服务器上安全测试,不碰一个真实文件?完全可以:给它一堆假工具,只记录调用日志,在假文件里埋陷阱指令,然后对着日志打分。这篇就是我自己搭的测试框架,亲测有效,而且只要能跑 Python 的地方就能跑——包括免费档次的服务器加免费模型接口,我就是这么跑的。 上周又刷到一个帖子讨论 AI Agent 越来越多功能——Shell
最近在研究CompTIA Security+ (SY0-701)认证的内容,发现安全架构这块知识点挺多而且挺重要。这篇把相关概念捋一遍,方便以后复习,也给同样在准备考试的同学做个参考。 安全架构(Security Architecture)简单说就是保护信息、网络和关键运营的技术系统设计。对于想在国防部(DoD)这类军事和政府机构从事网络安全的同学来说,理解不同架构如何提升安全性、可用性、韧性和
部署是 AI Agent 运行中断最常见的原因。不是崩溃,不是超时——就是一次普通的下午发布,而一个 14 步的运行任务刚好卡在第 9 步。 Pod 收到 SIGTERM,内存里的东西全没了。如果任务重试,就得从零开始,把那 9 步重新跑一遍,副作用也重新执行一遍。 要让这个过程变得可靠,需要四件独立的东西,但团队通常只做了其中一件就觉得万事大吉了。 1. 进程外部的状态 如果你用 La
共 389 条, 共 39 页