Marico's space
首页
我的日志
我的游记
世界·视野
编程技术
Marico's space
首页
我的日志
我的游记
世界·视野
编程技术
技术合作:
look@marico.cc
+86 18660050334
loading...
单块 TPU 自托管轻量级 agent 后端:Gemma 4 2B + vLLM(v5e-1)
8-11 17:38
最近折腾了一下在单块 TPU 上跑轻量级 Agent 后端,踩了几个坑,这篇把问题说清楚。实测跑 google/gemma-4-E2B-it 在 vLLM 下能到 1,496 tokens/秒 的聚合吞吐,单流延迟 8.02 ms,还自带原生 tool-calling。算下来支撑 8-16 个并发轻量 Agent,每百万输出 tokens 成本大概 $0.107。 这是一篇带数据的复盘文,所有数
调试 Claude Code Agents:阅读转录、追踪工具调用、定位问题所在
8-11 14:51
最近折腾 Claude Code Agent,踩了几个坑,这篇把调试方法说清楚。 大多数 Agent 调试问题源于把 AI 执行当成同步代码来对待。开发者习惯性地加 console.log、单步调试,然后纳闷为什么本地好好的 Agent 上线就挂了。执行模型根本不一样:Agent 在多次 LLM(大语言模型)调用中做出非确定性决策,每次决策都受到上下文影响,而上下文在每次运行之间是变化的。 传
使用 GitHub Copilot 和 Microsoft Agent Framework 在 Python 中构建安全的仓库维护智能体
8-11 11:28
前面折腾过 .NET 版本的仓库维护智能体,能检查代码、提出修复方案、运行测试、报告结果,所有写操作和 shell 命令都需要人工确认。这篇来用 Python 实现同样的功能。 安全策略和实现目标故意保持一致——不想因为 Python 实现起来更方便就悄悄选个更简单的演示。两个版本使用相同的测试用例、相同的指令、在相同的审批节点停下、必须通过相同的测试。唯一不同的是宿主语言。 最终得到的是一个
Agent 的权限清单应纳入版本控制,而非写在 Prompt 里
8-10 20:57
最近折腾 AI Agent 的权限控制,踩了几个坑才想明白一件事:把安全边界写在 Prompt 里,就像把门禁密码贴在门框上——不是没用,是完全不够用。这篇把问题说清楚,顺便给个能跑的具体方案。 你代码库里大概率有个系统 Prompt 写着"不要修改项目目录以外的文件"。然后某天这个 Agent 欢快地改了你 $HOME 下的文件,只因为用户请求换了个说法。这两个事实之间的差距,就是整个问题的核
AWS CloudFormation — 基础设施即代码、模板、Stacks 与 Change Sets
8-10 17:36
最近在系统性地把 AWS 基础打扎实,准备从传统运维往云/DevOps方向转。CloudFormation 是 AWS 基础设施自动化的地基——把"在控制台点点点"变成"可以 review、版本化、可复现的代码",这是云工程师的必备技能。 TOPICS COVERED # Topic Type 1 What is IaC and Why It Exists Concept + Intervi
ServiceNow Incident Management 与 Tower Stack Light 集成
8-10 14:49
最近折腾了 ServiceNow 和物理报警灯的集成,把 IT 故障直接变成红灯闪烁加蜂鸣,踩了几个坑,这篇把实现方案说清楚。 这篇聊聊 ServiceNow Incident Management(事件管理)与物理塔灯/堆栈灯集成的架构、实现方案、安全控制和运营价值。核心目标是把 ServiceNow 里的关键和高优先级事件自动转成物理的视觉和声音报警,减少人工盯着仪表盘的情况。 实现概述
CrowdStrike Falcon:现代端点安全实践入门
8-10 11:28
过去十年,网络安全的玩法彻底变了。 传统杀毒软件基本靠已知病毒特征库吃饭。但现在的攻击手法已经进化到勒索软件、凭证窃取、无文件攻击、横向渗透、云工作负载,动不动就是APT级别的对手。 CrowdStrike Falcon 就是这个背景下冒出来的平台。 这篇聊聊 Falcon 是什么、底层怎么跑的、为什么这么多企业在用,以及怎么自己动手试试。 CrowdStrike 是什么公司 Crowd
AI Agent 边界测试:免费服务器上的 Fake-Tool Harness
8-7 20:57
能不能测出一个 AI 编程 Agent 越过工具边界的频率有多高——在免费服务器上安全测试,不碰一个真实文件?完全可以:给它一堆假工具,只记录调用日志,在假文件里埋陷阱指令,然后对着日志打分。这篇就是我自己搭的测试框架,亲测有效,而且只要能跑 Python 的地方就能跑——包括免费档次的服务器加免费模型接口,我就是这么跑的。 上周又刷到一个帖子讨论 AI Agent 越来越多功能——Shell
理解未来国防部网络空间专业人员的安全架构
8-7 17:34
最近在研究CompTIA Security+ (SY0-701)认证的内容,发现安全架构这块知识点挺多而且挺重要。这篇把相关概念捋一遍,方便以后复习,也给同样在准备考试的同学做个参考。 安全架构(Security Architecture)简单说就是保护信息、网络和关键运营的技术系统设计。对于想在国防部(DoD)这类军事和政府机构从事网络安全的同学来说,理解不同架构如何提升安全性、可用性、韧性和
AI Agent 部署后中断任务的恢复
8-7 14:51
部署是 AI Agent 运行中断最常见的原因。不是崩溃,不是超时——就是一次普通的下午发布,而一个 14 步的运行任务刚好卡在第 9 步。 Pod 收到 SIGTERM,内存里的东西全没了。如果任务重试,就得从零开始,把那 9 步重新跑一遍,副作用也重新执行一遍。 要让这个过程变得可靠,需要四件独立的东西,但团队通常只做了其中一件就觉得万事大吉了。 1. 进程外部的状态 如果你用 La
共 389 条, 共 39 页
第
1
2
3
...
39
页