site logo

Marico's space

最近折腾了一个挺有意思的问题:企业里文档改来改去,但一线员工还是按老办法干活。这个Gap怎么填?我把答案做成了一个叫 DRIFTZERO 的系统,这篇把背景和实现说清楚。 运营变革的最后一公里 大企业对改文档这事很熟练。 新政策审批过了。 标准操作规程更新了。 工作流调整了。 培训邮件发出去了。 新版本正式生效了。 但问题是:第二天干活的人,可能执行的还是昨天的流程。 这个Ga
搭一个EKS集群20分钟就够,但把它跑稳、跑安全、跑省钱,那可就是另一回事了。Demo上跑通和扛住双十一流量之间,隔着安全加固、智能弹性伸缩、成本管控和版本升级这些硬活儿。 这篇聊聊EKS生产环境该做的那些事:安全策略怎么配、Karpenter怎么调、成本怎么砍、二次运营怎么搞。 EKS责任共担模型 ┌────────────────────────────────────────────
最近在给 .NET 微服务接入大语言模型时,踩了几个坑,特别是在选 Azure OpenAI Service 还是直接用 GPT-4 API 这个问题上纠结了一阵。这篇把两种方案的认证方式、延迟、费用、合规要求这些关键差异说清楚,顺带分享一套在 AKS(Azure Kubernetes Service)上跑生产级聊天机器人的实践方案。 TOKEN 成本、合规与延迟:看不见的隐形成本 在微服务
最近在折腾 Agent(人工智能代理)集成方案,踩了几个坑才搞明白一件事:光靠 MCP(模型上下文协议)做生产级工具链,远远不够。这篇说说 Corsair 这个思路,值得琢磨。 大多数 Agent 集成工具都把你锁死在单一场景里。接好 MCP 服务器让 LLM 调用工具,然后后端定时任务要调 Slack、用户后台要接钉钉,你又得重写一套 OAuth 流程和 API 适配器。Corsair(Git
最近折腾了一个在线教育 SaaS 的每周摘要推送功能,踩了几个坑,这篇把问题说清楚:公共 HTTPS 环境下,Webhook 推送、订阅模式、轮询三种方案怎么选。 先给结论:对于一个在欧美市场运营的小型教育 SaaS,每周发一次摘要,最稳妥的做法是——为每个客户每周维护一个幂等的投递任务,然后从轮询 worker 起步。只有当实测队列延迟、区域隔离需求或运维复杂度确实需要改进时,才考虑切换到队列
最近在搞航空毫米波雷达的信号处理架构,踩了不少坑,这篇把核心问题梳理清楚。 毫米波雷达装在飞机或无人机上,本质上是一个主动传感系统,用高频无线电信号探测、测量和跟踪目标。 但对开发者来说,最重要的是:这玩意儿不是一台只要输出目标坐标就完事的射频设备。 它是一个实时处理系统。 一个实用的架构大概是这样串起来的: 射频感知 → 数字化 → 信号处理 → 测量生成 → 导航对准 → 坐标变换
线上跑 PostgreSQL 时间长了,这个问题迟早会碰到: * 查询开始卡住不动 * 连接数蹭蹭往上涨 * 数据库响应越来越慢 * 连接数快要触及 max_connections 上限了 一个常见的原因就是某个会话把其他会话给堵住了。 典型场景就是连接处于 idle in transaction 状态——应用开了事务但既没 COMMIT 也没 ROLLBACK。 这篇文章聊聊怎么
最近折腾了一个定时运行的短视频脚本生成流水线,踩了几个坑,这篇把问题说清楚。 市面上的"自动化无脸YouTube频道"教程套路都差不多:拉一个RSS订阅源,用for循环遍历条目,把每个条目POST给大模型,塞一句"写一个40秒的TikTok脚本",把返回结果写到文件。四十行代码,演示没问题。 然后你设好定时任务,那些没人写过的问题就开始冒出来了: * 模型大约六分之一的概率返回一段没有分段
最近折腾微服务本地开发环境,踩了几个坑才把流程理顺。这篇把问题说清楚:怎么用 Docker Compose 配服务拓扑,用 Taskfile 套一层命令壳,让团队成员能一键启动、跑检查、看日志、干净重置。不会把底层工具藏起来,也不会搞一堆脆弱的 Shell 脚本。 具体场景是一个 API 服务、一个 Worker 进程、加 PostgreSQL(数据库)和 Redis(缓存)。涉及到 Docke
最近在给公司重构GraphQL架构,踩了几个坑,这篇把问题说清楚。 团队刚上GraphQL的时候,那感觉是真的爽。前端想要什么字段自己拼,一次网络请求搞定,类型还自动补全。但业务一扩张,问题就来了——GraphQL服务器变成了一个巨无霸单体。 假设你维护着一个服务几千万用户的国内电商平台,单用一个Node.js或PHP服务处理整个数据图,那这个代码库得同时理解用户、商品、评价、库存、支付……所
共 431 条, 共 44 页