存储AI–AI博客聚合
最新聚合的文章
-
ZGI:别再做Agent Demo了,先问问它在业务里能不能撑过下周三
Agent从演示到生产环境,模型管理、数据连接、流程串联、权限治理等问题逐一暴露。ZGI以开源Runtime定位,统一管理模型、知识、Skills、Workflow,提供可观测性与自托管能力,让Age
-
第39章:MongoDB 极端性能调优与容量规划
1. 项目背景 业务场景:本地生活电商准备迎接年度最大促销——"618 年中大促"。运维团队接到死命令:系统必须扛住 10 万 QPS 的读写混合负载,P99 延迟 < 100ms。
-
AGI 时代终于来了!
OpenAI 发布 GPT-6-Astra,多项科学、数学、终端、医疗与网络安全基准刷新纪录。本文梳理它的能力跃迁、开放节奏,以及为什么这次可能是 Agent 时代的重要拐点。
-
给 Agent 一个检索式记忆:把对话历史存进 Milvus,该记的都记得
给 Agent 一个检索式记忆:把对话历史存进 Milvus,该记的都记得 开篇:一个很"贵"的 Bug 先看一段真实的教训。我上一版"带记忆"的 Agent 是这样写的: 你猜怎么了? 对话到第 3
-
好玩系列:训练一个神经网络模型指导小孩玩游戏2-大局观教练
“循着错误的思考方向得不到正确的答案”,AI不会就是不会。 在上一篇博客中,我们得到了一个求解器只能网络,这一篇和诸位一起实现“直接进行大局观指导”的神经网络…
-
Spring AI 教程
这份 Spring AI 教程基于 1.1.2 版本,讲解搭建、Advisors、记忆、工具调用、向量库 RAG、MCP 等,提供代码与调参要点,助力 Java 开发 AI 应用。
-
Gemini锐评GPT6:我要泼冷水扒底裤!
都说同行是仇家啊,这次换“Gemini” 来发表对GPT6的看法了! Gemini现在被称为“最路边的一条”,没想到的是Gemini3.8Flash,在DISS别人这方面还挺强的。 喷了GPT6,还喷
-
Agent Memory 进阶:用 LLM 总结压缩上下文,告别”金鱼记忆”
上一篇 《一文搞懂 Agent Memory 管理》 我们聊了 Memory 的三种截断策略:消息数量截断、Token 数量截断、总结压缩。但上一篇对"总结压缩"只放了一段伪代码,很多同学看完还
-
SpringBoot 集成 JQuick-Curl:Spring 环境完整接入教程,第三方接口调用别再到处手写模板类
SpringBoot 集成 JQuick-Curl:Spring 环境完整接入教程,第三方接口调用别再到处手写模板类 项目地址:https://github.com/dromara/jquick-cu
-
从跨域到 WebSocket:前端跨域方案、SSE 与双向实时通信详解
在前端开发中,“跨域”几乎是绕不开的话题。 刚开始学习跨域时,我们通常会接触 CORS、Nginx 反向代理、JSONP 等方案;但随着业务逐渐涉及实时聊天、消息推送、大模型流式输出,又会接触 SSE
-
TS 类型工具
extends 可以用来继承一个class,interface,还可以用来判断有条件类型(很多时候在ts看到extends,并不是继承的意识) 示例: 上面的类型意思是,若 T 能够赋值给 U,那么类
-
消息积压治理实战:从百万积压到消费追平的完整方案
讲透消息积压的排查、应急与根治:三板斧扩容的分区天花板约束、临时 topic 转发、批量消费、重置 offset 时机与预防监控,12 张图 + 代码。
-
Agent 编排 Agent:DeepSeek Harness 的子代理与工作流系统有多强
第14章:子代理与工作流编排——agent 如何编排 agent 一个 agent 能写代码、能跑命令。但如果任务太大——「重构这个模块」「同时修 10 个文件」——单个 agent 的上下文窗口会爆
-
Nuxt + Twin CSS 中宽度超过屏幕时底部出现空白的原因与解决方案
我的处理方案在给最包层去掉 flex 或者加上 max-w-full 就解决了 在使用 Nuxt 搭配 Twin CSS 开发页面时,很多人都会遇到一个比较常见但又不太好排查的问题:当页面内容宽度超过
-
Linux驱动基础(一):模块机制的设计与实现
写在前面 每个内核驱动开发者都写过这样几行代码: 它们看起来只是"填表"式的模板,但实际上,这几行代码背后是一套完整的工程方案:如何让同一份驱动源码,既能编译成运行时可插拔的 .ko 模块,又能静态编