AIMRAgent记忆框架:让AI Agent不再金鱼记忆,Token成本暴降96% 辉哥 发布于 2026-06-27 收录于 AI 智能体实践📰 本文选自自游人今日AI科技日报 引言 2026年,AI Agent遍地都是。Claude Code帮你改代码,Cursor帮你写需求,各种"智能助手"跑在你的终端里,看着很聪明。 ...
AIPrompt注入2026全景:2000人挑战0成功,你的Agent防线够吗 辉哥 发布于 2026-06-27 收录于 AI 智能体实践📰 本文选自自游人今日AI科技日报 引言 “Ignore previous instructions.”
AIGLM-5.2 本地部署实战:M3 Ultra 跑出 21.6 tok/s 辉哥 发布于 2026-06-24 收录于 实用工具与脚本📰 本文选自 自游人今日AI科技日报 GLM-5.2 是什么? 2026年6月17日,智谱(Z.ai)正式上线并开源 GLM-5.2。它不是一个普通迭代——这是目前 开源模型中综合实力最强的,MIT 协议,不做地域限制。 ...
AIPrompt Injection无解之谜:模型分不清「你是谁」和「你什么角色」 辉哥 发布于 2026-06-24 收录于 AI 智能体实践📰 本文选自 自游人今日AI科技日报 一个四年无解的漏洞 Prompt Injection(提示词注入)从2022年被发现至今,始终占据OWASP LLM Top 10威胁榜首[^1]。四年过去了,没有任何单一技术能根治它——不是因为安全社区不努力,而是因为它不是代码漏洞,是架构级别的结构性缺陷。...
AIQwen-AgentWorld上手指南:用语言世界模型训练Agent 辉哥 发布于 2026-06-24 收录于 AI 智能体实践📰 本文选自 自游人今日AI科技日报 Agent训练的范式转换 训练AI Agent一直有个麻烦:你得给它真实的环境去交互。想让Agent学会用终端?搭个沙箱。学会操作浏览器?开个Chromium。学会用操作系统?配个虚拟机。每种环境都要配一套独立的执行引擎——开发成本高、速度慢、还容易出错。 ...
AISelf-Harness:让AI Agent学会自我修复的框架 辉哥 发布于 2026-06-24 收录于 AI 智能体实践📰 本文选自 自游人今日AI科技日报 Agent的上限在Harness,不在模型 AI Agent领域2026年有个越来越明确的共识:一个Agent在真实任务里能不能跑顺,核心决定因素不完全是模型本身。系统提示怎么写、工具怎么暴露、错误怎么恢复、什么时候验证中间产物、什么时候停止无效探索——这些围...
AIGLM-5.2 本地部署与量化实战指南 辉哥 发布于 2026-06-18 收录于 AI 智能体实践GLM-5.2 是 Z.ai 发布的 GLM-5 系列升级版本,Unsloth 提供 GGUF 转换与动态量化版本,用于本地推理。 很多人想在本地跑大模型,但往往受限于硬件配置,效果打折扣。这篇文章帮你搞清楚 GLM-5.2 的真实能力边界,告诉你它适合什么场景、怎么部署、怎么选量化,尤其适合想在本...
AIDiffusionGemma:谷歌新模型用扩散架构把文本生成提速4倍 辉哥 发布于 2026-06-13 收录于 AI 智能体实践📰 本文选自 自游人今日AI科技日报 引言 所有大模型都有一个共同点:它们都是一个字一个字往外蹦的。
AIGemma 4 12B 无编码器多模态终章:本地跑的AI Agent时代已来 辉哥 发布于 2026-06-13 收录于 AI 智能体实践📰 本文选自 自游人今日AI科技日报 引言 2026年6月3日,Google DeepMind 发布 Gemma 4 12B。这不是一次普通的参数规模更新——它在技术上做出了一个关键转向:不再给语言模型外挂视觉/音频编码器,而是把所有模态统一到一个 Decoder-only Transformer...
AINvidia RTX Spark 发布:本地运行 120B 大模型的 AI PC 新时代 辉哥 发布于 2026-06-02 收录于 AI 智能体实践还在为笔记本跑不动大模型而烦恼吗?想在本地流畅运行120B参数的AI助手却只能望洋兴叹?Nvidia刚刚发布的RTX Spark系列芯片可能就是答案!这颗革命性的Arm架构CPU不仅能在消费级笔记本上本地运行120B参数大语言模型,还带来了完整的Windows生态和游戏兼容性。本文将为你深度解析这款...