AI 智能体实践

2026本地部署LLM实战:从硬件选型到推理全链路
📌 本地跑大模型不是省钱——是为了数据不出本机。这篇从GPU怎么选到框架怎么配,一篇文章让你在本机跑起生产可用的大模型。

2026年大模型全景:选型、部署与Agent开发路线图
📌 AI不再稀缺。选哪个模型、怎么组合、在自己的场景里调优——这才是接下来的竞争力。 引言 2026年7月,大模型行业发生了两件看似矛盾的事。

AI Agent开发路线图2026:从入门到精通
📌 2026年,不会写Agent的开发者就是不会用AI的开发者。这篇路线图从框架选型到生产部署,手把手带你走完。

用900KB的Transformer把100MB压缩到7MB:HN社区吵翻了
📌 训练一个900KB的Transformer花20分钟死记硬背你的文件,然后呢?它能比gzip多压出3倍的剩余空间。代价是解压要45分钟。

SkillWeaver 架构拆解:Agent 面对千工具时的 Token 优化实操
一把工具钥匙打开千把锁 写 Agent 的人都有个体感:工具少的时候,把所有 function definition 塞进 system prompt 就完事了。但当你接入 MCP 生态,工具数量从十几个膨胀到上千个的时候,光工具描述就能吃掉好几万 token——还没算用户的实际请求。阿里最近发表的 …

Anthropic出口管制:全球AI格局正在被改写
📰 本文选自自游人今日AI科技日报 引言 2026年6月的AI圈,被同一件事炸了两轮。

DeepSeek DSpark 全解析:推测解码如何让 V4 推理快 4 倍
📰 本文选自自游人今日AI科技日报 引言 2026年6月27日,在完成500亿元融资之后,DeepSeek放出的第一个开源成果不是新模型——而是一套让现有模型跑得快得多的工程方案。没有改模型架构,没有加参数,但端到端生成速度提升了60%-85%。

MRAgent记忆框架:让AI Agent不再金鱼记忆,Token成本暴降96%
📰 本文选自自游人今日AI科技日报 引言 2026年,AI Agent遍地都是。Claude Code帮你改代码,Cursor帮你写需求,各种"智能助手"跑在你的终端里,看着很聪明。

Prompt注入2026全景:2000人挑战0成功,你的Agent防线够吗
📰 本文选自自游人今日AI科技日报 引言 “Ignore previous instructions.”

Claude Tag深度体验:Slack里来了个AI同事
📰 本文选自 自游人今日AI科技日报 这不是又一个Slack机器人 6月24日,Anthropic正式发布了Claude Tag——一个以"虚拟员工"身份常驻Slack频道的AI助手。它和此前所有Slack机器人的本质区别在于:它不只是在被@时回复你,它会主动读频道、拆任务、记 …