AIGLM-5.3 拆解:参数没涨,后训练如何硬拉 50% 辉哥 发布于 2026-08-14 收录于 AI 智能体实践📌 7430亿参数原地踏步,编程能力却涨了50%——智谱这次没靠堆参数,而是靠"后训练Scaling"。这背后是方法论层面的重要信号。 ...
AIQwen3.8-Max 全拆解:2.4T 国产旗舰值不值得用 辉哥 发布于 2026-08-14 收录于 AI 智能体实践📌 2.4 万亿参数的国产旗舰大模型,API 已上线,权重已开源——它到底值不值得你掏钱接入?这篇把它拆到零件级。 ...
资源Soup:4GB 笔记本 GPU 微调 8B 模型的开源新方案 辉哥 发布于 2026-08-05 收录于 免费资源与机会📌 微调 8B 大模型的最低门槛,被一个开源项目拉到了 4GB 显存——普通笔记本 GPU 就能跑。这不是魔法,是 layer streaming 技术。看完这篇,你可以在自己的电脑上微调一个专属模型。 ...
AI2026本地部署LLM实战:从硬件选型到推理全链路 辉哥 发布于 2026-07-12 收录于 AI 智能体实践📌 本地跑大模型不是省钱——是为了数据不出本机。这篇从GPU怎么选到框架怎么配,一篇文章让你在本机跑起生产可用的大模型。 ...
资源2026免费大模型API完全指南:从零成本到生产级 辉哥 发布于 2026-07-12 收录于 免费资源与机会📌 免费API不是噱头——2026年,你在Coding时用的模型可以一分钱不花。这篇把每个免费入口的额度、限制、注册流程都列清楚了。 ...
资源Gemini 免费 API 零成本上手指南 辉哥 发布于 2026-07-03 收录于 免费资源与机会如果你要做 AI 应用原型,第一步不是充值 OpenAI,而是去拿一把免费的 API Key。Google AI Studio 的免费层目前给到 Gemini 3.5 Flash + Gemini 3.1 Flash-Lite,1M token 上下文窗口,每天 1500 次请求,原生多模态——文字...
AISkillWeaver 架构拆解:Agent 面对千工具时的 Token 优化实操 辉哥 发布于 2026-07-03 收录于 AI 智能体实践一把工具钥匙打开千把锁 写 Agent 的人都有个体感:工具少的时候,把所有 function definition 塞进 system prompt 就完事了。但当你接入 MCP 生态,工具数量从十几个膨胀到上千个的时候,光工具描述就能吃掉好几万 token——还没算用户的实际请求。阿里最近发表的...
AIDeepSeek DSpark 全解析:推测解码如何让 V4 推理快 4 倍 辉哥 发布于 2026-06-27 收录于 AI 智能体实践📰 本文选自自游人今日AI科技日报 引言 2026年6月27日,在完成500亿元融资之后,DeepSeek放出的第一个开源成果不是新模型——而是一套让现有模型跑得快得多的工程方案。没有改模型架构,没有加参数,但端到端生成速度提升了60%-85%。 ...
资源freellmapi:16 家免费 API 一个端点全聚合,月省 17 亿 Token 辉哥 发布于 2026-06-27 收录于 免费资源与机会你的免费token矿 先说一个反直觉的事实:目前市面上至少有16家AI厂商提供免费API额度,加在一起每月超过17亿token。单拿其中任何一家都是"玩具级",但如果你能把它们叠在一起? ...
资源GLM-5.2 零成本部署指南:从 Cloudflare Workers AI 到本地 RTX 4090 辉哥 发布于 2026-06-27 收录于 免费资源与机会写在前面 2026年6月17日,智谱正式上线并开源了GLM-5.2——这意味着你能零成本拿到Code Arena全球盲测第一名的模型能力。本文不罗嗦,直接给你三条上桌路径。 ...