资源Soup:4GB 笔记本 GPU 微调 8B 模型的开源新方案 辉哥 发布于 2026-08-05 收录于 免费资源与机会📌 微调 8B 大模型的最低门槛,被一个开源项目拉到了 4GB 显存——普通笔记本 GPU 就能跑。这不是魔法,是 layer streaming 技术。看完这篇,你可以在自己的电脑上微调一个专属模型。 ...
AI2026本地部署LLM实战:从硬件选型到推理全链路 辉哥 发布于 2026-07-12 收录于 AI 智能体实践📌 本地跑大模型不是省钱——是为了数据不出本机。这篇从GPU怎么选到框架怎么配,一篇文章让你在本机跑起生产可用的大模型。 ...
资源2026免费大模型API完全指南:从零成本到生产级 辉哥 发布于 2026-07-12 收录于 免费资源与机会📌 免费API不是噱头——2026年,你在Coding时用的模型可以一分钱不花。这篇把每个免费入口的额度、限制、注册流程都列清楚了。 ...
资源Gemini 免费 API 零成本上手指南 辉哥 发布于 2026-07-03 收录于 免费资源与机会如果你要做 AI 应用原型,第一步不是充值 OpenAI,而是去拿一把免费的 API Key。Google AI Studio 的免费层目前给到 Gemini 3.5 Flash + Gemini 3.1 Flash-Lite,1M token 上下文窗口,每天 1500 次请求,原生多模态——文字...
AISkillWeaver 架构拆解:Agent 面对千工具时的 Token 优化实操 辉哥 发布于 2026-07-03 收录于 AI 智能体实践一把工具钥匙打开千把锁 写 Agent 的人都有个体感:工具少的时候,把所有 function definition 塞进 system prompt 就完事了。但当你接入 MCP 生态,工具数量从十几个膨胀到上千个的时候,光工具描述就能吃掉好几万 token——还没算用户的实际请求。阿里最近发表的...
AIDeepSeek DSpark 全解析:推测解码如何让 V4 推理快 4 倍 辉哥 发布于 2026-06-27 收录于 AI 智能体实践📰 本文选自自游人今日AI科技日报 引言 2026年6月27日,在完成500亿元融资之后,DeepSeek放出的第一个开源成果不是新模型——而是一套让现有模型跑得快得多的工程方案。没有改模型架构,没有加参数,但端到端生成速度提升了60%-85%。 ...
资源freellmapi:16 家免费 API 一个端点全聚合,月省 17 亿 Token 辉哥 发布于 2026-06-27 收录于 免费资源与机会你的免费token矿 先说一个反直觉的事实:目前市面上至少有16家AI厂商提供免费API额度,加在一起每月超过17亿token。单拿其中任何一家都是"玩具级",但如果你能把它们叠在一起? ...
资源GLM-5.2 零成本部署指南:从 Cloudflare Workers AI 到本地 RTX 4090 辉哥 发布于 2026-06-27 收录于 免费资源与机会写在前面 2026年6月17日,智谱正式上线并开源了GLM-5.2——这意味着你能零成本拿到Code Arena全球盲测第一名的模型能力。本文不罗嗦,直接给你三条上桌路径。 ...
AIMRAgent记忆框架:让AI Agent不再金鱼记忆,Token成本暴降96% 辉哥 发布于 2026-06-27 收录于 AI 智能体实践📰 本文选自自游人今日AI科技日报 引言 2026年,AI Agent遍地都是。Claude Code帮你改代码,Cursor帮你写需求,各种"智能助手"跑在你的终端里,看着很聪明。 ...
AIPrompt注入2026全景:2000人挑战0成功,你的Agent防线够吗 辉哥 发布于 2026-06-27 收录于 AI 智能体实践📰 本文选自自游人今日AI科技日报 引言 “Ignore previous instructions.”