最近我做了一些数学计算,这让我意识到世界有多么崩坏。一个光标20美元,有缺陷的最大值100美元,GPT专业版又100美元,Gemini Ultra再100美元,更不用说eleven labs、deep sea k和我两年前注册但早已忘记的所有API密钥——我对AI的上瘾变得如此昂贵,以至于我不得不戒掉酒精和禅修。我并非个例,因为美国酒精销量目前正处于历史低点,而这要归咎于大型AI公司。但这成为了我的觉醒时刻。自那以后,我取消了所有这些订阅,现在自行托管了面向开发者的终极AI技术栈,这不仅更便宜,而且效率更高。在今天的视频中,我们将介绍一系列可以在自己服务器上运行的免费开源项目。我们会让它们协同工作,同时仍可选择接入Claude和GPT soul等大型模型的智能。今天是2026年9月7日,您正在收看代码报告。

我们需要讨论的第一个工具是ollama,因为每个AI技术栈首先都需要一个模型。对大多数人来说,这意味着将专有代码发送给价值万亿美元的公司,并相信他们会完全保密。或者您可以使用Olama在本地完成所有操作。我在频道中多次提到过这个工具,本质上,它就像是大型语言模型的docker。它为您提供了一个简单的命令行界面和API,用于在本地机器上下载和运行模型。如果您想尝试最新的中文模型或其他开源模型,这非常棒。更妙的是,您的所有提示都保持私密,推理成本为零,这意味着即使您的信用卡被拒付,模型仍能继续工作。

但最大的问题是,您可能没有能运行接近最先进水平的硬件。小型模型几乎可以在任何地方运行,但运行一个前沿规模的Zed模型将需要一个小型数据中心。如果您是需要编写顶级代码的氛围工程师,这就是个大问题。幸运的是,有一个名为nine router的自托管解决方案,这是一个位于您的AI工具与数十个不同模型提供商之间的AI工具,通过一个本地端点连接。无需同时管理九个不同的API密钥,nine router提供了一个带有OpenAI兼容代理的单一入口,让您可以通过localhost连接一切。

但nine router真正酷的地方在于其故障转移层级。在第一层,您可能有已付费的现有订阅,如Claude max。然后在第二层,您可能有作为备份的廉价按量付费OpenAI模型。第三层则包含所有免费提供商,如中文模型、vertex试用积分等。这意味着如果您用完了Claude max的额度,它会自动转移到下一层,无需您进行任何操作。除此之外,nine router还会跟踪使用情况,并压缩您的工具输出以减少token消耗,最终为您节省大量资金。

但如果您每天仍消耗数十亿token,那么您需要了解headroom,这是AI代理的上下文压缩层。您要求AI居中一个div,为此它读取了50,000行package-lock.json文件。然后它蒸发了一个奥林匹克标准游泳池的水量。它刚刚意识到需要安装tailwind css。headroom位于您的应用程序和模型提供商之间,在真正发送给模型(这将是可计费的输入)之前,压缩从工具输出到日志文件的所有无用数据块。这个工具的一个巧妙设计特点是它是可逆的。发送给模型的压缩内容缓存在您的本地机器上,这意味着如果模型需要,它随时可以检索。

听起来很棒,但此时您可能想知道:我该在哪里部署所有这些?答案当然是Hostinger,今天视频的赞助商。它不仅是托管您自己虚拟私有服务器最经济实惠的地方之一,而且面板中还内置了完整的docker目录,这意味着我在本视频中讨论的每个开源项目都可以一键托管在那里。事实上,您可以在同一台VPS上运行所有这些工具并让它们协同工作。前往hostinger.com/fireship并使用我的优惠券代码,在启动自己的VPS时节省大量资金。

一旦完成这些,您接下来要安装的工具是diffy。到目前为止我们讨论的都是基础设施,但现在是时候构建一个真正能让我们致富的应用程序了,而不是试图通过提示词来设计一切。diffy是一个可视化构建器,允许我们在画布上拖放节点。这对Horse Tinder及其AI匹配功能来说是一个改变游戏规则的工具。应用程序将向diffy发送每匹马的个人资料信息。然后一个可视化工作流从数据库中检索兼容的马匹,并…