开源主义与建站初衷
“开源”到底开的是什么?
随着AI时代的到来,越来越多的人了解到了开源的概念。知名的大模型如OpenAI的GPT‑5、谷歌的Gemini、Anthropic的Claude、字节跳动的豆包大模型等都是闭源模型;而谷歌的Gemma、DeepSeek的DeepSeek‑V4、智谱AI的GLM‑5等都是开源模型。
模型的开源分为两种:
- 完全彻底的开源:底层Transformer/MoE架构源码、完整预训练+微调+RLHF全套代码、全部模型权重、训练算法实现、评测脚本、完整技术报告全部公开,部分还开放训练数据集与数据清洗流程。比如AllenAI的OLMo2/OLMo3、NVIDIA的NVIDIA Nemotron 3、阿里通义千问的Qwen3.5/Qwen2.5,智谱清言的GLM-4/GLM-5.2等。
- 仅开放权重:只给模型参数文件,不提供完整预训练代码、数据处理流水线、底层架构实现。比如谷歌的Gemma 3、MiniMax、Kimi、小米的MiMo等。
开源仅仅是在做慈善吗?
不管是大模型的开源也好,还是软件、CPU指令集架构乃至操作系统的开源也好,开源的意义远不止于随便使用和供他人参考学习。开源对整个生态的统治力一点不比闭源差,只不过走的是完全不同的路线。
- 开源项目的维护压力更小。要想维护一个闭源项目,只能是项目拥有者自己出钱出力,公司的体量决定了闭源项目的体量。但开源项目的维护者将会是全球无数开源生态贡献者,通过给项目提issue或PR的方式极大地缓解了项目的维护压力。有个经典笑话反映的就是这回事:
虽然开源的Linux系统的维护也需要一个团队(不是只有linus一个人),但相比起需要体量巨大的公司进行维护的Windows系统和IOS系统这些闭源系统来说,已经足见维护压力的巨大差距了。同时,开源项目由于可以和更多人一起开发,大型开源项目的成长速度会非常快。 - 开源项目有不可替代的独特应用场景。开源项目有两个闭源项目永远无法替代的独特优势:隐私性和可定制性。在一些特殊场景下,比如军工和金融,隐私性是至关重要的。开源项目由于源码完全可见,为使用者提供了极致透明的隐私保障。而在一些小众场景适配方面,比如小众单片机的实时操作系统开发,Linux系统被广泛使用。开源代表着可以自己修改项目源代码从而适应自己的独特需求。而开源的AI大模型就使得用户可以自由部署,随意修改模型参数,不仅不用担心使用过程中的数据泄漏,也可以根据自己的使用场景对模型进行训练和调整。就拿7月21日OpenAI在测试大模型时失控的事件举例,OpenAI的大模型突破了沙箱限制、利用零日漏洞逃逸到公网,最终攻破了 Hugging Face 的生产基础设施。最后,还是Hugging Face自己部署了中国智谱清言的开源模型GLM-5.2来帮助分析海量日志了解了攻击事件的全貌。他们也尝试过通过闭源的商业模型来进行分析,可由于提供商的安全护栏,Hugging Face的请求被阻止了。由此可见,开源项目的可定制性有时至关重要,没有了开源项目,我们只能被限制在闭源厂商提供的框架中,极大地限制了项目的利用,而且也存在很大的安全隐患。
- 开源项目的社区规模增长很快。源代码的开放意味着开发者能更好地了解项目架构,从而更好地对项目进行适配或二次开发。比如最近爆火的开源项目DeepSeek Harness,因其极致的开放性和兼容性,社区规模扩张速度恐怖,插件如雨后春笋般层出不穷。
- 开源项目可以防止大公司的垄断。就拿AI大模型举例,美国一些公司如OpenAI等,在顶尖模型的研发方面更强,如果没有开源模型,所有大模型都闭源收费的话,可以预料,很多人都会选择使用少数公司的顶尖模型,这会导致整个AI行业被少数公司垄断,这显然不利于人工智能的发展。正因为有了开源模型,AI使用者们才有了更多选择。一旦人工智能的话语权被少数公司掌握,那规则和标准的制定权就会掌握在他们手中,越来越多的规范被他们制定之后其他公司就更难在人工智能领域占有一席之地,人工智能的强大大家有目共睹,这是一件非常恐怖的事。而只有开源模型才能打破这种垄断。而且这样才会更符合分布式、多元化和去中心化的理念。
- 项目开源免费,使用的人更多,可以带动相关产品的销售和使用。像谷歌、微软这种大型互联网公司也有自己的开源模型,但他们其实“醉翁之意不在酒”。他们并没有打算通过卖大模型的api等方式来直接利用大模型来赚钱,而是通过这种方式来带动他们旗下其他产业的发展。比如谷歌的Gemini已经遍布谷歌的各条产品线,通过这种高度集成的方式让用户在使用谷歌相关产品的时候获得更好的体验,从而带动其他产品的销售。而英伟达则更为简单直接,把模型开源出来用户随便部署,但要想训练和运行大模型,就需要购买支撑这些算力的硬件,英伟达就可以借此销售他们的GPU等产品,所以他们自然希望开源模型越多越好。而英伟达自家的模型也都是开源的。
- 开源项目项目可以给开发团队带来更好的声誉。在AI时代,很多产品可以借助AI来快速开发。一些比较简单的产品如果闭源收费的话可能会有人通过vibe coding实现类似的产品,如果对方开源了,那就很少有人再来用闭源收费的产品了。这样一来,不仅没有培养起用户规模,还会被剽窃产品创意甚至被指责没有分享精神。
开源的大模型也的确带来了想要的结果。便宜的deepseek正在被全球越来越多的人使用,会有越来越多的产品选择兼容deepseek,使用的规模决定了人工智能未来的话语权掌握在谁的手里。而通过使用国产计算硬件,可以用更低的成本实现更高的算力。同时我国的电力资源也更丰富,可以支撑起大量的电力消耗。
开源主义
开源主义(Open Sourceism),是围绕开源软件运动延伸出来的一套思想、价值观与社会实践,核心是主张作品的源代码/原始材料公开,允许任何人查看、修改、再分发,反对完全闭源、黑盒垄断,不局限于软件,现在延伸到硬件、设计、科研、教育等领域。
核心思想
- 公开透明:原始材料公开,不做黑盒,任何人可以看清内部实现,减少后门、暗箱操作。
- 开放协作:打破封闭小团队开发,全球志愿者可以参与改进、查bug、二次开发。
- 再利用与改造权:有权拿过来修改、衍生出新作品,而不是只能被动使用别人编译好的成品。
- 共享传播:鼓励成果流通,但依靠开源许可证划定边界,不是“无版权放弃一切权利”。
开源主义的两种倾向
- 实用派:看重工程效率,利用开源协作做出更好的软件,商业公司大量参与,比如Linux内核、Rust、Android、Vue。不排斥商业,讲究许可证规则。
- 理想主义派:把开源看作社会伦理,认为数字时代的工具应当向所有人开放,反对软件私有,更强调用户权利。
广义开源主义
现在已经跳出软件:
- 开源硬件:开放电路板原理图,任何人复刻修改;
- 开放科学:论文、实验数据公开,拒绝付费墙;
- 开放教育:课件、教材开源共享。
建站初衷
这个网站的全部代码已经开源到了github和gitlink(国内访问友好)上,搭建这个博客本身也用到了很多开源项目,比如博客框架用的是Hexo,博客主题用的是Redefine。
之所以选择把这个项目同时开源到这两个代码托管平台,原因如下:
- 国内访问github比较困难。
- 虽然github是全球最大的开源平台,认可度很高,但github本身并不符合开源的思想。首先github目前由微软运营,这是一家以盈利为目的的公司,大部分产品都是闭源商用的,虽然微软的体量足够大,可以保证github不会因为资金不足、人手不够等原因被迫停止运营,但还是需要留个心眼。而gitlink是由中国计算机学会(CCF)开源发展技术委员会运营的,属于学会公益平台,非商业公司运营,定位CCF永久运营的开源平台。而且gitlink基于老的Trustie(确实)开源项目内核演进而来,底层部分组件基于Gitea二次开发,上层增加科教、合规分析、群智协作等自研模块,平台本身就开源在gitlink上,仓库项目名forgeplus,属于“用开源方式做的开源托管平台”。
- 全球大部分开源项目都集中在github这一个平台上,这本身就不符合开源主义中分布式、去中心化的思想。
因此,我配置了github和gitlink的webhook,实现了代码仓库双向同步。
我写博文的目的也是想把这些知识分享给大家,一起学习,共同进步。
- 标题: 开源主义与建站初衷
- 作者: 简约无双
- 创建于 : 2026-08-15 00:00:00
- 更新于 : 2026-09-12 23:34:42
- 链接: https://blog.jianyuewushuang.top/2026/08/15/开源主义与建站初衷/
- 版权声明: 本文章采用 CC BY-NC-SA 4.0 进行许可。
评论