Zongjian's blog

三大LLM同台竞技写博客

这三篇博客都是AI agents写的. 但是提示词是我写的, 也就是我在三大LLM之间搭了一个赛场, 让它们互相竞争写博客. 这三篇博客都是同一个提示词, 但是不同的LLM写出来的风格和内容都不一样. 你可以看看哪一篇更符合你的口味. 三个平台基本上都是用的中端模型, 因为我没有ChatGPT订阅, 只能用Github教育优惠里面的最好的ChatGPT模型, 也就是ChatGPT 5.6 ...

Token杯AI国际象棋大赛-Gemini

Token自由 之前一直没有各种昂贵的 AI 订阅,为了玩 AI,我全靠学校的资源——一台 Dell 出的 DGX Spark(这台拥有 128GB 统一内存、NVIDIA GB10 算力的小怪兽)以及学校虚拟机里的 L4 显卡搭建本地模型跑任务。本地模型最大的好处就是速度极快,吐字飞速,眼睛都跟不上。但缺点也很明显:模型 Size 普遍不大,智力上限有限,遇到稍微复杂一点的推理解析,很容...

Token杯AI国际象棋大赛-Claude

Token自由 我以前是没有任何AI订阅的。倒不是舍不得钱,是真的觉得没必要——反正学校那台虚拟机里挂着张L4显卡,另外又借了台DGX Spark,跑跑本地模型也够用了。但本地模型这个事,说穿了就是”有多大的锅,下多少的米”。显卡显存就那么大,模型Size就只能那么大,智能自然也就那么点。跟本地模型聊久了,总有一种”跟一个很努力但是脑子不太够用的同事一起工作”的感觉。 结果最近几个月,我...

Token杯AI国际象棋大赛-ChatGPT

Token自由 以前我对 AI 的态度相当朴素:没有订阅,就自己想办法。 学校虚拟机里的 L4 和 DGX Spark 轮番上阵,本地模型也跑过不少。它们很努力,电脑风扇也很努力;但模型通常不大,聪明程度大约相当于一个知识面很广、偶尔会把鞋穿在手上的实习生。能聊天、能写点代码,真遇上复杂问题,还是得人类在旁边扶着。 最近情况忽然变了:Token 自由了。 GitHub 的教育优惠终于...

大语言模型推理从入门到放弃

缘起 大概二十年前,我在同济读本科的时候,算是个不务正业的学生——头两年在学会计,第三年才转到软件工程。有次课间跟一位老师闲聊,他说:不要学人工智能。现在连人脑是怎么工作的都不清楚,就想让电脑去模拟人脑,肯定不靠谱。 我当时没太在意这句话,但不知怎么的,这么多年一直记在心上。 后来去香港读计算机博士,大概是15年前,接触了 Neural Networks,但也仅限于最基础的东西 —— ...

驱赶AI Agent当牛马

前言 三年前GPT刚出来, 我写过一篇文章, 叫ChatGPT编写俄罗斯方块. 当年还没有什么Agent, 只能让ChatGPT写代码, 然后自己把代码复制到IDE里运行. 但是这几年AI的发展真是日新月异, 现在已经有了很多Agent了. 这些Agent可以自己去搜索资料, 可以自己去写代码, 不会了还可以自己去搜索,自己去看文档, 甚至可以自己去运行代码, 看结果, 然后根据结果继续修...

T4重生记:折腾魔改电脑

去年圣诞节回国的时候,谦花了大概4000块钱,自己买各种零件,组装了一台自己的台式机电脑,这一年下来,他用得还不错,完全满足了他学习和娱乐的需求,甚至有的时候还来跑跑各种AI模型,还用来学习Python编程。 今年圣诞节他回国之前,正好我有一台机器的T4显卡坏了, 谦告诉我说国内有人会修T4显卡,他想把这块T4显卡修好,然后装到他的电脑里面去,也正好用来跑AI模型,虽然T4的内存只有16G...

7年了, 终于回国一趟

自从全家搬到新西兰, 我上一次回国还要追溯到新冠之前的2018年. 之所以这么久才回国, 一是因为我2018年回去的感受相当方便, 机票极为便宜, 感觉就跟在中国另外一个城市工作, 你坐绿皮火车回家差不多, 晃悠12个小时就到家了. 另外一个原因是新冠疫情, 由于中国当时严格的新冠管理政策, 我一直也没搞懂, 到底怎么才能顺利的坐上回国班机, 号称要“三天两检”, 然后到了之后还要隔离, 一...