AI改变了什么?
现在的AI究竟是在做什么
很多人其实不知道现在的AI能力究竟是什么?说白了就是一个很会“说话”的电脑程序。从22年ChatGPT3.5问答、到25年的DeepSeek-R1思考、到26年的开源的KimiK3也能有不俗的编程能力,还是有Seedance2.0做视频赶超对手等,本质都是让AI好好“说话”。
- 一问一答:你问什么,大模型就根据训练过的能力,回答什么
- 画图/做视频:也是“说话”能力,因为图片和视频在电脑中最终也是表达成代码,所以看懂和写代码也是AI会说“话”的其中一种。只是我们的语音是中文、英文,AI厉害一点还能说电脑端语言。
- 听说能力:同样的,语音在电脑中也是可以通过代码存储、传输的,所以TTS、STT能力也是AI会“听说”的延伸。
- Agetn(智能体):把以上所有的能力,通过工程手段(即预设大量办事逻辑的提示词、接口调用能力),让AI在做随机生成“语言”的时候,更加偏向性的选择正确的回答,就是说出来我们“期待”的答案。说得越准确,我们得到的文档、图片、视频、代码就会越可用。
怎样让AI说得准(我们想要的答案),就是AI工程师要解决的问题。
AI发展的70年
人工智能在图灵年代就一直开始研究,直到算力达到一定规模才成就现在处处都在用AI的时代。
- 图灵测试:通过人和AI做对话,如果回答能让一半以上的人不知道这就是AI,就通过测试。这个猜想现在为止最大的贡献就是拍成电影《银翼杀手》。因为,暂时来说你不论和什么AI对话,基本上都会有一股扑面而来的AI味。
- DeepMind:是IBM、谷歌最先开始的人工智能研究团队,最辉煌的成就是下棋,从国际象棋到围棋,都击败了当年的棋圣级人物。
- ChatGPT:这个由美国OpenAI公司通过Transformer理论、英伟达的CUDA生态打造的第一个让C端火爆的聊天智能体。
- DeepSeek时刻:本来OpenAI公司是致力做开源模型的,但是地缘政治、资本控制等原因,现在这个棒由中国的DeepSeek、Kimi等公司接力开源模型,主要的贡献是用GPT几分之一、几十分一的订阅、推理、训练价格来达到几乎一样的智能。最新的DeepSeekV4-Flash公测版被誉为所有大模型的斩杀线,只有比DeepSeekV4-Flash公测版更便宜,或者更聪明的模型才有可能活着,这几乎砍杀了90%市面上的主流模型。
AI的发展预测
普通人使用AI不需要绑死在一个厂商或模型上,也不需要现在就花大钱来获得什么AI壁垒的能力。因为AI也在经历一场类似“摩尔定律”的演变。即:
- 最新的模型,一般在一年半载后秒杀现在所有模型。
- AI的使用成本大约每年下降90%。
- AI的学习难度大约每年下降一个维度。
AI的使用场景
AI其实已经在方方面面都影响到我们了,不论抖音、B站、视频号的AI短剧和视频,还是每次接到骚扰电话大部分都是AI语音,还有是现在广告宣传都是AI制作,再是汽车自动驾驶的AI算力和智驾等级之争。
- 豆包:毫无疑问在手机APP,豆包占领了市场的大头,但是因为免费模式,所以豆包的变现场景不佳。需要靠火山大模型给输血,现在更要集成飞书。不然像字节这样的大公司也烧不起钱来养豆姐。
- Workbuddy:这个从龙虾、Claude Code、Codex等智能工具脱颖出来的牛马打工人手替工具,已经威胁到豆包了,能让字节针对Workbuddy做战略调整的,腾讯终于是上了AI的牌桌了,尽管Hy3还是一坨。但是中国的开源大模型拯救了这家靠“一直借鉴一直爽”的公司。
- ComfyUI:凡是AI做图、做视频都离不开以ComfyUI为代表的这些工具。大型工作室为了节省Token费用,还需要自己部署服务器来跑最新的绘图、视频生成模型。
- Ollama:本地部署是要不过去的一个坎,有的是为了隐私问题、有的是为了突破审核、有的是为了省Token,不论是用vLLM、llama.cpp,都是推理工具之争,还有WebUI的选择、终端选择、MCP还是CLi选择都是看场景的。
- liblib:很多时候本地部署的成本太高,技术要求也不低,所以就有网上开箱即用的AI网站,更多是做画图、视频的工作流快速开箱即用的场景使用。需要充点数,但是成本一般都不低。如一部60分钟的AI短剧,就单纯的Token投入可能就需要3~5万元。但是也比真人短剧还是便宜不少的。
- CUDA:要训练和推理AI,就离不开生态。英特尔、AMD、英伟达、华为、摩尔线程、砺算科技、寒武纪、龙芯…一堆的生态,一个模型要从这么生态里面选择一个来用做全栈适配,一般还是离不开英伟达的CUDA,因为是社区生态够大,中小厂商从成本出发没得可选。对于普通消费者来说就是,我要跑得动XXX模型,我是应该买5090显卡,还是AMD AI MAX 395?
- AIPC:可以说,AIPC是25年最大的骗局,每家都在吹,但是那可怜粑粑的NPU压根啥都做不了,最后还是需要联网用API。真的要入门做本地AIPC,最起码都是AMD的AI-MAX-395、摩尔线程的AIBook、英伟达的高端显卡游戏本。
个人0成本怎样体验AI?
- 下载豆包、DeepSeek、千问、Kimi、智谱等APP先用起来,普通用户90%的场景其实这些APP或PC客户端就能解决。
- 使用Workbuddy、OpenClaw、Hermes这样的Agent工具为自己的办公增加一点效率。这里就需要自己赚一些点数、积分了,或者花钱每个月一百、几十元买点API的Token能提升工作效率还是不错的。
- 用手头电脑安装Ollama、LM Studio这样的工具来本地跑2B、4B、7/8B、14B、27B、35B这样的模型。能跑得动多大的模型主要看显存(内存)大小和速度。
- 打造24小时的私人智能体、私人聊天陪伴机器人。这时候就需要一台24小时运行的服务器,最好是在阿里、腾讯有一台,部署OpenClaw、Hermes、AstrBot这样的智能体,连上QQ来使用,配合Ollama跑一些去掉审核的模型,干比较隐私的事情就更加安全了。
AI取代人的工作?
这个说法对,也不对。
- AI确实不可逆的会取代绝大部分的人类的“累活”,AI的思考让写作、创作过程更加简单和直接。具身智能让搞体力劳动和危险工种更加不值钱。
- 跟人类进入蒸汽时代、电力时代、计算机和通信时代一样,生产力提升的到来,反而让人更加“忙”了。就是人的工作时长、工作强度、工作难度都更高了。
- 但是反过来看,如果AI和具身智能的成本是贫民百姓能负担得起的话,生活难度会降低,生活质量会提高。这也是显而易见的,前提是不搞弄断、不搞歧视、不搞对立。
- 风险⚠️也随之而来,跟蒸汽机发明、电力发明、放射性发现、核弹发明的初期一样,都会伴随大量的不确定性的破坏能力。人工智能取代人类,跟核子武器毁灭世界一样,没有监管的滥用肯定会带来巨大的社会风险需要全球人来承担的。
- 这是不是人类文明自我毁灭的最后一个拼图?大概率不是,因为AI现在的算力太耗能源了,如果廉价可控核聚变成了,算力芯片又有新的突破了,这才有可能是人类集齐了自我毁灭的三件套。智力、武力和理由。
后话
这篇软文,本想用Workbuddy+hy3来校对,hy3还说我贬损它,哈哈。
结果我让hy3帮我改,它就抽风了。
后面Workbuddy也不让我切换成DeepSeek来继续,搞笑。