编程导航AI大模型话题讨论

AI大模型

118 参与
分享

快来分享你的内容吧~

点击登录,快来和大家讨论吧~
表情
图片
话题
打卡
综合
交流
文章
问答

GPT5.5 代号“大蒜”?!OpenAI拉响红色警报

三年前,ChatGPT 横空出世,逼得谷歌仓促拉响“红色警报”;三年后,攻守易形,奥特曼深夜亲自在 OpenAI 内部宣布进入“红色警报”状态。 奥特曼反应如此激烈也是有原因的:**谷歌 Gemini 3 Pro 发布两周,ChatGPT日均访问量骤降 6%。而反观 Gemini,月活已经从 7 月的 4.5 亿上涨到了 6.5 亿,增长率高达44%。** 对大部分用户来说,好用,足以让他们转投另一个大模型。 ![img](https://pic.code-nav.cn/post_picture/1802564102293139457/rfXBoRTEAmJy3wA5.webp) 为此,奥特曼暂停了广告计划,推迟了个人助手“Pulse”,**并计划推出新的大模型。** 据知情人士透露,OpenAI 即将推出的是两款不同的大模型。其中一款推理模型预计最快能在下周上线,内部评估比 Gemini 3 要好。 另外一款代号“Garlic”(大蒜)的新模型,或许是 OpenAI 接下来应对 Gemini 3 的秘密武器。内部测试显示,Garlic 在编码和推理任务上已超越 Gemini 3 和 Claude 4.5。 ![X上消息](https://pic.code-nav.cn/post_picture/1802564102293139457/wdI9FCDbarSqFnY5.webp) 在 10 月的时候,奥特曼曾说要推出一款代号为“Shallotpeat”的大模型。 Shallotpeat 翻译过来大概是,带泥的葱头? Garlic 是大蒜。 有点好奇,OpenAI 起名的时候是去超市生鲜蔬菜区转了一圈吗? ![表情包](https://pic.code-nav.cn/post_picture/1802564102293139457/dWkXTkr1o7bv5qZM.jpg) 从消息来看,Garlic 关键突破在于预训练:Garlic 成功将海量知识压缩至更小的架构中,并修复了 GPT-4.5 的遗留问题。这意味着同性能下成本大幅降低,明年初或将以 GPT-5.2/5.5 面世。 并且凭借着 Garlic 的经验,OpenAI 已经启动下一代大模型的训练。 不过要训练更强的模型,就意味着烧钱,烧钱,还是烧钱。 ChatGPT 今年预期收入仅100亿美元,此刻又停下广告计划,那接下来的大模型竞争,就要烧掉更多投资人的钱。 据说 OpenAI 明年打算再融 1000 亿美元以维持运转。这样激进的烧钱方式,是否能让 OpenAI 在这场 AI 攻防战中再次获胜? 我们拭目以待即可。 毕竟,我们用户才是最大受益者——巨头卷得越凶,AI 进化越快,使用体验越好。

又被 Cursor 烧了 1 万块,我麻了。。。

大家好,我是程序员鱼皮。这段时间国外的大模型真是火到不行,像新出的 Gemini 3.0 和 Claude Opus 4.5,天天最强、天天炸裂,搞的我已经有些麻了。。。 的确目前国外的大模型在编程能力上是领先的,但 **不一定是最适合咱们的**。 大多数同学用 AI 文本模型无非就 2 个目的嘛: - 自己用来写代码 - 对外提供 AI 应用 先说说第一个场景,像我们团队虽然也在用 Cursor 去处理复杂任务,但是前段时间刚刚分享过账单,价格真是太贵了,才一个多月就花了 **1 万多**!我整个人都麻了。。。 ![](https://pic.code-nav.cn/post_picture/1601072287388278786/nwX30eKYTe3fBy2D.webp) 除了费用贵之外,国外的大模型在很多任务的处理速度上是不如国内大模型的,很容易把简单的任务搞复杂,费时又费钱。之前国内的 GLM-4.6 发布的时候,我也专门 [写文章做过对比](https://mp.weixin.qq.com/s/8Gr__biKvaiaJqAu-8k6Ag),让它和 Claude 一决高下,一起做个包含完整前后端代码的工具网站。 ![null](https://pic.code-nav.cn/post_picture/1601072287388278786/oMCYNxNGCnlI4dUG.webp) 结果 GLM-4.6 不仅速度最快,而且功能实现最完整,理解了我的需求。 ![](https://pic.code-nav.cn/post_picture/1601072287388278786/WJ4sG19SbxuLfhS0.webp) 再说说第二个场景 —— 对外提供 AI 应用,也就是让自己的程序通过 API 接入 AI 大模型。 我们团队也做过很多 AI 应用,但是用的一直是国内大模型的 API! 原因很简单,不仅能够满足需求,而且 **更快、更稳定、更便宜**。所以国外大模型吹得再天花乱坠,我依然建议大家使用国内大模型的 API。 比如最近很火的 GLM-4.6 模型,在真实编程、长上下文处理、推理能力、信息搜索、写作能力与智能体应用等多个方面实现全面提升。他们新推出的 Coding Plan 套餐,更是能够以 Claude Code 1/7 的价格,享受 Claude Pro 套餐的 3 倍用量,同时能够在代码能力上对齐 Claude Sonnet 4。 之前我已经给大家分享过很多个人使用 AI 的技巧,今天这篇文章就主要分享大模型 API 的使用教程,我将以国内智谱最新旗舰的 GLM-4.6 模型为例,手把手带你学会 3 大使用 API 的场景。 ## 一、API 接入开发工具 下面以流行的 Cursor 和 Claude Code 为例,来演示如何将国内大模型 GLM-4.6 的 API 接入开发工具。 ### Cursor 接入 GLM 首先打开 Cursor 的设置界面,进入模型设置,然后添加自定义模型,注意名称一定要是大写的 `GLM-4.6`! 添加模型后,需要覆盖 OpenAI 的 API Key 为你自己的、同时覆盖 OpenAI 的请求地址为 `https://open.bigmodel.cn/api/coding/paas/v4`。 ![](https://pic.code-nav.cn/post_picture/1601072287388278786/99SYzWC1htnrTBQo.webp) 可以在智谱 AI 开放平台获取到 API Key,注意不要泄露! ![](https://pic.code-nav.cn/post_picture/1601072287388278786/1TtulMeANtToER89.webp) 然后,就可以在对话界面选择 GLM-4.6 大模型,愉快使用了~ ![](https://pic.code-nav.cn/post_picture/1601072287388278786/xqCIRbIjSKGD8y6e.webp) 国内模型的输出速度很快,实测下来结果也比较靠谱。 ![](https://pic.code-nav.cn/post_picture/1601072287388278786/xmgAMtz0FJ00D8O7.webp) ### Claude Code 接入 GLM 给 Claude Code 接入 GLM 也很简单,1 分钟搞定。 首先一行命令安装 Claude Code: ```shell npm install -g @anthropic-ai/claude-code ``` 然后执行 `claude` 命令打开程序,默认是需要登录 Claude 账号的,否则无法使用: ![](https://pic.code-nav.cn/post_picture/1601072287388278786/kgsz1VT4YEbXTdGm.webp) 不过没关系,让我们把它背后的 AI 大模型换成国内的。首先进入 `{用户目录}/.claude` 目录,创建一个 `settings.json` 配置文件: ![](https://pic.code-nav.cn/post_picture/1601072287388278786/f4k5YOPbIwMD8Cmh.webp) 然后修改配置文件中的内容如下,记得替换成你自己的 API Key: ![](https://pic.code-nav.cn/post_picture/1601072287388278786/5eGYkcc6OVimmlcY.webp) 接下来就可以愉快地使用了~ ![](https://pic.code-nav.cn/post_picture/1601072287388278786/Z09yEnhdcn2Cccqj.webp) ## 二、API 接入新项目 接下来让我们学习如何利用大模型 API 开发一个全新的 AI 应用。以 Java 项目为例,我们可以使用主流的 Spring AI 框架来开发 AI 应用。 首先利用 IDEA 创建一个 Spring Boot 项目,注意 JDK 版本最好选择 21: ![](https://pic.code-nav.cn/post_picture/1601072287388278786/s4BEzMpC0xGkLApj.webp) 然后选择 Spring Boot 3.x 的版本(暂时不要使用 4)以及需要的依赖。 Spring AI 已经兼容了智谱系列的大模型(包括 GLM-4.6),只需要勾选 `ZhipuAI` 依赖就好: ![](https://pic.code-nav.cn/post_picture/1601072287388278786/ezWspioZXMfnXXzm.webp) 创建新项目完成后,我们可以参考 Spring AI 官方文档来修改 `application.yml` 配置文件,填写对接智谱 AI 所需的配置。 官方文档:https://docs.spring.io/spring-ai/reference/api/chat/zhipuai-chat.html 比如: ```yaml spring: application: name: yupi-ai-project ai: zhipuai: api-key: <Your API Key> chat: base-url: https://open.bigmodel.cn/api/coding/paas options: model: glm-4.6 ``` 注意,上述代码中的 `base-url` 如果不填写,默认为 `https://open.bigmodel.cn/api/paas`;如果你要使用 Coding Plan 的优惠套餐包,需要替换为 `https://open.bigmodel.cn/api/coding/paas`(中间多加了个 coding)。 填写好配置后,让我们写一个单元测试文件,直接使用自动注入的 ChatModel 类型的 Bean,然后调用 ChatModel 提供的 call 方法和 AI 对话: ```java @SpringBootTest class YupiAiProjectApplicationTests { @Resource private ChatModel zhiPuAiChatModel; @Test void contextLoads() { String content = zhiPuAiChatModel.call("你好,我是程序员鱼皮"); System.out.println(content); } } ``` 直接运行单元测试,一次 AI 对话就完成了: ![](https://pic.code-nav.cn/post_picture/1601072287388278786/LGEH2D7RLym25qCm.webp) 将 AI 接入项目就是这么简单~ 而且因为我们用的是 Spring AI 框架,你可以享受框架提供的各种高级能力,比如对话记忆、RAG、工具调用、可观测性等等。 ## 三、API 接入已有项目 如果你的项目已经使用了 AI 开发框架、或者 Open AI 大模型,只需 1 分钟就能替换为国内的大模型 API。 以我当时带大家从 0 开始做的、对标大厂的 **AI 零代码生成项目** 为例,这个项目使用 Java 主流的 AI 应用开发框架 LangChain4j。 ![](https://pic.code-nav.cn/post_picture/1601072287388278786/esGx4hA2xt9fuul2.webp) 项目代码是 [完全开源](https://github.com/liyupi/yu-ai-code-mother) 的,大家可以直接下载学习,也欢迎到编程导航学习整个项目的完整教程。 ![](https://pic.code-nav.cn/post_picture/1601072287388278786/OR0Zo3gS23tr5SDi.webp) 之前这个项目接入的是 DeepSeek,现在如果要接入编程能力更快更强的 GLM-4.6,只需要更改一下配置文件: ```yaml langchain4j: open-ai: reasoning-streaming-chat-model: base-url: https://open.bigmodel.cn/api/coding/paas/v4 api-key: <Your API Key> model-name: glm-4.6 max-tokens: 32768 temperature: 0.1 ``` 其中,如果你要生成更复杂的项目,max-tokens 可以调大点,GLM-4.6 有 200K 超长上下文窗口,写几十个页面都不成问题。 然后依次启动后端和前端项目,输入提示词,比如让 AI 制作一个精美的作品展示网站: ![](https://pic.code-nav.cn/post_picture/1601072287388278786/mWzozzyZG8yRYcy9.webp) 大概 3 ~ 4 分钟左右,GLM-4.6 完成了任务,生成的网站效果还是相当不错的: ![](https://pic.code-nav.cn/post_picture/1601072287388278786/Aj14ZAFw32Z8riuo.webp) 之前这个项目我使用的是 DeepSeek-V3.2-Exp 模型,用同样的提示词,需要花费 6 ~ 8 分钟左右,做出来的效果如图: ![](https://pic.code-nav.cn/post_picture/1601072287388278786/JrbgRGKoRTp5CIry.webp) 显然无论是速度上,还是效果上,GLM-4.6 都更胜一筹。 为消除偶然性,我这边挑选了几个案例,进行了更多对比。 1)先是经典的个人博客网站,二者做出的效果差不多,GLM-4.6 更现代、DeepSeek 更简约传统: ![](https://pic.code-nav.cn/post_picture/1601072287388278786/zX8fqlibSAumLVx8.webp) 2)然后是一个宇宙大爆炸 3D 动画演示,这里显然 GLM-4.6 更专注于 “做动画效果”,而 DeepSeek 做的更像是一个知识科普网站。 ![](https://pic.code-nav.cn/post_picture/1601072287388278786/078r58KYFEPbhwWw.webp) 咱就是说,DeepSeek 做的这个 “宇宙膨胀” 方格动画真的给我看笑了。 3)然后是做一个微信 UI 原型图,这次我要把 Gemini 3 拉进来一起对比。 ![](https://pic.code-nav.cn/post_picture/1601072287388278786/8epCTEWbUCWmVD9R.webp) Gemini 3 的还原度是最高的,其次是 GLM-4.6,而 DeepSeek 根本就没有做聊天页面。不过这里我用的是 Gemini 3 的 Canvas 模式,有些图标会自己绘制,而国内的大模型直接用 Emoji 来代替图标了,所以逼真度差了一截。 4)最后是我最喜欢让 AI 做的案例 —— 仿做一个知名的海外视频网站,来验证 AI 的理解能力。 ![](https://pic.code-nav.cn/post_picture/1601072287388278786/0Hs9ydIOIANLKKsP.webp) 这把我觉得 GLM-4.6 的效果更好一些,增强了 “看视频” 的体验,有很多视频的分类;而 DeepSeek 考虑到了上传视频。到底哪个更符合现代视频网站的特点,我相信大家心里有答案。 ## 尾声 OK,以上就是几种国内大模型 API 的使用方法,学到的朋友们点个赞吧~ ![](https://pic.code-nav.cn/post_picture/1601072287388278786/66anOXAuCq8RkGJm.jpg) ## 更多 💻 编程学习交流:[编程导航](https://www.codefather.cn/) 📃 简历快速制作:[老鱼简历](https://www.laoyujianli.com) ✏️ 面试刷题神器:[面试鸭](https://www.mianshiya.com) 📖 AI 学习指南:[AI 知识库](https://ai.codefather.cn/)

Gemini 3.0 炸裂发布!前端又死了???

大家好,我是程序员老鱼皮~ 来看看现在的 AI 有多离谱! 1)设计原型图:1 句话几十秒,随便做个亿级流量的产品原型。 ![](https://pic.code-nav.cn/post_picture/1601072287388278786/AQI3P7x34XbDnDRE.webp) 嚯,这个还原度! 2)企业级网站:1 句话复刻各种企业级网站。 ![](https://pic.code-nav.cn/post_picture/1601072287388278786/q0EdmVSrkS2CnRNZ.webp) 真的是各种…… ![](https://pic.code-nav.cn/post_picture/1601072287388278786/3OKj5EQb6FACr99E.webp) 3)3D 动画特效网站:1 句话制作复杂的 3D 动画特效网站。 ![](https://pic.code-nav.cn/post_picture/1601072287388278786/PnLOeR2b4cZ5ALsF.webp) 这给我一个月也做不出来啊! 4)生活写实网站:1 句话还原各种生活场景。 ![](https://pic.code-nav.cn/post_picture/1601072287388278786/IMQTNkVhBi6JmTWR.webp) 你别说,还挺暖和,不知道大家隔着屏幕能不能感受到? 5)游戏网站:还可以一句话复刻我童年最喜欢的游戏。 ![](https://pic.code-nav.cn/post_picture/1601072287388278786/WepuaZ6R1dxvl55f.webp) 这我穿越回去不得赚麻了? 6)实用工具:小到做个实用工具、大到做个高仿版的操作系统,通通不在话下。 ![](https://pic.code-nav.cn/post_picture/1601072287388278786/Z7ENfkNuvgPWR3Dg.webp) ![](https://pic.code-nav.cn/post_picture/1601072287388278786/TDkQoN3grebVMKjO.webp) ## 如何使用? 这就是刚刚谷歌最新发布的 Gemini 3 大模型,不仅从数据上断层领先其他竞争对手,而且在前端编写网站的能力上也是肉眼可见的提升。 ![](https://pic.code-nav.cn/post_picture/1601072287388278786/sZc6R3dUWUQKsEq4.webp) 这么强大的模型现在竟然是可以免费使用的!直接在 [Gemini 官网](https://gemini.google.com/),选择思考模型,然后根据需求选择相应的能力就可以了。支持做图片、做网站、学习辅导、图文创作。 ![](https://pic.code-nav.cn/post_picture/1601072287388278786/cVJ58u5C4wg7dR7A.webp) 如果你要做复杂的项目,可以用它们刚刚发布的 AI 编程工具 [Antigravity](https://antigravity.google/),跟 Cursor、TRAE 什么的类似,不过现在可以免费使用 Gemini 3、Claude 4.5 等高级模型。 ![](https://pic.code-nav.cn/post_picture/1601072287388278786/2GOvVlRfxIFf69qq.webp) ## 前端已死? 这次 Gemini 更新后,网上很多朋友说,AI 这么厉害,前端已死啊! ![](https://pic.code-nav.cn/post_picture/1601072287388278786/UysN4VJGvicrYygp.webp) 单看这次更新我觉得真不至于,虽然看到 Gemini 3 生成单个页面的能力挺强、挺唬人,但企业项目可不是一两句口语就能搞定的。 我自己也测试了一下,用相同的提示词,使用 Gemini 3 模型和 Claude 4.5 模型开发一个完整的前后端项目《图片压缩工具》网站,对比下来感觉 Gemini 3 无论是质量还是速度都略逊一筹。 ![](https://pic.code-nav.cn/post_picture/1601072287388278786/DVktT12Dl0bjwOmt.webp) 不过 AI 编程的能力越来越强,这是必然趋势。无论是我们团队、还是身边的程序员朋友,都越来越依赖 AI 去写代码,尤其是前端代码。 以前费力写一周的工作,现在摸鱼半小时搞定。 **但我觉得,这种变化反而不是让前端死了,而是进化了。** 现在程序员的角色已经转变了,不再是自己写代码的码农,而是要会写高质量的提示词,有方案设计和整体架构能力,能有效指导 AI 干活,出了问题能快速掰扯过来,这才是核心竞争力。 而且你想啊,老板即使有了 AI,还是不会自己来搞项目的。有些老板可能自己先用 AI 生成个 Demo 试试,但那也只是减少了试错成本,项目真的火了还是得招人来干。而且最主要的,出了事情你得需要人来背锅吧? ![](https://pic.code-nav.cn/post_picture/1601072287388278786/aQkMeuglyWpHT4Sd.jpg) 所以我觉得大家还是理性看待 “前端已死论” 吧,虽然 AI 是会对行业有冲击的,尤其是 “只会写代码” 的初级岗位,但技术变革同样也会创造新机会。无论你是前端还是其他方向的程序员,会用 AI 工具、用好 AI、多拓宽知识面,尽量做到 T 型发展,才是最重要的。 最后再推荐一个 [学 AI、找 AI 资源很方便的网站](https://ai.codefather.cn),完全免费,按需自取~ ## 更多 💻 编程学习交流:[编程导航](https://www.codefather.cn/) 📃 简历快速制作:[老鱼简历](https://www.laoyujianli.com) ✏️ 面试刷题神器:[面试鸭](https://www.mianshiya.com)

GPT-5.1来了,但用户想要的是这个?

GPT5.1 来了! 这次更新了什么东西? ![](https://pic.code-nav.cn/post_picture/1802564102293139457/LMTH7tRah8iBfix0.webp) 这次 Open AI 更新的 5.1 版本,是 8 月发布 GPT5 的“升级版”,包括两个版本: - GPT-5.1 Instant - GPT-5.1 Thinking 将会在本周内向所有用户陆续推出。 从公告来看,GPT-5.1 Instant 将会更专注于对话的流畅性,回答也会更加“人性化“,Open AI 改进了它的指令遵循,因此模型可以更可靠地回答用户实际提出的问题。 而 GPT-5.1 Thinking 的升级则更多在,它能够根据用户的提问,自主调整思考时间,根据问题复杂度自主调整思考时长,力求在复杂问题上深入钻研,在简单问题上则快速给出简洁回答。 另外,ChatGPT 还推出了 8 种个性化选项卡,允许用户在使用的时候,选择自己喜欢的不同的聊天风格。 另外还有小部分用户可以提前体验个性化控件,可以根据需要,自行调整大模型的“温度”以及发表情符号的频率。 ![](https://pic.code-nav.cn/post_picture/1802564102293139457/0f8Jhm2czD9VvWb4.webp) 这一切的改进,似乎都指向一个明确的目标:情绪价值。在 4o 下线引发全球用户的广泛讨论后,OpenAI 终于听到了用户的声音。 这次 Open AI 的更新公告也谈到,【我们清楚地从用户那里听到,伟大的人工智能不仅应该是聪明的,而且应该是令人愉快的交谈。】 不过升级是一回事,用户买不买账,又是另外一回事: > 如果我们能有一个模型能够超快地适应每个用户,而无需在模式之间不断切换就好了。等等,我们有它......它叫什么名字?是的。4o ![](https://pic.code-nav.cn/post_picture/1802564102293139457/xHpnVfx30m6XlL80.webp) > 这不是用户一直在问的。一组个性化选项与 4o 的自适应人格完全相反。你不能模仿 4o,只需保持原样或像 4.5 一样扩展它。这些架构从根本上是不同的,你知道的。 ![](https://pic.code-nav.cn/post_picture/1802564102293139457/UIqMUjc1lenpQZKd.webp) > 我仍在使用你们的产品只是因为 4o 仍然存在 ![](https://pic.code-nav.cn/post_picture/1802564102293139457/ZzG1mEhrIQmEagTr.webp) 这次 GPT-5.1 的更新,是 OpenAI 对用户情感需求的重视,但用户真正渴望的,可能并非更多需要手动调节的选项,而是一个能真正“读懂”语境、自主匹配语气的 AI 伙伴。 否则,再多的 “5.1”“5.2”,也只会被一句“不如 4o”打回原形。

下载 APP