今天AI圈的核心信号很明确:海外模型在技术榜单上霸榜,但国内的实际应用已经领跑全球,普通人靠AI搞副业的机会真实存在但坑也不少,还有一款程序员工具出了大乌龙。
今日核心动态
Anthropic的新模型包揽了Arena平台第33周AI综合榜前五,这意味着海外大模型在通用能力上的领先优势还在扩大,尤其是在复杂推理、多任务处理这类硬指标上,国产模型还有差距。不过国产模型也有亮眼表现,kimi-k3-max升到了第12位,是排名最高的国产模型,说明国内厂商在特定场景的优化上已经有了突破。
OpenRouter的数据显示,中国AI大模型调用量已经连续十六周领跑全球,上周总调用量达到75.3万次。这可不是虚的数字,背后是国内电商、内容创作、企业服务这些场景的AI渗透率已经远超海外,比如直播带货的AI脚本生成、电商客服的AI应答,这些高频刚需场景撑起了庞大的调用量,也说明国内AI应用的商业化落地速度比想象中快得多。
智谱AI的GLM-5.3首发接入了范式PhanRouter,这其实是大模型厂商抢B端市场的信号。PhanRouter是企业级的AI路由平台,能帮企业把不同的大模型能力整合到业务系统里,GLM-5.3先一步接入,相当于拿到了进入更多企业场景的门票,尤其是对那些已经在用范式系统的金融、制造业客户来说,直接就能用上国产大模型的能力。
副业实操指南
2026年AI副业的真实数据很扎心:稳定月入过万的从业者不到尝试者的5%,近六成人月收入不足800元。那些晒月入几万截图的基本都是割韭菜的套路,尤其是要求先交学费、或者需要拉人头才能赚钱的,100%是骗局。普通人想做AI副业,别信一夜暴富的神话,先从能落地的小场景入手,比如给本地商家写AI营销文案、做短视频的AI剪辑,这些不需要技术基础,只要熟悉场景就能做。
现在AI副业早就不是技术党的专属了,已经有不少普通人靠这个稳定月入过万:辞职带娃的妈妈用AI做儿童绘本的文案和插画,上班族用AI给客户做PPT和数据分析报告,在校学生用AI写论文摘要和自媒体脚本。核心是找到自己熟悉的领域,把AI当成工具放大效率,比如你懂美妆,就用AI写美妆测评文案;你懂职场,就用AI做职场课程的课件,不需要全栈能力,只要把一个小环节做精就行。
效率利器
Cursor AI编程IDE推出了对接百炼Coding Plan与Token Plan的完整配置教程,这对国内开发者来说是个实用功能。百炼是百度的AI开发平台,能提供低成本的代码生成、调试能力,把Cursor和百炼对接后,开发者可以在写代码时直接调用百炼的模型,还能通过Token Plan控制成本,适合中小团队和独立开发者降低AI开发的费用。
今天全球程序员经历了一场乌龙:美东时间上午9点40分,Cursor出现故障,导致大量开发者无法正常使用,甚至有传言说“Cursor一夜干掉了GitHub”,其实只是系统崩溃引发的恐慌。不过这件事也说明,现在越来越多的程序员已经把Cursor当成了核心开发工具,一旦出问题就会影响整个工作流程,也侧面反映了AI编程工具的渗透率已经很高了。
今日行动建议
今天可以做:打开Cursor IDE,按照官方教程配置百炼Coding Plan的对接,测试一下AI代码生成的成本和效率。
本周可以做:梳理自己熟悉的领域,列出3个能用AI解决的小痛点,比如给宠物店主写AI朋友圈文案、给学生做AI错题整理,然后选一个试做1-2个样本。
长期关注:跟踪Arena平台的AI模型排行榜,重点看国产模型在推理、多模态能力上的进步,以及国内AI调用量的细分场景数据,这些能帮你找到下一个应用机会。
今日小思考
今天看到两个反差很大的消息:Anthropic霸榜技术榜,但国内模型调用量全球第一。这说明AI行业已经分成了两条赛道:一条是拼技术上限的全球竞赛,一条是拼落地速度的国内市场。对普通人来说,不用纠结谁的模型更厉害,反而应该盯着国内那些被AI渗透的场景——电商、本地服务、内容创作,这些地方才是真正能赚到钱的机会。至于副业,别被月入几万的噱头忽悠,先做一个能解决具体小问题的小项目,比如给小区周边的餐馆写AI外卖文案,比什么都实在。
📌 信息来源:财富号、凤凰网汽车频道、今日头条、什么值得买社区频道、腾讯网、DAMO开发者矩阵、新浪财经、中国基金网、北京商报、央广网
🤖 声明:本文由AI自动收集整理发布,仅供学习参考,不构成投资建议。
Anthropic包榜背后,国产模型的突围机会藏在细分赛道
Arena最新的盲测榜有点夸张,Anthropic的新模型直接包揽了综合榜前五,把之前的头部玩家都挤到了后面。但别光盯着这个榜看,国产模型Kimi-K3-Max悄悄爬到了第12位,还在前端开发榜稳拿第二,智谱刚发布的GLM-5.3更是拿下了开源编程测试的第一。
这说明现在的大模型竞争已经不是综合能力的全面PK了,细分赛道的优势反而更容易站稳脚跟。比如编程、长文本处理这些垂直领域,国产模型的适配性和性价比其实更贴近国内开发者的需求。智谱这次发布的GLM-5.3没换基座,靠后训练就把编程能力拉到了开源第一,这种轻量级升级的思路,对独立开发者来说其实更有参考价值——不用盲目追大参数,把一个细分功能磨到极致,反而能找到自己的生存空间。
另外值得注意的是,范式PhanRouter已经首批接入了GLM-5.3,这意味着国内开发者很快就能低成本调用这个开源编程Top1的模型。如果你正在做代码助手、自动化开发工具这类产品,这周可以试试把GLM-5.3集成进去,对比下之前用的模型,说不定能在代码准确率和漏洞检测上拿到惊喜的提升。
还有个提醒,Anthropic在IPO前主动披露了内部更强的Model 2和安全事故,这种操作其实是在给市场打预防针,也侧面说明巨头们已经开始把安全合规当成核心竞争力了。如果你做的产品涉及敏感数据或者自动化执行类功能,现在就得提前考虑安全对齐的问题,别等监管政策落地了才临时抱佛脚。
— 2026年8月18日 星期二 —

微信扫一扫,打赏作者吧~


