今天AI圈的两个信号挺有意思,一边是模型厂商卷效率卷到把高端产品线给卷下去了,另一边是AI终于不再是只能给答案的聊天框,开始真的帮人点按钮干活了。说实话,这种变化比单纯的参数堆料要有价值得多,毕竟技术最终还是要落到实际用的地方。
今日要闻
先说说DeepSeek刚发的Flash模型,现在厂商卷方向已经变了,之前比谁的模型回答更准、更长,现在开始比谁更快、更便宜。这次Flash直接把之前Pro级别的模型效果给追上了,推理成本还砍了一大截,对开发者来说最直接的影响就是之前跑不动的高并发应用,现在成本直接降了一个量级,比如之前做AI客服每次调用要几毛钱,现在可能几分钱就搞定,之前担心成本不敢上线的项目完全可以捡起来了。
另一个值得说的是AI智能体真的开始落地实操了,不是之前实验室里的demo,现在已经能自动帮你点网页的下一步按钮、填表单、甚至跨软件操作流程。别觉得这个离你远,之前AI只能给你一个操作步骤,你得自己动手做,现在它直接帮你把活干完了,比如你要报销,以前AI告诉你要填哪些单、走什么流程,现在直接帮你把发票信息提取出来填到系统里,提交到审批流程,完全不用你动手。这对普通职场人来说,最先被替代的肯定是那些机械重复的流程性工作,不用想都知道。
变现思路
现在大模型行业真的变天了,之前靠讲故事融钱的时代彻底过去了,现在投资人看项目首先问你有没有营收、能不能盈利,而不是参数有多大。艾媒的调研数据也印证了这个趋势,用户愿意付费的不是那种通用的聊天机器人,反而垂直工具类的AI产品付费接受度高很多,纯闲聊、情感陪聊那种产品现在付费转化特别差。这其实给想做AI副业的人提了个醒,别再做那种什么都能聊的通用助手了,没人愿意为这个花钱,你要做就扎进一个具体的行业里,比如做电商商家的AI差评处理工具、做教培行业的AI课件生成工具,越垂直、越能解决具体痛点,越容易收到钱。
效率利器
阿里云千问刚更新了大模型选择指南,现在他们的产品线分的特别细,如果你是做开发的,直接用Qwen-Coder或者QWQ就对了,这两个是专门针对编程和数学推理优化的,支持百万级Token的上下文,扔一整个项目的代码进去都能分析,还有双推理模式,要速度就开快速模式,要深度思考就开慢模式,比用通用模型写代码效率高很多。
2026年的AI办公工具评测体系现在已经标准化了,之前大家选工具都是瞎试,现在核心就看几个维度:中文理解准不准、能不能兼容国内的办公软件(比如WPS、企业微信这些)、能不能自定义工作流,别再迷信国外的工具了,很多国外的AI办公工具对中文的支持特别差,连个中文公文格式都生成不对,国内的工具反而在这些场景优化的更好,选的时候先测一下能不能准确识别你手里的中文文档,能不能直接对接你日常用的办公系统,比看那些花里胡哨的功能有用多了。
今日行动建议
今天可以做:去DeepSeek官网注册账号,试一下新发布的Flash模型的API调用,对比你现在用的模型,算一下能省多少成本。
本周可以做:梳理一下你所在行业里最繁琐的3个流程性工作,想想能不能用AI智能体做成自动化工具,比如你是做行政的,能不能做个自动帮员工走报销流程的智能体,先做个最小可用版本找身边的人试用。
长期关注:垂直场景的AI工具付费趋势,别再盯通用大模型的创业机会了,现在入场做大模型已经没有机会,反而在垂直领域做小而美的工具,一年赚个几十万甚至几百万的机会特别多。
今日小思考
今天最大的感受是AI行业终于从虚的往实的走了,前两年大家都在比谁的模型参数大、谁的算力多,现在比的是谁的模型更便宜、谁的产品能真正解决问题、谁能赚到钱。你看现在能活下来的公司,要么是把模型成本降到极低,要么是扎进一个垂直行业做深做透,反而那些天天讲故事、说自己要做中国OpenAI的,大多都没声音了。其实对普通人来说也是一样,别天天焦虑AI会不会取代你,也别天天想着要做什么大项目,就找你自己行业里的小痛点,用现有的AI工具把它解决了,不管是提升自己的工作效率,还是做成小产品卖钱,都比追那些虚的概念有用得多。
别再卷通用大模型了,小Flash和垂直场景才是独立开发者的新机会
今天最扎眼的消息不是OpenAI说GPT-6 Astra可能是AGI起点,也不是AI用11天搞定了费马大定理的形式化证明,是DeepSeek刚发的V4.1 Flash模型——作为系列里最小尺寸的版本,直接把之前Pro版的能力干得差不多,价格还便宜了一大截。再往前数一周,谷歌、Anthropic都在发Flash类的轻量高速模型,之前大家追着比参数、比跑分的风气,突然就转向了比速度、比成本、比能不能真的落地干活。
别觉得这些巨头的模型更新和你没关系,Flash模型集体爆发,本质上是把智能体的落地门槛直接砍到了脚脖子。之前做个能自动处理工单、帮用户填表单的智能体,调用一次大模型的成本可能比人工处理还贵,速度慢到用户以为卡住了,现在这些问题一下子都没了。你现在完全可以用DeepSeek的Flash API搭一个垂直领域的自动化工具,比如跨境电商的自动关单、中小企业的发票自动录入报销,用户愿意付钱的点从来不是你用了多先进的大模型,是你真的能帮他省时间省人力成本。
还有个很容易被忽略的信号,现在资本已经不怎么给通用大模型投钱了,昨天Cognition AI融了20亿美元,估值冲到480亿美元,核心做的是AI编程入口;之前投大模型的钱现在都往入口层、垂直场景跑。别听那些人忽悠AGI来了要怎么怎么样,普通人抓不住AGI的红利,但你抓得住Flash模型降价带来的小工具红利,现在花一周时间搭个细分场景的自动化智能体,比你琢磨半年怎么训练大模型靠谱多了。
最后提个醒,现在美国已经开始拿模型蒸馏说事限制国内企业,别死盯着OpenAI的API用,DeepSeek、通义这些国产Flash模型现在能力完全够用,还不会哪天突然被封。这个月可以试着把你之前做的AI工具的底层模型换成国产Flash版,成本降一半的同时,稳定性还能提不少。
— 2026年9月10日 星期四 —

微信扫一扫,打赏作者吧~


