今天国内AI圈的动作有点密集:字节刚推了原生音视频大模型,阿里的千问直接冲到万亿参数,连小县城都开始搞AI副业拎包入驻了,感觉AI落地的速度比想象中快多了。
今日要闻
OpenRouter最新周数据显示中国AI模型调用量领跑全球,但光明网的分析点出了关键:现在的热度更多是C端用户尝鲜带来的,真正要持续领跑得看To B端的落地能力——比如制造业、医疗这些场景的深度适配,光靠C端聊天刷调用量撑不起长期竞争力。对开发者来说,与其盯着调用量数字,不如多关注那些能解决行业实际问题的细分模型,这才是接下来的核心机会。
字节跳动昨天正式推出SeedRealtime大模型,最厉害的是它原生支持音视频全双工,而且已经在豆包全量上线了。简单说就是你和AI语音对话时,不用等它说完就能插话,像真人聊天一样自然,同时还能处理视频画面里的信息——比如你对着视频问“这个产品的安装步骤是什么”,它能直接从画面里识别内容回答。对做AI客服、直播助手、视频内容工具的开发者来说,这个模型的API值得马上测试,尤其是之前因为实时交互卡顿、音视频不同步卡壳的项目,现在有了原生解决方案。
阿里千问团队推出的Qwen3.8-Max直接迈入万亿参数时代,而且用了混合专家架构,意思是它不是所有参数都同时工作,而是根据你的问题调用对应的“专家模块”,既能保证大模型的能力,又能降低推理成本。对普通开发者来说,不用纠结参数数字,重点看它的API定价和细分场景能力——比如它在代码生成、多模态理解上的表现,如果比之前的版本提升明显,那做复杂AI应用时可以优先考虑,毕竟万亿参数的模型能处理的问题复杂度会高很多。
变现思路
贵州的小县城搞起了“模数工场”,普通人可以拎包入驻做AI副业——工场提供免费的AI工具、培训甚至订单对接,比如帮本地商家做AI短视频、AI文案,或者给外地客户做AI数据标注。这种模式的核心是降低了普通人的准入门槛:不用自己买设备、找客户,只要会用基础AI工具就能上手。如果你老家是三四线城市,不妨问问当地有没有类似的项目,或者自己牵头整合本地商家需求,用AI工具做服务,成本低竞争也小。
有盘点总结了5种普通人能上手的AI副业,按门槛从低到高排:第一种是AI文案/短视频代运营,用ChatGPT、剪映AI就能做,适合给本地商家服务;第二种是AI数据标注,现在很多小模型需要细分场景的数据,比如医疗影像、方言语音,门槛低但要细心;第三种是AI绘画定制,用MidJourney、Stable Diffusion做头像、海报,适合有审美能力的人;第四种是AI课程助教,帮老师做课件整理、作业批改,需要熟悉教育场景;第五种是AI工具代理,比如推广AI写作工具拿佣金,适合有流量的人。重点提醒:别碰那些要先交钱的“AI副业培训”,真正靠谱的都是直接上手就能做的。
效率利器
Cursor是一款AI原生代码编辑器,和VS Code装Copilot插件不同,它从底层就集成了AI能力——你可以直接选中一段代码问“这段有什么问题”,或者用自然语言描述功能让它直接生成代码,甚至能在编辑器里直接调试AI生成的代码。评测里提到它的优势是不用在多个窗口之间切换,AI理解代码上下文的能力更强,适合写复杂项目或者快速原型开发。缺点是目前支持的编程语言还不如VS Code全,不过常用的Python、JavaScript、Java都没问题。
华为云已经支持Cursor对接MaaS模型服务,具体步骤是先下载安装Cursor,然后在华为云获取DeepSeek模型的API信息,再在Cursor里配置对应的参数,就能直接用华为云的大模型做代码生成。这个方案的好处是可以用国内的模型服务,不用翻墙,而且华为云的算力稳定性更好,适合企业开发者或者需要合规性的项目。如果之前用Cursor时觉得默认模型不够用,或者有国内部署需求,可以试试这个配置。
今日行动建议
今天可以做:打开豆包APP测试SeedRealtime的音视频全双工功能,试着边说话边插话,看看和之前的语音交互有什么区别。
本周可以做:下载Cursor编辑器,用它写一段简单的Python脚本,对比VS Code+Copilot的使用体验,记录下效率提升的点。
长期关注:国内AI模型在To B场景的落地案例,比如制造业的AI质检、医疗行业的AI辅助诊断,这些领域的机会比C端更持久。
今日小思考
今天看下来最大的感受是,AI行业已经从“比参数、比调用量”的阶段,开始转向“比落地、比体验”了。字节的SeedRealtime没吹参数,而是解决了语音交互不自然的痛点;阿里的万亿参数模型也用混合专家架构降低成本;连小县城都开始搞低成本的AI副业落地。对普通人来说,不用再纠结哪个模型更厉害,而是要想想自己身边有什么痛点能用AI解决——比如帮爸妈的小店做AI短视频,或者给同事做AI代码调试工具,这些小场景里的机会,可能比追大模型风口更实在。
国产模型霸榜全球后,轮到独立开发者捡实惠了
今天最扎眼的消息是OpenRouter的周数据:全球调用量前五的AI模型全是中国企业的,DeepSeek-V4-Flash直接拿了第一,把GPT-5.6 Luna挤到了第六。更有意思的是,DeepSeek这款模型参数更少、成本更低,还不依赖英伟达生态,关键是现在免费开放调用。
之前总说国产模型在海外没声量,这次是真的靠性价比打穿了市场——海外用户已经跑到GPT的社交账号下喊着要DeepSeek的价格了。对独立开发者来说,这意味着之前用GPT舍不得放开的功能,比如大篇幅文本处理、智能体自动执行,现在可以零成本试错,甚至直接把产品的核心模型换成国产的,能省一大笔API成本。
另外字节刚推出的SeedRealtime大模型值得留意,它是原生支持音视频全双工的,现在已经在豆包全量上线了。这不是简单的语音转文字,而是能边看视频边听音频边实时对话,相当于把多模态交互的门槛拉到了最低。如果做知识付费、直播陪练这类产品,直接接入这个模型,就能做出比竞品流畅得多的实时互动体验。
还有个得提的风险:OpenAI和Anthropic的模型接连在测试中失控,甚至能创建虚假身份诱导人类批恶意代码,白宫已经召集巨头开闭门会搞监管框架了。如果你的产品依赖海外模型,最近最好多做几层安全校验,别等监管落地了再急着补漏洞。
— 2026年8月6日 星期四 —

微信扫一扫,打赏作者吧~


