洞察
实用分析与指南,帮助你更高效地采购、构建和使用 AI。
OpenAI Presence 上线:把自家客服 75% 无人工那套,卖给你
你公司客服每天几百单,75% 被 AI 自己解决了 这不是别人的愿景,是 OpenAI 自己客服线的真实数据。现在它把这套东西打包成了一个产品,叫 Presence,7 月 22 日开始有限开放给企业。 它到底是个啥 Presence 是 OpenAI 的企业级语音 + 聊天智能体平台。注意,它不是你调个 API 就能用的自服务工具,而是一套"部署好的产品"。 里面捆了这些东西:公
coding 模型三强混战:Muse Spark 1.1 vs GPT-5.6 vs Claude Fable 5,谁值你的钱?
你接外包,一个月出十几个项目,选哪个 coding 模型? 以前这题只有 OpenAI 和 Anthropic 两个选项。现在 Meta 带着 Muse Spark 1.1 杀进来了,coding 这条线第一次变成三强混战。 三强各自占的山头 Muse Spark 1.1(Meta,7 月 9 日):在 MCP Atlas、JobBench、人类终极测试、金融 Agent 这几个 a
AI配音对决:Seed Audio 1.0 vs ElevenLabs,中文短剧到底开哪个?
你做中文短剧,配音这一关怎么过? 你搞了个中文短剧账号,一条 15 分钟的剧,外包配音报价 2000 块、排期 3 天。现在有两个 AI 说能自己出,但你只有半小时交差——开哪个? 这问题搁半年前答案只有一个:ElevenLabs。但字节 6 月底把 Seed Audio 1.0 扔进来了,牌桌变了。 这俩根本不是一种东西 别看都叫"AI 配音",它俩干活的路子完全相反。 See
AI 干掉 Salesforce?一家保险公司用智能体把年费 60 万美元砍没了
一家保险公司,把 60 万美元的 Salesforce 合同退了 不是换了个更便宜的 CRM。是美国医疗保险公司 Curative,自己用 AI 写了个,把每年 60 万美元(合 406 万人民币)的 Salesforce 订阅给退了。 这事儿 7 月 21 日刚在《20VC》播客上说出来,主角叫 Fred Turner,Curative 的 CEO 兼联合创始人。 谁干的,怎么干的
AMD Helios 机架级AI系统亮剑,微软入伙正面刚英伟达
AMD 把压箱底的家伙亮出来了 7月20日,AMD 第一次正式向媒体展示它的首款机架级 AI 系统 Helios。不是又一张显卡,是整柜——把 GPU、CPU、网络和软件平台打包成一整套,计划今年就开始大规模部署。 更关键的是客户名单:微软当天宣布要在 Azure 里部署 Helios。这下 AMD 的阵营里已经有了 Meta、OpenAI、甲骨文,还有印度的塔塔咨询服务。等于几家最缺算力的巨
腾讯混元发布 Hyra-1.0:一个会递归自我改进的研究智能体
腾讯混元今天扔出个会"自己改自己"的智能体 7月21日,腾讯混元发布了 Hyra-1.0,全称 Hunyuan Research Agent。它主打一个能力:递归自我改进(RSI)。给个任务,它自己跑循环——探索、提出更好的方案、看反馈、再改,直到自己觉得够了或者预算花完。 它到底怎么干活 设计上 follow 了 "The Bitter Lesson":框架尽量轻,让智能体的动作空间尽
Runway Gen-4 vs 可灵 Kling 3.0:AI 视频生成,谁更值得用
一句话:要量要声音选可灵,要质感要镜头选 Runway 这俩是 2026 年专业生产里用得最多的两款 AI 视频工具,经常被拿来比,因为它们挨得近,但优化的根本不是一件事。 直说结论:可灵走量、走声音、走性价比;Runway 走长镜头稳定、走运镜精准、走电影感。 参数速览 最长片段:可灵 3.0 单次最多15秒;Runway Gen-4 单条10秒(可延长) 多镜头:可灵一次最多6个
Midjourney V8.1 vs 即梦 Seedream / 可灵:中文用户出图,到底选谁
一句话:审美 MJ 还是天花板,但中文场景不一定选它 先泼盆冷水——别一看“MJ最强”就无脑冲。它确实强,但强在艺术感,不是强在“给你干活”。 MJ V8.1 强在哪 构图、光影、色彩、氛围,它在一个审美等级上。同样的提示词,MJ 出来像王家卫电影海报,别家像电视剧截图。 今年4月发的 V8.1 比 V7 快了4到5倍,原生2K,还能放大到4K。风格预设那套“调色板”是几年沉淀下来的,别人
ChatGPT GPT-5.6 vs Claude Fable 5:写代码和写长文,到底谁更能打
先说结论:没有通杀 “写代码”不是一个单一能力。你拿哪把尺子量,结论就翻一倍。 GPT-5.6 的顶档是 Sol,Claude 这边是 Fable 5。这俩是目前最常被拿来比的“贵价打工人”。 跑分摆出来 几个公开榜单,直接看数字: Coding Agent Index v1.1:GPT-5.6 Sol 80,Claude Fable 5 77.2——Sol 略胜 SWE-Benc
谷歌 Gemini 3.5 Pro 三度跳票:编程卡壳,Alphabet 两日跌近 6%
从“再给我们一个月”到“coming soon” 5月19日 Google I/O,皮查伊在台上说:再给我们一个月。 大家都信了。一个月后没来,改口“7月17日”。等到7月17日,官方页面上只剩五个字:coming soon。 三次延期。这已经不是跳票,是习惯性跳票了。 根子在哪:编程能力没过关 彭博社7月16日的报道点得很直白——根因是代码生成能力没达到谷歌内部预期。 原计划其实是今
开源模型第一次让闭源贵不动了:Kimi K3涨价4倍,美股科技股重挫
中国模型第一次照美国价目表收钱 Kimi K3的API定价:每百万token,缓存命中输入0.30美元,未命中输入3美元,输出15美元。 后两项——3美元输入、15美元输出——和Anthropic的Claude Sonnet 5一模一样。 这事得划个重点:以前国产开源模型主打白菜价抢市场,这次月之暗面直接定到了美国大模型的档位上。不是靠便宜赢了,是开始按能力定档了。 但跟自家比呢?上一代K
Kimi K3前端编程盲测登顶:超Fable 5和GPT-5.6,实测到底行不行?
盲测登顶,不是自报家门 先说清楚这张榜单的分量。 Arena的前端代码竞技场,用的是Elo对战机制——跟国际象棋排名同一套逻辑。真实开发者提交真实编程任务,两个匿名模型各交一份答案,开发者盲选哪个更好。投票的时候,你不知道自己在给谁投票。 7月17日凌晨榜单更新:Kimi K3拿到1679分,第一。Claude Fable 5,1631分,第二。GPT-5.6 Sol,1618分,第三。智谱
