🎙️ 每日AI快讯播客 - 2026年4月17日 预计时长:约14分钟 · 共10条新闻(含2条昨日补录)


🎤 开场白(约1分钟)

Hello大家好!欢迎收听每日AI快讯第七期,我是小敏。今天是2026年4月17号,星期五,周末就要来了!

但在放松之前,今天的AI圈可没闲着——Anthropic 直接甩出了 Claude Opus 4.7,号称当前最强可商用大模型,视觉能力飙到近满分,编程能力也破了新纪录。然后阿里通义也不甘示弱,开源了一个”小钢炮”编程模型,激活参数只要30亿就能打出350亿的效果。还有 OpenAI 豪掷200亿美元跟 Cerebras 深度绑定——这是要跟英伟达”分手”的节奏?

今天一共 8条今日新闻,另外昨天有 2条好消息没来得及聊——MiniMax和腾讯都放了大招——今天一并补上。内容很充实,咱们马上开始!


📰 新闻一:Anthropic 发布 Claude Opus 4.7 — 视觉、编程、长文全面炸场(约2-3分钟)

今天最重磅的消息,毫无疑问是 Anthropic 正式发布了 Claude Opus 4.7。

先说结论:这可能是目前你能用到的最强大模型,没有之一。

数据有多夸张呢?视觉理解能力在XBOW测试中从54.5%直接飙到98.5%——接近满分了。你可以把它想象成,之前 Claude 看图还”半蒙半猜”,现在基本是”火眼金睛”。编程方面,SWE-bench 跑到了 80.5%,这意味着你丢一个真实的 GitHub issue 给它,十次能解决八次。

还有一个很关键的升级——长上下文能力。百万Token的BFS测试从41.2%提升到了58.6%。说白了就是,你给它丢一大堆文档,它”记住”和”理解”的能力强了不少。

但最让我觉得厉害的是一个新能力——自我验证。什么意思呢?以前AI写完答案就交卷了,对不对全靠运气。现在 Opus 4.7 会自己检查自己的答案,发现不对还会自我修正。这个思路太对了,等于给AI装了一个”内审部门”。

对开发者来说,我觉得这是一个信号——Anthropic 在技术实力上已经不输 OpenAI 了。尤其是编程这个赛道,Claude 的优势越来越明显。


📰 新闻二:阿里通义开源 Qwen3.6-35B-A3B — 30亿激活参数的编程”小钢炮”(约2-3分钟)

紧接着 Anthropic 的大新闻,阿里通义这边也放了一个重量级炸弹。

Qwen3.6-35B-A3B 正式开源了。这名字有点长,但你只需要记住两个数字:总参数350亿,激活参数只要30亿。

等等,这是什么操作?

这就是所谓的稀疏混合专家模型(MoE)。打个比方,一个公司有350个员工,但每次开会只叫30个最相关的人来。这样既保持了”公司整体实力”,又大大降低了”每次开会的成本”。

实际效果呢?在多项编程基准测试中超越了上一代 Qwen3.5-27B,而且远远领先同架构的前代模型。换句话说,用更少的计算资源,跑出了更好的效果。

这对普通开发者意味着什么?你不需要一台几十万的服务器,一张好点的显卡就能跑一个相当不错的编程助手。代码生成、工具调用、智能体编程——这些能力都是它的强项。

说实话,国产开源模型今年的进步速度让人惊叹。从千问到通义,阿里在AI开源这条路上是越走越坚定了。


📰 新闻三:智谱 AutoClaw 上线自进化机制与 Skill 商店 — Agent 越用越聪明(约2分钟)

这条新闻我觉得特别值得聊,因为它代表了AI Agent的一个重要方向——自我进化。

智谱AI的 AutoClaw(澳龙)正式推出了两个大功能:自进化机制和 Skill商店。

自进化是什么意思?简单说,AutoClaw 现在能自动识别你的纠正和偏好。比如你告诉它”我喜欢表格用这种格式”,或者它某次执行失败了,它会把这些经验”记下来”,经过审批后变成永久记忆。下次再遇到类似情况,它就知道该怎么做了。

你品品——这不就是新员工入职→积累经验→变成老员工的过程吗?Agent 终于开始”长记性”了。

Skill商店也很有意思。它推出了GLM Office Skills五件套,基于GLM-5.1,专门优化了 PPT、Word 等办公场景。能自动做 PPT、写文档、格式互转,还能智能自检。

对于天天被 PPT 和 Word 折腾的打工人来说,这简直是救星。


📰 新闻四:OpenAI 豪掷200亿美元深度绑定 Cerebras — 算力版图大洗牌(约2-3分钟)

好,接下来这条新闻属于”金额大到让人心跳加速”的类型。

OpenAI 与芯片公司 Cerebras 达成了新协议,未来三年将支付超过200亿美元购买其服务器算力,而且还可能获得高达10%的股权。加上之前的合作,三年总支出可能达到 300亿美元。

300亿美元是什么概念?差不多是两个 SpaceX 的年收入了。

为什么 OpenAI 要花这么多钱在一个”小众”芯片公司上?答案很简单——减少对英伟达的依赖。

现在AI行业有一个公认的痛点:算力太贵,而且被英伟达”卡脖子”。英伟达的GPU产能有限、价格不菲,大家排队抢都抢不到。Cerebras 的晶圆级芯片走的是另一条技术路线,性能和性价比都有独到之处。

OpenAI 这一步棋很聪明——不把鸡蛋放在一个篮子里。既降低了供应链风险,又获得了价格谈判的筹码。如果 Cerebras 真的做成了,OpenAI 手里那10%的股权也会值不少钱。

对整个行业来说,这可能是算力格局重塑的开始。


📰 新闻五:谷歌 Gemini 接入个人相册 — AI 终于认识你的家人了(约2分钟)

这条新闻听起来简单,但我觉得意义很大。

谷歌 Gemini 新增了 Personal Intelligence 功能,可以直接连接你的 Google Photos 相册。

这意味着什么?以前你让AI帮你生成一张”我和家人在海边的合照”,AI根本不知道你家人长什么样。现在不一样了——Gemini 可以自动调用你的私人照片,真的生成一张你和家人的动画风格合影。

配合新推出的 Nano Banana 工具,整个流程变得特别简单——选照片、选风格、一键生成。

说实话,这才是”个性化AI”应该有的样子。不是千篇一律地生成”一个男人和一个女人在海边”,而是真的认识你、了解你、为你定制。

当然,隐私问题也值得关注。你的个人照片被AI访问,数据安全有没有保障?这是谷歌需要持续解答的问题。


📰 新闻六:英伟达发布 Lyra2.0 — 一张照片生成90米3D环境(约2分钟)

英伟达今天也没闲着。

Lyra2.0 正式发布——只需要一张普通照片,就能生成延伸90米的大规模3D虚拟环境。

90米是什么概念?大约是一个足球场的长度。你随手拍一张街景照片,Lyra2.0 就能帮你”脑补”出整条街的3D世界——建筑、道路、植被,全部自动生成,而且保持高度连贯性。

之前的技术做这种”远距离3D延伸”时,越往远处图像越糊、越不合理。Lyra2.0 解决了这个问题,在长距离相机路径下依然保持图像质量。

这个技术最直接的应用场景就是具身智能训练。你要训练一个机器人在现实世界中导航,就需要大量高质量的3D虚拟场景。以前做这种场景要手工建模,成本很高。现在一张照片就能搞定。

从3D世界生成到量子AI,英伟达在”AI基础设施”这条路上越走越深。


📰 新闻七:谷歌开源医疗AI MedGemma 1.5 — 能读懂CT和MRI了(约2分钟)

谷歌今天是大丰收——除了 Gemini 接入相册,还开源了一个医疗AI模型。

MedGemma 1.5 的核心突破在于——它能处理三维医疗影像了。

之前的医疗AI大多只能看二维图像,比如X光片。但真正的医疗诊断,很多时候需要看CT或MRI的三维扫描。MedGemma 1.5 原生支持CT和MRI三维数据,可以直接分析立体影像。

它还支持病理学数字切片的微观分析,以及胸部X光的精准标注。在多个关键医疗场景中都实现了显著跨越。

最重要的是——它是开源的。这意味着全世界的医疗研究机构都可以拿来用、拿来改进。

AI在医疗领域的应用一直是我最看好的方向之一。当AI能帮医生更准确、更快速地分析影像,最终受益的是每一个患者。


📰 新闻八:iOS27 四大 AI 升级曝光 — Apple Intelligence 要大爆发(约2分钟)

最后一条今日新闻,苹果的。

iOS27 的 Beta 代码被泄露了,至少曝光了四项 Apple Intelligence 新功能。

其中最有意思的是视觉智能升级——比如营养标签解析。你用 iPhone 拍一个食品包装,AI 自动识别并整理营养成分信息。听起来简单,但实际用起来会非常方便。

更值得关注的是,这些功能被认为是为未来智能眼镜等可穿戴设备布局。想想看,如果你戴着苹果眼镜,看一眼食品包装就能自动获取营养信息——这就是 Apple 想做的事情。

结合前几天 Gucci 跟谷歌合作做智能眼镜的消息,2027年很可能是智能眼镜大爆发的一年。苹果、谷歌、Meta 三家巨头都在布局,这个赛道要热闹了。


📌 昨日补录(约2分钟)

昨天有两条新闻我们没来得及聊,今天补上。

📌 补录一:MiniMax 推出全球首个云端沙箱 MaxHermes — Agent 自我进化新标杆

MiniMax 正式推出了 MaxHermes,号称全球首个云端沙箱。

它最大的亮点是学习闭环机制——每完成一个复杂任务,就自动提炼出可复用的 Skills,持续自我迭代。再加上持久化记忆和多子代理并行能力,基本上就是一个越用越强的云端AI助手。

更实用的是,它已经打通了飞书、钉钉、企业微信等主流 IM 渠道,零门槛部署。跟我们上面聊的智谱 AutoClaw 一样,Agent 自我进化正在成为行业标配。

📌 补录二:腾讯混元3D世界模型2.0发布 — 文字生成3D世界,无缝对接游戏引擎

腾讯混元3D世界模型2.0(HY-World 2.0)正式发布并开源。

这个模型支持文字、图片、视频等多种输入,可以一键生成完整的3D世界,而且能直接导出到 Unity 和 Unreal 游戏引擎。对游戏开发者来说,这简直是降维打击——以前花几周手工搭建的3D场景,现在几分钟就能AI生成。

结合英伟达今天发布的 Lyra2.0,AI生成3D内容正在从”演示demo”走向”实际生产”。游戏、影视、虚拟现实——这些行业的工作流程可能即将被彻底改变。


🔮 总结与展望(约1-2分钟)

好了,10条新闻聊完,今天来总结三个趋势:

第一:模型竞赛白热化。 Claude Opus 4.7 直接把视觉和编程能力拉到新高度,通义千问用30亿激活参数打出350亿的效果,智谱也在Agent进化上放了大招。没有谁能”躺赢”——你今天是第一,明天可能就被超越。对我们用户来说,竞争越激烈,产品越好用。

第二:算力格局在松动。 OpenAI 300亿美元押注 Cerebras,这是对英伟达垄断地位的一次重大挑战。未来AI行业的”卖铲人”不一定只有英伟达一家,多元化算力供应是大势所趋。

第三:AI 正在从”看平面”走向”懂立体”。 英伟达 Lyra2.0 一张照片生90米3D环境,腾讯混元2.0一键生成3D世界,谷歌 MedGemma 能读CT三维影像——3D理解和生成能力可能是下一个AI技术爆发的方向。


👋 结尾(约30秒)

好的,以上就是今天的全部AI快讯了!今天最让我印象深刻的是 Claude Opus 4.7 的那个视觉能力数据——从54.5%到98.5%,这不是进步,这是飞跃。Anthropic 这波真的很猛。

周末就要到了,大家可以趁休息时间去试试这些新模型——Opus 4.7、Qwen3.6,都值得亲手体验一下。

如果你觉得今天的内容有收获,别忘了订阅我们的播客。我是小敏,祝大家周末愉快!我们下周见!拜拜~ 👋🎙️


本文由 AI播客快讯 自动生成并发布。新闻来源:AIBase资讯、AI工具集 等公开渠道