NewsletterBlogLearnCompareTopicsGlossary
English
LAUNCHTECHNIQUEINSIGHTTOOLRESEARCHBUILD

15 条资讯

Opus 5 来了:登顶排行榜,价格砍半

🧠 发布动态

Opus 5 来了:登顶排行榜,价格砍半。

Anthropic 发布旗舰模型 Claude Opus 5,在 Artificial Analysis Intelligence Leaderboard 拿下第一,价格却只有 Fable 5 的一半。这个定价策略很明确 — 不给你"便宜但弱"的选项,而是直接在最强档位打价格战。对开发者来说,如果你之前因为成本在 Fable 和 Sonnet 之间纠结,现在 Opus 5 可能直接终结这个选择题。claude.ai 和 API 均已可用,现在就去试。 详情 →

FLUX 3 多模态流模型:图像质量碾压 Seedance、Gemini、Grok。

Black Forest Labs 发布 FLUX 3 — 不只是图像生成模型,而是多模态流模型(Multimodal Flow Model),在质量上击败了 Seedance 2.0Gemini OmniGrok Imagine。这是本周最重要的媒体生成发布。如果你的产品有图像/视频生成管线,FLUX 3 值得立刻测试。 详情 →

FLUX-mimic 把视频-动作模型带到机器人领域。 BFL 同步发布 FLUX-mimic — 专为机器人设计的视频-动作模型(Video-Action Model)。从文生图到机器人控制,BFL 的野心已经不在画图这一亩三分地了。技术细节值得做机器人或具身智能的团队仔细读。(308 likes | 48 RTs) 详情 →


📝 技术实战

Prompting 玩法变了:Anthropic 发布 Claude 5 时代的 Context Engineering 新规则。

Anthropic 官方发文,明确告诉开发者:Claude 3.5 时代的 prompting 套路在 Claude 5 上不一定好使了。这篇指南系统讲了如何为 Claude 5 系列模型重新组织 system prompt、工具定义、示例和对话历史。核心转变是:别再只盯着 user message 调,把整个 context window 当成工程面来设计。如果你在用 Claude API 做产品,这篇是必读。 详情 →


🔧 开发者工具

Opus 5 之后的模型选择指南:Haiku、Sonnet、Opus、Fable 怎么选? Opus 5 加入后,Claude 的模型矩阵变了。这篇官方指南按成本、速度和能力三个维度拆解了四个模型的适用场景 — 简单任务用 Haiku 4.5 省钱,日常开发用 Sonnet 5,复杂推理上 Opus 5,极端任务才需要 Fable 5。选模型不再靠直觉,看这张表。 详情 →

Anthropic 推出四项角色认证。 面向在客户场景中部署 Claude 的专业人员,Anthropic 推出结构化认证体系。这个思路很像十年前 AWS 推认证 — 当工具从"酷玩具"变成"企业基础设施"时,标准化专业能力就成了刚需。做 AI 解决方案的团队可以关注。 详情 →


🔬 研究前沿

独立跑分确认:Opus 5 登顶智能排行榜。 Artificial Analysis 的独立测试确认 Opus 5 拿下智能排行榜第一 — 这不是 Anthropic 自卖自夸,而是第三方验证。跑分可以参考,但记住上周基础设施噪声那篇文章的教训:在你自己的场景上跑 eval 再下结论。(84 likes | 35 RTs) 详情 →

AI 药物设计管线开始产出真实药物成果。 MIT Tech Review 综述了 AI 如何重塑药物设计 — 从蛋白质工程到临床试验优化。重点不是"AI 能辅助药物设计"这个老生常谈,而是管线开始产出真实的药物候选分子了,不再只是发论文。AI for Science 的落地正在加速。 详情 →


💡 行业洞察

Nvidia、微软、Meta 联手反对开源模型过度监管,开源之战升级到大厂层面。

三大巨头 — Nvidia微软Meta — 联合发声反对对开源权重模型的过度监管。这紧接着本周早些时候 684 位创始人联名信之后。开源权重的政策博弈从创业公司喊话升级到了 Big Tech 亲自下场,信号非常明确:开源 AI 的生存权已经成为行业共识级别的议题。(464 likes | 218 RTs) 详情 →

Simon Willison 的独立 Opus 5 评测。 Simon Willison 以公正、详尽的模型评测闻名,他对 Opus 5 的第一手分析是目前最值得信赖的外部视角。不看厂商 PR 稿,看这篇。 详情 →

Claude Design 的设计师自己怎么用它:先探索,再动手。 Anthropic 分享了 Claude Design 的产品设计师如何用自己设计的工具做创意探索 — 核心工作流是"先用 AI 快速探索 10 个方向,再选一个深入构建"。这个"explore-before-build"模式适用于任何设计密集型产品团队。 详情 →


🏗️ 值得一试

KAT-Coder V2.5:快手入局编程模型。 快手 旗下 Kwaipilot 团队的编程模型 KAT-Coder V2.5 在 HuggingFace 上热度攀升。又一个中国团队入局编程模型赛道,对标 DeepSeek Coder 和 Qwen Coder。模型开放下载,值得在你自己的代码任务上跑个对比。(121 likes | 396 downloads) 详情 →


🎓 模型小课堂

Context Engineering(上下文工程):随着 Opus 5 发布和 Anthropic 发出 Claude 5 时代的新 prompting 指南,"Prompt Engineering"正在进化为"Context Engineering"。区别在哪?Prompt Engineering 关注的是怎么写好那一句 user message;Context Engineering 关注的是整个上下文窗口的编排 — system prompt 怎么写、工具定义怎么放、示例放几个放哪里、对话历史怎么裁剪,这些全部是需要工程化设计的面。模型厂商现在明确期望开发者把 context window 当作一个完整的工程表面来对待,而不只是往里塞一句话。不同模型系列的最优 context 策略还不一样 — 不针对性调整,就是在浪费模型能力。


⚡ 快讯

  • The Guardian 质疑 OpenAI "失控黑客 Agent"叙事:对本周刷屏的 AI Agent 失控故事泼冷水,值得看看另一面。(385 likes | 210 RTs) 链接
  • Thomas Ptacek 的 AI 安全架构观点:Simon Willison 引用应用安全大佬 Ptacek 的分析,做生产级 AI 系统的必读。 链接
  • 中美 AI 博弈遇上能源基础设施瓶颈:MIT Tech Review 报道 AI 扩展的两大约束 — 地缘政治和电力 — 正在政策层面交汇。 链接

🎯 今日精选

Anthropic 亲自发"新规则"指南,说明 Prompt Engineering 正在按模型代际碎片化:Anthropic 为 Claude 5 系列发布官方 Context Engineering 指南这件事本身,比指南内容更值得关注。它传递的信号是:prompt engineering 不是在收敛为一套通用原则,而是在按模型代际碎片化。在 Claude 3.5 上调好的 prompt,搬到 Claude 5 上可能效果打折;反过来,Claude 5 能利用的 context 策略在其他模型上可能无效。这意味着"一套 prompt 走天下"的时代结束了 — 认真做 AI 产品的团队需要按模型家族维护不同的 context 策略。Opus 5 登顶排行榜是预期内的事,但"你需要重新学怎么跟我说话"这个信号,才是今天最该认真对待的。 详情 →


下期见 ✌️