Ollama 上线原生 Agent UI,顺手支持了 Qwen3.5
🧠 发布动态
Ollama 上线原生 Agent UI,顺手支持了 Qwen3.5。
本地模型终于不用纯命令行撸 Agent 了。Ollama v0.32.0 加入了原生 Agent 界面和工具调用支持,同时引入 Qwen3.5 模型。这意味着你可以在笔记本上跑完整的 Agent 循环 — 搜文件、调 API、多步推理,不用把数据交给云端。本地 AI Agent 从"能用"到"好用"的门槛又低了一截。 详情 →
Claude Code 2.1.207 在 Bedrock 和 Vertex 上解锁 Auto 模式。
Claude Code 新版本让 Bedrock、Vertex、Foundry 用户无需手动 opt-in 即可使用 Auto 模式,同时修复了长时间流式输出时终端卡死的问题。如果你之前因为终端冻住而骂过 Claude Code,现在可以升级了。 详情 →
💡 行业洞察
Latent Space 深度拆解 GPT-5.6 和 ChatGPT 的超级应用转型。
还没消化完上周 GPT-5.6 Sol/Terra/Luna 三连发?Latent Space 出了一篇完整复盘 — 重点不只是模型本身,而是 ChatGPT 从聊天工具变成超级应用的战略转向。OpenAI 的棋很明显:模型是地基,应用生态才是护城河。值得花 20 分钟读完。 详情 →
Apple 起诉 OpenAI,指控窃取商业秘密。
Apple 对 OpenAI 提起诉讼,指控其"高层主导的商业秘密窃取"。这不是普通的人才流动纠纷 — Apple 的措辞直指 OpenAI 管理层。如果立案成功,会给整个 AI 行业的人才流动设下新的法律红线。目前 OpenAI 还没正式回应,事态还在发展中。 详情 →
Meta 下架 Instagram AI 功能,用户反弹赢了。 Meta 在用户大规模抗议后撤回了 Instagram 上一个争议 AI 功能。这是"先上线再道歉"策略在 AI 领域首次大规模失败 — 撤回造成的信任损失和媒体负面报道,远超提前做两周用户同意设计的成本。每个正在做 AI 功能的产品团队都该把这个案例钉在墙上。 详情 →
🔧 开发者工具
LangChain 为 OpenAI 模型加入显式 Prompt 缓存:langchain-openai 1.3.5 上线,你现在可以在 LangChain 链中直接启用 OpenAI 的 Prompt 缓存。跑 GPT-5.6 的生产链条,这是最直接的成本优化杠杆 — 重复前缀不再重复计费。 详情 →
Vercel AI SDK 修复 Groq 缓存静默失效:@ai-sdk/groq 4.0.8 修复了一个阴间 bug — Groq 的隐式 Prompt 缓存命中数一直报 undefined,意味着你的成本估算可能一直是错的。更新后重新检查一下你的 Groq 用量数据。 详情 →
MCP 官方参考服务器统一发版:modelcontextprotocol/servers 发布 2026.7.10 版本,filesystem、time、fetch、git 等官方参考服务器同步更新。如果你在做 MCP 集成,锁定这个版本可以避免依赖版本不一致的问题。 详情 →
HuggingFace Transformers 5.13.1 解锁 vLLM 升级路径:一个针对性补丁,解决了 transformers 与最新版 vLLM 的兼容性问题。如果你跑 vLLM 推理一直卡在旧版 transformers 不敢升级,现在可以放心更新了。 详情 →
LangGraph 1.2.9 修复多步 Agent 状态损坏:LangGraph 修复了 updateState 在 delta channel 中的元数据和计数器处理 bug — 一个在多步 Agent 图中可能导致状态悄悄损坏的隐患。用了 delta channel 的赶紧更新。 详情 →
📝 技术实战
llama.cpp 干掉了一个 29 倍的正则重编译瓶颈。 llama.cpp b9966 版本修复了 tensor-split 模式下的一个性能炸弹 — 每个 tensor 每个 token 都要重编译 29 次正则表达式,直接把解码线程拖垮。这是一个教科书级的性能分析案例:问题不在算法,在一行被忽视的编译调用。用 tensor-split 模式的立刻更新。 详情 →
🔬 研究前沿
MIT Tech Review 让 Claude 的概念空间发现"破圈"了:MIT 技术评论 用大众读得懂的方式介绍了 Anthropic 在 Claude 内部发现的概念空间 — 模型不只是在做模式匹配,而是构建了某种内部"概念地图"。这是可解释性(Interpretability)领域的重要突破。如果你有不懂 ML 但关心 AI 安全的同事,把这篇发给他们。 详情 →
🏗️ 值得一试
Mesh LLM:用 P2P 网络跑分布式推理:基于 iroh 的去中心化 mesh 网络做 LLM 分布式推理 — 不需要中心化编排,异构硬件(你的 Mac、同事的 Linux 工作站、办公室角落的旧 GPU 服务器)自动组网。还很早期,但边缘推理的思路值得关注。(26 likes | 10 RTs) 详情 →
AI Market Pulse:开发者的自动化股票研报:给个股票观察列表,每天自动生成 AI 分析的市场研报。对量化好奇但没时间从零搭系统的开发者,这个开箱即用。(106 likes | 18 RTs) 详情 →
🎓 模型小课堂
Agent 循环与工具调用编排(Agent Loops and Tool-Use Orchestration):Ollama 新出的 Agent UI 把工具调用循环带到了本地模型 — 但"Agent 循环"到底是怎么工作的?核心很简单:模型每一轮推理后做一个决策 — 是"调用工具获取更多信息"还是"直接回复用户"。如果选了调工具,工具的返回结果会作为新的上下文喂回模型,模型再做下一轮决策。这个"推理 → 决策 → 执行 → 反馈"的循环不断重复,直到模型判断信息足够、可以给出最终回答。理解这个循环机制,无论你用的是云端 API 还是本地 Ollama,调试 Agent 行为都会顺畅得多。
⚡ 快讯
- Vercel AI SDK 7.0.21:强制统一 Zod v4 导入方式,Zod 4 迁移后遇到验证 bug 的检查一下。 链接
- Latent Space:"今天没什么大事":连续一周模型大战后终于喘口气,可以停下来消化整合了。 链接
- GPU 热潮背后的循环融资:深度拆解 Nvidia、CoreWeave、Nebius 之间的资金闭环 — "AI 繁荣"里有多少是互相输血?(130 likes | 46 RTs) 链接
- 别再让我去问 AI 了:高讨论度吐槽文 — 开发者社区里"问 AI 啊"正在变成新的"去 Google 啊",但很多时候这个建议根本不管用。(108 likes | 59 RTs) 链接
- Project r0x:Claude Code 插件,支持 Robinhood Chain 上的 x402 加密支付 — AI Agent + 加密支付的早期实验。(122 likes) 链接
🎯 今日精选
Meta 下架 Instagram AI 功能 — "先上后改"在 AI 时代行不通了:Meta 在用户大规模反弹后被迫撤回 Instagram 上的 AI 功能,这是 AI 产品领域第一个重量级的"快速上线、事后道歉"策略失败案例。撤回本身的成本 — 信任流失、媒体负面报道周期、品牌损伤 — 远远超过了提前做两周用户同意流程设计的成本。这里面的不对称性值得每个正在做 AI 功能的产品团队深思:用户对 AI 功能的容忍度比传统功能低得多,因为 AI 天然带着"不透明"和"侵入性"的标签。以后再有人说"先上了再说",把 Meta 这个案例甩给他。 详情 →
下期见 ✌️