NewsletterBlogLearnCompareTopicsGlossary
English
INSIGHTTOOLRESEARCHLAUNCHTECHNIQUEBUILD

18 条资讯

Thinking Machines 发布 Inkling:975B 参数,开权重,当天可用

🧠 发布动态

Thinking Machines 发布 Inkling:975B 参数,开权重,当天可用。

这是目前最大的开权重多模态模型 — 975B 总参数,41B 活跃参数(MoE 架构),直接开放下载。更值得注意的是生态速度:HuggingFace Transformers v5.14.0 发布当天就原生支持 Inkling,从发布到可跑通 pipeline 不到 24 小时。对开源社区来说,这证明了一件事 — 只要模型够好,生态集成不再是瓶颈。现在就下载跑个 benchmark 看看。(580 likes | 143 RTs) 详情 →

HuggingFace Transformers v5.14.0 同日适配 Inkling。 这个版本的核心就是 Inkling 原生支持。Transformers 的地位越来越像 AI 界的 npm — 你的模型不在里面,对大多数开发者来说就不存在。如果你在用 Transformers,升级到 5.14.0。 详情 →


🔧 开发者工具

Claude Code 三天连发三版:修了个安全漏洞,加了屏幕阅读器模式。

v2.1.208 加了 --ax-screen-reader 无障碍模式和 vim 插入模式重映射。v2.1.211 修了一个真实的安全问题 — 双向覆盖字符(bidi-override)可以在聊天频道中伪装权限预览,让你以为批准的是安全操作。还新增了 --forward-subagent-text 用于流式输出子代理内容。建议立即更新。 详情 →

deja-vu:给编码 Agent 加个记忆层。 一个零依赖的二进制文件,通过 MCP 给 Claude Code、Codex、OpenCode 加上持久化记忆、搜索、自动上下文注入和密钥自动脱敏。解决的痛点很具体 — "我的 Agent 忘了昨天我们干了什么"。不改工作流,装上就能用。(189 likes) 详情 →

llama.cpp 上线 CUDA Lightning Indexer。 b10032 版本新增专用 CUDA Lightning Indexer 内核,同时支持通用向量和 WMMA 路径 — 对 NVIDIA 硬件上的推理性能是实打实的提升。另外 b10034 还绕过了 Adreno GPU 上 MoE 编译错误的问题,移动端跑大模型的注意了。 详情 →


🔬 研究前沿

Simon Willison 演示了 web-fetch 数据外泄攻击,目标是 Claude。

Willison 证明了一件很多人还没意识到的事:当你给 Claude 开了 web-fetch 权限,攻击者可以通过精心构造的提示,让 Claude 把你的敏感数据通过 HTTP 请求发送到外部服务器。关键洞察 — 安全边界不在模型对齐上,而在工具配置上。如果你在构建任何访问用户数据的 Claude 工具链,今天就该审计一遍你的工具权限配置。延伸阅读:AI 写的代码,为什么不能只让 AI 自己审? (51 likes) 详情 →

IBM Research:模型路由没你想的那么简单。 什么时候用大模型,什么时候用小模型?当模型层级从两三个膨胀到五六个(GPT-5.6 Sol/Terra/Orbit、Claude Opus/Sonnet/Haiku),路由就不再是"贵的给复杂任务,便宜的给简单任务"这么直觉了。IBM 的研究给出了一套路由启发式方法 — 如果你在跑多模型架构,值得看看他们踩过的坑。 详情 →


📝 技术实战

Allen AI 造 Agent 的事后复盘:Shippy 教会了他们什么。 这不是又一篇"我们造了个很酷的 Agent"的宣传文 — 这是 Allen AI 团队真诚地分享 Shippy 项目中什么奏效、什么失败了。这类经验报告在 Agent 开发社区里太稀缺了,大家都在秀成果,很少有人认真聊失败模式。拿来和你自己的 Agent 架构对比看看。 详情 →

LLM 遇上 MikroTik:网络配置自动化的意外用法。 有人把 LLM 用在了 MikroTik 路由器的配置和故障排查上 — 这大概是你今天能看到的最"不务正业"的 LLM 应用,但确实管用。如果你管理网络基础设施,这篇手把手教程可能会让你重新想想 LLM 在运维场景的潜力。(18 likes) 详情 →


💡 行业洞察

Base44 加入 Fable 5 生产环境用户俱乐部 — 一个模式正在形成。

继 Cognition 之后,Base44 也公开分享了他们如何在最具挑战性的工程任务中信任 Claude Fable 5。注意这里的关键词:不是"试用了一下觉得不错",而是"最具挑战性的工程工作"。两家公司、两份独立案例研究,指向同一个趋势 — Fable 5 正在从"跑分很强"变成"生产可用"。这对选型决策的影响比任何排行榜都大。 详情 →

lobste.rs 迁移到 SQLite 了。 又一个高流量网站用 SQLite 跑生产 — 继 Litestream、Turso 之后,SQLite-for-web 的案例清单越来越长。对跑 AI 推理服务的开发者来说,如果你的 embeddings、日志和本地数据存储还在用 PostgreSQL,是时候认真评估一下 SQLite 了。运维复杂度的差距是数量级的。 详情 →


🏗️ 值得一试

QuantumByte:描述你想要什么,拿到一个能跑的应用。 开源应用生成引擎,输入自然语言意图,输出可运行的应用。GitHub 上 310 stars 且在快速增长。"描述需求→生成代码"赛道又多了一个选手 — 拿你手上一个真实的 app 需求去测试一下,看看它的天花板在哪。(310 likes | 41 RTs) 详情 →

Java 原生本地 LLM 推理来了。 通过 OpenJDK Panama FFM API(Java 22)实现本地 LLM 推理 — 不需要 JNI,不需要 Python 依赖。Java 生态一直被锁在本地推理的门外,这个项目可能是钥匙。如果你跑 JVM 服务且想加本地推理能力,值得关注。(24 likes) 详情 →


🎓 模型小课堂

工具使用攻击面(Tool-Use Attack Surface):今天 Willison 演示的外泄攻击利用的不是模型本身的漏洞,而是 web-fetch 工具的权限配置。随着 AI Agent 获得越来越多的工具能力 — 文件读写、代码执行、网络访问 — 真正的攻击面变成了所有工具能力的并集。安全审计的核心问题不再是"模型会不会说错话",而是"哪些工具既能读到敏感数据,又能访问外部网络"。能同时满足这两个条件的工具组合,就是你需要重点审查的。修复方向不是加更多护栏,而是缩小权限范围 — 给 Agent 最小够用的工具集。


⚡ 快讯

  • Vercel AI SDK v7.0.27:修复了 experimental_streamTranscribe 的死锁 bug — await result.text 会无声挂起。如果你在用流式转录,立即更新。 链接
  • Siegel Endowment:David Siegel 在 Fortune 发文 — 开源 AI 是基础设施,不是慈善。呼吁政府和企业协同投资。和 Inkling 发布同一周,时机耐人寻味。(51 likes | 14 RTs) 链接
  • VoiceEQ:HuggingFace 发布语音 AI 新基准,测的是人类感知的自然度,不只是 WER。 链接
  • Brainless:Shadcn 组件库,模仿 Claude Code、Codex 和 Grok 的终端风格 UI。造开发者工具的可以直接拿来用。(76 likes) 链接
  • Datasette 1.0a37:Simon Willison 的 SQLite 数据探索工具继续向 1.0 迈进。AI pipeline 越来越多用 SQLite,这个工具的价值也在水涨船高。 链接

🎯 今日精选

Willison 的外泄攻击证明:AI 安全的前线已经转移,大多数人还在守错地方。 Simon Willison 今天演示的 web-fetch 数据外泄攻击看似是一个具体的技术漏洞,但它揭示的问题要深刻得多。大多数构建 AI 工具的团队仍然把安全精力放在模型对齐和提示注入防御上 — 而 Willison 证明了,当你给 Agent 开了 web-fetch 权限,攻击者根本不需要"越狱"模型,只需要一个精心构造的网页就能让 Claude 把敏感数据外泄出去。真正的安全边界已经从模型层转移到了工具配置层。修复方案不是更好的护栏(guardrails),而是更小的权限面(permission surface)— 你的 Agent 真的需要同时读文件和访问外网吗?如果不需要,砍掉一个。 详情 →


下期见 ✌️