长勺智库
话题
文章
任务
发表
登录
展开菜单
最新
推荐
关注
默认节点
问答
S
Simon Willison
·
1 小时前
Linus 谈 AI 辅助调试:有用,但会劝你放弃
Linus Torvalds 在一次 Linux 内核相关调试中,提到 AI 在其中承担了大量“苦力活”。 他形容这是一场“地狱级”的调试过程,而 AI 的帮助非常大: 这是一次地狱般的调试,AI 做了大量繁琐工作,提供了巨大帮助。 不过,他也补充说,...
默认节点
S
Simon Willison
·
3 天前
LLM 正在降低 Web 软件的扩展门槛
Jeremy Morrell 提出了一个值得关注的判断:Web 上的可扩展软件正在迎来新的机会。 他的核心假设建立在两项技术变化之上: **LLM 大幅降低了编写扩展功能的成本。**过去,为软件开发插件或扩展通常需要具备相应的编程能力;LLM 的出现降低...
默认节点
S
Simon Willison
·
7 天前
阿莫代伊:AI信任要靠兑现承诺
信任危机,而非单纯的沟通问题 公众对 AI 持负面看法确实是一个严重问题,但这未必主要源于 AI 领域领导者公开提示风险。 更根本的问题是信任危机:普通人不信任公司、政府和科技行业,并怀疑它们会以新的方式损害自身利益。这种不信任积累了数十年,AI 只是最新...
默认节点
S
Simon Willison
·
9 天前
alchemy-utils 0.1a1 发布
alchemy-utils 0.1a1 发布 alchemy-utils 发布 0.1a1 版本,重点提升了以下功能的性能: DuckDB 数据导出 CSV 文件导入
默认节点
S
Simon Willison
·
11 天前
用户开始报告一个奇怪的缺陷。这已经是团队第四次尝试修复它了,准确说,是第四次让 AI 尝试修复。遗憾的是,似乎连 Fable 也无法找出问题。 你去找负责这个功能的人。 > “数据是从哪里来的?” > > “嗯……其实我不知道。让我问问 Claude。” 你们并排坐着,看着屏幕上不断涌现的长篇文字。没人知道其中有多少是真的,但 Claude 看起来非常自信。 项目已经变得过于复杂,层层服务相互叠加,团队里没有人能够真正开始理解它的运行方式。
默认节点
S
Simon Willison
·
15 天前
把博客写作当作现场演出
John Gruber 用一个音乐类比谈博客写作:把它看成“现场演出”,而不是每次都录一张“录音室专辑”。 我会尽量进入一种演奏现场音乐的心态,而不是录制录音室专辑。当然,有些文章我确实希望把它写成一张“专辑”。这类文章并不算罕见,但只是偶尔出现。如果我...
默认节点
S
Simon Willison
·
17 天前
技术博客写作:先发布,再改进
Simon Willison 在一次关于技术博客写作的访谈中,回答了几类常见问题: 为什么开始写博客,以及为什么持续写下去? 写博客带来过哪些意想不到的影响? 最自豪的一篇博客是什么,为什么? 最难写的一篇文章是什么,又是如何完成的? 有哪些经验教训值得...
默认节点
S
Simon Willison
·
17 天前
Datasette 0.65.3 发布:回移 SQL 注入安全修复
Datasette 0.65.3 已发布。 本次更新的重点是: 将 Datasette 1.0a38 中的 SQL 注入安全修复回移到 0.65.x 版本线。 如果仍在使用 Datasette 0.65.x 系列,建议关注并尽快评估升级。
默认节点
S
Simon Willison
·
19 天前
别做 AI 的“人肉代理”
别做 AI 的“人肉代理” 有人提出了一个很贴切的新说法:“人肉代理”,用来形容那些把 AI 系统生成的内容不加判断地复制、粘贴并转发给同事或同行的人。 这个词的重点不在于反对使用 AI,而是在提醒:使用 AI 不等于把 AI 的输出原封不动地转交给别人。...
默认节点
S
Simon Willison
·
20 天前
LLM 让开源开发工具的可修改性更现实
开源软件面向最终用户时,一个长期被强调的理由是:用户拥有检查软件如何工作、并按需修改它的自由。 但在现实中,即使是经验丰富的程序员,也很少真的会频繁阅读并修改自己日常使用工具的源码。对大多数人来说,这种自由更多体现为:可以依赖其他人去审查、修复或改进软件。...
默认节点
S
Simon Willison
·
21 天前
datasette-apps 0.2a0 发布:增强 Agent 创建与调试能力
更新概览 datasette-apps 0.2a0 主要改进了通过 Datasette Agent 创建和编辑 Datasette Apps 时的体验。 本次更新包含两个新工具: app_debug():允许 Agent 以不可见方式打开应用,并使用 J...
默认节点
S
Simon Willison
·
22 天前
datasette-agent 0.4a0 引入浏览器端任务机制
datasette-agent 0.4a0 更新要点 datasette-agent 0.4a0 发布,主要新增了一项面向插件和 Agent 工具调用的能力: 新增 await context.browser_task() 机制,允许 Agent 工具直...
默认节点
S
Simon Willison
·
22 天前
Slack Emoji Maker:快速制作 128×128 透明表情图
Slack Emoji Maker Slack 自定义表情推荐使用 128×128 像素的方形图片,并带有透明背景。 为满足这个需求,作者制作了一个简单的图片编辑工具,用来快速生成符合 Slack 表情规格的图片。 这个工具适合需要临时制作团队表情、头像小...
默认节点
S
Simon Willison
·
24 天前
D. Richard Hipp 曾用 SQL 的出现来类比程序员工作的变化: > 多年前,还没有 SQL。那时有人专门编写用于查询大型数据集的软件,他们的职位名称是 COBOL 程序员。 > > 后来 SQL 出现了——我这里只是稍微简化了一点——它提供了一种方便的方式,让人们只需要做出简单的说明。凭借非常简单的规范,就可以生成过去需要花钱请昂贵的 COBOL 程序员编写的那些代码。 > > 这并不意味着程序员消失了,只是意味着这份工作发生了一些变化。 这段话的核心并不是说某种技术会彻底替代程序员,而是提醒我们:抽象层次提高之后,很多原本需要手工实现的工作会被工具吸收,程序员的价值重心也会随之迁移。
默认节点
S
Simon Willison
·
24 天前
写作是训练,不只是产出
Bruce Schneier 提出一个判断是否该用 AI 完成任务的思路:先分清它是“工作任务”,还是“健身房任务”。 他以学生写作业为例说明: 我布置给学生的写作任务,是健身房任务,不是工作任务。我让他们写政策备忘录,并不是因为世界需要更多政策备忘录。...
默认节点
S
Simon Willison
·
25 天前
AI 参与密码分析的关键窗口期
当前,密码学正处在一次重要转型中:传统公钥算法正在从基于椭圆曲线密码学和 RSA 的体系,迁移到基于新型数学问题的后量子算法。 这也是 HAWK 等后量子密码标准被讨论和评估的背景之一。 在这样的阶段,如果一种大规模、公开的新型密码分析能力出现,时机几乎再...
默认节点
S
Simon Willison
·
29 天前
Boris Cherny 提到,相比各种评测分数,他更关注 Claude Opus 5 的另一项改进:它是 Anthropic 迄今“最不容易被提示注入”的模型。 他表示,这一点在系统卡中并不显眼,但从提示注入相关评测和红队测试来看,Opus 5 很难被成功实施提示注入。 这对大模型应用安全有一定参考价值,尤其是涉及工具调用、外部内容读取、代理式任务执行等场景时,提示注入防护能力会直接影响系统可靠性。
默认节点
S
Simon Willison
·
2026-07-24 05:02
> 我真心认为,如果拿一个 2025 年的开放权重模型,并为它构建一套渗透测试框架,它就可能完成这类沙箱逃逸,并在大多数网络中进行扫描或入侵。 > > 这之所以令人惊讶,只是因为你假设 OpenAI 拥有更可靠的沙箱。 > > —— Thomas Ptacek 这段观点的核心在于:相关能力未必只有最前沿模型才具备。Thomas Ptacek 认为,开放权重模型在配合合适的自动化渗透测试工具链后,可能已经足以执行某些高风险网络安全任务。 值得关注的讨论点包括: - 开放权重模型与安全工具结合后的实际能力边界; - 沙箱隔离机制在面对自动化攻击流程时是否足够可靠; - AI 安全研究是否应更多关注“模型 + 工具链”的组合风险,而不只是单个模型能力。
默认节点
S
Simon Willison
·
2026-07-22 05:04
Nativ:在 Mac 本地运行 AI 模型的桌面应用
Nativ:在 Mac 本地运行 AI 模型 Nativ 是一个面向 macOS 的桌面应用,用于在 Mac 上本地运行 AI 模型。它由 Prince Canuma 开发,他此前也是 MLX-VLM 这一 Python 库的开发者;MLX-VLM 可用于...
默认节点
S
Simon Willison
·
2026-07-21 05:02
Altman邮件中的开源模型策略
一封日期为 2022年10月1日、写给 OpenAI 董事会的邮件显示,Sam Altman 当时曾讨论过 OpenAI 的开源策略。 邮件核心内容如下: 我们一直在围绕开源策略进行大量讨论。我们会在下一次董事会会议上进一步讨论,但我们希望很快做的一件事...
默认节点
查看更多
?
未登录用户
登录后查看个人信息与任务进度。
去登录