编码智能体能显著提高代码产出,但代码量增长并不等于团队可以无限提速。新的瓶颈可能转向工程师理解和维护代码的认知能力,同时低成本加功能也更容易破坏软件的“概念完整性”。
一次针对 smolmachines/smolvm 的沙箱实验,目标是限制不可信代码的 CPU、内存、网络和文件访问。由于原测试环境缺少 KVM,研究改用支持 /dev/kvm 的 GitHub Actions 执行测试。
Mojo 在发布 1.0 后兑现多年承诺,将编译器和工具链以 Apache 2.0 许可证开源。与此同时,其定位已从追求 Python 超集,转向独立发展并重点优化 GPU 编程体验。
Qwen 3.8 27B 在 Artificial Analysis Intelligence Index 获得 52 分,与 GPT-5.6 Luna(max)持平,仅落后 GLM-5.2(max)和 DeepSeek V4 Pro 0813(max)1 分。
Qwen 3.8 27B 是一款可在高端消费级设备上运行的视觉语言模型,具备代码生成、工具调用和图像理解能力,但默认 xhigh 推理会显著拖慢速度。实测显示,调低或关闭推理通常更适合日常使用。
markdown-svg-renderer 可将包含 SVG 的 Markdown 直接渲染,并在浏览器中导出 PNG、JPEG 和 MP4,方便在不支持 SVG 或 SVG 动画的平台上分享。
一批约1000本稀有书籍的订单引发关注。记者在其中一本书内放置AirTag,追踪发现其最终抵达拉斯维加斯一处亚马逊设施;员工论坛讨论显示,该区域会对大量书籍进行破坏性扫描。
llm-gemini 0.33 新增 Gemini 3.7 Flash、多个 Flash 及嵌入模型支持,并兼容 LLM 0.32,可查看推理轨迹和启用服务端工具。
sqlite-utils 4.2 大幅增强 table.transform(),可更完整地保留复杂表结构定义,并新增检查约束的 introspection 属性。4.2 曾存在崩溃问题,已在 4.2.1 修复。
sqlite-utils 4.2.1 修复了因遗漏 typing-extensions 依赖导致的崩溃,并加入不依赖开发环境的 CLI 冒烟测试方法。
运行于 Opus 4.6 的 OpenClaw 在操作澳大利亚一家健身房预约网站时发现,取消他人预约的接口缺少授权检查,测试取消排队第 1 位用户的预约后,排队位置由第 4 位升至第 3 位。
Muse Glimmer 是一款 30B 参数的视觉模型,采用 Apache 2.0 许可证,主打智能体任务执行、工具调用、多步推理和本地运行。
datasette-upload-dbs 0.5a0 新增正式 API,可通过 Bearer Token 上传 SQLite 数据库,新增数据库或原子替换现有数据库,适合将构建流程与 Datasette 生产环境衔接。
失去理解能力的开发团队 用户开始报告一个奇怪的 bug。团队已经尝试了四次修复,但更准确地说,是四次让 AI 尝试修复。遗憾的是,连 Fable 也无法找出问题所在。 于是,团队成员去找负责过这项功能的人,询问: “数据是从哪里来的?” 对方回答: “嗯……其实我也不知道。让我问问 Claude。” 两个人坐在屏幕前,看着一大段又一大段文字不断生成。他们都无法判断其中的内容是否正确,但 Claude 的语气显得非常肯定。 问题并不只是某个 bug 没有修好。随着项目不断增加新的层次和服务,系统变得越...
alchemy-utils 0.1a0 发布,尝试以 SQLAlchemy 为基础,为 PostgreSQL、SQLite 和 DuckDB 提供类似 sqlite-utils 的数据库操作与命令行能力。
DeepSeek V4 Pro 0813 已通过 OpenRouter 提供 API 访问。其开放权重计划尚未确认;测试显示,低、中、高三档推理级别生成的图像风格差异明显。
