编码智能体能显著提高代码产出,但代码量增长并不等于团队可以无限提速。新的瓶颈可能转向工程师理解和维护代码的认知能力,同时低成本加功能也更容易破坏软件的“概念完整性”。
一次针对 smolmachines/smolvm 的沙箱实验,目标是限制不可信代码的 CPU、内存、网络和文件访问。由于原测试环境缺少 KVM,研究改用支持 /dev/kvm 的 GitHub Actions 执行测试。
智谱AI CEO唐杰提出,模型能力不能再只用参数量衡量,数据、算力投入方式、部署条件与后训练同样关键。GLM-5.3的能力提升主要来自长周期环境中的强化学习训练。
Matt Pocock 推出的 /wayfinder 技能,面向目标尚不清晰的新项目与复杂规划场景。它通过拆分规划线程、原型验证和研究,再汇总为更完整的规格,降低长上下文与多会话规划的负担。
在发布日期固定、设计资源已投入其他项目的情况下,Stampli 借助 Codex 和 ChatGPT Work,将原本需要数周的发布制作流程压缩至数天。
OpenAI 推出新博客 AI Futures,聚焦变革性人工智能可能如何重塑权力、治理、经济以及个人自由等重要议题。
Mojo 在发布 1.0 后兑现多年承诺,将编译器和工具链以 Apache 2.0 许可证开源。与此同时,其定位已从追求 Python 超集,转向独立发展并重点优化 GPU 编程体验。
前沿模型成本持续攀升、开放权重模型能力增强,使企业越来越难用单一模型覆盖所有任务。Glean CEO Arvind Jain 认为,模型路由的核心是在效果、成本与企业治理之间动态选择,甚至判断某些任务是否根本不需要调用大模型。
内存市场正经历罕见的价格逆转:部分产品一年涨价约500%,128GB DDR5套装价格达到历史低点的10倍。有观点认为,单位容量内存成本已回到2007年前后的水平,而大型云计算客户正在提前锁定未来DRAM产能。
NVIDIA 团队使用 ChatGPT Work 减少人工任务、连接快速变化的信息信号,并将经过验证的工作流程推广到全球团队。
Replit 推出由 GPT-5.6 Luna 驱动的 Free Mode,让用户无需担心 Token 成本,即可将想法转化为可运行的软件。
OpenAI 重申将继续向符合条件的 API 客户提供零数据保留(ZDR),同时预告 Private Safety Processing:在不让 OpenAI 人员接触客户原始内容的情况下,跨多次交互识别潜在安全风险。
Qwen 3.8 27B 在 Artificial Analysis Intelligence Index 获得 52 分,与 GPT-5.6 Luna(max)持平,仅落后 GLM-5.2(max)和 DeepSeek V4 Pro 0813(max)1 分。
OpenRouter 据称接近以 70 亿美元被 Stripe 收购,距离其 13 亿美元估值的 B 轮融资仅约 90 天。披露数据显示,其年化收入约 1.4 亿美元、年化毛利润约 1 亿美元,模型路由层的商业价值正在快速上升。
Asana 使用 Codex 移除已停止活跃维护的 Enzyme 测试系统,两周内完成原计划至少五年的工程任务,模型与基础设施成本约 1.2 万美元。
ChatGPT for Teens 面向青少年用户,重点支持学习、批判性思考和更有信心地使用 AI,同时加入更严格的内置保护、健康使用功能以及面向家长的额外控制。
随着新模型可能达到“关键网络安全能力”门槛,OpenAI暂时放缓前沿模型扩展,并从研究环境隔离、思维链监控和对齐训练三方面提高安全标准,部分高风险训练仍处于暂停状态。
OpenAI 与 CodeAI 宣布合作,面向学生和教育工作者提供 AI 教育工具与项目,重点培养学生理解 AI、批判性评估模型输出、安全负责使用 AI 以及参与 AI 创作的能力。


