长勺智库长勺智库
话题文章任务
登录
SSimon WillisonSimon Willison发布于 8 分钟前
AI 编程提速之后,真正的瓶颈是认知能力

编码智能体能显著提高代码产出,但代码量增长并不等于团队可以无限提速。新的瓶颈可能转向工程师理解和维护代码的认知能力,同时低成本加功能也更容易破坏软件的“概念完整性”。

0
LLMAgent工具链
0
LLMAgent工具链
SSimon WillisonSimon Willison发布于 9 分钟前
用 smolvm 隔离运行不可信 Python 与 JavaScript

一次针对 smolmachines/smolvm 的沙箱实验,目标是限制不可信代码的 CPU、内存、网络和文件访问。由于原测试环境缺少 KVM,研究改用支持 /dev/kvm 的 GitHub Actions 执行测试。

0
LLMAgent工具链
0
LLMAgent工具链
LLatent SpaceLatent Space发布于 9 分钟前
参数量不再是核心指标:GLM-5.3押注后训练扩展

智谱AI CEO唐杰提出,模型能力不能再只用参数量衡量,数据、算力投入方式、部署条件与后训练同样关键。GLM-5.3的能力提升主要来自长周期环境中的强化学习训练。

0
AIAgent工程实践
0
AIAgent工程实践
LLatent SpaceLatent Space发布于 10 分钟前
/wayfinder:帮 AI Agent 穿过项目规划的“战争迷雾”

Matt Pocock 推出的 /wayfinder 技能,面向目标尚不清晰的新项目与复杂规划场景。它通过拆分规划线程、原型验证和研究,再汇总为更完整的规格,降低长上下文与多会话规划的负担。

0
AIAgent工程实践
0
AIAgent工程实践
OOpenAI NewsOpenAI News发布于 12 分钟前
Stampli 如何用 ChatGPT Work 将数周发布工作压缩到数天

在发布日期固定、设计资源已投入其他项目的情况下,Stampli 借助 Codex 和 ChatGPT Work,将原本需要数周的发布制作流程压缩至数天。

0
AIAgent大模型OpenAI
0
AIAgent大模型OpenAI
OOpenAI NewsOpenAI News发布于 12 分钟前
OpenAI 推出 AI Futures,探讨变革性 AI 的社会影响

OpenAI 推出新博客 AI Futures,聚焦变革性人工智能可能如何重塑权力、治理、经济以及个人自由等重要议题。

0
AIAgent大模型OpenAI
0
AIAgent大模型OpenAI
SSimon WillisonSimon Willison发布于 1 天前
Mojo 1.0 后正式开源:编译器与工具链采用 Apache 2.0

Mojo 在发布 1.0 后兑现多年承诺,将编译器和工具链以 Apache 2.0 许可证开源。与此同时,其定位已从追求 Python 超集,转向独立发展并重点优化 GPU 编程体验。

40
LLMAgent工具链
40
LLMAgent工具链
LLatent SpaceLatent Space发布于 1 天前
模型路由正在成为企业 AI 的关键基础设施

前沿模型成本持续攀升、开放权重模型能力增强,使企业越来越难用单一模型覆盖所有任务。Glean CEO Arvind Jain 认为,模型路由的核心是在效果、成本与企业治理之间动态选择,甚至判断某些任务是否根本不需要调用大模型。

20
AIAgent工程实践
20
AIAgent工程实践
LLatent SpaceLatent Space发布于 1 天前
内存价格一年暴涨500%,AI算力需求正在挤压DRAM供应

内存市场正经历罕见的价格逆转:部分产品一年涨价约500%,128GB DDR5套装价格达到历史低点的10倍。有观点认为,单位容量内存成本已回到2007年前后的水平,而大型云计算客户正在提前锁定未来DRAM产能。

10
AIAgent工程实践
10
AIAgent工程实践
OOpenAI NewsOpenAI News发布于 1 天前
NVIDIA 如何用 ChatGPT Work 扩展团队专业能力

NVIDIA 团队使用 ChatGPT Work 减少人工任务、连接快速变化的信息信号,并将经过验证的工作流程推广到全球团队。

10
AIAgent大模型OpenAI
10
AIAgent大模型OpenAI
OOpenAI NewsOpenAI News发布于 1 天前
ChatGPT Ads 将扩展至欧洲 31 个市场

ChatGPT Ads 宣布扩展至欧洲 31 个市场,广告主可在人们探索信息、比较选项和做出决策的过程中触达潜在用户。

0
AIAgent大模型OpenAI
0
AIAgent大模型OpenAI
OOpenAI NewsOpenAI News发布于 1 天前
Replit 推出 Free Mode,降低软件创作门槛

Replit 推出由 GPT-5.6 Luna 驱动的 Free Mode,让用户无需担心 Token 成本,即可将想法转化为可运行的软件。

10
AIAgent大模型OpenAI
10
AIAgent大模型OpenAI
OOpenAI NewsOpenAI News发布于 1 天前
OpenAI 为前沿模型提供零数据保留,并预告隐私安全处理机制

OpenAI 重申将继续向符合条件的 API 客户提供零数据保留(ZDR),同时预告 Private Safety Processing:在不让 OpenAI 人员接触客户原始内容的情况下,跨多次交互识别潜在安全风险。

10
AIAgent大模型OpenAI
10
AIAgent大模型OpenAI
SSimon WillisonSimon Willison发布于 2 天前
Qwen 3.8 27B 智力指数得分 52,逼近超大参数模型

Qwen 3.8 27B 在 Artificial Analysis Intelligence Index 获得 52 分,与 GPT-5.6 Luna(max)持平,仅落后 GLM-5.2(max)和 DeepSeek V4 Pro 0813(max)1 分。

40
LLMAgent工具链
40
LLMAgent工具链
LLatent SpaceLatent Space发布于 2 天前
Stripe 据称将以 70 亿美元收购 OpenRouter

OpenRouter 据称接近以 70 亿美元被 Stripe 收购,距离其 13 亿美元估值的 B 轮融资仅约 90 天。披露数据显示,其年化收入约 1.4 亿美元、年化毛利润约 1 亿美元,模型路由层的商业价值正在快速上升。

50
AIAgent工程实践
50
AIAgent工程实践
OOpenAI NewsOpenAI News发布于 2 天前
Asana 用 Codex 两周完成原计划五年的测试系统迁移

Asana 使用 Codex 移除已停止活跃维护的 Enzyme 测试系统,两周内完成原计划至少五年的工程任务,模型与基础设施成本约 1.2 万美元。

70
AIAgent大模型OpenAI
70
AIAgent大模型OpenAI
OOpenAI NewsOpenAI News发布于 2 天前
OpenAI 推出青少年版 ChatGPT,强化学习支持与安全保护

ChatGPT for Teens 面向青少年用户,重点支持学习、批判性思考和更有信心地使用 AI,同时加入更严格的内置保护、健康使用功能以及面向家长的额外控制。

70
AIAgent大模型OpenAI
70
AIAgent大模型OpenAI
OOpenAI NewsOpenAI News发布于 2 天前
前沿模型触及关键网络能力,OpenAI放慢训练节奏并升级安全措施

随着新模型可能达到“关键网络安全能力”门槛,OpenAI暂时放缓前沿模型扩展,并从研究环境隔离、思维链监控和对齐训练三方面提高安全标准,部分高风险训练仍处于暂停状态。

80
AIAgent大模型OpenAI
80
AIAgent大模型OpenAI
OOpenAI NewsOpenAI News发布于 2 天前
OpenAI 与 CodeAI 合作推进青少年 AI 素养教育

OpenAI 与 CodeAI 宣布合作,面向学生和教育工作者提供 AI 教育工具与项目,重点培养学生理解 AI、批判性评估模型输出、安全负责使用 AI 以及参与 AI 创作的能力。

70
AIAgent大模型OpenAI
70
AIAgent大模型OpenAI
OOpenAI NewsOpenAI News发布于 2 天前
OpenAI 推出国家安全 AI 民主监督倡议

OpenAI 推出一项新倡议,旨在加强国家安全领域人工智能应用的民主监督,并通过工具、培训和专业知识支持政府机构提升相关能力。

70
AIAgent大模型OpenAI
70
AIAgent大模型OpenAI
每日签到未签到

每天签到一次,持续获得积分。

@2024-2027长勺智库浙ICP备2024134526号浙公网安备33011002017958
?
未登录用户

登录后查看个人信息与任务进度。

去登录