运营热点解读
近 300万人围观卡帕西亲测 Opus 5:两小时写完 5500 行代码, 却连自己写的游戏都玩不了
雷达摘要
过去,人们喜欢用一道颇具喜感的题目测试大模型:“请生成一张鹈鹕骑自行车的可缩放矢量图。” 下面这张图是 ChatGPT 为我生成的: 这道题看似简单,实际上需要模型理解自行车的结构、鹈鹕的身体组成,以及两者之间的空间关系,再用一系列坐标、路径和图形元素把它们组合起来。 模型画出的鹈鹕究竟是坐在车上、悬浮在空中,还是与自行车融成一团,往往能直观暴露其空间推理能力。 但现在,Andrej Karpathy 认为,评价前沿模型的方式可能需要再次升级。 8 月 2 日,Karpathy 在 X 上公布了一项实验。他把《指环王》第一章开头的一段文字交给 Claude Opus 5,给出 100 万 Token 的推理预算——按他的估算约为 10 美元——并要求模型用 Three.js 把这段故事渲染成一个三维场景。 O…
为什么值得关注
AI 能力更新,影响电商内容生产、素材制作或运营自动化效率。
建议动作
评估该 AI 能力能否降低素材、客服或数据分析的人力成本,安排小规模测试。
分类:ecommerce
原始信息
本页是基于公开来源生成的摘要与运营提示,不替代原文。请以原始发布方内容为准。
电商热点雷达