太阳系科普

　　《新科学家》网站还报道，在被视为AGI重要衡量标准的抽象与推理语料库-AGI（ARC-AGI）大赛中，o3模型也创下新纪录：在低算力配置下，它以75.7%的得分登上公共排行榜前列。只因确定此项大奖得主的测试具有更严格的算力限制，在该算力限制下，o3的挑战以失败告终。　　不过，在超出官方算力限制172倍的高算力下，o3采用“蛮力”取得了87.5%的成绩，达到了代表人类水平的85%门槛。　　对于o3的表现，谷歌前工程师、ARC-AGI主要创建者弗朗索瓦·肖莱在博客中写道，这是AI能力的一次惊人且重要的跃升。但o3尚未实现AGI，因为其仍然无法解决ARC-AGI比赛中一些非常简单的问题，这表明其与人类智能存在根本差异。　　AGI是一个假想中的未来系统，它能够模仿人类思维、决策，拥有自我意识，并能自主行动。然而，AGI目前主要活跃在科幻作品中，尚未走进现实。　　升级迭代并非易事　　o3不仅是OpenAI公司的最新力作，也是AI巨头竞逐大型语言模型的生动写照。　　两年前，OpenAI发布了ChatGPT，由此拉开了AI军备竞赛的序幕。从GPT-3.5到更准确、更具创造性的GPT-4，再到o1，直至o3，OpenAI在不断精进自家产品。　　其他顶级AI开发商也在利用日益先进的技术，推动自家产品迭代升级。此前不久，谷歌推出了其旗舰模型“双子座”（Gemini）的新版本，据称其速度是上一代的两倍，并且能够“思考、记忆、规划，甚至替代用户采取行动”。元宇宙平台公司计划明年推出Llama 4。　　然而，迭代之路并非坦途。包括OpenAI和谷歌在内的几家领军企业，正面临新模型开发耗资巨大但回报递减的困境。OpenAI的GPT-5模型开发工作进展缓慢。据悉，仅6个月的训练，单计算成本就高达约5亿美元，而性能仅比该公司现有产品略胜一筹。