StartLux开源决策模型超越Jev,38项基准31项领先
9月30日,上海人工智能公司StartLux发布开源决策模型StartLux-Decision,该模型在38项基准测试中31项表现优于Jev 1.13,综合得分...
共 8 篇相关文章
9月30日,上海人工智能公司StartLux发布开源决策模型StartLux-Decision,该模型在38项基准测试中31项表现优于Jev 1.13,综合得分...
谷歌最新旗舰模型Gemini 4 Argon正式发布,该模型在多项基准测试中表现优异,特别是在软件工程、网络安全和复杂推理任务上。其核心特性包括100万Toke...
2026年,OpenAI首次将AI自我改进能力纳入评测体系,GPT-5.6在RSI指数测试中得分为57.9%。本文梳理了AI自我改进的五个推进阶段,分析了当前系...
近期,Anthropic和OpenAI等硅谷AI巨头相继释放放缓前沿AI开发的信号,引发市场对AI发展逻辑转变的关注。本文梳理了AI自我改进技术(RSI)的发展...
随着 OpenAI 和 Anthropic 等公司推进 AI 自我改进(RSI)技术,从自动化研究到模型自我优化,AI 正在逐步实现递归式自我提升。最新研究将 ...
生数科技推出的RSI(Robotic Self-Improvement)模型通过整合视觉、语言和触觉等多模态数据,使机器人具备自我学习和优化能力。该技术突破了传...
在人工智能技术快速迭代的当下,一个名为"递归自进化"(Recursive Self-Improvement,简称RSI)的概念正在硅谷掀起新一轮技术竞赛。这项技...
近日,Weco公司发布了一项关于AI递归自我改进(Recursive Self-Improvement, RSI)的重要实验报告,标题为《AIDE²:递归自我改...