RecodeX 重构消息,字节Seed团队发布Agent评测项目EdgeBench,通过让模型执行134个长达12小时的任务并进行约3.8万小时的实验,发现了Agent在环境学习中的Scaling Law,即平均学习曲线被同一函数以极高精度拟合,且模型的学习效率约每3个月翻一番。
字节Seed团队发布Agent评测项目EdgeBench,通过让模型执行134个...
AI 辅助判断积极仅供信息参考,不构成投资建议
原始信息来源Pedailynews.pedaily.cn
查看原文 ↗RecodeX 重构消息,字节Seed团队发布Agent评测项目EdgeBench,通过让模型执行134个长达12小时的任务并进行约3.8万小时的实验,发现了Agent在环境学习中的Scaling Law,即平均学习曲线被同一函数以极高精度拟合,且模型的学习效率约每3个月翻一番。