RecodeX 重构消息,多家机构研究人员在Cell发表论文,推出面向衰老研究的整套大模型体系,包括用于评测模型能力的LongevityBench、针对衰老数据训练的Longevity-LLMs,以及连接大模型与衰老分析工具的科研智能体Longevity Claw。
LongevityBench以真实生物数据测试大模型,涵盖17类任务,结果显示通用大模型表现参差不齐。研究团队据此训练出5款参数规模0.6B至9B的Longevity-LLM,其中9B参数的L-Qwen3.5-9B综合排名超过Gemini 3.1 Pro等通用前沿模型,部分单项任务表现更优。
消融实验显示,模型判断依赖输入的生物特征,但无法推导因果关系。团队将L-Qwen3.5-9B接入Longevity Claw,该系统可开展候选靶点搜索,筛选出的部分候选基因富集已有衰老相关基因信号,但仍需实验验证。目前相关benchmark、模型和工具已公开。