IT之家 8 月 20 日消息,DeepReinforce 昨日(8 月 19 日)宣布推出 Ornith-1.5 系列开源模型,在训练模型时重点引入“自我改进循环”机制, 其最大 397B 规模模型部分性能超过 Claude Opus 4.8。 训练方面,Ornith-1.5 在其学习过程中融入了自我改进循环,通过不断创建一个循环来实现自主性能提升,在这个循环中,人工智能模型会在学习过程中提出...