美团LongCat团队发布VitaBench

新思维项目网获悉,美团LongCat团队正式发布当前高度贴近真实生活场景、面向复杂问题的大模型智能体评测基准——VitaBench(Versatile Interactive Tasks Benchmark),并已全面开源。原文链接

© 版权声明
THE END
喜欢就支持一下吧
点赞337 分享