6月7日,国际人工智能顶会CVPR 2023举办的第一届大模型挑战赛(CVPR 2023 Workshop on Foundation Model:1st foundation model challenge)落下帷幕,本次比赛吸引了来自全球著名高校和知名企业的1024名参赛者。经过为期2个月的激烈角逐,天翼云AI团队(队名CTRL)在多任务大模型赛道中表现出色,荣获本届大赛冠军。
CVPR会议是由IEEE主办的关于计算机视觉和模式识别的国际学术会议,收录了该领域最新的研究成果和技术发展,是全球计算机视觉三大顶级会议之一。
传统的视觉模型生产流程通常采用单任务,从零开始训练,各个任务之间无法相互借鉴。由于单任务数据有限,导致模型的实际效果过于依赖任务数据分布,通常对于不同场景的泛化效果不佳。
近年来,大数据预训练技术迅速发展,通过利用大量数据学习通用知识并将其迁移到下游任务中的方法,本质上实现了不同任务之间的相互借鉴。基于海量数据获得的预训练模型具有较好的知识完备性,即使在下游任务中使用少量数据进行微调,仍然能够获得良好的效果。然而,基于预训练+下游任务微调的模型生产流程需要为每个任务单独训练模型,这在研发上消耗了大量资源。相比之下,多任务训练方案通过使用多个任务的数据训练一个功能强大的通用模型,可以直接应用于处理多个任务,从而有效提高模型生产效率和泛化能力。
在本次竞赛中,参赛者需要使用单一模型同时完成交通场景下的分类、检测和分割三个代表性任务的联合训练。天翼云AI团队在模型设计方面凭借丰富的算法开发经验,选择了参数量仅为第2名60%的预训练模型,用更少的参数却获得了更高的精度。
为了解决多任务训练中各分支损失函数和梯度不一致导致收敛缓慢的问题,天翼云AI团队采用了损失均衡和梯度尺度统一的方法,以此来平衡各任务分支的损失函数,并使梯度具有一致的尺度,从而提高模型的训练效率和收敛速度。此外,天翼云AI团队还通过精心设计的任务专属特征金字塔和注意力机制,使各分支任务能够利用骨干网络中对自身任务更有效的特征,进一步提升了整体模型的精度和性能。
通过以上模型设计和训练策略,天翼云AI团队在竞赛中取得了优异成绩,充分展示了在图像、音频及多模态领域的深厚积累和持续创新能力。未来,天翼云将继续在广阔的人工智能领域进行创新和探索,以更先进的技术和卓越的成果惠及更多用户,为千行百业的数字化发展提供支撑。
好文章,需要你的鼓励
人工智能初创公司Counterintuitive Corp.正式发布,旨在通过开发专为推理而非模仿设计的芯片和软件来重新定义AI。该公司提出人工推理单元(ARU)这一全新计算架构类别,以解决现代AI面临的"精度无真理、推理无记忆"双重困境。ARU采用确定性、记忆驱动的推理架构,配合全栈推理软件,承诺突破当前AI局限性,开启后GPU时代的智能计算新纪元。
北京大学团队开发出WoW世界模型,这是首个真正理解物理规律的AI系统。通过200万机器人互动数据训练,WoW不仅能生成逼真视频,更能理解重力、碰撞等物理定律。其创新的SOPHIA框架让AI具备自我纠错能力,在物理理解测试中达到80.16%准确率。该技术将推动智能机器人、视频制作等领域发展,为通用人工智能奠定重要基础。
全球最大云服务提供商亚马逊云服务(AWS)遭遇大规模故障,影响政府机构、AI公司和金融平台等众多客户。尽管AWS称已基本恢复,但仍有用户无法连接租用服务器。故障源于关键数据库服务的数字目录故障,导致依赖该数据库的软件无法获取信息而出现连锁反应。受影响服务包括Venmo、苹果音乐、Zoom等数百个网站和应用。
香港大学和蚂蚁集团联合推出PromptCoT 2.0,这是一种让AI自动生成高质量训练题目的创新方法。通过"概念-思路-题目"的三步策略,AI能像老师备课一样先构思解题思路再出题,大幅提升了题目质量和训练效果。实验显示该方法在数学竞赛和编程任务上都取得了显著提升,为解决AI训练数据稀缺问题提供了新思路。