亚马逊云服务(AWS)宣布为其S3云对象存储推出矢量存储功能——S3 Vectors,该公司声称此举可将AI存储中矢量化数据的上传、存储和查询成本降低多达90%。
该功能旨在让客户能够经济高效地在AWS云中存储大量矢量数据,并通过此类索引进行搜索以查找特定内容类型,有望成为更昂贵的矢量数据库的替代方案。
矢量数据支持所谓的语义搜索,搜索功能利用元数据中的矢量信息,让用户能够找到相似类型的信息。例如在视频文件中查找相似场景、在医学影像中记录的模式,或具有相关主题的文档集合。
S3 Vectors为其S3对象存储引入了专门构建的AWS存储桶类型,并将提供应用程序编程接口(API)以允许应用程序连接到此类数据存储。
每个Amazon S3 Vectors存储桶最多可支持10,000个矢量索引,每个索引能够存储数千万个矢量。
创建矢量索引后,客户还可以将元数据作为键值对附加到矢量上,以便根据一组条件过滤未来的查询。AWS表示,S3 Vectors将随时间自动优化矢量数据,以实现最佳的性价比。
S3 Vectors与Amazon Bedrock知识库集成,并可与Amazon OpenSearch一起使用。
Bedrock是AWS的托管服务,允许客户构建生成式AI应用程序,而OpenSearch是大量数据的存储库和可视化工具,有助于创建检索增强生成(RAG)应用程序。
据AWS称,S3 Vectors可以消除为矢量数据库配置基础设施的需要。这可能是因为S3和基于云的对象存储比矢量数据库更便宜构建和运行。
对象存储旨在使用扁平结构和最小开销处理大量非结构化数据,并允许高效检索单个文件。而矢量数据库则专为跨复杂高维数据的高性能相似性搜索而设计。它们通常依赖于专门的索引方法和硬件加速,这可能推高硬件和运行成本。
矢量数据是一种高维数据类型,之所以这样称呼是因为数据点中的特征或值数量远超过收集的样本或数据点数量。
在AI中,矢量用于存储数据并对其执行计算。
例如,自然语言中的生成式AI请求会被处理以获得词义、上下文等信息,然后以多维矢量格式表示,可以对其进行数学运算。这被称为矢量嵌入。
为了获得查询答案,解析和处理的数值结果可以与已经矢量嵌入的数据进行比较并提供答案。
这意味着数据可以表示可能在所谓非结构化数据中找到的特征——例如形状、颜色,以及当它们作为整体被解释时可能代表的含义。
到目前为止,AWS似乎是第一家为其基础对象存储产品引入矢量功能的超大规模云提供商。
微软Azure通过Azure Cosmos DB(一个矢量数据库)提供矢量存储和搜索。在Azure中可以使用Azure AI搜索进行矢量搜索。
与此同时,谷歌云平台通过Vertex AI为存储在GCP的BigQuery、Cloud SQL或AlloyDB数据库中的矢量数据提供矢量搜索。
好文章,需要你的鼓励
Replit与RevenueCat达成合作,将订阅变现工具直接集成至Replit平台。用户只需通过自然语言提示(如"添加订阅"),即可完成应用内购和订阅配置,无需离开平台。RevenueCat管理超8万款应用的订阅业务,每月处理约10亿美元交易。此次合作旨在让"氛围编程"用户在构建应用的同时即可实现商业变现,月收入未达2500美元前免费使用,超出后收取1%费用。
LiVER是由北京大学、北京邮电大学等机构联合提出的视频生成框架,核心创新是将物理渲染技术与AI视频生成结合,通过Blender引擎计算漫反射、粗糙GGX和光泽GGX三种光照图像构成"场景代理",引导视频扩散模型生成光影物理准确的视频。框架包含渲染器智能体、轻量化编码器适配器和三阶段训练策略,支持对光照、场景布局和摄像机轨迹的独立精确控制。配套构建的LiVERSet数据集含约11000段标注视频,实验显示该方法在视频质量和控制精度上均优于现有方法。
所有人都说AI需要护栏,但真正在构建它的人寥寥无几。SkipLabs创始人Julien Verlaguet深耕这一问题已逾一年,他发现市面上多数"护栏"不过是提示词包装。为此,他打造了专为后端服务设计的AI编程智能体Skipper,基于健全的TypeScript类型系统与响应式运行时,实现增量式代码生成与测试,内部基准测试通过率超90%。他认为,编程语言的"人类可读性时代"正走向终结,面向智能体的精确工具链才是未来。
这项由蒙特利尔学习算法研究所(Mila)与麦吉尔大学联合发布的研究(arXiv:2604.07776,2026年4月)提出了AGENT-AS-ANNOTATORS框架,通过模仿人类数据标注的三种角色分工,系统化生成高质量网页智能体训练轨迹。以Gemini 3 Pro为教师模型,仅用2322条精选轨迹对90亿参数的Qwen3.5-9B模型进行监督微调,在WebArena基准上达到41.5%成功率,超越GPT-4o和Claude 3.5 Sonnet,并在从未见过的企业平台WorkArena L1上提升18.2个百分点,验证了"数据质量远比数量重要"这一核心结论。