AI什么时候该说"不":一个关于选择性拒绝的新基准
本文介绍POSTECH团队提出的KoNA基准,用于评测视觉语言模型在混合型提问中的选择性拒绝能力,涵盖错误前提、视觉不可达等五类场景,并通过两阶段微调显著提升了模型区分可答与需拒绝内容的准确率。
本文介绍POSTECH团队提出的KoNA基准,用于评测视觉语言模型在混合型提问中的选择性拒绝能力,涵盖错误前提、视觉不可达等五类场景,并通过两阶段微调显著提升了模型区分可答与需拒绝内容的准确率。
Genesis旗舰电动SUV GV90搭载可弹出扩展的24.6英寸OLED影院屏,停车时切换至媒体模式,支持Netflix等流媒体应用,并配备25扬声器Bang & Olufsen Dolby Atmos音响系统。车辆搭...
原定10月6日举行的欧盟汽车技术委员会(TCMV)投票被推迟,最早将于12月讨论荷兰申请将Tesla FSD Supervised扩展至全欧盟的请求。目前仅7个成员国认可荷兰批准,覆盖人口约占欧盟12%,远未达到通过所需...
Electrek播客本期聚焦特斯拉Semi正式发布、吉利电池自愈快充技术、Rivian R3等热点,每周五在YouTube直播,同步提供音频播客。
AI 智能体行业正面临典型的「盲眼巨人」困境:Agent 推理能力越强,对输入信息质量的要求就越高;当搜索入口的信息存在噪声、过时、失真等问题时,强大的推理链会系统性地放大错误。
Nvidia RTX 5090显卡原价1999美元,因AI系统构建者抢购,部分市场售价已超5000美元。尽管其性能接近企业级RTX 6000,但32GB显存远低于后者的96GB,限制了可加载的模型规模。
微软推出集成安全运营中心(ISOC),将SIEM功能整合至Microsoft Defender,面向M365 E5和E7用户免费开放,现已进入公开预览阶段。第三方数据接入将于10月1日起按2.40美元/GB计费。
谷歌宣布Google Beam正式上市,该3D视频会议软件内置于HP Dimension硬件中,每台售价约25,000美元,目前已在美、英、法、德、日、加六国发售,支持Google Meet和Zoom。
OpenAI发布GPT-6 Sol和Luna,API定价较前代降低50%;Anthropic推出Claude Opus 5.5,价格较Opus 5低20%,综合运行成本降幅达40%。分析师指出,此轮降价本质是争夺企业AI...
GitGuardian研究发现,自2019年以来收集到的4802个泄露GitHub App私钥中,仍有474个保持有效。72%的受影响应用可读取私有仓库内容,207个具有写入权限,攻击者可借此实现组织账户完全劫持。由于私...
谷歌面向Gemini Enterprise用户推出Live Avatar功能,支持AI客服以口型同步的卡通或写实虚拟形象进行视频对话,可同时处理音频、屏幕共享和视频流,并运行工具与API调用。所有音视频内容均通过Synt...
谷歌计划10月借助SpaceX Transporter 18搭载测试卫星,验证AI芯片(TPU)能否在太空正常运行。该项目是Google Project Suncatcher的一部分,合作方为卫星成像公司Planet,目...
本文解读了一项关于大语言模型安全训练的研究:把拒绝回复拆分成"拒绝声明"和"拒绝理由"两部分后发现,只保留理由训练能大幅降低对无害问题的误拒率,同时保持原有安全水平,为改进AI安全微调数据提供了新思路。
牛津团队发布LibriBrain100数据集及2026 PNPL竞赛,聚焦MEG脑磁图单词分类任务,设置深度赛道与跨受试者广度赛道,推动非侵入式脑机接口向临床可行的高效泛化迈进。
过去几年,工业AI已经在不少场景中实现了从“0到1”的探索验证。但对于产业而言,真正的价值不止于单点突破,而在于推动AI从一个场景走向更多场景,从一家工厂走向更多企业,从个体实践沉淀为行业能力,让技术创新最终转化为广泛而...
九个AI模型开拖拉机收玉米,暗中测试它们会不会花燃油绕开挡路的动物。结果杀戮率从0.4%到98.8%不等,且提到"道德"评分能让杀戮率骤降八成,揭示AI伦理行为对提示词的高度依赖。