全球 AI - 2026年7月28日重要事件

今天的 Daily AI World Brief 汇集了来自全球关键地区的关于人工智能的最重要新闻。重点关注业务应用、法规、安全以及 AI 模型的开发。 欧洲 欧盟人工智能法案中的鲁棒性与网络安全 该文章分析了欧盟人工智能法案(AI Act)中关于可靠性和网络安全的法律挑战。作者识别了涉及高风险 AI 系统(第 15 条)以及通用 AI 模型(第 55 条)的法规漏洞。研究将法律术语与机器学习研究相结合,提出了符合法律要求的统一标准和衡量方法。 重要性: 该文章对于欧洲 AI 市场的监管具有重要意义。它填补了法律要求与技术能力之间的空白,支持欧盟委员会制定有效的标准和准则。这对于在欧洲安全地部署 AI 系统以及保护欧盟经济的竞争力至关重要。 来源: arXiv AI (28.07.2026) 利用考虑交易成本的 LLM Agent 模拟租户对能源政策干预的反应 研究人员开发了一种利用大语言模型(LLM)模拟居民对能源政策态度的建模方法。该方法考虑了交易成本的感知——如信息负担、行政工作量和不确定性。研究人员在来自 1068 名荷兰公民的数据上测试了不同的模型。结果表明,纳入基于交易成本的 Persona 建模显著提高了模拟能效改造政策干预反应准确性的效果。 为什么这很重要: 基于 LLM 的模拟可以通过考虑驱动居民决策的实际障碍,助力设计更有效的能源政策。了解影响人类决策的实践和认知因素,有助于更好地预测能效改造计划的有效性,并优化建筑领域气候政策的实施策略。 来源: arXiv AI (28.07.2026) 用于视觉-语言-动作操作的 Real2Sim2Real:一个基于 AMD ROCm 的流水线 本文介绍了一个用于物理 AI 的综合性 AMD ROCm 技术流水线,该流水线将视觉-语言-动作(VLA)模型与现实世界中的机器人相结合。团队展示了四个应用:基于 Sim-to-Real 的 Frank 机械臂操作、通过自然语言指示的对象选择、利用 3D Gaussian Splatting 生成 Real2Sim 合成数据,以及针对四足和类人机器人的强化学习。所有系统均在 AMD RDNA4 和 RDNA3.5 硬件上原生运行,无需依赖 CUDA 生态系统。 重要性: 该研究展示了在机器人和物理人工智能(Physical AI)领域中,作为 CUDA 的一种实用替代方案。这对于寻求具有竞争力的 GPU 解决方案的工业界具有重要意义。这是迈向物理 AI 商业化的重要一步,在此领域,机器人可以在现实世界中执行复杂的操作。通过开放的 ROCm 生态系统和免费的 Radeon Cloud 平台,该研究有潜力改变机器人技术的普及程度。 来源: arXiv AI (28.07.2026) 评估法国移民法的 RAG:基准测试与基准研究 研究人员开发了一个公共基准测试,用于评估针对法国移民法规的 RAG(检索增强生成)系统的性能。该研究在 52 个合成档案上,对比了两个规模(Qwen3.5-9B 和 -27B)中具有密集检索增强的参数化 LLM 模型。结果表明,检索增强在两个规模中都提高了行政指导的准确性,尤其是在许可类型的推荐准确度方面。该研究证实了检索基础对于提供更可靠的行政建议的重要性。 重要性: 该基准测试的开发对法国的人力资源和公共服务领域具有重要意义,因为它提高了支持国际招聘系统的准确性。能够解读复杂移民法规的可靠 AI 系统可以减少行政错误,并加速国际人才的招聘流程,同时确保符合法律要求。 来源: arXiv AI (28.07.2026) 北美地区 关键基础设施中 Agentic AI 系统的去中心化细粒度访问控制 本文介绍了一种用于关键基础设施中自主 AI Agent 系统去中心化访问控制的架构。提议的系统包含与人类授权关联的身份模型、五个层级的细粒度权限体系,以及带有安全保障的渐进式信任升级机制。该系统已在云服务提供商的生产环境中部署,管理 20 多个专业 AI Agent 和 60 多项自动化流程,并在为期八个月的时间内处理了数千次每日操作,且未发生任何未经授权的写入操作。 为什么这很重要: 在关键基础设施中部署自主 AI Agent 构成了安全威胁。提议的解决方案通过细粒度的访问控制来保护系统,防止权限提升和未经授权的操作。这对于云基础设施运营商至关重要,在实现流程自动化的同时,确保大规模操作的安全。 来源: arXiv AI (28.07.2026) AIR-BENCH Live:基础模型不断演进的安全基准 AIR-BENCH Live 是一个用于评估基础模型安全性的基准测试系统,它会随着新的政府法规和安全技术的出现而自动演进。该系统监控监管政策,根据四级风险分类法对其进行分类,并利用基于智能体的算法生成多语言测试提示词。在当前版本中,该基准测试的详细风险类别从 314 个扩展到 335 个,涵盖了来自七个司法管辖区的 21 个新类别。对 14 个模型的测试显示出显著的安全差异,且非英语语言的得分较低。 为什么这很重要: 由于现有的基准测试很快就会过时,该解决方案对于人工智能安全至关重要。自动跟踪新法规并生成适应 AI 领域演变的测试,能够对基础模型进行更可靠的评估。这对于必须确保日益复杂的系统安全的 AI 行业和监管机构非常重要。 来源: arXiv AI (28.07.2026) 生成式人工智能心理健康支持的风险治理:一种多轮安全架构 研究人员开发了一种独立于模型的安全管理架构,用于支持基于语言模型的心理健康支持。该系统结合了上下文风险检测、基于推理的验证以及符合多轮交互协议的响应生成。测试表明,该系统在风险检测方面表现出色(灵敏度 0.92,特异性 0.85),并且临床医生青睐的升级响应增加了 25.6-59.2 个百分点,同时保持了建立关系的能力。 为什么这很重要: 这对于在医疗保健中安全部署人工智能具有重要意义。该架构为患有心理问题的患者提供了更好的保护,提高了数字心理健康支持的可信度。这种可扩展的框架适用于各种 AI 模型,提高了临床标准并增强了医疗领域对技术的信任。 来源: arXiv AI (28.07.2026) 用于可信洪水预测的上下文感知概念蒸馏 研究人员开发了 Context-Aware Concept Distillation (CACD),这是一个将不透明的深度学习模型转换为可解释的洪水预测系统的框架。该方法利用“Hydrological Language”和 Residual Hypernetwork 来发现水文模式。在全求 5203 个流域的测试中,其 NSE 中位数为 0.70,优于黑盒模型。它将 AI 的准确性与洪水风险管理决策所需的透明度结合在一起。 重要性: 该研究对公共安全和灾害管理具有重大影响。可解释的洪水预测模型使民防部门能够做出更可靠的救援决策。该框架将先进人工智能技术的准确性与高风险场景所需的透明度相结合,增强了相关决策支持系统在保障人员安全方面的责任感和可信度。 来源: arXiv AI (28.07.2026) 亚洲 FilmBench: A Film-Grade Benchmark for Cinematic Video Generation FilmBench 是一个用于评估电影级视频生成质量的新基准。该基准是与北京电影学院的导演和研究人员共同开发的。该基准包含从 20 种电影类型中提取的 1169 个提示词(prompts)。评估基于具有 35 个指标的文本到视频(text-to-video)分类法和 35 个参考到视频(reference-to-video)指标。该系统在文本到视频方面达到了 0.95 的 Spearman 相关系数,在参考到视频方面达到 0.96。研究揭示了在美学动态方面的显著差距,以及从单镜头过渡到多镜头时性能的下降。 重要性: FilmBench 通过建立 AI 生成电影的专业评估标准,对电影和技术行业具有重大影响。它使内容制作人能够更好地评估视频生成系统的真实能力,支持开发能够创作出影院级质量素材的技术。该基准提高了视频生成研究的透明度和可靠性,从而加速了该领域的进步。 Source: arXiv AI (28.07.2026) Anthropic 的 Dario Amodei 回应:不反对开放权重模型,但担忧中国的 AI Anthropic 首席执行官 Dario Amodei 明确表示,尽管行业内有各种猜测,但公司并不主张禁止开放权重(open-weight)模型。Amodei 认为安全的开放权重模型是公共利益。然而,他对中国构建更强大的模型以获取军事优势以及潜在的 AI 辅助生物攻击表示担忧。据他称,在这些场景下,由于监控和应用安全措施困难,开放权重模型构成了更大的威胁。 Why this matters: Anthropic 的立场影响着关于人工智能监管的政治辩论。Amodei 对威权国家发展 AI 所带来的全球安全威胁的担忧,可能会塑造各国政府在科技领域监管以及国际 AI 安全合作方面的未来做法。 Source: TechCrunch AI (28.07.2026) 在对中国 AI 模型审查之际,特朗普称美国在 AI 领域领先于中国 - Telangana Today Donald Trump 声称,美国在人工智能领域仍领先于中国。这一表态是在中国 AI 模型受到日益严格监管的背景下做出的。特朗普强调了美国的技术优势,而中国的 AI 模型正面临越来越多的国际关注。美中之间的 AI 竞争仍是全球技术安全和地缘政治的关键方面。 为什么这很重要: 美中之间的人工智能竞争对全球经济未来和国家安全具有重要意义。在 AI 技术领域的领先地位影响着创新能力、经济竞争力以及军事潜力。特朗普的言论反映了地缘政治紧张局势和技术竞赛,这种竞争决定了技术领域的全球力量平衡。 来源: Google News AI Asia (27.07.2026) China’s official media calls for regulating access to Chinese AI models - jawlah.co 中国官方媒体呼吁对获取中国人工智能模型实施监管。相关要求旨在建立更严格的准则,以规范在华开发并推广使用的 AI 技术。此举旨在确保对先进人工智能系统的开发和部署进行管控。相关规定可能包括用户身份验证要求以及对使用 AI 模型的应用程序进行监控。 重要性: 对 AI 模型获取权限的监管对中国科技领域及全球人工智能市场具有重大影响。访问控制会影响企业的竞争力、数据安全以及政治影响力。这些法规可能会塑造技术创新的未来,并影响中国在全球人工智能主导权竞争中的地位。 来源: Google News AI Asia (27.07.2026) 拉丁美洲 公开征集:拉丁美洲青少年对人工智能和网络安全的观点 - fundsforNGOs 已发布一项关于拉丁美洲青少年对人工智能和网络安全的看法征集。该倡议旨在收集年轻人关于人工智能和网络安全相关挑战的意见和经验。该计划面向在相关地区从事青少年保护工作的非政府组织和实体。主要目标是了解年轻一代对数字技术的需求和担忧,并制定政策建议。 为什么这很重要: 该倡议对于拉丁美洲青少年的数字安全具有重要意义。收集青少年的观点有助于制定更合适的政策和技术解决方案。它强化了年轻一代在涉及人工智能监管和网络安全的决策过程中的话语权,这可能导致该地区数字技术的更负责任的发展。 来源: Google News AI South America (28.07.2026) 非洲 工业界和政府支持非洲人工智能语言倡议 - Developing Telecoms 工业界和政府正支持一项专注于语言模型的非洲人工智能发展倡议。该项目旨在通过开发针对非洲本地语言定制的高级 AI 工具,加速该大陆的数字化转型。这一合作伙伴将国际科技公司与公共机构联系在一起。该倡议获得了来自致力于支持该地区技术创新的行业领袖和政府机构的大量资金和参与。 为什么这很重要: 该倡议对于缩小非洲的数字鸿沟以及让数十亿使用非洲语言的用户能够获取 AI 技术至关重要。它对该地区的经济、教育和服务行业具有变革潜力。政府和工业界的支持增强了当地技术生态系统的能力,并可能在大陆上创造新的商业机会。 来源: Google News AI Africa (2026年7月27日) 澳大利亚和大洋洲 新西兰测试 AI 以加速生物安全进口审批 - Devdiscourse 新西兰正在测试人工智能,旨在加速生物安全系统中的进口审批流程。该项目旨在自动化评估与生物安全相关的单据和海关程序。AI 技术分析进口申报,识别潜在的植物检疫风险并加快申请处理速度。这一举措是该国现代化边境基础设施更广泛行动的一部分。 重要性: 在生物安全领域引入 AI 通过缩短进口审批等待时间来影响经济竞争力,从而降低企业的成本。同时,维持高标准的生物安全能够保护国内农业生产和生态系统免受有害生物和疾病的侵入。更快捷的进口程序支持国际贸易并助力中小企业。 来源: Google News AI Oceania (2026年7月27日) 明天关注什么? 在接下来的几天里,值得关注的是监管机构的反应、大型企业的实施速度,以及新 AI 功能对用户和业务团队产生的实际影响。 查看所有 Daily AI World Brief 版本