华为云胡玉海:深耕Agentic Cloud,共创行业智能新范式
9月18日华为全联接大会2026期间,以“深耕Agentic Cloud,共创行业智能新范式”为主题的华为云峰会成功举办,华为云携手全球行业标杆客户、伙伴分享解读智能体时代的技术创新与行业实践
知行合一,迈向AI Native:慧通差旅论坛圆满举行,通宝智能体2.0发布
华为全联接大会2026期间,慧通差旅成功举办以“AI向实深耕,加速差旅行业数智化升级”为主题的专题论坛
工商银行携手华为发布《金融AI原生技术应用生态建设白皮书》
[中国,上海,2026年9月17日] 华为全联接大会2026期间,中国工商银行(以下简称“工商银行”)与华为联合发布《金融AI原生技术应用生态建设白皮书》(以下简称“白皮书”),旨在基于双方实践,为银行业从“云原生”向“...
机器人不需要学会说人话,它只需要看懂动作往哪儿飞
Hydra-0是NVIDIA等机构提出的通用世界模型,通过将机器人动作表示为图像平面上的像素运动轨迹(动作流),实现跨机器人形态、跨任务的统一建模,在动作预测精度、开环策略评估和逆向动作生成上均取得显著效果提升。
当AI助手学会"闭嘴":为什么让模型陪你做饭比让它看视频难一百倍
南京大学团队推出OmniAssistBench,首次系统评测全模态大模型作为实时视频助手的能力。通过反向剪辑互联网视频构建多轮交互数据,发现Gemini-3-Pro仅得66.4分,模型普遍存在手势跟随差、长期记忆弱、不会...
AI看得懂日本的"再来一杯咖啡"吗?
NARU是一个考察AI理解日语长视频能力的基准测试,包含155部影片、1481道题,涵盖叙事发展和文化隐含意义两大维度,揭示当前主流大模型在长视频理解上的真实差距。
AI客服总是"抄近道",直到有人给它画了一张地图
本文解读KAIST团队提出的POLICYGUIDE系统,它把客服政策编译成工作流图,由外部验证员实时追踪AI客服执行进度,在电信、零售、航空三大场景显著提升政策合规率,电信领域提升尤为突出。
AI智能体的两极:机遇与风险并存
本周Salesforce Dreamforce大会押注AI Agent新时代;Altman、Musk支持放缓前沿模型发布;Exaforce、Cohesity等厂商推出智能体安全开关,多家AI创企完成大额融资。
AGNTCon欧洲大会:如何让AI智能体不再"失控"
AGNTCon Europe 2026在阿姆斯特丹举行,Traefik Labs、Orkes、Reboot等七家初创公司展示了智能体AI治理与编排方案,企业控制AI风险成为核心主题。
Petlibro新款AI喂食器:多猫家庭的智能升级
Petlibro推出Granary 2系列智能喂食器,内置秤和AI摄像头,最高可识别10只猫并分别追踪进食习惯,售价129.99至249.99美元,部分高级功能需付费订阅。
谷歌Gemini成为最新一款自主实施黑客攻击的AI模型
谷歌Gemini在安全公司Irregular的测试中,自主入侵了三家企业的受保护系统,手段包括暴力破解密码和从公开仓库获取凭证。谷歌在被WSJ询问前未主动披露,遭安全专家批评隐瞒AI越界行为。
Meta的Muse为何显得诡异?真相出人意料
Meta Muse新Mac应用被指在未授权情况下获取用户消息,且AI无法解释原理。Meta澄清属功能描述混乱,相关权限为用户主动开启。
Flock裁员风波:安防技术公司推出自愿离职补偿计划
Flock Safety面向约1500名员工推出自愿离职补偿方案,背景是其车牌识别技术被警方滥用事件持续发酵:46起涉嫌滥用案、佛罗里达与德克萨斯州宣布停用,仅8月就有90座城市放弃该服务。
{给音频模型装上"预知未来"的能力:NAPE如何用最简单的办法学会听懂声音}
这篇论文提出NAPE,一种给音频模型设计的自监督预训练框架,核心思路是让因果Transformer像语言模型预测下一个词一样,预测频谱图中下一个声音片段的嵌入向量。整个方法只靠因果掩码和停止梯度维持训练稳定,不需要解码器...
深度学习曾经输给一个叫"密集轨迹"的手工方法,直到这篇论文出现
这篇论文提出了双流卷积网络,通过将视频拆分为空间流(单帧图像)和时间流(光流场)两个独立网络分别学习,再融合结果,在2014年首次让深度学习方法在视频动作识别任务上追平并超越了此前占统治地位的手工特征方法密集轨迹,成为该...














