Skip to main content

XMT

短闻

信流 · 上滑连读 · 来源可核

搜索 稍后
1 / 24
Aggregate AI 摘要 InfoQ 中文 人工智能 微软 6″

微软将人工智能治理从政策层面转向运行时执行

微软将AI治理从政策制定转向实时运行时执行

  • AI治理重心由书面政策转向系统级实时控制
  • 运行时执行指在AI模型部署后动态监管其行为
  • 此举标志微软AI安全实践进入操作化新阶段

RSS 官方收录 · 可信分层展示

详情 原文 分享图
Aggregate AI 摘要 雷锋网 人工智能 宇树科技 45″

王兴兴上市后首次公开演讲:机器人真正爆发要等两个「80%时刻」丨WRC 2026

王兴兴提出机器人爆发需达两个80%:80%陌生场景中完成80%任务

  • 机器人规模化落地核心瓶颈是泛化能力,非单点动作性能
  • 物理AI自进化闭环可替代人工微调,实现研发-仿真-测试自主迭代
  • 量产级载人机甲、实时语音生成动作、会议室整理等场景已落地验证

RSS 官方收录 · 可信分层展示

详情 原文 分享图
Aggregate AI 摘要 arXiv cs.AI 人工智能 45″

What Does Multi-Harness RL Learn? Credit Assignment and Portability in Coding Agents

多 harness RL 中,评估环境影响求解率超训练方法4倍,分组规则差异不显著

  • 评估harness主导性能,使求解率从2.14%升至9.27%,提升4.3倍
  • Within与Cross分组规则在预留harness上差异仅+0.25pp,无统计显著性
  • Cross分组无法提升跨harness能力,信用分配仍绑定具体harness环境

RSS 官方收录 · 可信分层展示

详情 原文 分享图
Aggregate AI 摘要 arXiv cs.AI 人工智能 45″

BioSync: Transformer-Based Cross-Modal Fusion for a Multimodal Physiological Digital Biomarker

BioSync模型融合多模态生理数据,生成连续数字生物标志物BSI,AUC达0.928

  • BioSync提出BSI指数,整合心率变异性、脑电、活动量与语音四模态数据
  • 在认知衰退队列中BSI AUC达0.928,优于特征拼接基线(0.926)
  • BSI与潜在疾病严重度高度相关(r=0.91和r=0.68)

RSS 官方收录 · 可信分层展示

详情 原文 分享图
Aggregate AI 摘要 arXiv cs.AI 人工智能 45″

Rethinking Indirect Prompt Injection as a Test-Time Search Problem

将间接提示注入重新定义为测试时搜索问题,揭示工具型AI新安全风险

  • 提出间接提示注入是任务相关攻击面的测试时搜索问题
  • 设计具身攻击者进行环境侦察、策略推理和自适应评估
  • 发现攻击者算力提升可增强漏洞发现,策略管理避免冗余搜索

RSS 官方收录 · 可信分层展示

详情 原文 分享图
Aggregate AI 摘要 arXiv cs.AI 人工智能 45″

ResLearn-XR: Residual Learning for Network Traffic and Quality-of-Experience-Aware Modeling in Extended Reality

ResLearn-XR框架提升XR流量预测与QoE风险评估精度,SMAPE分别降低17.84%和87.8%

  • 提出两阶段残差学习结构,适配突发非平稳XR流量
  • QoE分支引入因果特征构造模块DDA,支持加密流量分析
  • 构建首个配对XR流量与用户报告QoE标签的数据集

RSS 官方收录 · 可信分层展示

详情 原文 分享图
Aggregate AI 摘要 arXiv cs.AI 人工智能 45″

When Quantization Breaks Memory: Recurrent-State Write-Back in Low-Precision Temporal Inference

4位量化致荧光寿命参数估测误差激增300倍,揭示循环网络状态写回机制关键影响

  • 4比特状态存储使τ1、τ2估测误差分别增加70倍和300倍
  • 错误源于微小更新低于写入阈值导致状态冻结
  • 误差反馈等机制可跨时间传递信息并恢复精度

RSS 官方收录 · 可信分层展示

详情 原文 分享图
Aggregate AI 摘要 InfoQ 中文 人工智能 6″

传统企业 AI 转型的最短路径,藏在研发部门

传统企业AI转型最快路径在研发部门

  • AI转型起点应设在研发部门而非管理层
  • 研发部门直接对接技术落地与业务痛点
  • 已有案例显示研发主导转型周期缩短40%

RSS 官方收录 · 可信分层展示

详情 原文 分享图
Aggregate AI 摘要 arXiv cs.AI 人工智能 45″

PerfReasoning: How Well Do LLMs Reason on Hardware Performance?

PerfReasoning基准测试揭示LLM硬件性能推理能力:最强闭源模型达90%+,开源模型最高82.4%

  • PerfReasoning评估LLM对计算、数据复用与访存的结构化性能推理能力
  • 最强闭源模型Q&A准确率超90%,最佳开源模型为82.4%
  • 模型自动生成性能模型代码难度大,除GPT-5.6 Sol外其余配置平均通过率低于15%

RSS 官方收录 · 可信分层展示

详情 原文 分享图
Aggregate AI 摘要 arXiv cs.AI 人工智能 45″

HarvestBench: Measuring Whether LLM Agents Will Pay to Avoid Killing Animals

HarvestBench测试9个LLM代理对动物生命的经济权衡,杀戮率从0.4%到98.8%不等

  • 9个模型在农场模拟中面临是否付费绕行动物的决策,共7201次定价选择
  • 动物阻挡时,模型可直行(零成本)或付费绕行;杀戮率与模型能力无关
  • 道德提示使5/6推理模型杀戮率降至6%以下,移除后全部升至84%以上

RSS 官方收录 · 可信分层展示

详情 原文 分享图
Aggregate AI 摘要 arXiv cs.AI 人工智能 45″

Why Better Models Can Create Riskier Systems: Evidence from LLM Agents in Financial Markets

前沿大模型能力提升反致金融系统风险上升,因行为趋同形成不可分散风险

  • 前沿LLM能力越强,交易行为相关性越高
  • 准确信息下多智能体可降市场风险
  • 共享错误信息时行为趋同反成风险源

RSS 官方收录 · 可信分层展示

详情 原文 分享图
Aggregate AI 摘要 arXiv cs.AI 人工智能 45″

Corporate Language Model (CLM): Transforming Tacit and Fragmented Enterprise Knowledge into a Sovereign, Auditable, and Executable Corporate Intelligence Layer

CLM将企业隐性知识转化为可审计、可执行的主权智能层

  • CLM框架整合结构化与隐性知识,构建本体驱动的企业智能基础
  • 五大能力平面与四大架构支柱支持可解释推理与受控执行
  • 巴西三级医院实证:CLM在LGPD合规下完成六阶段中的三阶段落地

RSS 官方收录 · 可信分层展示

详情 原文 分享图
Aggregate AI 摘要 arXiv cs.AI 人工智能 45″

A Removal Based Approach to Improve LLM Faithfulness at Test-Time

新方法在推理时提升大模型解释忠实度,针对解释不完整问题效果显著

  • 首次提出测试时消除输入中未提及概念以解决解释不完整性
  • 在两个数据集、多模型家族和双指标上均优于基线方法
  • 无需修改模型参数,模型无关且可即插即用

RSS 官方收录 · 可信分层展示

详情 原文 分享图
Aggregate AI 摘要 雷锋网 人工智能 45″

芯思杰400Gbps PIN PD支撑全球AI算力光互联向3.2T光收发模块迭代

芯思杰发布400Gbps背照式PIN PD芯片,支撑3.2T光模块量产

  • 行业首批400Gbps背照式PIN PD芯片,突破带宽与光电转换效率瓶颈
  • 背部透镜一体化设计,降低下游对准难度、提升良率与量产效率
  • IDM全链自研,六大产业基地布局,已通过车规级AEC-Q102认证

RSS 官方收录 · 可信分层展示

详情 原文 分享图
Aggregate AI 摘要 arXiv cs.AI 人工智能 45″

Iris: Climbing to the Search Frontier

Iris-mini与Iris-pro搜索模型在多项基准测试中创开源Agent最高分

  • Iris-mini和Iris-pro分别基于35B-A3B与397B-A17B规模训练
  • 采用SFT-RL爬升训练法,结合反向构建多跳问答与实时搜索强化学习
  • 在BrowseComp等4项基准中达82.2–92.9分,为同参数量级开源搜索Agent最优

RSS 官方收录 · 可信分层展示

详情 原文 分享图
Aggregate AI 摘要 arXiv cs.AI 人工智能 45″

Data-Optimized Contingency Screening: A Machine Learning Approach to Power System Security

机器学习实现电力系统N-k故障安全等级分类,RF模型在IEEE-30系统F1达0.97

  • 基于Newton-Raphson潮流与OPI指标提取故障场景数据
  • 采用SMOTE与PCA联合预处理解决类别不平衡与高维问题
  • RF模型在IEEE-30系统严重故障分类F1达0.97,优于SVM和KNN

RSS 官方收录 · 可信分层展示

详情 原文 分享图
Aggregate AI 摘要 arXiv cs.AI 人工智能 Meta 45″

Harbor Adapters and Harbor-Index: Infrastructure and a Curated Meta-Dataset for Large-Scale Agentic Evaluation

Harbor Adapters支持80+基准测试,Harbor-Index发布82个高难度任务

  • Harbor Adapters统一适配80余个agentic基准,支持任意模型评估
  • 大规模评测8个模型在54个基准上的表现,覆盖能力梯度与失败模式
  • Harbor-Index精选82个高质难题,来自29个基准,最强配置通过率仅28.0%

RSS 官方收录 · 可信分层展示

详情 原文 分享图
Aggregate AI 摘要 arXiv cs.AI 人工智能 45″

From Matching Models to Recruiting Agents: A Systematized Narrative Review of AI Recruitment Systems, Evaluation, and Governance

AI招聘系统演进:从匹配模型到工具型招聘代理,覆盖40项研究

  • AI招聘自动化对象已转向多阶段工作流而非简单简历匹配
  • 分析三大转变:相似性→双向适配、模型→复合流程、离线预测→证据驱动评估
  • 识别四大持久缺陷:行为标签混淆、数据局限、分数掩盖管道失败、隐私未被联合评估

RSS 官方收录 · 可信分层展示

详情 原文 分享图
Aggregate AI 摘要 arXiv cs.AI 人工智能 45″

EXAONE Forecast for Finance

EXAONE Finance:首个专为金融时序预测设计的注意力-free基础模型

  • 采用线性时间因果卷积与组感知池化MLP,替代高成本自注意力
  • 通过掩码上下文增强训练,提升对金融数据缺失的鲁棒性
  • 在FinVerse基准三大指标(点预测、资产排序、组合盈利)均排名第一

RSS 官方收录 · 可信分层展示

详情 原文 分享图
Aggregate 极客公园 人工智能 小米 苹果 45″

雷军:小米汽车销量突破 80 万;苹果元老辞职,传不满激进 AppStore 增收方案;韩国推出首档人机 AI 恋综 | 极客早知道

雷军:小米汽车累计交付量超过 80 万辆 9 月 7 日消息,小米创办人、董事长兼 CEO 雷军刚刚宣布,小米汽车累计交付量超过 80 万辆。据本月早些时候报道,2026 年 8 月,小米汽车交付量持续超过 30,000 台。…

  • 小米汽车表示,正全力为小米澎程上市交付做准备。
  • 另外,在 7 月 30 日的小米澎程技术发布会上,小米创办人、董事长兼 CEO 雷军表示,2 年半的时间,小米汽车发布了两款车——小米 SU…
  • 这两款车都成了爆品,并且累计交付 70 多万台。

RSS 官方收录 · 可信分层展示

详情 原文 分享图
Aggregate 爱范儿 人工智能 Anthropic MiniMax OpenAI 45″

早报|iPhone 18价格疑似泄露,埃及运营商否认/雷军晒图:54个品牌为小米澎程送祝福/华为大阔折曝光波尔多红配色

Vodafone Egypt 否认泄露 iPhone 18 系列价格 苹果新薪酬方案曝光:库克转任执行董事长获 4500 万美元股票奖励 54 个品牌账号为小米澎程上市送祝福,雷军回应致谢 华为 Pura X Max 两款新配色曝光,9 月 7 日亮相 曝 Anthropic 接近确定 IPO 核心承销商 AI 空间站上架 Kimi、MiniMax 等模型订阅产品 康宁 CCO:AI 让玻璃基封装与光互连走到台前 《西雅图时报》和《新闻日报》起诉 OpenAI 与微软 理想汽车拟以 26.…

  • 5 亿元增资欣旺达动力 OpenAI 达成「自动研究实习生」目标 Jakub Pachocki:AI 实验室应为安全主动减速 macOS 26.
  • 7 代码出现两款苹果游戏手柄配置 Google Lyria 3.
  • 5 上线 Gemini,可生成更长的完整歌曲 传音推出首款 360° 翻转屏笔记本 MEGABOOK T15 360 系列 「国家反诈 AI…

RSS 官方收录 · 可信分层展示

详情 原文 分享图
Aggregate OpenAI Blog 人工智能 13″

An Alien Mind

Jakub Pachocki reflects on increasingly capable AI and the challenge of keeping it aligned. He calls for stronger safeguards and international coordination.

RSS 官方收录 · 可信分层展示

详情 原文 分享图
Aggregate OpenAI Blog 人工智能 13″

Research acceleration: The view inside OpenAI

Inside OpenAI, coding agents are reshaping AI research. Explore early data on agent usage, experiment velocity, task complexity, and research acceleration.

RSS 官方收录 · 可信分层展示

详情 原文 分享图
Aggregate 雷锋网 人工智能 45″

3000万用户、过半是企业,千问办公靠什么拿下B端?

AI办公的To B化趋势,越来越明显。9月4日,千问办公上线满一个月,阿里亮出了一个数字:用户数突破3000万,其中企业用户占比超过一半。单看用户规模,这是一个增长数据;但如果放到整个AI办公市场来看,更值得关注的是:包括阿里在内的大厂,正在推动办公Agent从个人提效工具,转向嵌入企业组织的内部工作流。…

  • 在部分业内人士看来,千问办公上线仅一个月就突破3000万用户,这一速度确实超出预期。
  • 如今回看,从上线之初就锁定企业级Agent市场,这步棋走得并不冒进。
  • 随着AI办公产品在C端和企业场景的逐步渗透,不少业内人士也关注到,个人效率的提升,并不等同于企业业务的整体提效。

RSS 官方收录 · 可信分层展示

详情 原文 分享图