QOBLIB:追踪量子优化领域的进展
IBM联合多家机构推出量子优化基准测试库QOBLIB,涵盖十类具有挑战性的优化问题,已吸引逾2000条结果提交。该项目近日在《自然·计算科学》发表论文,并上线专属网站,支持社区用户探索基准、对比方法与贡献成果。QOBLI...
IBM联合多家机构推出量子优化基准测试库QOBLIB,涵盖十类具有挑战性的优化问题,已吸引逾2000条结果提交。该项目近日在《自然·计算科学》发表论文,并上线专属网站,支持社区用户探索基准、对比方法与贡献成果。QOBLI...
ARCHead是一种专门压缩大语言模型输出层的方法,通过量化低秩核心与激活度量修正,将LM-head存储压缩至BF16的约25%,质量损失极小。
Oracle宣布与Quantinuum达成多年合作,将Quantinuum的Helios量子计算机部署于美国OCI AI数据中心,并计划推出OCI量子服务,为企业客户提供混合量子-AI工作负载的云端访问。Helios基于...
这项研究发现AI投票推理在多答案问题上会系统性失效,提出用因果数学规则直接验证候选答案的CALVER方法,准确率比投票提升约11至19个百分点,且差距随尝试次数持续扩大。
全球约1300亿至1700亿美元的数据中心项目因社区反对而暂停或终止。公众反对已从最初对资源消耗、电费上涨的担忧,扩展至对税收豁免、NDA不透明协议以及就业数据虚报等问题的强烈不满。研究显示,数据中心创造就业的投资比率远...
这项来自港科大与腾讯视频的研究提出WorldCycle框架,通过可逆动作循环构造无标注自验证奖励,将视频世界模型的长程漂移误差降低最高44%,复合动作准确率提升约四倍。
谷歌发布Pixel 11 Pro Fold,售价1899美元,较上代上涨100美元,原因是行业性内存短缺推高成本。新机最大亮点是耐用性提升至上代三倍,外屏采用玻璃陶瓷盖板,内屏配备抗冲击膜,铰链经重新设计,机身减重近10...
哥本哈根大学团队构建了首个同时覆盖三种引用粒度、屏蔽信息泄露、包含全量段落候选库的法律信息检索数据集LegalPincite,用于评估法律判决段落精确检索任务。
澳大利亚生物科技正加速拥抱AI与数字化基础设施。Autolomous CEO Alexander Seyf指出,澳大利亚凭借风险比例原则的监管框架(非EU式单一AI法案路径)、SMART CRC等国家战略,正成为面向大洋...
Capital One研究团队发现AI推理模型存在"答案漂移"问题,提出DASH方法通过分段赋予奖惩来减少无效自我反思,在数学竞赛题上显著提升准确率。
科技服务公司Apexon扩展其智能体AI平台AgentRise,新增Polaris、Lodestone和Harness三个组件。Polaris帮助企业筛选值得投资的AI项目并制定路线图;Lodestone构建企业知识层,...
ReflectRL提出利用强模型产生的失败推理轨迹,通过"反思再纠正"训练模式提升大语言模型推理能力,并逐步过渡至无需外部草稿的直接推理,在9项基准测试中取得持续提升。
谷歌DeepMind推出手语转文字模型SL2T,面向全球约7000万聋哑及听障用户。该模型首发于Pixel 11手机,支持Gboard和Live Transcribe应用中的手语输入功能,初期可将美国手语(ASL)实时转...
RestoreKV是韩国釜山国立大学与淑明女子大学联合提出的KV缓存恢复技术,通过极少量LoRA参数为压缩后的缓存生成上下文感知补丁,在极端压缩条件下大幅恢复大语言模型性能。
CodeRabbit宣布完成1.43亿美元C轮融资,由Atomico和Smash Capital领投,BMW i Ventures、Datadog等跟投。融资同期,公司推出Agentic变更管理层,帮助企业治理和优先处理...
北京大学团队构建CONTINUALSKILLBENCH基准,测试大语言模型代理能否通过100道连续任务自主进化技能库,发现顺序学习平均提升近17%,但技能碎片化是弱模型的主要瓶颈。
北弗吉尼亚州约3800兆瓦的数据中心负荷在7月22日输电故障后切换至自备发电,创PJM历史最大单次负荷转移纪录。此事件暴露出大型数据中心已成为电网可靠性的主动变量——其保护系统在感知电压频率波动时会自动转为离网运行,引发...
伊利诺伊大学等机构联合构建首个儿童步态视频临床数据集CGV,提出ChildGait-Video框架,通过骨骼提示与掩码剪枝实现儿童步态异常自动评分,准确率达70%至93%。
由丝绸之路创新中心联合TechCrunch等机构举办的"Road to Battlefield"创业大赛今年收到来自39个国家的726份申请,较上届增长近50%。其中约84%的参赛项目聚焦AI领域。22个入围团队将于8月...
本研究由中国人民大学与蚂蚁集团联合开展,系统揭示了混合专家扩散语言模型的扩展规律,并据此训练出LLaDA MoE v2,以更少训练数据接近顶尖自回归模型性能。