英伟达与本地 AI 社区携手推动开源模型与智能体发展
NVIDIA联合开源社区,持续推动本地AI生态建设。8月期间,NVIDIA重点展示合作伙伴成果与开源社区进展,涵盖最新开放模型、软件开发工具、加速计算库及教育资源。本月智能体领域动态尤为密集,NVIDIA将通过"本地AI...
NVIDIA联合开源社区,持续推动本地AI生态建设。8月期间,NVIDIA重点展示合作伙伴成果与开源社区进展,涵盖最新开放模型、软件开发工具、加速计算库及教育资源。本月智能体领域动态尤为密集,NVIDIA将通过"本地AI...
ARCHead是一种专门压缩大语言模型输出层的方法,通过量化低秩核心与激活度量修正,将LM-head存储压缩至BF16的约25%,质量损失极小。
受超大规模云厂商大量抢购内存资源影响,全球IT基础设施市场供应持续紧张。内存价格上涨50%至200%,服务器价格涨幅超125%,网络设备交货周期延长至6至18个月,且这一趋势预计将持续至2027年底。专家建议企业采取多项...
这项研究发现AI投票推理在多答案问题上会系统性失效,提出用因果数学规则直接验证候选答案的CALVER方法,准确率比投票提升约11至19个百分点,且差距随尝试次数持续扩大。
Meta在美国多地法院遭遇儿童安全诉讼连败。新墨西哥州法院判令其向青少年心理健康基金支付5.67亿美元,此前已有3.75亿美元罚款及洛杉矶4.2百万美元赔偿判决。Meta还面临42个州提起的诉讼及数千起类似案件。法院要求...
这项来自港科大与腾讯视频的研究提出WorldCycle框架,通过可逆动作循环构造无标注自验证奖励,将视频世界模型的长程漂移误差降低最高44%,复合动作准确率提升约四倍。
Palo Alto Networks凭借Cortex XDR连续第四年入选Gartner端点保护平台魔力象限领导者。随着企业大规模部署AI智能体,传统端点安全工具对本地模型、插件等形成严重盲区。Cortex XDR通过统...
哥本哈根大学团队构建了首个同时覆盖三种引用粒度、屏蔽信息泄露、包含全量段落候选库的法律信息检索数据集LegalPincite,用于评估法律判决段落精确检索任务。
Meta发布测试版编程智能体Muse Code,支持macOS和Linux,基于Muse Spark 1.2模型。其核心特性是持久化后台代理——代理在整个会话中保持活跃,异步执行任务并自主决定何时上报结果,减少重复信息收...
Capital One研究团队发现AI推理模型存在"答案漂移"问题,提出DASH方法通过分段赋予奖惩来减少无效自我反思,在数学竞赛题上显著提升准确率。
微软于7月31日发布开源工具code-testing-generator,这是一款可为任意编程语言自动生成单元测试的AI智能体。该智能体通过"研究-规划-实现"(RPI)流水线协调测试生成:首先扫描代码库、识别语言和测试...
ReflectRL提出利用强模型产生的失败推理轨迹,通过"反思再纠正"训练模式提升大语言模型推理能力,并逐步过渡至无需外部草稿的直接推理,在9项基准测试中取得持续提升。
工作流引擎公司Temporal今年将AI支出增至原来的五倍,营收同期翻番,但CEO Samar Abbas坦言尚无法证明二者存在直接因果关系。公司全员推行AI工具采用,工程师以Claude Code为主,非技术团队也借助...
RestoreKV是韩国釜山国立大学与淑明女子大学联合提出的KV缓存恢复技术,通过极少量LoRA参数为压缩后的缓存生成上下文感知补丁,在极端压缩条件下大幅恢复大语言模型性能。
谷歌即将在Made by Google 2026发布会上推出Pixel 11系列,其中最受关注的新功能是HiLight(前称Pixel Glow)——一块位于手机背面的小型显示屏,可在手机正面朝下时,通过彩色灯光提示来电...
北京大学团队构建CONTINUALSKILLBENCH基准,测试大语言模型代理能否通过100道连续任务自主进化技能库,发现顺序学习平均提升近17%,但技能碎片化是弱模型的主要瓶颈。
现代核电站面临延寿至80年以上的运营需求,自动化与仪控(I&C)技术的升级改造成为关键路径。通过部署先进的数字化控制系统、预测性维护平台和实时监测技术,核电运营商可显著提升设备可靠性、降低运维成本并满足日益严格的监管要求...
伊利诺伊大学等机构联合构建首个儿童步态视频临床数据集CGV,提出ChildGait-Video框架,通过骨骼提示与掩码剪枝实现儿童步态异常自动评分,准确率达70%至93%。
今天讲的出海案例是晶赛科技,这家石英晶振及封装材料厂商正在泰国春武里建设生产基地,项目主体注册资本已经增至 7000 万泰铢。
本研究由中国人民大学与蚂蚁集团联合开展,系统揭示了混合专家扩散语言模型的扩展规律,并据此训练出LLaDA MoE v2,以更少训练数据接近顶尖自回归模型性能。