DeepSeek V4.1 Flash 跑分追平 Opus 5,实测两极分化,开源越做越大,本地部署越来越难
过去一周,AI 圈有一个绕不开的名字, DeepSeek V4.1 Flash。
过去一周,AI 圈有一个绕不开的名字, DeepSeek V4.1 Flash。
这篇论文通过对照实验和轨迹分析,深挖AI"技能包"到底为什么有效。研究发现技能主要靠程序锚定而非知识注入起作用,能减少环境配置和格式类错误,但会引入误用风险;技能库越大,精确检索越难,但任务成功率相对稳定,揭示了检索精度...
MIT团队研发xvr技术,可在约5分钟内完成患者X光与术前3D扫描的自动配准,精度达亚毫米级,准确性大幅超越现有AI方法,有望提升微创手术安全性与可及性。
这篇论文提出了双流卷积网络,首次让深度学习在视频动作识别任务上超越手工特征方法。通过将空间流(处理静态图像)和时间流(处理光流运动信息)分开建模再融合,模型在UCF-101数据集上达到88%准确率,超过此前最强的密集轨迹...
这篇论文提出双流卷积网络,把视频动作识别拆解为处理静态画面的空间流和处理光流运动信息的时间流两个独立网络,通过融合两者判断,在 2014 年首次让深度学习方法在准确率上超越了此前最强的手工特征方法密集轨迹,是视频理解领域...
2014年,Simonyan和Zisserman提出双流卷积网络,首次让深度学习在视频动作识别任务上追平手工特征方法。该方法将视频拆成空间流(画面内容)和时间流(光流运动信息)两路网络分别处理再融合,在UCF-101数据...
Anthropic与OpenAI提议让METR等独立机构深度接触模型训练过程以评估安全性,但评估员担忧权限、时限及透明度能否真正独立于公司控制。
这篇2014年的论文提出双流卷积网络,把视频动作识别拆分成空间流和时间流两个分支分别处理静态画面和运动光流信息,再融合结果,首次让纯深度学习方法在准确率上全面超越传统手工特征方法,准确率达到约88%,为后续的时序分段网络...
据报道,苹果正开发搭载M8 Ultra芯片的企业级AI服务器,预计2029年发布,或与英伟达NVLink技术互联,为近20年来首款苹果服务器产品。
1个月内,牛津大学团队用双流卷积网络首次让深度学习在视频动作识别上打赢了统治多年的手工特征方法密集轨迹,在UCF-101上做到88%准确率,为后续I3D等视频理解模型开创了技术路线。
AI推理硬件初创公司Delos Data完成超1亿美元融资,并推出配套网络芯片Nonstop AI Data Interface,主打低延迟与故障自愈能力。
本文解读了剑桥大学团队关于"循环语言模型"在AI工具调用任务中表现的研究。研究发现,让模型对同一问题反复迭代计算,能显著提升需要多步协同、维护调用依赖关系的复合任务表现,而对单次简单调用提升有限;自适应停止机制还能在准确...
Cohere与Aleph Alpha正式签署合并协议,合并后公司估值约200亿美元,德国Schwarz集团及加拿大财团提供资金支持,合并后总部设于柏林与多伦多。
AVA-Encoder是一套让AI"看懂"电影的智能体视频自编码框架,通过将电影转换为结构化的电影知识图谱并反向重建视频来检验信息保真度,重建准确率比最强基准方法高出73.1%,其学出的编码策略甚至超越了人工调优版本,同...
Anthropic把Claude Cowork并入Claude聊天界面,并推出Claude Docs、Claude Slides等测试版功能,打造一站式AI超级应用。
这篇论文研究了一种叫Engram的外部记忆机制能否跨模型复用:把源模型训练好的记忆表冻结后接到不同架构的目标模型上,只训练一个轻量读取器。实验发现记忆内容和正确寻址都重要,但决定成败的关键是目标端读取器的设计,强读取器能...
Snap发布“预判式”AI服务Specs Intelligence,可连接邮件、Slack等账户管理日程,先在iOS预览,后续登陆Mac。
这篇论文提出Agentic ESOpt,一种用进化策略替代反向传播来训练长任务AI智能体的方法,只需推理级显存即可全参数微调大模型,在数独、数学解题、网页操作等任务上验证了其相比传统强化学习在长任务场景下的优势,并可灵活...