李飞飞十年前论文获时间检验奖

📅 发布时间:2026/9/14 21:53:08
李飞飞十年前论文获时间检验奖
AI科技圈最近一周又发生了啥新鲜事25位菲尔兹奖得主联合发表公开信陶哲轩、邓煜等25位菲尔兹奖得主联合署名发表公开信《人工智能在数学中的严重错位》指出AI公司把解决数学问题当作基准测试来推进的做法与数学共同体追求概念性理解与洞见的目标严重错位。公开信承认AI具备加速数学研究的潜力但反对匆忙公布结果而跳过论文撰写、方法提炼与在先工作引用等环节。此事背景是OpenAI于9月8日宣布其内部模型用约1万个智能体、88小时完成Navier-Stokes问题证明随后数学家Tristan Buckmaster公开质疑该证明的路径选择与信息来源并称署名问题存在争议。此前已有莱顿宣言等类似呼吁https://terrytao.wordpress.com/2026/09/11/a-severe-misalignment-of-ai-in-mathematics/OpenAI宣布用未公开模型攻克纳维-斯托克斯方程千禧年难题OpenAI使用一款比GPT-6 Astra更强大的未公开下一代前沿模型联合约1万个并发协作的AI Agent耗时88小时攻克了纳维-斯托克斯方程的存在性与光滑性问题并发布166页论文及配套Lean形式化验证代码。该项目选择证明带光滑外力情形下方程会在有限时间内出现奇点所有Agent共交换490万条消息、生成约3000亿输出Token算力成本达数百万美元。OpenAI表示放弃申领100万美元奖金但该成果随后卷入争议纽约大学数学教授Tristan Buckmaster称其与Anthropic研究员Levent Alpöge此前已取得相近结果并对成果归属提出质疑https://mp.weixin.qq.com/s/VuVsQdpjtS4jXFhs3muYIAOpenAI暂停ChatGPT Pro 20X套餐新订阅OpenAI宣布暂停ChatGPT Pro 200美元Pro 20X套餐的新订阅和升级现有用户不受影响原因是Astra模型引发的需求超出预期算力不足以保障体验。Astra按量计费标准约为GPT-5.6 Sol的2.5倍其Pro版本仅面向Pro、Business和Enterprise用户Pro 20X每周额度为200条。分析显示Pro 20X是单位算力最便宜、使用率最高的档位使用率超过5.7%即进入负毛利而购买该档位的用户多为跑长链路Agent任务的重度开发者https://help.openai.com/en/articles/9793128-about-chatgpt-pro-tiersOpenAI推出ChatGPT Images 2.5图像生成模型OpenAI发布ChatGPT Images 2.5该图像生成模型在真实感、细节精度和文本渲染方面实现显著提升支持照片级真实感图像、精确排版、复杂多面板构图以及风格一致性。技术层面该模型在真实感、文本准确性和指令遵循等维度超越前代能生成带有清晰可读文字的标志、菜单和海报创建复杂多面板布局并保持跨图像角色和风格一致。实际应用场景涵盖营销材料设计、概念可视化、故事板创作、技术图表绘制、教育插图生成等同时支持图像编辑和扩展功能。Plus、Pro和Team用户即日起可在ChatGPT网页端、移动端和Windows应用中体验企业和教育用户即将获得访问权限https://openai.com/index/introducing-chatgpt-images-2-5/Xiaomi MiMo Desktop 开放邀测Xiaomi MiMo Desktop 面向真实工作场景支持直接处理多种格式素材无需预先整理通过自然语言理解目标并拆解任务调用工具交付可编辑的文档、表格、PPT、网页、3D 模型乃至软件工程项目。成果并非静态截图而是包含交互逻辑与数据可视化的完整页面支持会话内实时操作与局部修改并保留版本记录便于回退。内置「Smart」调度模式自动匹配模型与执行路径多会话可协同完成复杂任务。浏览器既是信息入口也是执行环境可自主检索、提取素材并验证网页成果。通过模型路由、局部编辑与高缓存命中优化长任务成本得到有效控制。邀测期间通过申请的用户可限时、限量、免费体验 MiMo-X-Pro-Preview 与 MiMo-X-Flash-Preview 两款模型优先面向 Xiaomi MiMo 开放平台已有用户开放https://mp.weixin.qq.com/s/Ey0GaGl3erC6sm_ubOOEEQLing-3.0-flash-VL开源发布Ling-3.0-flash-VL是百灵系列首个原生多模态大模型基于MoE架构总参数124B单次推理激活5.5B支持图像、文本及视频输入上下文窗口达256K Token。模型原生多模态联合训练证明视觉能力能反哺文本智能在Artificial Analysis Intelligence Index v4.1.1评估中较纯文本版本提升4分。其核心创新在于引入视觉反馈机制将任务从一次性生成推进为“观察→行动→验证→修正”的持续闭环使执行结果更可靠。在具体应用上模型支持视觉反馈编程能根据网页截图生成可运行代码并自我矫正也能作为GUI Agent理解界面状态并跨工具推进任务还可辅助解读医疗报告整合跨文档数据并以直观方式展示健康风险https://huggingface.co/inclusionAI/Ling-3.0-flash-VLECCV 2026揭晓最佳论文欧洲计算机视觉国际会议公布本年度各大奖项会议共收到有效投稿10473篇录用2834篇中稿率27.1%其中163篇入选oral。最佳论文奖授予伦敦帝国学院的《Heat Kernel Textures》该研究提出了一种无需UV贴图的3D纹理表示方法HKTex将类似高斯的热核直接贴附在物体Mesh表面可自然贴合曲面形变并集成进可微分的物理渲染管线实验显示纹理存储空间较原始UV纹理约降低一个数量级。两篇最佳论文提名分别来自Meta的LSRM——通过将原生稀疏注意力迁移至3D重建把可处理的物体token数量提升至此前SOTA的20倍PSNR较SOTA提升超2.4 dB以及纽约州立大学石溪分校的Poppy——以单次偏振采集作为测试时监督信号优化任意冻结RGB主干的法线输出合成数据平均角误差降低23%–26%。时间检验奖颁给三篇十年前的经典论文Wei Liu等人的SSD目标检测、Justin Johnson、Alexandre Alahi与李飞飞合著的感知损失风格迁移以及Zhizhong Li与Derek Hoiem提出的持续学习开创性工作Learning Without Forgettinghttps://mp.weixin.qq.com/s/ss9MNuL3A4gfoax7cWNStQLLaDA-Image全栈开源LLaDA-Image是一个6B参数的Diffusion Transformer模型采用“先学会画再学会听话”的路线在累计2.2亿训练样本中超过90%使用纯图片监督图文对集中在后续语言对阶段。模型预训练和中期训练不依赖Caption而是通过图像自身产生条件信号建立视觉世界后续SFT阶段再引入图文对完成文本—视觉对。其架构包括负责理解条件的dLLM视觉语言模型、连接接口和单流DiT可统一处理文生图与图片编辑。编辑时参考图像绕过语言模型通过SigLIP-VQ特征和FLUX2-VAE潜变量提供语义与像素信息。为提升推理效率团队采用TwinFlow蒸馏将50步基础模型压缩至2-4步生成。在Qwen-Image-Bench上LLaDA-Image在开源模型中排名第一模型已全栈开源https://github.com/inclusionAI/LLaDA-ImageDeepSeek发布V4.1 Flash模型DeepSeek V4.1 Flash是全新Causal-Encoder-Decoder结构系列的首款模型552B参数MoE模型输入激活仅8B输出激活16B原生支持多模态视觉理解。新模型在基准测试中超越包括DeepSeek V4 Pro在内的一众旗舰模型同时KV Cache缓存大幅压缩对HBM需求减少至1/4SSD需求减少至1/8有效降低Agent任务成本。模型已上线DeepSeek API旧版本模型暂时路由至V4.1 Flash腾讯及OpenCode作为官方合作伙伴已全量接入。得益于架构创新V4.1 Flash定价下调并采用峰谷定价策略。模型开源链接及论文已同步公开https://huggingface.co/deepseek-ai/DeepSeek-V4.1-Flash/blob/main/DeepSeek_V41_Tech_Report.pdf面壁智能开源MiniCPM5-2BMiniCPM5-2B是面壁智能联合OpenBMB开源社区开源的高密度端侧语言基础模型参数规模为20亿。根据Artificial Analysis Intelligence Index的最新评测该模型综合能力得分23分在全球4B参数规模以下的开源基座模型中综合表现第一智能密度超过Qwen3.5 9B以及参数规模约为其6倍的Gemma 4 12B模型。在评测智能体能力的Agentic Index指标上MiniCPM5-2B获得20分实现断层式领先同等参数规模的其他模型得分均低于10分初步验证了端侧模型承载Agent能力的可行性。此次开源范围包括模型权重、完整训练配方、强化学习框架及配套数据集https://github.com/OpenBMB/MiniCPM