首次,统一建模视角下的扩散语言模型后门威胁
扩散语言模型(DLM)正逐渐成为自回归(Autoregressive, AR)语言模型之外一种新兴的建模范式。
超越OpenAI,中国00后团队攻破「记忆」难题!打造下一个AI互联网时刻
80年前,阿根廷作家博尔赫斯写过一个寓言,叫《博闻强记的富内斯》。博尔赫斯笔下的富内斯,拥有过目不忘、堪称完美的记忆,却无法思考,因为思考依赖于遗忘和抽象。
提示词工程论文登上ICML 2026,网友吵翻了天
这年头,提示词工程也能发ICML了???
10000小时人类数据,练出全球首个全身移动操作隐式世界动作模型
过去两年,人形机器人赛道的竞争焦点,正从整机硬件进一步延伸到模型能力。
视频通用模型来了!DeepMind 再证「生成即理解」,何恺明参与
如果想开发一个视频理解应用,你会怎么做?
离谱,Claude Fable 5 手搓魔兽世界后,开始和人类组队开黑了!
这两天网上冲浪的时候,发现有人用 Claude 复刻了一个类似《魔兽世界》的在线多人游戏。
3步推理生成加速20+倍!CoLT教会多模态大模型用「潜思维链」思考
近年来,多模态大语言模型(MLLM)在视觉问答、图表理解、科学推理等任务上取得了令人瞩目的进展。
登顶 ICML Oral !专访上交大团队:这个 3D 自动标注 AI 太强了
3D空间数据的瓶颈,从来不是算法,而是标注。
AI越会回答,人为什么越需要深度思考?复旦发布2026人文社科智能发展蓝皮书
曾经我们对 AI 的期待还比较朴素,写邮件、翻译论文、聊天搭子……那时候,AI 像一个初出茅庐的实习生,你指哪它打哪,但也经常一本正经地胡说八道。
Yann LeCun连续转发并高度认可的VISReg,到底强在哪?
近日,自监督学习新工作 VISReg(Variance-Invariance-Sketching Regularization)获图灵奖得主 Yann LeCun 连续转发并给予高度认可 —— 他在转发时评价道「VICReg begat SIGReg which begat VISReg」(VICReg 孕育了 SIGReg,SIGReg 又孕育了 VISReg),
深度|腾讯AI的双线战争:混元之外,微信WeLM用四年证明了另一种可能
7月6日,腾讯混元Hy3正式版发布。
Science | 北大研制全球首款基于可控存内计算的忆阻器神经动力学芯片
近日,新基石研究员、北京大学集成电路学院教授、深圳研究生院信息工程学院院长杨玉超团队,联合中国科学院上海微系统与信息技术研究所宋志棠研究员团队等,在国际顶级学术期刊《科学》发表最新成果,在新型神经动力学计算芯片领域取得重大突破。
全生命周期法律模拟世界|一键推演 or 亲自上场?法律界的「模拟人生」来了
打官司,从来不是一问一答就能结束的事。
无需视觉 tokenizer,北大PRA解锁自回归图像生成潜力,135M模型性能反超1.9B基线
过去几年,扩散模型几乎定义了高质量图像生成:从随机噪声出发,经过多轮迭代,逐步 “雕刻” 出一张图像。但随着大语言模型席卷人工智能领域,另一条路线正迅速走到舞台中央 —— 图像,能否也像语言一样,通过自回归方式逐步生成?
md2wechat 3.0重磅发布,10种图片场景一次讲透
大家好,我是极客杰尼。 今天,md2wechat 正式发布 3.0.0 大版本,这次最重要的变化,是普通创作者也能让 Agent 帮自己完成多图和 SVG 排版。
Codex封号、Claude查证件,而它选择了免费且不限期
刚刚,Agnes 升级了!
OpenAI骑脸输出!仅5分钟,把GPT-5.6塞进Claude老家
OpenAI高管亲自下场,教开发者5分钟极速「策反」Claude Code,这波贴脸开大太狠了。
Codex + ChatCut,Agent 剪视频成了!
最近刷小红书,总能刷到 ChatCut。
全球首创!AI看一眼视频就能「读出」双手,三个世界第一
不教AI认手,而是从视频世界模型里直接「读」出双手:三大基准SOTA,让百万小时野生视频第一次能变成机器人的操作教材。
5秒挖出15年Linux漏洞,AI却让无辜记者成了偷车嫌犯
一个AI工具挖出了藏在Linux里15年的致命漏洞,另一个AI却因为一个被录错的数字,让四辆警车把无辜记者当成盗车贼围了起来。