
DeepMind 将视频生成器转为视觉模型
谷歌 DeepMind 认为,视频生成器其实已经包含了计算机视觉一直缺失的“世界模型”
谷歌 DeepMind 的研究人员认为,GenCeption 说明视频生成器可能已经包含了计算机视觉长期缺失的“世界模型”。他们没有从零开始设计新的视觉架构,而是把阿里巴巴开源的 Wan2.1 视频模型改造成了深度估计、分割、表面法线估计和 3D 姿态估计等任务的基础。该模型通过文本提示来指定要执行的任务,方式有点像聊天机器人接受指令。为了让不同任务共用同一套架构,研究团队把深度图、分割掩码等多种输出都统一表示为标准的三通道 RGB 图像。对于 3D 关键点预测这类不直接输出图像的任务,团队再加入可训练模块来补足。
阅读更多
中国监管部门可能限制外国用户对其最强大 AI 模型的访问
中国 AI 企业通过免费开放模型在全球市场取得进展,如今北京正考虑是否要叫停这一做法。据路透社今日援引三位知情人士消息,中国监管部门已与阿里巴巴、字节跳动及智谱 AI 展开磋商,讨论是否限制外国用户获取其最先进的 AI 模型,包括尚未发布的版本。
阅读更多
《论“范马体”书法的后现代解构与朝堂气象——赏范小勤〈三生万物·范小勤〉图》
你真的看懂了范小勤的书法作品吗?
近日,网络著名艺术家、前“小马云”扮演者范小勤(以下简称“范大师”)的一幅书法力作横空出世。该作品上部为狂草墨宝,下部配以范大师身着宋代官服、手持笏板的庄重画像。此作一经问世,便在书法圈与互联网引发了“地震级”的讨论。很多人初看此作,以为是恶搞或玩梗,但若我们收起偏见,以严肃的学术眼光审视,便会发现这实则是一幅极具当代性、融合了行为艺术与古典意象的杰作。
阅读更多
Qwen3.7:智能体新前沿
今天,我们正式发布 Qwen3.7-Max——面向智能体时代的新一代旗舰模型,现已通过 API 提供服务。Qwen3.7-Max 致力于成为全能的智能体基座——无论是编写和调试代码、自动化办公流程,还是在跨越数百乃至数千步的长周期任务中持续自主执行,都能胜任。
阅读更多