
阿里巴巴发布面向长周期任务的 Qwen3.8-Max
阿里巴巴表示,Qwen3.8-Max 基于 Qwen3.5 架构,拥有 2.4 万亿总参数和每次查询 950 亿激活参数,属于稀疏的专家混合架构。公司展示了其在编码、论文复现、芯片设计和电商模拟中的自主运行,但这些结果来自阿里巴巴自己的评测,而不是独立基准测试。
阿里巴巴 Qwen 团队发布了 Qwen3.8-Max,这是其目前最强大的语言模型。该模型总参数规模达到 2.4 万亿,每次请求激活 950 亿参数,重点不在于回答单轮提示词,而是面向长周期的自主执行任务。阿里巴巴表示,它基于 Qwen3.5 架构开发,并将成为首个公开发布权重的 Qwen-Max 模型。该模型的预览版其实在 7 月中旬就已公布,当时可以通过 Alibaba 的 Token Plan、Qoder 和 QoderWork 以标准价格 10% 的费用使用。
阅读更多
美科技巨头联合发布《开放权重与美国AI领导力》文件,呼吁政策支持AI开源生态
2026年7月24日,一份名为《开放权重与美国AI领导力》(Open Weights and American AI Leadership)的行业联合文件正式发布。包括英伟达(NVIDIA)、OpenAI、谷歌(Google)、Meta、微软(Microsoft)等在内的数十家美国顶尖科技公司、风投机构及研究组织共同签署。该文件呼吁美国政策制定者支持“开放权重”(Open Weights)AI模型的发展,将其视为维持美国在全球人工智能领域领导地位、促进经济繁荣及保障国家安全的关键战略。
阅读更多
当人工智能被用于破译失传语言时,会发生什么?
每一个曾被破译的古代语言都需要一个锚点。通常这是一份双语文本,比如罗塞塔石碑,或者一个已知的亲属语言作为参照。然而,希腊克里特岛上青铜时代米诺斯文明的文字系统——线形文字 A,两者皆不具备。线形文字 A 被描述为"语言孤立体",因为它与任何已知语言(无论现存还是已消亡)都没有确凿关联。正因如此,过去一个世纪里,它给语言学家带来了巨大挑战。而罗马帝国崛起前意大利使用的伊特鲁里亚语,处境也仅稍好一些。
阅读更多
月之暗面 Kimi 引发新一轮开源 AI 争论
中国公司月之暗面本周发布了新版 Kimi 模型,引发了外界围绕中国开源 AI 进展的又一轮争论。月之暗面表示,Kimi K3 仍然落后于最强的闭源模型,并点名 Claude Fable 5 和 GPT 5.6 Sol,但该模型在自家评测体系中展现出了前沿级表现。来自 Arena.ai 和 Vals AI 的独立分析也显示,Kimi 在竞争力上接近前沿级模型。此次发布恰逢中国国家主席习近平在上海世界人工智能大会上的讲话。市场对此反应紧张,周五纳斯达克指数下跌约 1%,投资者抛售了包括 Nvidia 在内的芯片公司股票。这个反应让人联想到 2025 年 1 月 DeepSeek R1 发布时的讨论,当时另一家中国开源模型也曾引发类似争议。
阅读更多
外科医生远程操控人形机器人完成猪胆囊手术
研究人员展示了一种新的手术协作方式:由外科医生远程控制的人形机器人,从活体猪身上切除了胆囊。
研究人员展示了一种新的手术协作方式:由外科医生远程控制的人形机器人,从活体猪身上切除了胆囊。报道将这项工作描述为一项前所未有的临床前实验,并已发表在《Nature》上。需要强调的是,这些机器人并不是自主外科医生,整个手术过程仍然依赖人类远程操控。报道指出,这项研究的目标,是探索人形机器人未来是否能够把机器人辅助手术带到那些买不起、也放不下现有专用设备的地方。
阅读更多
Meta 推出 Muse Spark 1.1 进军 AI 编码
Meta 于周四发布了新版 Muse Spark,将其定位为一款用于代理式编程的多模态 AI 模型。
Meta 于周四发布了新版 Muse Spark,将其定位为一款用于代理式编程的多模态 AI 模型。公司表示,Spark 1.1 能够进行多步推理,处理复杂流程,管理数字工作流,并更新企业系统中的功能。Meta 的卖点是,这个模型可以支持大规模自动化任务,例如修复漏洞和进行大规模代码迁移。此次发布发生在 OpenAI 和 Anthropic 已经在这一领域深耕多时的背景下,因此 Meta 是在一个竞争者已经很强的市场中入场。尽管如此,Meta 似乎打算同时从能力和价格两个方向发力。
阅读更多
GLM-5.2逼近闭源编码领先者
智谱AI发布了 GLM-5.2,并将其定位为面向长程任务的模型,适合持续数小时、涉及数千个步骤的工作。为支持这类场景,公司把上下文窗口扩展到 100 万 token,并重点用智能体式编码工作负载进行训练。智谱强调,真正困难的不是宣布一个很大的上下文窗口,而是在长时间、非结构化的编码会话中保持稳定可靠的表现。在 FrontierSWE 基准上,GLM-5.2 得分为 74.4%,仅比 Anthropic 的 Claude Opus 4.8 低 1 个百分点,同时略高于 OpenAI 的 GPT-5.5。在 PostTrainBench 上,它击败了 GPT-5.5 和 Opus 4.7,但仍落后于 Opus 4.8。到了难度更高的 SWE-Marathon,GLM-5.2 的表现就明显落后了,只拿到 Opus 4.8 大约一半的分数。
阅读更多
Statement on the US government directive to suspend access to Fable 5 and Mythos 5
关于美国政府暂停访问《寓言5》和《神话5》的声明
美国政府援引国家安全当局的理由,发布了出口管制指令,暂停任何外国人(无论在美国境内还是境外)访问 Fable 5 和 Mythos 5,包括外国籍的 Anthropic 员工。该命令的净效果是,我们必须突然禁用所有客户的 Fable 5 和 Mythos 5,以确保合规。其他所有 Anthropic 模型的访问不受影响。
阅读更多
Anthropic Claude Opus 4.8 核心升级与工程落地实践
Claude Opus 4.8. It builds on Opus 4.7 with improvements across benchmarks, and is a more effective collaborator. It’s available today for the same price.
美国时间 2026 年 5 月 28 日,Anthropic 正式推出了其旗舰模型的最新迭代版本——Claude Opus 4.8。距离上一代 4.7 版本的发布仅过去短短一个多月,Anthropic 并没有选择进行底层架构的跨代更迭,而是采取了极其务实的“渐进式优化”策略。根据官方定义,Opus 4.8 是一次面向生产环境、聚焦于“高可靠协作”(Effective Collaborator)和“长时自主任务”(Long-running Autonomous Tasks)的深度抛光。
阅读更多
OpenAI:推进内容溯源,构建更安全、更透明的 AI 生态
依托内容凭证、SynthID 以及面向公众的早期验证工具,帮助人们理清 AI 生成内容的来源
如今,人们每天都在使用 OpenAI 的工具来创作和编辑图像与音频,让日常沟通变得更具表现力、更实用、更触手可及。随着这些工具融入人们构建、想象和分享的方方面面,使用户能够理解并验证媒介的来源变得至关重要,这能让他们在解读信息时更有信心。内容溯源特征可以通过提供上下文,帮助人们了解内容的来源、创建或编辑的方式,以及它是否可信。
阅读更多
玻璃翼计划:初步更新
Project Glasswing: An initial update
在这篇文章中,我们将讨论在 Project Glasswing 最初几周对这一关键网络安全挑战的了解。我们重点关注 Mythos Preview 性能的早期公开证据,关注我们扫描数千个开源软件项目的初步成果,以及这些进展对当今网络防御者的意义。我们还介绍了 Project Glasswing 接下来的期待,以及我们未来如何考虑发布 Mythos 级模型。
阅读更多
科技爱好者周刊(第 395 期):软件开发的第三种方式
这里记录每周值得分享的科技内容,周五发布。
阮一峰科技周刊第395期:探讨AI时代软件开发的"神秘屋"新模式——单人+AI驱动、快速迭代、高度个性化;同步更新大模型人气榜(Claude/GPT/国产模型排行)、AI门诊预检、自动驾驶安全等前沿科技动态,附实用开发工具与资源推荐,程序员每周必备技术资讯。
阅读更多
借助OpenAI的能力制定专属健康计划
借助OpenAI的能力制定专属健康计划
阅读更多
推出 NVIDIA Ising
NVIDIA 发布全球首个开源 AI 模型系列,加速研究人员和企业实现实用量子计算机进程。
NVIDIA 发布全球首个开源 AI 模型系列,加速研究人员和企业实现实用量子计算机进程。全球首个开放量子 AI 模型加速实用量子计算机进程。
阅读更多
DeepSeek-V4 预览版:迈入百万上下文普惠时代
DeepSeek-V4 拥有百万字超长上下文,在 Agent 能力、世界知识和推理性能上均实现国内与开源领域的领先。
阅读更多
OpenAI 正式发布 ChatGPT Images 2.0
开启图像生成新纪元
OpenAI 今日正式推出 ChatGPT Images 2.0,这是一款革命性的图像生成模型,标志着 AI 视觉创作从基础渲染迈向智能化设计的新阶段。
阅读更多