
阿联酋与美国在阿布扎比成立全球首个双边军事AI特遣部队
代号“Talon Synapse”总部落户阿布扎比,聚焦情报分析与关键基建保护,两国防务科技合作再升级
阿联酋与美国在阿布扎比成立全球首支双边军事AI特遣部队“Talon Synapse”,由20名专家常驻,聚焦军事情报AI整合、关键基础设施保护及中东安全实时监测。此举基于两国多年无人系统与AI联合演习经验,并受益于2025年《重大国防伙伴关系》协议及美国放宽对阿出口管制。该部队将显著提升地区情报感知与多域威慑能力,标志......
阅读更多
Meta 发布 AI 编程智能体 Muse Code
主打大型代码库并行开发,以成本优势直击 OpenAI 与 Anthropic
Meta发布AI编程智能体Muse Code,专为大型代码库设计,由代码大模型Muse Spark驱动。该工具通过并行子代理和隔离工作树机制,可同时处理多任务且不干扰主代码副本,实现规划、编码到验证的全流程自动化。产品直接对标OpenAI Codex与Anthropic Claude Code,主打成本优势,旨在吸引企...
阅读更多
阿里巴巴发布面向长周期任务的 Qwen3.8-Max
阿里巴巴表示,Qwen3.8-Max 基于 Qwen3.5 架构,拥有 2.4 万亿总参数和每次查询 950 亿激活参数,属于稀疏的专家混合架构。公司展示了其在编码、论文复现、芯片设计和电商模拟中的自主运行,但这些结果来自阿里巴巴自己的评测,而不是独立基准测试。
阿里巴巴 Qwen 团队发布了 Qwen3.8-Max,这是其目前最强大的语言模型。该模型总参数规模达到 2.4 万亿,每次请求激活 950 亿参数,重点不在于回答单轮提示词,而是面向长周期的自主执行任务。阿里巴巴表示,它基于 Qwen3.5 架构开发,并将成为首个公开发布权重的 Qwen-Max 模型。该模型的预览版其实在 7 月中旬就已公布,当时可以通过 Alibaba 的 Token Plan、Qoder 和 QoderWork 以标准价格 10% 的费用使用。
阅读更多
美科技巨头联合发布《开放权重与美国AI领导力》文件,呼吁政策支持AI开源生态
2026年7月24日,一份名为《开放权重与美国AI领导力》(Open Weights and American AI Leadership)的行业联合文件正式发布。包括英伟达(NVIDIA)、OpenAI、谷歌(Google)、Meta、微软(Microsoft)等在内的数十家美国顶尖科技公司、风投机构及研究组织共同签署。该文件呼吁美国政策制定者支持“开放权重”(Open Weights)AI模型的发展,将其视为维持美国在全球人工智能领域领导地位、促进经济繁荣及保障国家安全的关键战略。
阅读更多
当人工智能被用于破译失传语言时,会发生什么?
每一个曾被破译的古代语言都需要一个锚点。通常这是一份双语文本,比如罗塞塔石碑,或者一个已知的亲属语言作为参照。然而,希腊克里特岛上青铜时代米诺斯文明的文字系统——线形文字 A,两者皆不具备。线形文字 A 被描述为"语言孤立体",因为它与任何已知语言(无论现存还是已消亡)都没有确凿关联。正因如此,过去一个世纪里,它给语言学家带来了巨大挑战。而罗马帝国崛起前意大利使用的伊特鲁里亚语,处境也仅稍好一些。
阅读更多
月之暗面 Kimi 引发新一轮开源 AI 争论
中国公司月之暗面本周发布了新版 Kimi 模型,引发了外界围绕中国开源 AI 进展的又一轮争论。月之暗面表示,Kimi K3 仍然落后于最强的闭源模型,并点名 Claude Fable 5 和 GPT 5.6 Sol,但该模型在自家评测体系中展现出了前沿级表现。来自 Arena.ai 和 Vals AI 的独立分析也显示,Kimi 在竞争力上接近前沿级模型。此次发布恰逢中国国家主席习近平在上海世界人工智能大会上的讲话。市场对此反应紧张,周五纳斯达克指数下跌约 1%,投资者抛售了包括 Nvidia 在内的芯片公司股票。这个反应让人联想到 2025 年 1 月 DeepSeek R1 发布时的讨论,当时另一家中国开源模型也曾引发类似争议。
阅读更多
Nvidia推动日本工厂AI布局
报道称,Nvidia 首席执行官黄仁勋于7月15日至16日在东京停留两天,会见了日本工业界和芯片供应链的重要人物,此前他刚访问过台湾和韩国。文章称,他此行带回了覆盖日本整个科技生态的多项合作,包括全国AI工厂、机器人合作,以及为 Nvidia 下一代AI芯片服务的芯片材料供应协议。此行的核心,是把日本打造为“物理AI”的重要中心;黄仁勋将这种AI的下一个阶段描述为围绕工厂车间、机器人和机器展开。报道把这次访问解读为 Nvidia 与日本工业基础的战略对接,而日本工业界也越来越需要先进的AI基础设施。文章还提到一个历史细节:30年前,Sega 的500万美元投资曾帮助 Nvidia 度过危机。一个关键项目是 Noetra,也就是日本的主权AI计划,SoftBank、Sony、NEC、Honda 等约44家国内企业参与其中。
阅读更多
Anthropic 邀请尖锐问题
许多人对人工智能持积极态度。他们每天都在使用它,并看到了它在减轻工作和生活负担、改变学习方式、加速科技进步、创造新的繁荣源泉,以及解决我们面临的一些重大医疗和社会问题方面的潜力。
阅读更多
美联储请 Andreessen 研究 AI 与通胀
该工作组由Andreessen、斯坦福经济学家Charles I. Jones(目前在Anthropic休假)以及微软高管Asha Sharma共同担任联合主席。主席Kevin Warsh认为AI可能成为“显著的通缩力量”,但官员们也警告说,AI基础设施扩张可能先推高芯片、能源、资本和原材料需求,然后生产率收益才会出现。
美国联邦储备委员会成立了一个名为“生产率与就业”的新工作组,并任命风险投资人Marc Andreessen担任联合主席之一。该公告于2026年7月9日发布,是美联储同时宣布的五个工作组之一。根据《华盛顿邮报》的报道,这个小组的任务是研究AI和其他基础性技术如何重塑经济。
阅读更多
腾讯拟控股 Manus
报道称,腾讯、真格基金、HSG 等早期投资者以及 Manus 管理层都在讨论这笔交易,而 Benchmark 预计不会参与。Manus 据称将继续以新加坡为基地独立运营,且其最新披露的年收入接近 5 亿美元。
报道称,腾讯、真格基金、HSG 等早期投资者以及 Manus 管理层都在讨论这笔交易,而 Benchmark 预计不会参与。Manus 据称将继续以新加坡为基地独立运营,且其最新披露的年收入接近 5 亿美元。
阅读更多
Flint:面向 AI 时代的可视化语言
Flint 是由微软研究院(Microsoft Research)与中国人民大学IDEAS实验室合作开发的开源可视化中间语言项目。它旨在解决AI智能体在创建数据可视化图表时面临的核心挑战:如何在简洁的规范与专业的视觉效果之间找到平衡。
阅读更多
深度解析 x402 协议:基于 HTTP 402 与 Cloudflare Workers 构建 Web3 微支付网关
HTTP 状态码 402 Payment Required 自 1997 年在 RFC 1945 中被定义以来,一直被戏称为“被遗忘的状态码”。在过去的近 30 年里,互联网主要通过广告和订阅制来变现,402 始终没有统一的实现标准。然而,随着 AI Agent(人工智能代理)经济的爆发以及 Web3 微支付技术的成熟,这个沉睡的协议正在迎来它的“觉醒时刻”。近期,Cloudflare 发布了 Monetization Gateway(变现网关),彻底降低了微支付的门槛。在此背景下,独立开发者 Igor Shtein 通过一篇硬核的 PoC(概念验证)文章,向我们展示了如何利用 x402 协议,在 Cloudflare Workers 上为静态博客或 API 搭建一个支持多链(Base/Solana)、按次付费(Pay-per-use)的微支付网关。
阅读更多
外科医生远程操控人形机器人完成猪胆囊手术
研究人员展示了一种新的手术协作方式:由外科医生远程控制的人形机器人,从活体猪身上切除了胆囊。
研究人员展示了一种新的手术协作方式:由外科医生远程控制的人形机器人,从活体猪身上切除了胆囊。报道将这项工作描述为一项前所未有的临床前实验,并已发表在《Nature》上。需要强调的是,这些机器人并不是自主外科医生,整个手术过程仍然依赖人类远程操控。报道指出,这项研究的目标,是探索人形机器人未来是否能够把机器人辅助手术带到那些买不起、也放不下现有专用设备的地方。
阅读更多
Meta 推出 Muse Spark 1.1 进军 AI 编码
Meta 于周四发布了新版 Muse Spark,将其定位为一款用于代理式编程的多模态 AI 模型。
Meta 于周四发布了新版 Muse Spark,将其定位为一款用于代理式编程的多模态 AI 模型。公司表示,Spark 1.1 能够进行多步推理,处理复杂流程,管理数字工作流,并更新企业系统中的功能。Meta 的卖点是,这个模型可以支持大规模自动化任务,例如修复漏洞和进行大规模代码迁移。此次发布发生在 OpenAI 和 Anthropic 已经在这一领域深耕多时的背景下,因此 Meta 是在一个竞争者已经很强的市场中入场。尽管如此,Meta 似乎打算同时从能力和价格两个方向发力。
阅读更多
中国监管部门可能限制外国用户对其最强大 AI 模型的访问
中国 AI 企业通过免费开放模型在全球市场取得进展,如今北京正考虑是否要叫停这一做法。据路透社今日援引三位知情人士消息,中国监管部门已与阿里巴巴、字节跳动及智谱 AI 展开磋商,讨论是否限制外国用户获取其最先进的 AI 模型,包括尚未发布的版本。
阅读更多
腾讯发布Hy3开源MoE模型
腾讯混元Hy3正式发布:Agent能力显著提升,产品深度融合
腾讯发布了Hy3,这是一款采用混合专家(MoE)架构的开源语言模型。该模型总参数规模为2950亿,但在任意时刻只激活210亿参数。腾讯表示,这种设计让Hy3能够达到规模大两到五倍的模型的表现。腾讯还称,该模型的幻觉率已经减半,降至5.4%。
阅读更多
OpenCode 在 Supabase 上的代理编码
Supabase 的 OpenCode 集成现已可用。
OpenCode与Supabase集成。将您的代理连接到您的数据库、边缘函数和日志。MCP设置会自动配置。
阅读更多
Anthropic 核心主力模型的最新迭代 Claude Sonnet 5 全面介绍
智能体时代的效率跃升:Claude Sonnet 5 深度技术拆解与落地指南
随着大语言模型(LLM)逐步迈向自主规划、多步执行的“智能体(Agentic)时代”,企业对模型长程跟踪、自主纠错和工具调用的能力提出了苛刻要求。在传统分级体系中,中端模型(如 Sonnet 级别)一向在速度、成本和性能之间寻找平衡,而重度智能体任务则长期被高昂的旗舰模型(如 Opus 级别)所垄断。最新发布的 Claude Sonnet 5 彻底打破了这一格局。作为 Anthropic 核心主力模型的最新迭代,它通过架构重构与自适应思考机制,在维持中端定价的同时,下放了旗舰级的智能体长程执行力。本文将基于官方披露的技术数据与 System Card 评测,对 Claude Sonnet 5 进行公正、严谨的技术拆解。
阅读更多
OpenAI 试图说服特朗普政府作为投资者进行投资
据报道,OpenAI 公司正在考虑将 5%的股份分配给美国政府,这一举措显然是为了在面临美国人工智能企业所面临的政治压力时,改善与唐纳德·特朗普政府的关系。
阅读更多
GLM-5.2逼近闭源编码领先者
智谱AI发布了 GLM-5.2,并将其定位为面向长程任务的模型,适合持续数小时、涉及数千个步骤的工作。为支持这类场景,公司把上下文窗口扩展到 100 万 token,并重点用智能体式编码工作负载进行训练。智谱强调,真正困难的不是宣布一个很大的上下文窗口,而是在长时间、非结构化的编码会话中保持稳定可靠的表现。在 FrontierSWE 基准上,GLM-5.2 得分为 74.4%,仅比 Anthropic 的 Claude Opus 4.8 低 1 个百分点,同时略高于 OpenAI 的 GPT-5.5。在 PostTrainBench 上,它击败了 GPT-5.5 和 Opus 4.7,但仍落后于 Opus 4.8。到了难度更高的 SWE-Marathon,GLM-5.2 的表现就明显落后了,只拿到 Opus 4.8 大约一半的分数。
阅读更多
Statement on the US government directive to suspend access to Fable 5 and Mythos 5
关于美国政府暂停访问《寓言5》和《神话5》的声明
美国政府援引国家安全当局的理由,发布了出口管制指令,暂停任何外国人(无论在美国境内还是境外)访问 Fable 5 和 Mythos 5,包括外国籍的 Anthropic 员工。该命令的净效果是,我们必须突然禁用所有客户的 Fable 5 和 Mythos 5,以确保合规。其他所有 Anthropic 模型的访问不受影响。
阅读更多
Anthropic Claude Opus 4.8 核心升级与工程落地实践
Claude Opus 4.8. It builds on Opus 4.7 with improvements across benchmarks, and is a more effective collaborator. It’s available today for the same price.
美国时间 2026 年 5 月 28 日,Anthropic 正式推出了其旗舰模型的最新迭代版本——Claude Opus 4.8。距离上一代 4.7 版本的发布仅过去短短一个多月,Anthropic 并没有选择进行底层架构的跨代更迭,而是采取了极其务实的“渐进式优化”策略。根据官方定义,Opus 4.8 是一次面向生产环境、聚焦于“高可靠协作”(Effective Collaborator)和“长时自主任务”(Long-running Autonomous Tasks)的深度抛光。
阅读更多
OpenAI:推进内容溯源,构建更安全、更透明的 AI 生态
依托内容凭证、SynthID 以及面向公众的早期验证工具,帮助人们理清 AI 生成内容的来源
如今,人们每天都在使用 OpenAI 的工具来创作和编辑图像与音频,让日常沟通变得更具表现力、更实用、更触手可及。随着这些工具融入人们构建、想象和分享的方方面面,使用户能够理解并验证媒介的来源变得至关重要,这能让他们在解读信息时更有信心。内容溯源特征可以通过提供上下文,帮助人们了解内容的来源、创建或编辑的方式,以及它是否可信。
阅读更多
玻璃翼计划:初步更新
Project Glasswing: An initial update
在这篇文章中,我们将讨论在 Project Glasswing 最初几周对这一关键网络安全挑战的了解。我们重点关注 Mythos Preview 性能的早期公开证据,关注我们扫描数千个开源软件项目的初步成果,以及这些进展对当今网络防御者的意义。我们还介绍了 Project Glasswing 接下来的期待,以及我们未来如何考虑发布 Mythos 级模型。
阅读更多
科技爱好者周刊(第 395 期):软件开发的第三种方式
这里记录每周值得分享的科技内容,周五发布。
阮一峰科技周刊第395期:探讨AI时代软件开发的"神秘屋"新模式——单人+AI驱动、快速迭代、高度个性化;同步更新大模型人气榜(Claude/GPT/国产模型排行)、AI门诊预检、自动驾驶安全等前沿科技动态,附实用开发工具与资源推荐,程序员每周必备技术资讯。
阅读更多
借助OpenAI的能力制定专属健康计划
借助OpenAI的能力制定专属健康计划
阅读更多
推出 NVIDIA Ising
NVIDIA 发布全球首个开源 AI 模型系列,加速研究人员和企业实现实用量子计算机进程。
NVIDIA 发布全球首个开源 AI 模型系列,加速研究人员和企业实现实用量子计算机进程。全球首个开放量子 AI 模型加速实用量子计算机进程。
阅读更多
DeepSeek-V4 预览版:迈入百万上下文普惠时代
DeepSeek-V4 拥有百万字超长上下文,在 Agent 能力、世界知识和推理性能上均实现国内与开源领域的领先。
阅读更多
OpenAI 正式发布 ChatGPT Images 2.0
开启图像生成新纪元
OpenAI 今日正式推出 ChatGPT Images 2.0,这是一款革命性的图像生成模型,标志着 AI 视觉创作从基础渲染迈向智能化设计的新阶段。
阅读更多