
阿里通义千问开源Qwen3.8-Flash-Next
提前预览Qwen4代架构,125B参数MoE模型训练成本降至前代九分之一
阿里巴巴通义千问正式开源新一代多模态MoE模型Qwen3.8-Flash-Next,作为Qwen4架构的早期预览版,采用125B参数与混合注意力机制,每Token仅激活6B参数,原生支持26万Token上下文。该模型训练成本仅为前代的九分之一,在代码生成、多模态理解及Agent任务中表现卓越,同步上线商业API版本Qw......
阅读更多
DeepSeek 发布实验性多模态视觉模型 剑指智能体工作流
V4-Flash-Vision-Exp上线,多模态Agent能力媲美Opus 4.8,同步推出免费Files API
DeepSeek正式发布实验性多模态视觉模型DeepSeek-V4-Flash-Vision-Exp,在保持纯文本推理能力的同时新增图像理解功能,多模态智能体基准测试表现媲美Anthropic Opus 4.8。该模型支持复杂Agent工作流,可自动抓取图片生成商业PPT、重构网站UI及制作3D动态特效。API同步上线.....
阅读更多
阿里云通义千问 Qwen3.8 预览版上线
2.4万亿参数旗舰模型即将开源,自主编程能力跻身全球第一梯队
阿里云通义千问正式发布Qwen3.8-Max-Preview旗舰预览模型,总参数量达2.4万亿,采用第三代MoE架构,支持100万Token超长上下文及原生多模态能力。该模型在编程和AI Agent自主执行任务上实现突破,可连续完成超十天的大型软件工程任务,性能对标国际顶尖模型。目前预览版已上线阿里云百炼等平台,并推出...
阅读更多
Meta 发布 AI 编程智能体 Muse Code
主打大型代码库并行开发,以成本优势直击 OpenAI 与 Anthropic
Meta发布AI编程智能体Muse Code,专为大型代码库设计,由代码大模型Muse Spark驱动。该工具通过并行子代理和隔离工作树机制,可同时处理多任务且不干扰主代码副本,实现规划、编码到验证的全流程自动化。产品直接对标OpenAI Codex与Anthropic Claude Code,主打成本优势,旨在吸引企...
阅读更多
Vercel CEO Guillermo Rauch 谈模型与智能体之争
在 ShipNYC 大会之后的一次经过轻度编辑的对谈中,Vercel CEO Guillermo Rauch 介绍了公司如何从 AI 原型阶段转向更关注生产环境中的现实问题。Vercel 以无需开发者管理服务器即可部署智能体的云基础设施著称,如今表示其每天处理 600 万次部署,其中大约一半由编码智能体触发。Rauch 还提到,Vercel 的 AI gateway 每天处理超过 1 万亿个 token,显示出该公司已成为 AI 软件基础设施中的关键一环。他认为,智能体最重要的机会不仅是编程助手,还包括帮助企业处理日常运营的内部智能体。对于企业级场景,他强调必须安全访问数据、审计智能体行为,并记录所有工具调用和访问控制。
阅读更多