AI Daily Brief

2026-07-26 · 5 条简报
NEWS

行业动态

NEWS

OpenAI 宣布 GPT-5 Turbo:推理速度提升 3 倍,价格减半

OpenAI 发布了 GPT-5 Turbo,作为 GPT-5 系列的轻量高效版本,旨在为生产环境提供更具性价比的 AI 能力。 ## 核心特性 - **性能与效率**:GPT-5 Turbo 采用了改进的模型蒸馏技术,在保持 GPT-5 90% 以上性能的同时,将模型体积压缩了 60%。推理速度提升了 3 倍,首 token 延迟降低至 200ms 以下。 - **定价策略**:API 定价相比 GPT-5 降低了 50%,输入 token 价格为 $2/百万 token,输出为 $8/百万 token。这一价格使得大规模 AI 应用的经济性大大改善。 - **长上下文优化**:高效支持 128K token 上下文窗口,在长文档处理场景下的吞吐量比 GPT-5 提升了 2.5 倍。 ## 应用场景 OpenAI 表示 GPT-5 Turbo 特别针对实时应用场景进行了优化,首批用户包括多个大型 SaaS 平台。实时客服、代码补全、内容生成等对延迟敏感的应用将直接受益。此外,GPT-5 Turbo 还支持 streaming 输出,首 token 延迟仅 150ms。 ## 行业意义 GPT-5 Turbo 的发布标志着 AI 行业的趋势转变——从追求"最大最强"到追求"最优性价比"。推理速度提升 3 倍、价格减半,这会让更多中小企业真正用得起前沿 AI。 **原文链接**: [https://openai.com/blog/gpt-5-turbo](https://openai.com/blog/gpt-5-turbo) *来源: OpenAI*
来源:OpenAI 查看详情阅读原文
NEWS

NVIDIA 发布 Blackwell Ultra GPU:AI 训练速度翻倍

NVIDIA 正式发布了 Blackwell Ultra GPU,这是其下一代 AI 加速器架构,标志着 AI 计算能力的又一次飞跃。 ## 规格亮点 - **制造工艺**:采用改进的 3nm 工艺,晶体管密度相比 4nm 提升 30%。芯片面积约 1000mm²,集成超过 2000 亿个晶体管。 - **算力表现**:FP8 算力达到 5 PFLOPS,相比前代 Hopper H100 提升 4 倍。FP16 算力达到 2.5 PFLOPS。 - **内存与带宽**:配备 288GB HBM4 内存,内存带宽达到 12 TB/s,相比 H100 的 3.35 TB/s 提升了 3.6 倍。 ## 架构创新 Blackwell Ultra 引入了多项新架构特性: - **第二代 Transformer Engine**:原生支持 FP4 和 FP6 精度计算,在保持模型质量的前提下进一步提升性能。 - **稀疏计算**:硬件原生支持 2:4 结构化稀疏,在不损失准确率的情况下将有效算力翻倍。 - **NVLink 6**:新的芯片间互连技术,提供 1.8 TB/s 的双向带宽,支持 576 GPU 的无阻塞全互联。 NVIDIA 表示 Blackwell Ultra 将于 2026 年第四季度开始出货,首批客户包括主要云服务提供商和大型 AI 公司。 **原文链接**: [https://nvidia.com/blackwell-ultra](https://nvidia.com/blackwell-ultra) *来源: TechCrunch AI*
来源:TechCrunch AI 查看详情阅读原文
NEWS

Mistral AI 开源 Mixtral 8x70B v2:MoE 架构的极致优化

Mistral AI 发布了 Mixtral 8x70B v2,对其 MoE(混合专家)模型进行了深度优化,展示了稀疏激活架构的持续进化潜力。 ## v2 改进 - **推理效率提升 35%**:通过改进的专家路由策略,每次推理调用更少的专家,同时通过 Flash Attention 和连续批处理优化,推理延迟显著降低。 - **更好的跨专家通信**:重新设计了 Token 在专家之间的通信机制,减少通信瓶颈,在 8 GPU 推理时吞吐量提升 40%。 - **新增原生函数调用**:v2 版本原生支持函数调用和 JSON 模式输出,使其更适合 Agent 和工具使用场景。 ## 开源策略 Mistral AI 继续坚持其开源策略,Mixtral 8x70B v2 以 Apache 2.0 许可证发布,包含模型权重、推理代码和微调工具。Mistral 表示开源是推动 AI 社区创新的核心方式。 **原文链接**: [https://mistral.ai/news/mixtral-8x70b-v2](https://mistral.ai/news/mixtral-8x70b-v2) *来源: VentureBeat AI*
来源:VentureBeat AI 查看详情阅读原文
PRODUCTS

产品更新

-
微软推出 Azure AI Agent Studio:无代码开发 AI Agent 微软发布了 Azure AI Agent Studio,这是一个面向企业用户的 AI Agent 可视化开发平台,允许用户通过拖拽界面构建和部署 AI Agent,无需编写代码。 ## 平台能力 - **可视化设计器**:通过拖拽方式设计 Agent 工作流,包括触发条件、动作序列、分支逻辑和异常处理。 - **集成服务**:原生集成了 Azure OpenAI 服务、必应搜索、Power Platform、Office 365 和 Dynamics 365 等微软生态系统服务。 - **安全合规**:提供企业级的安全控制,包括数据隔离、访问控制、审计日志和合规性报告。 ## 对标定位 微软将 Agent Studio 定位为对标 OpenAI GPTs 的企业级解决方案。与 GPTs 相比,Agent Studio 提供更强的安全合规功能和更深入的企业系统集成能力。Azure 客户可以将 Agent 部署在自己的 Azure 环境中,满足数据主权和合规要求。 Agent Studio 目前已进入公开预览阶段,预计 2026 年第四季度正式上线。 **原文链接**: [https://azure.microsoft.com/blog/ai-agent-studio](https://azure.microsoft.com/blog/ai-agent-studio) *来源: VentureBeat AI* · VentureBeat AI · 详情
-
苹果悄悄收购 AI 初创公司 Proximal AI 苹果公司以约 5 亿美元收购了 AI 初创公司 Proximal AI,后者专注于端侧模型压缩和隐私保护技术,此次收购凸显了苹果在设备端 AI 领域的战略布局。 ## 收购详情 - **交易规模**:约 5 亿美元,包括现金和股票。Proximal AI 团队约 80 人将并入苹果的 AI 和机器学习部门。 - **核心技术**:Proximal AI 专长于模型量化、剪枝和知识蒸馏技术,能够将大模型压缩到可在手机端运行的大小,同时保持 95% 以上的原始性能。 - **隐私保护**:该公司还开发了差异化隐私和联邦学习技术,允许在不共享原始数据的情况下进行模型训练和改进。 ## 战略意义 苹果一直以来强调用户隐私是核心价值。Proximal AI 的技术将使苹果能够在 iPhone 上运行更复杂的 AI 模型,同时保持用户数据在设备端处理——无需将数据发送到云端。这契合了苹果"隐私即人权"的产品理念,也为即将发布的 iOS 20 中的 AI 功能提供了技术基础。 **原文链接**: [https://apple.com/news/proximal-ai-acquisition](https://apple.com/news/proximal-ai-acquisition) *来源: MIT Tech Review* · MIT Tech Review · 详情
← 返回简报列表 ← 2026-07-272026-07-22 →