2026年8月12日 · 周三

AI 资讯速递

精选 30 条今日最重要的 AI 新闻,NVIDIA 推出 Nemotron 3.5 Lightning 领衔

数据来源aihot.virxact.com自动聚合生成
头条AI模型开源产品AI HOT

NVIDIA 推出 Nemotron 3.5 Lightning,加速本地智能体任务

NVIDIA 发布 Nemotron 3.5 Lightning,一款可定制的开源 30B 混合专家(MoE)模型,专为常驻智能体设计。相比同类开源模型,其 token 生成速度最高提升 4 倍,任务完成时间缩短 30%。该模型采用开放权重,支持用户微调以匹配特定任务,并可在 RTX PC、DGX Spark 及 Jetson 等设备上运行。

⚡ 本地智能体加速🧩 开放权重💻 RTX / Jetson 可运行
阅读原文
模型与开源
AI模型开源产品AI HOT

SGLang 宣布 Day-0 支持 NVIDIA Nemotron 3.5 Lightning

SGLang 宣布对 NVIDIA Nemotron 3.5 Lightning 提供 Day-0 支持,支持最长 1M token 上下文,可通过 OpenAI 兼容 API 接入智能体工作流。

AI模型开源产品AI HOT

Ling-3.0-tiny 正式开源:1.3B 激活参数如何进入真实任务

蚂蚁百灵开源 Ling-3.0-tiny,一款总参数 7.9B、推理时仅激活 1.3B 参数的原生混合推理模型,同步提供 BF16、FP8 和 INT4 三个版本。

AI模型产品国际08:00

SpaceXAI debuts Grok 4.6, overtaking Kimi K3 and matching GPT-5.6 Sol on Artificial Analysis

SpaceXAI 发布 Grok 4.6,并称其在 Artificial Analysis Intelligence Index 上超过 Kimi K3、追平 GPT-5.6 Sol,进入全球前沿模型第一梯队。

产品与更新
AI产品AI HOT

Runway Seedance 2.5 上线,支持50角色参考

Seedance 2.5 已在 Runway 上线,支持 50 个独特角色参考,以及最长 30 秒、与音乐同步的片段。

AI模型产品企业AI HOT

Gemini 助力 Database Migration Service 加速 PostgreSQL 迁移

Google Cloud 在 Database Migration Service 中推出由 Gemini 驱动的 AI 辅助代码转换,可将 Oracle 或 SQL Server 代码转换为 PostgreSQL PL/pgSQL。

AI模型产品AgentAI HOT

ZCode全面升级:Goal、Subagents、Remote Control与闲时任务四大功能上线

ZCode 针对 GLM 深度优化,上线 Goal、Subagents、Remote Control 与闲时任务功能,提升编码代理工作流效率。

AI模型产品AgentAI HOT

ChatGPT 桌面端支持导入其他智能体工作数据

ChatGPT 桌面应用现可导入项目、聊天记录、技能和插件,查看导入历史,并可在设置中选择开启自动更新。

AI开源产品AgentAI HOT

Databricks 开源 Metals v2:面向数百万行代码库的 Java 和 Scala 语言服务器

Metals v2 专为智能体驱动的开发场景设计,旨在提升大规模代码库中的编辑与导航性能。

AI模型产品企业08:00

OpenAI brings ChatGPT desktop app to Linux with ChatGPT, Work and Codex in one place

OpenAI 推出 Linux 版 ChatGPT 桌面应用,将 ChatGPT、Work 与 Codex 工作流整合在桌面端。

行业与资本
AI模型安全研究AI HOT

研究人员发现可读取ChatGPT等模型加密推理过程的API漏洞

研究团队发现 OpenAI、Anthropic、Google 等主要 AI 提供商 API 存在漏洞,可读取推理模型的加密思考过程,并在公开会话中发现密钥和密码泄露。

AI模型财经IPOAI HOT

消息称 Anthropic 最快今年 9 月上市,向投资者淡化 AI 模型竞争等挑战

Anthropic 正与潜在投资者接触,为可能成为史上规模最大的 IPO 做准备,计划今年 9 月或 10 月初正式上市。

AI模型产品AI HOT

Gemini月活破10亿,成谷歌增长最快产品

每月已有超过 10 亿人使用 Gemini app,成为谷歌有史以来增长最快的产品之一。

AI模型开源产品AI HOT

消息称英伟达开发万亿参数开源 AI 模型 Nemotron 4,目标挑战全球顶级

英伟达正在研发新一代开源 AI 模型 Nemotron 4,规模最大的模型预计至少拥有 1 万亿个参数。

AI产品芯片国际AI HOT

NVIDIA 为何需要新供电架构以扩展 AI 算力性能

NVIDIA 主张以 800 VDC 直流配电替代传统交流多次转换,以降低损耗、支撑 AI 算力扩展。

AI模型开源产品AI HOT

英伟达循环融资达到新高度,黄仁勋是否过度出牌?

金融观察者对英伟达循环融资做法表示担忧,同时 Nemotron 真正开源版本可能影响其生态伙伴格局。

AIAgent基础设施AI HOT

Electric 加入 Databricks,将 WASM Postgres 引入 AI 智能体沙箱

该技术让智能体在隔离环境中运行本地数据库,支持实时数据同步与离线操作,提升可靠智能体应用构建效率。

AI模型产品企业08:00

Google co-founder Sergey Brin reportedly urges AI teams to go all in on Gemini models

Google 联合创始人 Sergey Brin 要求 AI 团队集中资源推进 Gemini 模型,以应对 OpenAI、Anthropic 等对手。

政策与安全
AI财经安全企业AI HOT

每个类别都有赢家:AI 时代 SaaS 龙头的估值溢价

SaaS 估值整体承压,但每个细分赛道都跑出了 AI 龙头,安全、边缘网络和电商软件等领域估值分化显著。

AI产品安全企业08:00

Google Chrome rolls out Device-Bound Service Credentials to reduce session cookie theft

Google Chrome 推进 DBSC 机制,把会话凭证与设备绑定,以降低账号接管和 Cookie 窃取风险。

研究与观点
AI模型开源产品AI HOT

Apple Silicon 与 macOS 虚拟机:借助 Llama.cpp 实现 11–16 倍的 LLM 推理加速

研究团队为 macOS 虚拟机中的 Metal 能力查询构建兼容层,使 llama.cpp 能选用更新的 Metal 内核并接近裸机性能。

AI模型研究基础设施AI HOT

统一 Radix 缓存:为混合模型前缀缓存构建单一树结构

LMSYS 团队提出 Unified Radix Cache,用单一 token 键控 radix 拓扑统一管理混合模型缓存。

AI模型产品研究AI HOT

AMIE 研究医疗 AI 系统首次展示实时临床视频问诊能力

Google Research 与 DeepMind 推进医疗 AI 系统 AMIE,实现实时临床视频问诊并展示专家级 AI 能力。

AI模型产品研究AI HOT

OpenAI 用 Astra 模型攻克 10 道数学难题,数学家既兴奋又担忧

OpenAI 宣布未发布的 Astra 模型解决 10 道长期悬而未决的数学难题,并发布论文及 Lean 验证结果。

AI模型芯片基础设施AI HOT

用 ComfyUI API 实现 MiniMax-H3 多模态视频与音频生成流水线

教程演示以 ComfyUI 为无头推理后端,构建 MiniMax-H3 视频生成工作流,覆盖模型下载、节点校验与进度监控。

AI产品Agent企业AI HOT

将 GitHub Copilot 置于中间人(MitM)代理之后后,我学到了什么

作者通过 mitmproxy 对 VS Code 中的 GitHub Copilot 进行中间人代理拦截,逆向分析其网络流量与内部架构。

AI模型AgentAI HOT

编写智能体时,哪种编程语言最合适?

作者用 GPT-5.6 Sol 让智能体实现 zstd 解码器进行实测,讨论动态语言与静态语言在智能体编码任务中的差异。

AI消费AI HOT

微信小微AI帮写与AI点评内测:朋友圈最后一点人味正在消失

微信基于小微推出朋友圈 AI 帮写与 AI 点评内测功能,可根据图片和文字生成文案或评论。

AI安全AI HOT

Ryan Greenblatt:人类级AI或于2032年前通过递归自我改进催生失控超级智能

Ryan Greenblatt 探讨递归自我改进可能性、自动化 AI 研发时间线以及超级智能对齐和失控风险。

AI安全AI HOT

Can you trust what AI tells you?

Claude 官方视频讨论 AI 输出可信度、模型回答边界以及用户如何判断 AI 信息质量。