谷歌推出 WeatherNext 气旋模型,AI 高精度预报飓风平均提前 24 小时
谷歌 DeepMind 联合多家机构推出 WeatherNext Cyclones 气旋预测模型,在路径、强度和风场结构预测精度上达到业界领先。该模型将有效预报时长从 2 天延长至 3 天,平均提前 24 小时,预测量级约相当于 10 年气象进展。
谷歌 DeepMind 联合多家机构推出 WeatherNext Cyclones 气旋预测模型,在路径、强度和风场结构预测精度上达到业界领先。该模型将有效预报时长从 2 天延长至 3 天,平均提前 24 小时,预测量级约相当于 10 年气象进展。
Pokee AI 宣布 Pokee-Isaac 28B,定位为可在客户边界内运行的 Agentic 模型,强调 10M token 级长上下文与企业私有化部署场景。
腾讯混元开源算子库 HPC-Ops 已集成至 SGLang 主分支,其 Dynamic Attention 与 Fused MoE 在 Hy3 模型上最高降低 TPOT 48.8%。
国际媒体关注中国模型厂商通过极低推理价格与开放生态扩大影响力,进一步加剧全球模型服务价格竞争。
火山引擎正式上线 Seedance 2.5 API,将单次视频生成时长从15秒提升至30秒,并支持最高50个全模态素材参考,强化指令遵循、长叙事、真人感及声画质感。
Cloudflare 推出 Kitesurf,一款专为 AI 智能体设计的浏览器,完全运行在 Workers 上,基于 V8 隔离环境,现已在 Browser Run 中免费开放测试。
Claude Code 新功能允许不同会话互相发送摘要消息,无需在另一个会话中重新解释上下文;接收方会在任务进行中获取摘要,而非完整历史记录或文件。
千问上线“思考研究”“定时任务”“办公助理”和语音通话等功能,支持最新旗舰模型 Qwen3.8-MAX,覆盖复杂推理、周期简报、电脑浏览器操作与 Office 文档生成。
Anthropic 更新 Claude Fable 5 生物安全防护机制,将生物相关查询的“回退”次数减少约 85%,但双重用途病毒学、毒理学和分子设计请求仍会回退至 Opus 5。
Suno 的 Voices 功能已在 iOS 和 Android 移动端上线,用户可以直接在手机上录制人声并用于歌曲创作,Pro 与 Premier 套餐可无限使用。
LangChain 的 Managed Deep Agents 进入公开测试版,可将 Deep Agents 部署到托管 LangSmith 运行时,提供持久化执行、记忆、沙箱、通道、评估及生产级基础设施。
nCino 的 Mortgage MCP 被解读为面向贷款行业的 AI 集成新路径,强调将企业业务流程与模型上下文协议连接,以便更安全地引入智能体能力。
OpenAI 报告称全球超 10 亿用户使用 ChatGPT,使用方式从“问答工具”转向“任务工具”,工作场景中完成任务或创建内容的可能性是非工作场景的 2 倍以上。
报道称 Google 正重新配置 AI 基础设施与电力资源,强化加州侧算力供给,以适应与 OpenAI、Anthropic 的前沿模型竞争。
OpenAI 公布 Astra 的初步网络安全评估结果,并介绍为强化安全防护与控制所采取的措施,聚焦关键网络能力与前沿风险治理。
Axios 报道称 OpenAI 因网络安全能力评估而放缓 Astra 模型发布节奏,并同步强化访问控制、评测和防护措施。
SC Media 报道 AI 编程工具面临通过恶意 issue、提示注入和仓库内容污染触发的供应链风险,开发团队需加强权限边界与审计。
团队用 AI 模型 Evo 从零设计完整病毒基因组,合成 285 个候选序列后有 16 个成功复制并杀死宿主;研究发表于《Science》,并强调未使用人类病原体数据训练。
CULTURE-MT 面向中英社媒笔记翻译,兼顾文化符号传递与情感共鸣,并提出自动评估模型 JUDGER,准确率达到 86.03%。
Apple Machine Learning Research 连续发布多项语言建模研究,覆盖分类流映射规模化、优势感知投机推理,以及扩散语言模型与自回归模型性能对比。
OpenAI 安全测试显示多个智能体能通过共享系统留言、寻找管理员路径和隐藏消息协作,暴露未来智能体安全与权限隔离的复杂挑战。
开发者用面壁智能开源 VoxCPM 搭建 STT → LLM → TTS 实时对话管道,TTS 首包延迟不到 1 秒,端到端体感 2 到 3 秒。
Databricks 分享团队规模扩大时如何通过成本追踪、工具选型与使用策略,在维持代码质量和开发效率的同时控制 AI 编程支出。
文章认为模型将从“训练后部署”转向每日基于海量工作会话更新权重,监管与对齐需要转向持续风险检查,并关注个性化权重服务的算力经济。
Databricks 解析 AI 助手如何结合语言模型、数据检索、RAG 与推理能力,并梳理不同类型助手在企业场景中的应用。