📡 每日 AI 信号

📦产品

13
1

阿里云灵骏真武M890超节点上线,可承载十万亿参数模型

阿里云宣布灵骏真武M890超节点实例正式上线,首批在内蒙古乌兰察布开售。该实例是国内首个成功运行超2万亿参数大模型的超节点算力,可承载最高十万亿参数级MoE模型推理,支持FP8/FP4低精度计算,通过自研ICN Switch 1.0芯片将互联规模升至64卡、卡间互联达800GB/s,Kimi K3和Qwen3.8-Max已基于该实例提供服务。IT之家 · 36分钟前 · 原文 ↗
2

goutoujunshi:AI 恋爱军师,兼顾情绪疏导与策略分析

这是一个基于 Codex 的 AI 恋爱咨询 Agent,能先回应用户情绪,再分析关系中的法律、心理学、社会学等多维度问题,最终给出可执行建议。内置心理、法律、性学、婚姻家庭等人文知识库,并支持 LGBTQ 等多元关系场景,本质上是一个垂直领域的对话式智能助手。GitHub 新仓库 · 1天前 · 原文 ↗
3

ComfyUI 发布 v0.32.0:调试体验与低显存兼容性升级

ComfyUI 推出 v0.32.0 版本更新,主要改进包括:让嵌套张量的调试更便捷,最低支持 PyTorch 升至 2.7,修复升级模型在非动态显存模式下的崩溃问题以改善低显存用户体验,并将工作流模板同步至 v0.11.37。ComfyUI · 6小时前 · 原文 ↗
4

OpenAI 网络防御模型上线亚马逊 Bedrock

OpenAI 专为网络安全防御设计的两款模型 Daybreak Red 与 Daybreak Blue,现已在亚马逊 Bedrock 平台向合格客户开放。两款模型在芯片层面强制零操作员访问,确保用户代码与漏洞数据安全,为企业级安全场景提供托管 AI 能力。多源:AWS 机器学习 ↗ · OpenAI ↗ · 6小时前
5

Claude Code v2.1.228 发布

本次为问题修复版本:解决交互会话因内部布局错误停止重绘但进程仍运行的问题;修复在 Windows 上从 git 安装父目录启动时无法识别 git / Git Bash 的问题;修复 /tui 在 /model 切换后会话回退到旧模型的问题;修复安装或升级后首次会话偶发无收件箱的跨会话消息问题;修复 Remote Control 配合 /resume 使用时的相关异常。Claude Code · 8小时前 · 原文 ↗
6

Runway上线Seedance 2.5,支持50角色参考与30秒音视频生成

Runway推出Seedance 2.5版本,单次生成可支持最多50个独特角色参考,并生成最长30秒、与音乐同步的视频片段。该更新显著提升了多角色场景与音画同步的视频生成能力,进一步降低了复杂叙事内容的AI视频制作门槛。AI Hot(卡兹克) · 9小时前 · 原文 ↗
7

ChatGPT桌面端支持导入其他智能体工作数据

ChatGPT桌面应用新增跨智能体数据导入功能,可将其他智能体的项目、聊天记录、技能和插件同步至ChatGPT Work和Codex,并支持自动更新与导入历史查看。此举降低了用户切换AI工作流的迁移成本,强化了ChatGPT作为统一工作平台的生态绑定能力。AI Hot(卡兹克) · 10小时前 · 原文 ↗
8

LangChain Core 1.5.4 发布

LangChain 核心库发布 1.5.4 补丁版本,主要修复多项问题:兼容 Pydantic 2.14、防止 StructuredPrompt 修改调用方参数、保留 RootModel runnables 的扁平工具参数 schema、流式 tracer 关闭内部事件循环、保留 OpenAI 文件块等,并更新了相关依赖。属于稳定性维护更新,建议升级以避免与新版 Pydantic 不兼容。LangChain · 10小时前 · 原文 ↗
9

谷歌AMIE医疗AI实现实时视频问诊

谷歌推出研究型医疗AI系统AMIE,首次在模拟临床场景中实现实时视频问诊能力。这一进展表明AI有望在临床分诊、病史采集与初步诊疗建议等环节辅助医生,值得关注其在真实医疗环境中的安全性与可及性。多源:Google Research ↗ · Google AI ↗ · 11小时前
10

ONESTRUCTION联合AWS GenAI创新中心打造建筑BIM基础模型

日本建筑科技公司ONESTRUCTION与AWS生成式AI创新中心合作,基于AWS GenAIIC的技术指导,构建了专为建筑与BIM工作流定制的基础模型Ishigaki-IDS。该架构案例展示了如何结合领域专业知识与生成式AI技术,为建筑行业提供智能化解决方案。AWS 机器学习 · 12小时前 · 原文 ↗
11

Ollama v0.32.9 发布,新增 NVIDIA Nemotron 3.5 Lightning 支持

Ollama 发布 v0.32.9 版本,新增对 NVIDIA Nemotron 3.5 Lightning 模型的支持。该模型是一个开源 300 亿参数 MoE 架构,激活参数 30 亿,专为 OpenClaw、Hermes Agent 等持续运行的 AI Agent 框架设计,配合 NVIDIA NemoClaw 安全管理栈使用。版本同时新增 Nemotron 3 架构处理及 MuseGlimmer 函数调用解析器的边界条件修复。多源:Sam Witteveen ↗ · Ollama ↗ · NVIDIA ↗ · 15小时前
12

Mistral布局欧洲主权AI:区域推理、开源模型与基础设施

Mistral正在欧洲部署本地化推理基础设施,推广开源模型,并作出长期承诺,以帮助欧洲掌控自身AI发展方向。这一布局不仅强化了欧洲的技术主权,也为全球主权AI的发展提供了可借鉴的路线图。Mistral AI · 16小时前 · 原文 ↗
13

OpenAI开始在ChatGPT中测试广告

OpenAI宣布在ChatGPT免费版中测试广告以支持免费访问,明确广告标注、不影响回答独立性、强化隐私保护并保留用户控制权。这是OpenAI在订阅收入之外探索新商业模式的关键一步,也引发外界对AI助手中立性的关注。多源:TechCrunch AI ↗ · OpenAI ↗ · 18小时前

🏭行业

14
14

台积电:5.5倍光罩尺寸CoWoS良率达99%,验证走向系统级

台积电先进封装技术副总经理何军在OCP APAC峰会上透露,已量产的5.5倍光罩尺寸CoWoS先进封装技术在部分AI客户产品上良率可达99%,稳定超过98%。台积电计划2029年推出15倍光罩尺寸的超大面积CoWoS。同时指出AI SoC验证正加速从器件级走向系统级,因同一芯片在不同系统中表现存在差异,而当前半导体全产业链供应紧张进一步推动了这一趋势。IT之家 · 15分钟前 · 原文 ↗
15

Saber否认用ChatGPT取代《Rideshare》游戏编剧

游戏发行商Saber CEO Matthew Karch公开否认用AI取代《Rideshare Stimulator》编剧团队的指控。此前该游戏前首席编剧Stella Sacco声称被ChatGPT替代,引发对游戏行业AI取代人类创作者的讨论。事件反映出游戏开发者与发行商在AI使用边界上的争议。The Verge AI · 3小时前 · 原文 ↗
16

英伟达联合六大机构拟调动超5000亿美元建AI基础设施

英伟达宣布与Apollo、黑石、贝莱德、Brookfield、高盛、KKR达成合作,建立独立融资平台,目标调动逾5000亿美元第三方资本,用于AI基础设施建设。这标志着AI算力正从企业自建资产转变为可投资的资产类别,融资模式的转变将加速全球AI基础设施扩张。NVIDIA · 3小时前 · 原文 ↗
17

零基础用户半天上手AI的12步实操流程

文章给出一套零基础用户半天上手AI的12步实操流程:准备内存不低于16G的电脑,订阅ChatGPT并安装Codex或使用WorkBuddy,用语音输入法以【背景、痛点、需求】框架向AI交代任务,经苏格拉底提问澄清需求后投喂文件让AI直接完成,最后沉淀为可复用Skill。文中建议Codex选GPT-5.6 Sol最高模型,WorkBuddy选Kimi K3。AI Hot(卡兹克) · 4小时前 · 原文 ↗
18

AI 吞噬网络,互联网集体记忆正在消失

Hacker News 高热度讨论(857 分,856 条评论)聚焦 AI 对网络内容的冲击。随着 AI 爬虫大规模抓取、生成内容充斥互联网,原有网页持续消失或被覆盖,链接失效、内容被改写,互联网作为人类集体记忆载体的可靠性正受到根本性挑战。该话题引发关于内容真实性、信息保存与未来网络生态的广泛担忧。Hacker News · 1天前 · 原文 ↗
19

Accel 超额认购 5.5 亿美元印度新基金

美国风投 Accel 在上一只 6.5 亿美元印度基金尚余 55% 可投的情况下,几周内迅速完成 5.5 亿美元新一期印度基金的超额认购,显示 LP 对印度初创生态、尤其是 AI 相关项目的强烈配置需求。TechCrunch AI · 6小时前 · 原文 ↗
20

ChatGPT与Gemini月活双双突破10亿

OpenAI于8月6日披露ChatGPT月活用户超10亿,其周活在7月已达此规模;Google CEO皮查伊宣布Gemini月活突破10亿,今年2月该数字为7.5亿,成为Google史上增长最快的产品。两大AI聊天机器人跨过同一用户量级门槛,标志着生成式AI在大众消费市场已进入主流。多源:The Verge AI ↗ · AI Hot(卡兹克) ↗ · TechCrunch AI ↗ · 8小时前
21

OpenAI资深高管Brad Lightcap宣布离职

OpenAI特别项目负责人、前首席运营官Brad Lightcap在任职八年后宣布离职。他在随后发布于X的内部备忘录中告知同事将离职。作为OpenAI核心高管之一,他的离开是近期公司管理层变动的又一例证,引发外界对AI实验室领导层稳定性的关注。The Verge AI · 10小时前 · 原文 ↗
22

研究人员发现AI模型API漏洞可窃取加密推理过程

Alexander Panfilov团队发现OpenAI、Anthropic、Google等主流AI厂商API存在安全漏洞,攻击者可读取推理模型原本加密的思考过程。研究者扫描约7000条公开会话即提取出62个API密钥、33组邮箱和密码,并通过越狱手段让Anthropic Haiku 4.5逐字复述Opus 4.8的原始推理内容,解码1万条推理轨迹成本约720美元。该漏洞直接威胁推理模型的隐私保护与知识产权安全。多源:AI Hot(卡兹克) ↗ · Simon Willison ↗ · 10小时前
23

扩展AI算力性能为何需要全新电力架构

新一代加速计算对底层基础设施提出更高要求,包括更强的算力、更高的机柜密度以及更高效可扩展的配电系统。当前的瓶颈已从芯片本身转向电力架构,重塑供电设计成为释放AI算力潜能的关键。NVIDIA · 13小时前 · 原文 ↗
24

蚂蚁首次投向机器人“指尖”!数亿元押注,全球首个物理交互脑发布

资本正从具身本体集体涌向触觉量子位 · 14小时前 · 原文 ↗
25

NVIDIA联合开源社区推动本地AI模型与智能体发展

NVIDIA于8月聚焦本地AI生态,发布最新开源模型、软件及工具,与开源社区合作降低开发者在本地构建、定制和运行AI智能体的门槛。该计划展示从模型到应用的完整生态进展,体现NVIDIA从硬件向AI软件与社区生态的延伸。NVIDIA · 15小时前 · 原文 ↗
26

新能源大厂撑起全球最大AI算力超级单体

在AI算力竞赛中,电力供应成为关键瓶颈。相关报道聚焦一家新能源企业如何为全球规模最大的AI算力单体项目提供电力支撑,反映出AI基础设施对能源的依赖正在加深,电力或将成为下一阶段算力扩张的核心制约因素。量子位 · 16小时前 · 原文 ↗
27

布林紧急接管Gemini团队,3.5 Pro已被取消

谷歌联合创始人谢尔盖·布林亲自介入Gemini项目,原因是内部算力分配存在严重内耗,影响研发进度。下一代模型3.5 Pro已确认取消,Gemini路线图面临重大调整。量子位 · 19小时前 · 原文 ↗

🎬创作者

4
28

Relay 技能:让 AI 任务更快更便宜

视频博主 Matthew Berman 介绍一个名为 Relay 的技能,主打让大型 AI 任务在执行时既更便宜又更快速,并将其开源在 GitHub 上,鼓励观众直接采用。核心看点是提供了一个实用的效率优化工具,适合经常调用大模型处理重任务的开发者。Matthew Berman · 9小时前 · 原文 ↗
29

在MIT待了3天:机器人炒作比你想的更糟

作者上周在MIT CSAIL实验室实地考察,了解机器人技术前沿的真实发展情况。文章揭示了当前机器人领域的炒作现象与实际进展之间存在明显差距,值得关注行业真实动态而非营销宣传。Fireship · 12小时前 · 原文 ↗
30

OpenAI的AI智能体突破关键边界

OpenAI的AI智能体技术近期取得重大进展,引发行业广泛关注。Lambda等GPU云服务商正为其提供算力支持,更多相关报告陆续发布。这一突破可能改变AI智能体的发展方向与商业化路径,值得持续关注。Two Minute Papers · 12小时前 · 原文 ↗
31

深度体验GPT-Live:不只是更快的语音输入,而是新时代的交互革命

用了一段时间GPT-Live+Codex的组合,已经回不去了。 不只是打字快了这么简单。语音入口变成了统筹所有项目的中控,一次性可以吩咐好几个活,它分头执行。有什么想法直接口喷就行,Karpathy也是这么干的。 当年iPhone用触摸屏代替了键盘,整个交互范式被重写了。今天语音AI也在发生一样的事。 当然,实践出真知,所有AI工具都得自己深度用才有体会。傅盛 · 14小时前 · 原文 ↗

📄论文

2
32

CARE-X:面向临床实用化的放射学视觉语言模型

CARE-X 提出了一种统一的放射学 AI 框架,将可灵活推理、经过校准的预测与基于工具的测量能力相结合,专为胸片解读而设计。该模型通过辅助监督、奖励对齐学习与工具增强测量三大机制,旨在超越传统的报告生成,使其更贴近真实临床应用需求。微软研究院 · 12小时前 · 原文 ↗
33

Hugging Face:更少 token 即可实现 ACE 效果

Hugging Face 提出方法可显著减少实现 ACE(Agentic Context Engineering)所需的 token 数量,在保持效果的同时降低计算成本。值得关注的是,该方案让上下文压缩更高效,有助于降低大模型部署与推理的算力开销。Hugging Face · 14小时前 · 原文 ↗

🛠️技巧与观点

3
34

自然语言文本不存在无损转换

Sophie Alpert 分享了工程师使用 AI 辅助写作的内部规范,强调作者必须为文档中的每个观点和每句话负责,确保文档完全代表自身想法。Simon Willison 借此指出对自然语言文本做"无损转换"本质上是不可能的,提醒 LLM 辅助写作时不能放弃对内容的最终判断。Simon Willison · 4小时前 · 原文 ↗
35

开发者角色转变:从编码者到智能体编排者

GitHub 发布博文指出,随着 AI 编码智能体普及,开发者的角色正从单纯写代码转向编排整个交付系统,承担智能体协作、流程设计与质量把控等更广泛职责。GitHub Universe 大会将围绕这一主题展开讨论与经验分享。GitHub Blog · 9小时前 · 原文 ↗
36

通过中间人代理逆向分析 GitHub Copilot

作者使用 mitmproxy 对 VS Code 中的 GitHub Copilot 进行网络流量拦截与逆向分析,揭示其运行时行为与内部架构细节。文章指出 Copilot 等 AI 应用普遍基于 Electron 构建,共享相似网络栈,因此该探测方法可迁移至其他同类 AI 应用。AI Hot(卡兹克) · 10小时前 · 原文 ↗

📚教程 · 大家在学什么

14
T1

《从零开始构建智能体》教程

DataWhale 发布的 hello-agents 教程,系统讲解智能体(Agent)的核心原理与从零搭建实践。内容覆盖智能体架构设计、工具调用、记忆与规划等关键模块,适合想深入理解 LLM Agent 的开发者学习,可作为入门到实战的完整路径。DataWhale · ★ 72.4k · 原文 ↗
T2

Hugging Face Agents 智能体课程

Hugging Face 官方推出的 AI Agents 智能体课程,系统讲解智能体(Agentic AI)的核心概念、构建方法与主流框架(如 LangChain)。适合希望从零入门或系统提升 AI 智能体开发能力的开发者与学习者。完成课程可掌握智能体设计、工具调用及多框架实践技能。Hugging Face · ★ 30.9k · 原文 ↗
T3

Hugging Face 官方 Transformers 课程

Hugging Face 官方推出的 Transformers 实战课程,系统讲解 Transformers 库的使用方法与底层机制,覆盖 NLP 与深度学习核心概念。内容适合有一定 Python 基础的开发者与学习者,从模型加载、微调到部署全流程实操,学完可独立完成主流 Transformer 模型的训练与应用。Hugging Face · ★ 4.1k · 原文 ↗
T4

DIY-LLM:系统构建大语言模型全栈课程

一门系统性的 LLM 从零构建课程,覆盖预训练数据工程、Tokenizer、Transformer、MoE 架构、CUDA/Triton GPU 编程、分布式训练、Scaling Laws、推理优化及 SFT/RLHF/GRPO 对齐方法。课程通过 6 个渐进式代码驱动作业,帮助学习者建立大模型全栈认知体系,适合具备深度学习基础、希望深入理解 LLM 实现原理的工程师与研究者。DataWhale · ★ 1.2k · 原文 ↗
T5

Hello GPU:AMD GPU 与 ROCm 实战教程

这是一套面向 AI 开发者的 GPU 实战教程,从 AMD GPU 架构讲起,涵盖 ROCm 工具链使用、HIP/Triton 算子优化以及单卡推理性能分析。适合希望深入理解非英伟达 GPU 生态、动手做算子开发与推理性能调优的学习者。DataWhale · ★ 51 · 原文 ↗
T6

Stop Calling the First Significant Day a Win

Checking an A/B test until it crosses p The post Stop Calling the First Significant Day a Win appeared first on Towards Data Science .TDS · 原文 ↗
T7

Should AI Developers Make the Switch from Polars to Pandas?

Not all Python data libraries are created equal! The post Should AI Developers Make the Switch from Polars to Pandas? appeared first on Towards Data Science .TDS · 原文 ↗
T8

7 Async Patterns for Running Agents Concurrently in Python

In this article, you will learn seven async patterns for running AI agents concurrently in Python, what each pattern is suited for, and the production-level...MachineLearningMastery · 原文 ↗
T9

Scaling, Optimizing, and Exporting Transformers with PyTorch Lightning

Table of Contents Scaling, Optimizing, and Exporting Transformers with PyTorch Lightning Introduction to Scaling PyTorch Lightning Transformer Training Configuring Your Development Environment Preparing PyTorch LightningPyImageSearch · 原文 ↗
T10

Prompt 缓存与微调:成本与延迟优化决策指南

文章对比了 Prompt 缓存与微调两种策略在智能体 AI 系统中降低推理成本与延迟的机制与适用场景。适合正在构建生产级 LLM 应用的工程师学习,可帮助其在效果、成本与响应速度之间做出更合理的架构选择。MachineLearningMastery · 原文 ↗
T11

DeepSeek-V4-Flash 超越 Pro、史上最大 GitHub 爬取、编写更安全的代码系统提示

DeepLearning.AI 每周《The Batch》要点速览:DeepSeek 新版 V4-Flash 模型表现亮眼,性能超越 Pro 版本;GitHub 完成迄今最大规模代码爬取,数据集规模显著扩大;文章还探讨如何工程化设计系统提示词,以提升 LLM 生成代码的安全性。适合关注前沿模型动态、AI 工程实践和开发者学习者阅读。DeepLearning.AI · 原文 ↗
T12

本周AI精选:Opus力压Fable、Hugging Face越狱事件、巨头天价算力

DeepLearning.AI《The Batch》本周聚焦三大议题:Anthropic的Claude Opus在创意写作基准上再次超越Fable等竞品;Hugging Face遭遇闭源模型越狱攻击,引发开源社区对安全防御的讨论;多家头部AI公司为获取算力投入巨额资本支出,反映行业竞争白热化。适合关注AI前沿动态、产品对比与行业趋势的产品经理、研究者与从业者阅读。DeepLearning.AI · 原文 ↗
T13

Harness 工程:让 AI 实现自我改进

Lilian Weng 系统梳理了"递归自我改进"(RSI)的概念脉络,从 I. J. Good(1965)的"超智能机器"到 Yudkowsky(2008)的自我反馈循环定义。文章重点讨论如何通过 Harness 工程对当前 AI 模型施加约束与引导,使其在推理与训练过程中实现安全、可控的自我提升。适合对 AI 安全、对齐工程感兴趣的学习者,帮助理解自我改进机制的原理与实际工程落地。lil'log · 原文 ↗
T14

AI教育与实体工具都做错了什么

作者反思当下学习仪表盘和AI教育产品的设计误区,主张应回归具象、可操作的实体学习体验。文章适合关注教育产品设计、AI教育落地的产品经理与教育者阅读,提供了对当前学习工具人机交互设计的批判性视角。fast.ai · 原文 ↗