📡 每日 AI 信号

📦产品

15
1

LTX-2.5模型登场:10秒720P视频生成仅需6.8秒

LTX推出LTX-2.5视频生成模型,原生集成ComfyUI,在2张英伟达GB200配置下生成10秒720P视频仅需6.8秒。其Fast版本生成带音频720P视频每秒成本约0.09美元,10秒片段约0.9美元;ARR低于1000万美元的组织可免费使用。该模型以显著的速度与成本优势降低视频生成门槛。AI Hot(卡兹克) · 3小时前 · 原文 ↗
2

Mojo 语言正式发布 1.0:提供稳定生产环境基础

Modular 开发的 Mojo 编程语言正式发布 1.0 版本,提供稳定且可用于生产环境的语言基础。自 2023 年首次发布以来,Mojo 已发展为通用语言,自开源标准库后近 200 名贡献者合入超 1,100 个 PR、修改超 20 万行代码。作为面向 AI 硬件的高性能语言,1.0 版本为生态扩展和后续开发奠定了关键基础。AI Hot(卡兹克) · 14小时前 · 原文 ↗
3

阿里云灵骏真武M890超节点上线,可承载十万亿参数模型

阿里云宣布灵骏真武M890超节点实例正式上线,首批在内蒙古乌兰察布开售。该实例是国内首个成功运行超2万亿参数大模型的超节点算力,可承载最高十万亿参数级MoE模型推理,支持FP8/FP4低精度计算,通过自研ICN Switch 1.0芯片将互联规模升至64卡、卡间互联达800GB/s,Kimi K3和Qwen3.8-Max已基于该实例提供服务。IT之家 · 7小时前 · 原文 ↗
4

goutoujunshi:AI 恋爱军师,兼顾情绪疏导与策略分析

这是一个基于 Codex 的 AI 恋爱咨询 Agent,能先回应用户情绪,再分析关系中的法律、心理学、社会学等多维度问题,最终给出可执行建议。内置心理、法律、性学、婚姻家庭等人文知识库,并支持 LGBTQ 等多元关系场景,本质上是一个垂直领域的对话式智能助手。GitHub 新仓库 · 1天前 · 原文 ↗
5

ComfyUI 发布 v0.32.0:调试体验与低显存兼容性升级

ComfyUI 推出 v0.32.0 版本更新,主要改进包括:让嵌套张量的调试更便捷,最低支持 PyTorch 升至 2.7,修复升级模型在非动态显存模式下的崩溃问题以改善低显存用户体验,并将工作流模板同步至 v0.11.37。ComfyUI · 12小时前 · 原文 ↗
6

OpenAI 网络防御模型上线亚马逊 Bedrock

OpenAI 专为网络安全防御设计的两款模型 Daybreak Red 与 Daybreak Blue,现已在亚马逊 Bedrock 平台向合格客户开放。两款模型在芯片层面强制零操作员访问,确保用户代码与漏洞数据安全,为企业级安全场景提供托管 AI 能力。多源:AWS 机器学习 ↗ · OpenAI ↗ · 12小时前
7

Claude Code v2.1.228 发布

本次为问题修复版本:解决交互会话因内部布局错误停止重绘但进程仍运行的问题;修复在 Windows 上从 git 安装父目录启动时无法识别 git / Git Bash 的问题;修复 /tui 在 /model 切换后会话回退到旧模型的问题;修复安装或升级后首次会话偶发无收件箱的跨会话消息问题;修复 Remote Control 配合 /resume 使用时的相关异常。Claude Code · 14小时前 · 原文 ↗
8

Runway上线Seedance 2.5,支持50角色参考与30秒音视频生成

Runway推出Seedance 2.5版本,单次生成可支持最多50个独特角色参考,并生成最长30秒、与音乐同步的视频片段。该更新显著提升了多角色场景与音画同步的视频生成能力,进一步降低了复杂叙事内容的AI视频制作门槛。AI Hot(卡兹克) · 15小时前 · 原文 ↗
9

ChatGPT桌面端支持导入其他智能体工作数据

ChatGPT桌面应用新增跨智能体数据导入功能,可将其他智能体的项目、聊天记录、技能和插件同步至ChatGPT Work和Codex,并支持自动更新与导入历史查看。此举降低了用户切换AI工作流的迁移成本,强化了ChatGPT作为统一工作平台的生态绑定能力。AI Hot(卡兹克) · 16小时前 · 原文 ↗
10

LangChain Core 1.5.4 发布

LangChain 核心库发布 1.5.4 补丁版本,主要修复多项问题:兼容 Pydantic 2.14、防止 StructuredPrompt 修改调用方参数、保留 RootModel runnables 的扁平工具参数 schema、流式 tracer 关闭内部事件循环、保留 OpenAI 文件块等,并更新了相关依赖。属于稳定性维护更新,建议升级以避免与新版 Pydantic 不兼容。LangChain · 16小时前 · 原文 ↗
11

谷歌AMIE医疗AI实现实时视频问诊

谷歌推出研究型医疗AI系统AMIE,首次在模拟临床场景中实现实时视频问诊能力。这一进展表明AI有望在临床分诊、病史采集与初步诊疗建议等环节辅助医生,值得关注其在真实医疗环境中的安全性与可及性。多源:Google Research ↗ · Google AI ↗ · 17小时前
12

ONESTRUCTION联合AWS GenAI创新中心打造建筑BIM基础模型

日本建筑科技公司ONESTRUCTION与AWS生成式AI创新中心合作,基于AWS GenAIIC的技术指导,构建了专为建筑与BIM工作流定制的基础模型Ishigaki-IDS。该架构案例展示了如何结合领域专业知识与生成式AI技术,为建筑行业提供智能化解决方案。AWS 机器学习 · 18小时前 · 原文 ↗
13

Ollama v0.32.9 发布,新增 NVIDIA Nemotron 3.5 Lightning 支持

Ollama 发布 v0.32.9 版本,新增对 NVIDIA Nemotron 3.5 Lightning 模型的支持。该模型是一个开源 300 亿参数 MoE 架构,激活参数 30 亿,专为 OpenClaw、Hermes Agent 等持续运行的 AI Agent 框架设计,配合 NVIDIA NemoClaw 安全管理栈使用。版本同时新增 Nemotron 3 架构处理及 MuseGlimmer 函数调用解析器的边界条件修复。多源:Sam Witteveen ↗ · Ollama ↗ · NVIDIA ↗ · 21小时前
14

Mistral布局欧洲主权AI:区域推理、开源模型与基础设施

Mistral正在欧洲部署本地化推理基础设施,推广开源模型,并作出长期承诺,以帮助欧洲掌控自身AI发展方向。这一布局不仅强化了欧洲的技术主权,也为全球主权AI的发展提供了可借鉴的路线图。Mistral AI · 22小时前 · 原文 ↗
15

OpenAI开始在ChatGPT中测试广告

OpenAI宣布在ChatGPT免费版中测试广告以支持免费访问,明确广告标注、不影响回答独立性、强化隐私保护并保留用户控制权。这是OpenAI在订阅收入之外探索新商业模式的关键一步,也引发外界对AI助手中立性的关注。多源:TechCrunch AI ↗ · OpenAI ↗ · 1天前

🏭行业

19
16

vivo OriginOS 7 系统 Beta 版开推,「视频剪辑导出流畅」特性首曝

IT之家 8 月 12 日消息, OriginOS 7 系统已于今年 7 月底开启了 Beta 内测招募 ,首批适配 vivo X300 Pro 、 vivo X Fold6 、 iQOO 15 等机型。 IT之家注意到,vivo OS 产品总监 @vivo百奇Bucky 今日发文分享, OriginOS 7 系统 Beta 版已经陆续推送 。他还首曝了新系统的「视频剪辑导出流畅」新特性。 日常视频创作中,导出时的等待一直是影响创作效率IT之家 · 53分钟前 · 原文 ↗
17

宇树科技人形机器人累计下线约1.8万台

宇树科技宣布旗下仿生双足人形机器人累计下线约18000台,5月至8月增加约7000台,月产量显著提升。2025年宇树人形机器人出货量超5500台位居全球第一,2026年上半年出货约5900台占全球31%市场份额。宇树已获科创板注册,发行价150.80元/股,预计上半年营收10.52亿至11.28亿元,同比增长超35%。IT之家 · 55分钟前 · 原文 ↗
18

Research Gold 号称"100%人类撰写、绝不使用AI",实则全程由AI驱动

面向医学研究者的网站 Research Gold 宣称其服务"100%由人类撰写、绝不使用AI",并列出多名博士审稿人。但调查发现,这些审稿人系AI生成、并不存在;部分真实方法学家的身份和照片未经许可被挪用。致电该公司时,自称"Sarah"的AI助手坚称自己是真人,邮件与聊天回复也均为AI生成。AI Hot(卡兹克) · 4小时前 · 原文 ↗
19

擎羽探索跨本体基础智能,让机器人身体成为新变量

具身智能公司擎羽跳出人形机器人单一形态,从柔性本体出发,推动跨本体基础智能研究,使任务执行与世界知识可在不同身体结构间延续。这一方向试图解决具身智能受限于特定硬件的问题,是具身智能走向通用的关键一步。量子位 · 6小时前 · 原文 ↗
20

Manus恢复独立运营,完成复活

Manus在经历一系列风波后正式恢复独立运营,团队重新掌握产品与业务主导权。此前Manus曾因与投资方或合作方的分歧陷入停摆,恢复独立意味着其AI Agent产品线与商业化路径将回到创始团队掌控之下,后续产品节奏值得关注。量子位 · 7小时前 · 原文 ↗
21

台积电:5.5倍光罩尺寸CoWoS良率达99%,验证走向系统级

台积电先进封装技术副总经理何军在OCP APAC峰会上透露,已量产的5.5倍光罩尺寸CoWoS先进封装技术在部分AI客户产品上良率可达99%,稳定超过98%。台积电计划2029年推出15倍光罩尺寸的超大面积CoWoS。同时指出AI SoC验证正加速从器件级走向系统级,因同一芯片在不同系统中表现存在差异,而当前半导体全产业链供应紧张进一步推动了这一趋势。IT之家 · 6小时前 · 原文 ↗
22

Saber否认用ChatGPT取代《Rideshare》游戏编剧

游戏发行商Saber CEO Matthew Karch公开否认用AI取代《Rideshare Stimulator》编剧团队的指控。此前该游戏前首席编剧Stella Sacco声称被ChatGPT替代,引发对游戏行业AI取代人类创作者的讨论。事件反映出游戏开发者与发行商在AI使用边界上的争议。The Verge AI · 9小时前 · 原文 ↗
23

英伟达联合六大机构拟调动超5000亿美元建AI基础设施

英伟达宣布与Apollo、黑石、贝莱德、Brookfield、高盛、KKR达成合作,建立独立融资平台,目标调动逾5000亿美元第三方资本,用于AI基础设施建设。这标志着AI算力正从企业自建资产转变为可投资的资产类别,融资模式的转变将加速全球AI基础设施扩张。NVIDIA · 9小时前 · 原文 ↗
24

零基础用户半天上手AI的12步实操流程

文章给出一套零基础用户半天上手AI的12步实操流程:准备内存不低于16G的电脑,订阅ChatGPT并安装Codex或使用WorkBuddy,用语音输入法以【背景、痛点、需求】框架向AI交代任务,经苏格拉底提问澄清需求后投喂文件让AI直接完成,最后沉淀为可复用Skill。文中建议Codex选GPT-5.6 Sol最高模型,WorkBuddy选Kimi K3。AI Hot(卡兹克) · 10小时前 · 原文 ↗
25

AI 吞噬网络,互联网集体记忆正在消失

Hacker News 高热度讨论(857 分,856 条评论)聚焦 AI 对网络内容的冲击。随着 AI 爬虫大规模抓取、生成内容充斥互联网,原有网页持续消失或被覆盖,链接失效、内容被改写,互联网作为人类集体记忆载体的可靠性正受到根本性挑战。该话题引发关于内容真实性、信息保存与未来网络生态的广泛担忧。Hacker News · 1天前 · 原文 ↗
26

Accel 超额认购 5.5 亿美元印度新基金

美国风投 Accel 在上一只 6.5 亿美元印度基金尚余 55% 可投的情况下,几周内迅速完成 5.5 亿美元新一期印度基金的超额认购,显示 LP 对印度初创生态、尤其是 AI 相关项目的强烈配置需求。TechCrunch AI · 12小时前 · 原文 ↗
27

ChatGPT与Gemini月活双双突破10亿

OpenAI于8月6日披露ChatGPT月活用户超10亿,其周活在7月已达此规模;Google CEO皮查伊宣布Gemini月活突破10亿,今年2月该数字为7.5亿,成为Google史上增长最快的产品。两大AI聊天机器人跨过同一用户量级门槛,标志着生成式AI在大众消费市场已进入主流。多源:The Verge AI ↗ · AI Hot(卡兹克) ↗ · TechCrunch AI ↗ · 14小时前
28

OpenAI资深高管Brad Lightcap宣布离职

OpenAI特别项目负责人、前首席运营官Brad Lightcap在任职八年后宣布离职。他在随后发布于X的内部备忘录中告知同事将离职。作为OpenAI核心高管之一,他的离开是近期公司管理层变动的又一例证,引发外界对AI实验室领导层稳定性的关注。The Verge AI · 16小时前 · 原文 ↗
30

扩展AI算力性能为何需要全新电力架构

新一代加速计算对底层基础设施提出更高要求,包括更强的算力、更高的机柜密度以及更高效可扩展的配电系统。当前的瓶颈已从芯片本身转向电力架构,重塑供电设计成为释放AI算力潜能的关键。NVIDIA · 19小时前 · 原文 ↗
31

蚂蚁首次投向机器人“指尖”!数亿元押注,全球首个物理交互脑发布

资本正从具身本体集体涌向触觉量子位 · 20小时前 · 原文 ↗
32

NVIDIA联合开源社区推动本地AI模型与智能体发展

NVIDIA于8月聚焦本地AI生态,发布最新开源模型、软件及工具,与开源社区合作降低开发者在本地构建、定制和运行AI智能体的门槛。该计划展示从模型到应用的完整生态进展,体现NVIDIA从硬件向AI软件与社区生态的延伸。NVIDIA · 21小时前 · 原文 ↗
33

新能源大厂撑起全球最大AI算力超级单体

在AI算力竞赛中,电力供应成为关键瓶颈。相关报道聚焦一家新能源企业如何为全球规模最大的AI算力单体项目提供电力支撑,反映出AI基础设施对能源的依赖正在加深,电力或将成为下一阶段算力扩张的核心制约因素。量子位 · 22小时前 · 原文 ↗
34

布林紧急接管Gemini团队,3.5 Pro已被取消

谷歌联合创始人谢尔盖·布林亲自介入Gemini项目,原因是内部算力分配存在严重内耗,影响研发进度。下一代模型3.5 Pro已确认取消,Gemini路线图面临重大调整。量子位 · 1天前 · 原文 ↗

🎬创作者

4
35

Relay 技能:让 AI 任务更快更便宜

视频博主 Matthew Berman 介绍一个名为 Relay 的技能,主打让大型 AI 任务在执行时既更便宜又更快速,并将其开源在 GitHub 上,鼓励观众直接采用。核心看点是提供了一个实用的效率优化工具,适合经常调用大模型处理重任务的开发者。Matthew Berman · 15小时前 · 原文 ↗
36

在MIT待了3天:机器人炒作比你想的更糟

作者上周在MIT CSAIL实验室实地考察,了解机器人技术前沿的真实发展情况。文章揭示了当前机器人领域的炒作现象与实际进展之间存在明显差距,值得关注行业真实动态而非营销宣传。Fireship · 18小时前 · 原文 ↗
37

OpenAI的AI智能体突破关键边界

OpenAI的AI智能体技术近期取得重大进展,引发行业广泛关注。Lambda等GPU云服务商正为其提供算力支持,更多相关报告陆续发布。这一突破可能改变AI智能体的发展方向与商业化路径,值得持续关注。Two Minute Papers · 18小时前 · 原文 ↗
38

深度体验GPT-Live:不只是更快的语音输入,而是新时代的交互革命

用了一段时间GPT-Live+Codex的组合,已经回不去了。 不只是打字快了这么简单。语音入口变成了统筹所有项目的中控,一次性可以吩咐好几个活,它分头执行。有什么想法直接口喷就行,Karpathy也是这么干的。 当年iPhone用触摸屏代替了键盘,整个交互范式被重写了。今天语音AI也在发生一样的事。 当然,实践出真知,所有AI工具都得自己深度用才有体会。傅盛 · 20小时前 · 原文 ↗

📄论文

2
39

CARE-X:面向临床实用化的放射学视觉语言模型

CARE-X 提出了一种统一的放射学 AI 框架,将可灵活推理、经过校准的预测与基于工具的测量能力相结合,专为胸片解读而设计。该模型通过辅助监督、奖励对齐学习与工具增强测量三大机制,旨在超越传统的报告生成,使其更贴近真实临床应用需求。微软研究院 · 18小时前 · 原文 ↗
40

Hugging Face:更少 token 即可实现 ACE 效果

Hugging Face 提出方法可显著减少实现 ACE(Agentic Context Engineering)所需的 token 数量,在保持效果的同时降低计算成本。值得关注的是,该方案让上下文压缩更高效,有助于降低大模型部署与推理的算力开销。Hugging Face · 20小时前 · 原文 ↗

🛠️技巧与观点

4
41

专家警告医学生过度依赖AI:可能从未学会诊疗推理

斯坦福医学院学生与约翰斯·霍普金斯创伤外科医生在《卫报》撰文指出,医学生过度使用AI可能从一开始就无法形成诊疗推理能力,比单纯技能退化更危险。报道同时披露,美国约三分之二医生已在使用临床AI工具OpenEvidence,而《Nature Medicine》一项研究发现,医疗专用大语言模型的可靠性反而不如ChatGPT和Claude等通用聊天机器人。IT之家 · 27分钟前 · 原文 ↗
42

自然语言文本不存在无损转换

Sophie Alpert 分享了工程师使用 AI 辅助写作的内部规范,强调作者必须为文档中的每个观点和每句话负责,确保文档完全代表自身想法。Simon Willison 借此指出对自然语言文本做"无损转换"本质上是不可能的,提醒 LLM 辅助写作时不能放弃对内容的最终判断。Simon Willison · 10小时前 · 原文 ↗
43

开发者角色转变:从编码者到智能体编排者

GitHub 发布博文指出,随着 AI 编码智能体普及,开发者的角色正从单纯写代码转向编排整个交付系统,承担智能体协作、流程设计与质量把控等更广泛职责。GitHub Universe 大会将围绕这一主题展开讨论与经验分享。GitHub Blog · 15小时前 · 原文 ↗
44

通过中间人代理逆向分析 GitHub Copilot

作者使用 mitmproxy 对 VS Code 中的 GitHub Copilot 进行网络流量拦截与逆向分析,揭示其运行时行为与内部架构细节。文章指出 Copilot 等 AI 应用普遍基于 Electron 构建,共享相似网络栈,因此该探测方法可迁移至其他同类 AI 应用。AI Hot(卡兹克) · 16小时前 · 原文 ↗

📚教程 · 大家在学什么

14
T1

从零开始构建智能体教程

DataWhale 开源的《hello-agents》智能体教程,系统讲解智能体(Agent)原理与实践。内容从零起步,覆盖智能体核心概念、架构设计与实战开发,适合 AI 学习者入门并掌握构建自主智能体的关键技能。DataWhale · ★ 72.5k · 原文 ↗
T2

Hugging Face Agent 智能体课程

Hugging Face 官方推出的 Agent 智能体系统学习课程,覆盖 agentic AI 与智能体构建核心概念,使用 LangChain 等工具进行实战。适合想入门 AI Agent 开发的工程师与学习者,可掌握智能体设计、工具调用与多步骤任务编排等技能。Hugging Face · ★ 30.9k · 原文 ↗
T3

vibe coding 入门:AI 原生产品构建者首课

这是一个面向 AI 原生产品构建者的入门教程,聚焦「vibe coding」这一新兴编程范式。课程适合希望借助 AI 进行产品开发的初学者,帮助他们掌握如何利用 AI 辅助完成从想法到产品的全流程。DataWhale · ★ 18.9k · 原文 ↗
T4

Hugging Face Transformers 官方课程

Hugging Face 官方推出的 Transformers 课程,系统讲解如何使用 transformers、datasets、tokenizers 等核心库进行 NLP 与深度学习任务。内容涵盖预训练模型加载、微调、训练循环与部署,适合有 Python 基础的开发者入门并进阶大模型应用开发。学完后可掌握基于开源生态构建、训练和发布 AI 模型的全流程。Hugging Face · ★ 4.1k · 原文 ↗
T5

Hello GPU:AMD GPU与ROCm实战教程

本教程从 AMD GPU 架构讲起,系统介绍 ROCm 工具链、HIP 与 Triton 算子开发方法,并结合单卡推理性能分析给出实战指导。适合想深入了解非英伟达 GPU 生态、进行算子优化与推理性能调优的 AI 工程师和研究者学习。DataWhale · ★ 52 · 原文 ↗
T6

别把首次显著日当作A/B测试胜利

这篇文章指出,在A/B测试中过早停止实验(首次p值显著即宣告胜出)会导致统计结论不可靠。它讲解了序贯检验中"偷看数据"带来的假阳性膨胀问题,并给出合适的样本量与检验周期建议。适合做产品实验、数据驱动决策的分析师与产品经理阅读。TDS · 原文 ↗
T7

AI开发者该从Polars切回Pandas吗?

对比Python两大数据处理库Polars与Pandas的取舍:从性能、API设计、生态成熟度等维度分析,探讨AI开发者在不同场景下如何选择。适合数据科学和机器学习从业者参考,帮助根据项目需求决定数据栈选型。TDS · 原文 ↗
T8

Python中并发运行Agent的7种异步模式

教程系统讲解在Python中并发运行AI Agent的7种异步模式,涵盖每种模式的适用情境及生产级考量。学习后可掌握如何为多Agent系统选择合适的异步并发策略,提升Agent协作效率与吞吐量。适合正在搭建多Agent应用的中高级Python开发者。MachineLearningMastery · 原文 ↗
T9

用 PyTorch Lightning 扩展、优化与导出 Transformer

PyImageSearch 发布的实战教程,讲解如何使用 PyTorch Lightning 进行 Transformer 模型的多 GPU 扩展、混合精度训练与模型导出。内容涵盖开发环境配置、代码架构重构以及性能优化策略,适合已掌握 Transformer 基础、希望将模型训练工程化并提升效率的开发者。PyImageSearch · 原文 ↗
T10

Prompt缓存与微调:成本与延迟决策框架

本文讲解在智能体AI系统中,Prompt缓存与微调两种策略在降低成本与延迟上的差异,并给出选择框架。读者可学会根据场景判断该用缓存、微调还是组合使用,适合正在构建LLM应用、关注推理成本与响应速度的开发者与AI工程师。MachineLearningMastery · 原文 ↗
T11

工程化系统提示提升代码安全性,DeepSeek-V4-Flash 超越 Pro

DeepLearning.AI《The Batch》本期汇总三条要点:DeepSeek-V4-Flash 表现优于 Pro 版本;GitHub 完成史上最大规模代码爬取,对 AI 编程训练数据生态影响显著;此外分享了如何通过工程化设计系统提示(system prompts)来提升代码生成的安全性,适合开发者与 AI 工程师学习 prompt 工程实践。DeepLearning.AI · 原文 ↗
T12

AI周报:Opus表现亮眼、Hugging Face漏洞揭秘、大公司豪掷算力

DeepLearning.AI 本期《The Batch》汇总三条要闻:Anthropic 旗下 Opus 模型在多项基准上超越包括 Fable 在内的同类竞品;Hugging Face 遭遇闭源模型未能有效防御的安全事件,团队复盘攻击过程与教训;多家 AI 头部企业继续大举投入算力建设,揭示行业军备竞赛态势。适合关注大模型动态、安全攻防与算力趋势的从业者阅读。DeepLearning.AI · 原文 ↗
T13

LLM 自我改进中的 Harness 工程

文章探讨 LLM 自我改进循环中 Harness(约束与脚手架)工程的关键作用。梳理从 I.J. Good(1965)到 Yudkowsky(2008)的递归自我改进思想脉络,并分析现代 AI 中模型重写自身代码或训练流程时的反馈机制与风险。适合关注 AI 安全、对齐与自主智能体的研究者与工程师阅读。lil'log · 原文 ↗
T14

孩子学习不该被仪表盘化

文章批评当前教育产品(包括模拟式和 AI 类)将孩子学习过程过度量化、可视化。探讨学习仪表盘为何会扭曲学习动机,以及真正以学习者为中心的设计应当是什么样。适合关注教育科技、AI 教育产品的产品经理与教育者阅读。fast.ai · 原文 ↗