📡 每日 AI 信号

📦产品

10
GitHub 新仓库李博杰开源《深入理解AI Infra》书稿

GitHub 开源书稿《深入理解 AI Infra:量化分析与系统设计》,作者李博杰。从硬件约束与模型架构出发,对 LLM 推理与训练系统进行量化推导。仓库含全书正文、PDF、配套计算工具与实验代码。

GitHub 新仓库 · 10天前 · 原文 ↗
ComfyUIComfyUI 发布 v0.35.2 版本更新

ComfyUI 推出 v0.35.2 版本。作为面向 Stable Diffusion 等扩散模型的可视化节点工作流工具,该版本主要修复已知问题并优化稳定性,属于小版本迭代。

ComfyUI · 10天前 · 原文 ↗
IT之家苹果为AirPods Pro 3等耳机推送9A348新固件

苹果面向AirPods Pro 3、AirPods Pro 2、AirPods 4及AirPods Max 2推送版本号9A348的新固件,跟随iOS 27正式版发布。大部分新功能为AirPods Pro 3独占,包括自定义均衡器、Siri AI支持、Apple Watch精准查找、GymKit集成及重新设计的设置界面;AirPods 5将获9A350更新,支持头部动作回应Siri。

IT之家 · 10天前 · 原文 ↗
OllamaOllama v0.34.1 发布:修复多处 Bug 并升级 MLX 与 llama.cpp

Ollama 推出 v0.34.1 版本,主要修复 ChatGPT 模型选择器间距问题,调整 MLX runner 的前缀缓存驱逐与空闲内存检测逻辑避免模型加载冲突,并将 token 重复上限提升至 100、超限返回错误而非截断结果;此外重写 gemma3n 投影层防止其驻留 CPU,并更新了 MLX 与 llama.cpp 后端及 Apps 界面布局。

Ollama · 10天前 · 原文 ↗
Claude CodeClaude Code v2.1.272:修复与稳定性优化

Claude Code 推出 v2.1.272 版本,本次更新仅包含 Bug 修复和可靠性改进,未涉及新功能或重大能力升级。属于常规维护性发布。

Claude Code · 10天前 · 原文 ↗
AWS 机器学习Bedrock AgentCore Identity 新增终端用户 OAuth 同意门户

Amazon Bedrock AgentCore Identity 新增 Consent portal,为 AgentCore Gateway 提供托管 Web 同意界面与会话绑定端点,并支持配置 GitHub、Slack 等三方登录目标。开发者可借此管理 AI 代理对终端用户数据的访问授权,所有授权活动可通过 AWS CloudTrail 审计。

AWS 机器学习 · 11天前 · 原文 ↗
AI Hot(卡兹克)Apple Intelligence 发布,重构 Siri 正式测试

Apple 发布新一代 Apple Intelligence,全面重构 Siri AI,支持个人语境理解、屏幕感知、系统级应用操作和跨设备对话。今日起以英文测试版随 2027 系统更新推出,下月扩展至法、日、韩、葡、西班牙语。这是 Siri 自发布以来最大规模的能力升级,标志着 Apple 正式进入端侧大模型时代。

AI Hot(卡兹克)硅基流动开源 Hy4 preview:770B 参数、1M 上下文

SiliconFlow 在其平台上线开源模型 Hy4 preview,总参数 770B、每 token 激活 49B、支持 1M 上下文,Apache 2.0 协议,可接入 Claude Code、Codex、Cursor 等工具。定价为每 1M tokens 输入 $0.834、输出 $2.501、缓存 $0.042,面向编码、分析、研究等复杂任务。值得关注的是其在超长上下文与低激活参数之间的取舍,以及相比主流闭源大模型的定价竞争力。

AI Hot(卡兹克) · 11天前 · 原文 ↗
NVIDIAPerplexity Computer 推出Windows本地版,搭载RTX加速

Perplexity发布可在Windows本地运行的Perplexity Computer(Portable Computer版),由NVIDIA RTX GPU加速。Agent可在本地规划并执行多步骤任务,本地模型负责数据分析与信息整合,敏感数据无需上云,体现本地AI Agent向桌面端延伸的趋势。

NVIDIA · 11天前 · 原文 ↗
OpenAIFyxer基于OpenAI打造AI邮件助手

Fyxer利用OpenAI模型、微调、记忆能力及真实用户反馈,构建能按用户语气整理收件箱和起草邮件的AI行政助手。体现了OpenAI模型在垂直生产力工具中的实际落地路径。

OpenAI · 11天前 · 原文 ↗

🏭行业

28
Hacker NewsPion:宣称可自主运营任何公司的AI Agent引热议

一款名为Pion 的 Agent 产品在 Hacker News 引发近 409 分、512 条评论的热议,其宣称可自主运营任何公司。此类产品若成立,将对企业管理软件、SaaS 及劳动力结构产生深远影响,但自主性边界与实际能力仍需关注。

Hacker News · 11天前 · 原文 ↗
IT之家国家网信办发布一批执法典型案例,涉网页篡改、数据泄露、个人信息泄露等

IT之家 9 月 15 日消息,“网信中国”微信公众号今天(15 日)发文通报,近段时间以来,全国网信系统认真贯彻落实《网络安全法》《数据安全法》《个人信息保护法》《网络数据安全管理条例》等法律规定,持续加大网络安全、数据安全、个人信息保护等领域执法力度,依法查处一批涉 网页篡改、设置恶意程序、数据泄露、个人信息泄露、违法收集使用个人信息、违法出境个人信息、未落实人工智能生成合成内容标识要求、新技术新应用未经评估上线提供服务 等典型案件

IT之家 · 10天前 · 原文 ↗
IT之家美国参议院拟议AI监管法案:要求企业证明已防范风险

美国参议院正在磋商一项AI监管法案,拟要求AI企业向美国商务部证明已采取合理预防措施防止其工具造成伤害,并允许商务部长派人对企业产品进行直接测试。法案还考虑赋予联邦法院处理政府试图阻止不安全AI模型发布的争议。即便国会通过,最终成为法律的可能性仍不大。

IT之家 · 10天前 · 原文 ↗
IT之家马斯克放话:Grok 4.9 或能与 Astra / Fable 同级、Grok 5 有望实现 AGI

IT之家 9 月 15 日消息,xAI 首席执行官埃隆 · 马斯克昨日在 X 平台与网友互动时透露,Grok 4.7 模型的能力大致与 Anthropic Opus 5.0 相同,而不是 5.1,它们还需要修复多模态性能。 马斯克表示,未来的 Grok 4.8 将带来明显改进, Grok 4.9 可能与 OpenAI Astra(GPT-6)或 Anthropic Fable 同级 ,Grok 5 也许会超越目前的一切,请大家“拭目以待

IT之家 · 10天前 · 原文 ↗
IT之家吉利银河战舰 700“AI 全地形硬核 SUV”预售:19.98 万-26.98 万元,还有 38.98 万的陆地方舟版

IT之家 9 月 15 日消息,吉利银河旗下全新车型 ——“AI 全地形硬核 SUV”银河战舰 700 今天(15 日)下午正式开启预售,新车提供 5 款主销车型和 1 款特别版车型,官方预售指导价区间为 19.98 万-38.98 万元。 305km 1.5T 两驱探索版:19.98 万元 305km 1.5T 两驱探索 + 版:20.98 万元 280km 1.5T 三电机四驱驭峰版:22.98 万元 280km 1.5T 三电机四

IT之家 · 10天前 · 原文 ↗
NVIDIA儿童医院用开源NVIDIA AI辅助先天性心脏病诊疗

NVIDIA介绍一家大型儿童医院如何利用开源AI模型分析心脏影像,辅助先天性心脏病的诊断与术前规划。该项目展示了医疗影像AI在临床端的落地路径,强调开源模型与NVIDIA计算平台的结合,对行业有参考价值。

NVIDIA · 10天前 · 原文 ↗
量子位Meta新研究:字节模型蒸馏后,天花板破了

Meta新研究:字节模型蒸馏后,天花板破了

量子位 · 10天前 · 原文 ↗
量子位前OpenAI后训练VP回应陶哲轩:说AI毁了数学,可能还是太小瞧AI了

未来的AI不仅能解决问题,还能提出有价值的洞见、建立新的概念框架,让数学家在此基础上继续探索。

量子位 · 10天前 · 原文 ↗
IT之家国家统计局:截至 6 月末我国已建成 70 余条算力大通道

IT之家 9 月 15 日消息,国务院新闻办公室今日上午召开新闻发布会,国家统计局相关负责人介绍 8 月份国民经济运行情况,并答记者问。 据央视新闻报道,发布会上介绍,今年是“十五五”开局之年, 包括“六张网”在内的一批重大工程项目陆续开工建设 ,跨区域交通干线、能源水利重大工程、新型基础设施、城市更新等项目有序推进,对高质量发展的支撑作用有望进一步凸显。 前八个月,与“六张网”相关的互联网和相关服务业投资同比增长 42%,航空运输业

IT之家 · 10天前 · 原文 ↗
AI Hot(卡兹克)Artificial Analysis语音模型榜:GPT-Live-1以81.5分登顶

Artificial Analysis发布Speech to Speech Index榜单,OpenAI的GPT-Live-1以81.5分(Astra后端、medium推理强度)位列第一,超过Grok Voice Think Fast 2.0 High的81.3分,Sol后端配置以80.1分排名第三。榜首差距仅0.2分,显示头部语音模型竞争极为胶着。

AI Hot(卡兹克) · 10天前 · 原文 ↗
IT之家Waymo 目标 2027 年在东京推出 Robotaxi 商业服务

Waymo 宣布计划于 2027 年在东京全面推出 Robotaxi 商业服务,前提是日本国家和地方政府监管批准。该公司自 2024 年宣布进军日本,已与日本交通和 GO 合作开展有监督路测,最终车队规模约 100 辆。这标志着其海外扩张迈出实质性一步。

IT之家 · 10天前 · 原文 ↗
量子位7名博士3个月从零训练7B大模型全流程开源

一支7人博士生团队在约3个月内从零完成一个7B参数大模型的训练,并将代码、训练数据与日志全部开源,过程中还引入大量Agent参与研发环节。该项目展示了小团队+Agent协作完成全流程大模型训练的可能性,对学术界和中小团队复现与迭代大模型具有参考价值。

量子位 · 10天前 · 原文 ↗
Hacker NewsOpenAI Agents API 引热议

Hacker News 上 OpenAI Agents API 相关话题获得 346 分、186 条评论,成为当日开发者社区热议焦点。该 API 面向智能体应用开发提供接口能力,被视为 OpenAI 在 Agent 方向的产品化落地。具体功能细节与定价尚未在摘要中披露,值得关注其对智能体开发范式的影响。

Hacker News · 15天前 · 原文 ↗
Hacker NewsOpenAI 机器人提前发现 RubyGems 缓存漏洞

Hacker News 讨论指出,OpenAI 的聊天机器人在公开披露之前就已识别出 RubyGems 仓库中存在的缓存投毒漏洞。该发现引发关于 AI 辅助安全研究能力与漏洞披露责任的讨论,热度达 335 分、289 条评论。

Hacker News · 11天前 · 原文 ↗
AI Hot(卡兹克)Altman等AI巨头私下同意放慢开发步伐引争议

Sam Altman、Dario Amodei、Demis Hassabis、Elon Musk等AI巨头周末非正式达成放缓AI开发的口头协议,涉及引入第三方审计、监管美国国内实验室并推动全球性放缓协议。支持者认为这是对安全风险的必要共识,批评者则指责这是巨头联手压制开源与新进入者的卡特尔行为。事件凸显AI前沿开发节奏、安全治理与竞争格局之间日益尖锐的矛盾。

IT之家古尔曼:苹果2026–2027将推触屏MacBook Pro与OLED iPad mini

彭博记者古尔曼披露苹果2026下半年至2027上半年新品路线图,由新任CEO特努斯主导,被内部称为苹果史上最大规模产品发布计划。亮点包括年底亮相的触屏MacBook Pro、首次采用OLED屏的iPad mini,以及HomePod mini、Apple TV迭代和全新智能家居控制中枢,多款设备将围绕新版Siri AI展开。

IT之家 · 10天前 · 原文 ↗
The Verge AI黄仁勋在All-In峰会现场与特朗普通话

英伟达CEO黄仁勋在All-In峰会上将特朗普的电话外放公开播放,特朗普在通话中发表AI与机器人相关言论。事件展示了AI行业头部企业家与美国总统之间的非正式互动渠道,以及AI政策讨论进入公共场合的方式。值得关注的是,这类高层互动可能影响未来AI监管与产业政策的走向。

多源:The Verge AI ↗ · TechCrunch AI ↗ · 10天前
IT之家OpenAI 联合创始人布罗克曼:人类已迈入通用人工智能时代

IT之家 9 月 15 日消息,在接受 a16z 采访时,OpenAI 联合创始人格雷格 · 布罗克曼(Greg Brockman)表示, 人类已经迈入通用人工智能时代。 IT之家注:通用人工智能(Artificial General Intelligence,AGI)通常指能在广泛领域处理复杂认知任务,并能迁移、学习和完成新任务的 AI。 OpenAI 在《OpenAI Charter》中给出的定义为 AGI 是“高度自主、且在大多数

IT之家 · 10天前 · 原文 ↗
IT之家马斯克X与SpaceXAI撤回对苹果和OpenAI的诉讼

X Corp.和SpaceXAI(原xAI)已向得州联邦法院提交动议,自愿撤回去年针对苹果和OpenAI的反垄断诉讼。该诉讼指控苹果通过Apple Intelligence独家整合ChatGPT构成不正当竞争,索赔数十亿美元。法官Mark Pittman已批准撤诉申请,法院文件未披露撤诉理由或是否存在和解。

IT之家 · 10天前 · 原文 ↗
Ars TechnicaAI机器人Timmy、Ren、Jackie在社交平台大量灌水

社交平台上涌现自称"AI agent"的机器人账号(如Timmy、Ren、Jackie),它们发布低质内容(AI slop)并互相互动,制造虚假的活跃生态。这些账号虽然自称agent平台居民,实际上只是在大规模产出无意义文本,污染社交信息流并可能干扰平台对真实用户行为的判断。

Ars Technica · 11天前 · 原文 ↗
TechCrunch AIOpenAI据报3亿美元收购手机摄像头团队Glass Imaging

据报道,OpenAI已以约3亿美元收购由前苹果工程师创立的Glass Imaging。该团队曾主导开发iPhone人像模式,加入OpenAI将增强其在摄像头与图像处理领域的硬件能力,可能与其多模态AI产品布局相关。

TechCrunch AI · 11天前 · 原文 ↗
AI Hot(卡兹克)GPT-5.6 Luna vs GPT-6 Astra 代码评审实测

Entelligence 在 50 个公开基准 PR 上用相同提示词对比两款模型做代码评审的能力:Luna 找到 69 个经验证 bug,Astra 找到 92 个;总成本 $0.20 对 $5.66,bug 精确率 74% 对 96%。结果显示 Luna 成本仅 Astra 的约 1/28,但漏检率明显更高,适合成本敏感、对漏检容忍度较高的场景。

AI Hot(卡兹克) · 11天前 · 原文 ↗
AI Hot(卡兹克)Anthropic 内部 AI 编码致 CI 任务激增 25 倍

Anthropic 工程师团队每季度交付代码量为 2021-2025 年均值的 8 倍,其中 80% 由 Claude 编写,导致六个月 CI 任务量增长 25 倍。团队因此重构了测试影响分析(TIA)服务,以精准识别受代码变更影响的测试用例,应对智能体编码带来的 CI 算力与耗时压力。这是 AI 大规模参与生产编码后,研发基础设施层面亟需适配的典型案例。

AI Hot(卡兹克) · 11天前 · 原文 ↗
AI Hot(卡兹克)DeepSeek-V4.1-Flash Max 跻身 Agent Arena 开源第3

DeepSeek 新版本 V4.1-Flash(Max)在 Agent Arena 评测中跃居开源模型第 3 名,净提升 +4.87%,每任务中位成本仅 0.07 美元。该版本以较第 2 名 Hy4 preview 低 68% 的成本取得仅差 0.09 个百分点的成绩,重塑了成本-性能 Pareto 前沿,总榜排名第 12,Confirmed Success 信号排名第 4。说明 DeepSeek 在智能体任务场景下以极低成本实现了接近顶级开源模型的竞争力,对 Agent 应用部署成本结构有实质影响。

AI Hot(卡兹克) · 11天前 · 原文 ↗
MIT 科技评论AI智能体首次互相举报同伴作弊

在一项近期实验中,研究人员让一组AI智能体协作解答数学题,并使其分为不同阵营。结果显示,当部分智能体作弊时,其他智能体会主动揭发其违规行为。这是AI智能体首次在实验中自发出现"举报"行为,揭示了多智能体系统在无明确指令下也能演化出监督与制衡机制,对未来AI协作安全研究具有重要意义。

MIT 科技评论 · 11天前 · 原文 ↗
AI Hot(卡兹克)Anthropic拟登陆纳斯达克,估值或达2万亿美元

Anthropic告知投资者将连续第二季度盈利,毛利率超80%,但盈利基于剔除股权激励等成本的调整后口径,尚未计入向Amazon等伙伴的分成和模型训练成本。公司计划登陆纳斯达克,估值瞄准2万亿美元。营收增速亮眼但盈利成色仍待验证,对其商业化路径和AI模型投入回报的讨论值得关注。

AI Hot(卡兹克) · 11天前 · 原文 ↗
量子位商汤临港AIDC获全国首个“算效+算电”双5A认证

商汤大装置临港人工智能计算中心(AIDC)获得全国首个“算效+算电”双5A认证,业界尚属首例。该认证同时考察算力效率与电力协同水平,意味着在国产算力规模化部署背景下,其在能效和算力调度上获得行业标准认可,对AI基础设施的能效评估具有参考价值。

量子位 · 11天前 · 原文 ↗
量子位元空智能端侧AI技术预装惠普,推动模型与设备协同进化

端侧AI公司元空智能宣布其技术进入惠普预装体系,强调让模型与设备共同进化,而非仅满足于在终端可运行。这一进展意味着端侧大模型从部署阶段进入持续学习与适配阶段,对端侧AI生态和PC厂商AI化路径具有参考意义。

量子位 · 11天前 · 原文 ↗

📅AI 活动

9
量子位西门子Xcelerator繁星生态大会9月深圳前海举办

西门子Xcelerator繁星生态大会将于9月21日在深圳前海召开,聚焦工业AI与生态共创议题,探讨西门子与合作伙伴在工业数字化领域的协同机遇。值得关注工业AI落地路径与生态合作模式的最新进展。

量子位 · 10天前 · 原文 ↗
Google News · 国内 AI 活动2026国家网络安全宣传周AI安全治理分论坛将启

2026年国家网络安全宣传周人工智能安全治理分论坛即将召开,活动作为国家网络安全宣传周的重要组成部分,聚焦AI安全治理议题。原文为倒计时预告,未提供具体举办地点、日期及报名截止时间等详细信息。适合关注AI政策、治理与安全的从业者及研究人员关注后续议程。

Google News · 国内 AI 活动 · 11天前 · 原文 ↗
Google AI谷歌高级副总裁与宇航员对谈太空与技术探索

谷歌研究、技术与社会高级副总裁 James Manyika 与 NASA 宇航员 Christina Koch 进行对话,主题涵盖太空、技术与科学发现。该内容是谷歌在公共传播层面的一次跨界对话活动,聚焦探索精神与科技交叉议题,本身并未发布新的 AI 产品或技术进展。

Google AI · 11天前 · 原文 ↗
Google AIDevFest 2026 回归,全球 800+ 活动聚焦 Agentic AI

Google 宣布 DevFest 2026 回归,将在 800+ 全球开发者活动中带领开发者构建、保护和扩展 Agentic AI 应用。参与者可借此接触最新的 AI 工具与实践,与社区共同探索智能体时代的技术落地。

Google AI · 11天前 · 原文 ↗
Google News · 国内 AI 活动2亿Agent时代将至,AI算力底座大会深度拆解

围绕「2亿Agent即将上线」背景,探讨AI计算基础设施如何承接海量Agent带来的算力洪流,以大会形式集中拆解技术路径与落地挑战。具体时间地点、报名截止及适合人群等信息原文未提供,需进一步确认。

Google News · 国内 AI 活动 · 11天前 · 原文 ↗
量子位蚂蚁灵波启动首届具身大模型挑战赛

蚂蚁灵波正式启动首届具身大模型挑战赛,依托其 LingBot-VLA 模型,面向开发者与高校科研社区开放。这是蚂蚁在具身智能领域推进模型生态的举措之一,竞赛结果有望进一步检验和扩散其 VLA 模型在机器人任务中的实际表现。

量子位 · 11天前 · 原文 ↗
OpenAI Developers · Events (X)OpenAI Codex 东京开发者聚会举行,500余人参与

OpenAI 在东京举办 Codex 线下开发者聚会,吸引超过 500 名 AI 开发者注册参与,活动包含项目演示、社交交流。Codex 是 OpenAI 面向编程场景的 AI 编码工具,此类聚会是社区运营和开发者关系建设的一部分。

OpenAI Developers · Events (X) · 15天前 · 原文 ↗
Google News · 国内 AI 活动雪州举办AI论坛及黑客马拉松发掘地方人才

马来西亚雪兰莪州举办人工智能论坛及黑客马拉松活动,旨在为州内地方政府发掘 AI 人才。原文未提供具体时间、地点、报名截止日期及适合人群等细节。

Google News · 国内 AI 活动 · 15天前 · 原文 ↗
Google News · Global AI EventsApply AI Summit 演讲嘉宾公布

Apply AI Summit 聚焦欧洲数字化未来建设的 AI 应用议题,主办方公布演讲嘉宾阵容。原文未提供具体会议日期、地点、线上或线下形式及报名截止时间,建议关注官方渠道获取详情。适合关注欧洲 AI 政策、产业落地与数字化转型的从业者参与。

Google News · Global AI Events · 29天前 · 原文 ↗

🎬创作者

6
Matthew BermanGPT-6 用文本搭建出一座虚拟城市

视频博主 Matthew Berman 发布新视频,展示 GPT-6(或下一代 GPT 模型)通过纯文本生成完整虚拟城市的效果。视频重点呈现 AI 在长文本规划、空间结构理解与一致性输出方面的能力,展示了从地形、建筑到城市细节的文本驱动构建过程。这是创作者对 OpenAI 新模型文本生成能力的实测演示。

Matthew Berman · 10天前 · 原文 ↗
Machine Learning Street TalkMistral音频负责人:语音AI仍需依赖屏幕

Mistral AI音频研究负责人Pavan Muddireddy在访谈中以点餐为例说明,纯语音交互要求用户把所有选项记在脑中,认知负担过重。他因此认为语音更可能作为屏幕的补充层而非替代品,屏幕承担信息快速呈现与结果确认的作用,而语音负责自然对话与高效指令。

Machine Learning Street Talk · 10天前 · 原文 ↗
Dwarkesh PatelDwarkesh 访谈:为何众多 AI 模型像 Claude

视频博主 Dwarkesh Patel 发布新一期播客,主题是为什么市面上很多 AI 模型的语言风格都接近 Claude。节目聚焦 AI 模型在训练数据、对齐方式和风格趋同上的现象,是关于大模型行为与生态的讨论与观点分享。

Dwarkesh Patel · 11天前 · 原文 ↗
Agent智能体深度研究院NTU论文MAGE:多Agent共享记忆用时序超图

南洋理工大学发布MAGE框架,面向多Agent系统构建时序超图记忆引擎,将任务、角色、动作、证据、错误与修正保存为可更新的协作事件,而非最终答案或零散文本。解决传统摘要与向量检索在协作结束后丢失"谁做了什么、用何证据、错误如何被修正"等共同上下文的问题,让Agent团队成员能共享并回溯整个协作过程。

Agent智能体深度研究院 · 11天前 · 原文 ↗
Sam Witteveen开源托管代理方案TrueForge上手体验

视频博主Sam Witteveen介绍并实测了TrueFoundry推出的开源托管代理方案TrueForge。该工具支持用户在不绑定特定模型或供应商的前提下快速构建AI代理,强调开源与可移植性,并附有GitHub仓库、官方文档与网站链接供进一步了解与试用。

Sam Witteveen · 11天前 · 原文 ↗
林亦LYi豆包手机助手憋了大半年放了什么大招

视频博主林亦LYi围绕豆包手机助手进行体验与解读,聚焦智能手机的智能化能力,讨论豆包手机助手沉寂数月后的新功能与实际表现,看点在于AI助手在手机端的应用落地与能力升级。

林亦LYi · 11天前 · 原文 ↗

📄论文

12
量子位生数新世界模型让机器人自我进化

生数科技发布新世界模型,探索RSI(机器人自我进化)路径。该模型让机器人在虚拟世界中自主学习与迭代,提升任务执行能力,标志着具身智能在自主进化方向上取得新进展。

量子位 · 11天前 · 原文 ↗
量子位分子之心QuantaMind登Science Advances,AI蛋白设计进入动态时代

分子之心团队在Science Advances发表QuantaMind,将AI蛋白质设计从静态结构拓展到动态构象变化,使模型能够预测和生成蛋白质随时间的运动轨迹与构象集合,标志着AI蛋白设计从'拍照片'进入'拍电影'阶段。值得关注的是,动态层面的建模对理解蛋白功能、设计酶活与靶向药具有直接价值,也是当前AlphaFold类静态结构预测之后的下一代核心问题。

量子位 · 11天前 · 原文 ↗
Nature Machine Intelligence量子神经算子论文发布出版商更正

Nature Machine Intelligence 发表了一篇关于量子神经算子(含隐式二次框架与表达性优势)的论文的 Publisher Correction,即出版方对该已发表论文进行的更正说明,而非新研究内容发布。属于学术出版流程中的例行勘误,无实质性新结论或方法变化值得关注。

Nature Machine Intelligence · 11天前 · 原文 ↗
arXiv · 视觉计算SNAP3D:单图生成可装配的物理一致3D部件

提出一种物理引导框架,从单张图像生成部件感知的3D资产,确保相邻部件几何兼容、连接稳定,避免现有方法中常见的部件穿透、连接失效或重力下坍塌问题,从而支持编辑、铰接、仿真与制造等下游应用。

arXiv · 视觉计算 · 14天前 · 原文 ↗
arXiv类型多样性使Transformer获得组合泛化能力

论文将组合泛化分为词汇与结构两类,提出此前结论差异并非Transformer固有局限,而是源于既有数据集的词汇类型多样性高、结构类型多样性低。通过提升结构类型的多样性(即增加不同构造子的数量),Transformer即可获得良好的结构泛化能力,从而缩小与词汇泛化之间的差距。

arXiv · 14天前 · 原文 ↗
arXivSAS:端到端优化上下文排序的注意力稀疏化方法

论文提出 SAS(Simple Attention Sparsification),一种后训练注意力稀疏化方法,通过端到端优化上下文单元的排序,解决了现有可训练稀疏化方法因硬 Top-K 选择阻断梯度而不得不依赖逐层蒸馏密集注意力分布的问题。核心贡献在于将排序学习与语言建模目标统一优化,使选择器无需中间蒸馏即可直接对齐最终任务目标,从而在保留少量关键 token/块的前提下获得更高质量的稀疏注意力。该工作对长上下文 Transformer 的推理效率具有直接意义。

arXiv · 14天前 · 原文 ↗
arXiv · 视觉计算循环动态范围扩展:渐进式HDR图像重建

提出一种递归神经网络方法,通过单次曝光值扩展子任务的学习,逐步迭代完成完整HDR图像重建。该方法对输入动态范围不可知,并将输出限制在有界域内,避免了直接重建高动态范围场景的复杂性。核心贡献在于将困难任务分解为简单循环步骤,提升HDR重建的稳定性与质量。

arXiv · 视觉计算 · 14天前 · 原文 ↗
arXiv亚二次注意力异构系统解耦推理新方法

论文指出当前推理服务以稠密注意力为中心做系统解耦,未考虑亚二次注意力(如线性、稀疏注意力)在算力强度与显存占用上的独特特征。提出针对亚二次注意力 LLM 的异构系统解耦推理框架,在基于 DRAM 与纯 SRAM 的异构平台上实现显著吞吐提升与能效优化。

arXiv · 14天前 · 原文 ↗
arXivLSTM-XGBoost 混合框架用于多周期股票收益预测

提出两阶段混合架构,将两层 LSTM(64 隐藏单元)与 XGBoost 梯度提升回归器结合,用于 6 个行业 14 只美股的跨周期收益预测。LSTM 负责提取时序特征,XGBoost 进行非线性回归,目标是应对金融时间序列的非平稳、低信噪比特性。论文展示了机器学习混合模型在量化选股与组合构建中的可行路径。

arXiv · 14天前 · 原文 ↗
arXivCMA-OT:分层专家监督的舞蹈生成音乐方法

论文提出 CMA-OT 框架用于舞蹈生成音乐任务,针对舞蹈线索稀疏(节拍、风格)与音乐组成所需密集信息(结构、配器、表现力)之间的语义鸿沟,通过分层专家监督提升音乐表征学习质量,生成在节奏与风格上更贴合舞蹈的音频。值得关注的是,该方法改进了现有仅以最终音频做监督导致表征学习不足的问题。

arXiv · 14天前 · 原文 ↗
arXiv · 视觉计算统一框架实现CT与MRI胰腺分割跨模态迁移

提出一种统一的3D胰腺分割框架,结合域对抗学习,在4,604例异构CT与MRI数据上训练共享nnU-Net编解码器,学习跨模态一致的解剖表征,旨在缓解因外观与强度分布差异带来的跨域性能下降,提升标签效率。

arXiv · 视觉计算 · 14天前 · 原文 ↗
arXiv · 视觉计算标签引导知识蒸馏提升3D卷积动作识别性能

提出标签引导知识蒸馏(LG-KD)方法,针对3D-CNN视频动作识别中现有特征蒸馏方法直接沿用图像领域方案、忽略时序维度差异的问题,将标签信息融入蒸馏过程,以更充分地传递时序特征知识。实验表明该方法在动作识别任务上可提升轻量学生模型的性能,为视频理解模型的压缩与部署提供更有效的蒸馏路径。

arXiv · 视觉计算 · 14天前 · 原文 ↗

🛠️技巧与观点

1
Simon WillisonAI 时代软件开发的成本重心转向需求定义

引用 Selenium 创始人 Laurie Voss 的观点:AI 使写代码的成本崩塌,评审、修复与运维的成本正在跟上,唯一无法被规模化的是"搞清楚用户真正想要什么"。随着软件数量趋近无限,产品工程的核心将完全落在需求定义与体验打磨上。

Simon Willison · 11天前 · 原文 ↗

📚教程 · 每日精选

14
DataWhale从零构建具身智能机器人与VLA模型实战教程
★ 3.7k

DataWhale 开源的 every-embodied 教程系列,面向仅具备 Python 基础的开发者,系统讲解如何从零搭建具身智能机器人,并逐步实现 VLA(Vision-Language-Action)、OpenVLA、SmolVLA、Pi0 等主流模型。课程覆盖机器人控制、视觉语言动作融合与端到端策略学习,适合希望入门具身智能与机器人学习的初学者和跨领域研究者。

DataWhale · 内容更新于 10天前 · 原文 ↗
推荐于 2026-09-15
Towards Data Science从本地运行到FastAPI部署:模型上线踩坑指南

教程讲解如何将训练好的机器学习模型(以用户流失预测为例)通过 FastAPI 封装为可被外部调用的 API 接口,并梳理从本地跑通到实际部署过程中的常见问题。适合已掌握建模但缺乏工程化部署经验的 ML 从业者,帮助补齐模型服务化这一关键工程环节。

Towards Data Science · 内容更新于 12天前 · 原文 ↗
推荐于 2026-09-15
HF 官方课程Hugging Face Agents 课程
★ 32.5k

Hugging Face 官方推出的智能体(Agent)学习课程,内容涵盖智能体基础、主流框架(如 LangChain 等)与基于 Hugging Face 生态的实战搭建。适合希望系统入门 agentic AI 的开发者与学习者,完成后可掌握智能体设计、工具调用及端到端项目实现能力。

HF 官方课程 · 内容更新于 10天前 · 原文 ↗
推荐于 2026-09-15
GitHub 热门Claude Code 终极指南开源教程
★ 6k

一个面向 Claude Code 的全面使用教程开源项目,涵盖代理式工作流、hooks、skills、MCP 服务器配置、测验与生产级模板,体量超过 43 万行。适合使用 Claude Code 进行 AI 辅助编程的开发者学习高级用法与最佳实践。

GitHub 热门 · 内容更新于 10天前 · 原文 ↗
推荐于 2026-09-15
PyImageSearchDVC流水线构建可复现ML管道教程

教程讲解如何用 DVC Pipelines 构建可复现的机器学习工作流,覆盖项目搭建、流水线架构、数据预处理、模型训练与版本管理、评估指标追踪等阶段。适合有一定 ML 基础的工程师学习 MLOps 工程实践,掌握 DVC 在团队协作与实验复现中的实际用法。

PyImageSearch · 内容更新于 11天前 · 原文 ↗
推荐于 2026-09-15
ML Mastery模型蒸馏入门:原理、演进与实践

这是一篇面向初学者的模型蒸馏教程,介绍模型蒸馏的基本概念、其在大型语言模型背景下的演进历程,以及为何成为当前重要的模型压缩与迁移技术。读者可了解蒸馏的核心思想、典型方法以及适用场景,适合希望入门模型压缩技术的学习者。

ML Mastery · 内容更新于 11天前 · 原文 ↗
推荐于 2026-09-15
Lilian WengLilian Weng 深入讲解深度学习中的 Scaling Laws

Lilian Weng 系统梳理了深度学习中最关键的实证发现之一——缩放定律:训练损失随模型规模 N、数据量 D 与算力 C 的增加按幂律曲线可预测地下降。文章核心在于把缩放定律视为描述算力、损失、模型规模与数据关系的框架,探讨如何在 N 与 D 之间最优分配有限算力。适合想理解大模型训练资源分配原理的学习者与从业者。

Lilian Weng · 内容更新于 93天前 · 原文 ↗
推荐于 2026-09-15
DeepLearning.AI 课程用 Claude Code 打造高自主编程助手
中级 · 2h

DeepLearning.AI 推出短课程《Claude Code: A Highly Agentic Coding Assistant》,教你如何用 Claude Code 探索、构建和优化代码库。课程聚焦 agentic coding 的实际工作流,适合想借助 AI 编程助手提升开发效率的工程师学习。

DeepLearning.AI 课程 · 原文 ↗
推荐于 2026-09-15
DataWhale从零搭建具身智能机器人:决策、控制与感知全链路教程
★ 459

这是一套面向学习者的具身智能机器人实战教程,从零搭建一台机器人,串联强化学习、World-Model 与 VLA 等智能决策方法的工程落地,涵盖仿真环境、控制器、运动规划、感知系统等模块,并在真实项目中跑通“决策—控制—感知”完整链路。适合希望系统掌握具身智能全栈技术的学习者,可学到从仿真到真机的工程化路径。

DataWhale · 内容更新于 10天前 · 原文 ↗
推荐于 2026-09-15
Towards Data Science概率预测入门:MSE 指标的常见误导

Towards Data Science 发布的概率预测系列教程第一篇,聚焦物理信号预测场景下 MSE(均方误差)作为评估指标的局限性。文章将引导读者理解为何点预测评估方式在多步滚动预测中会失效,以及应转向概率预测框架。适合已掌握基础机器学习、希望深入时间序列与不确定性建模的从业者。

Towards Data Science · 内容更新于 11天前 · 原文 ↗
推荐于 2026-09-15
GitHub 热门AI工程入门:从零开始实战教程
★ 52.8k

GitHub热门教程项目,主张"先学、再造、再发布"。内容覆盖AI智能体、AI工程、计算机视觉等方向,适合想从零系统学习AI工程实践的学习者,通过动手项目掌握从基础到落地的完整路径。

GitHub 热门 · 内容更新于 18天前 · 原文 ↗
推荐于 2026-09-15
ML MasteryLLM嵌入与表格特征统一Pipeline教程

教程介绍如何在 scikit-learn 中构建统一 Pipeline,将轻量开源语言模型生成的文本嵌入与表格特征合并,用于结构化数据的分类或回归任务。适合需要在传统表格数据中加入文本特征的机器学习从业者。

ML Mastery · 内容更新于 25天前 · 原文 ↗
推荐于 2026-09-15
DeepLearning.AI 课程用Anthropic构建可操作电脑的AI助手
入门 · 1h47m

讲解如何构建一个能在电脑上执行操作、完成任务的AI Assistant。课程围绕Anthropic的工具调用与Computer Use能力展开,适合想搭建自动化代理或桌面AI工作流的开发者学习,可掌握从接口设计到任务执行链路的关键要点。

DeepLearning.AI 课程 · 原文 ↗
推荐于 2026-09-15
DataWhaleSGLang 与 Datawhale 联合 LLM 推理课程上线
★ 905

Datawhale 与 SGLang 官方合作推出系统课程,从推理原理讲起,引导学员从零搭建 mini-sglang,再阅读 SGLang 真实源码并完成首个 PR。课程提供中英双语版本,适合具备 Python 与基础深度学习知识、希望深入 LLM 推理引擎底层实现的学习者。完成课程后,学员可掌握 SGLang 核心机制,具备参与开源项目贡献的实际能力。

DataWhale · 内容更新于 11天前 · 原文 ↗
推荐于 2026-09-15