📡 每日 AI 信号

📦产品

11
1

Reflex开源XY:Rust驱动的Python超快绘图库

Reflex AI 开源基于 Apache-2.0 许可的 Python 交互式 2D 绘图库 XY,采用 Rust 原生核心与二进制缓冲传输,结合 WebGL2 渲染,在 1 万至 1 亿数据点范围内均能保持约 0.08 秒的渲染速度。值得关注的是,该库为大规模数据可视化提供了 Python 生态中罕见的流畅交互能力,适合 AI/ML 场景下的高维数据探索。AI Hot(卡兹克) · 8天前 · 原文 ↗
2

腾讯混元发布 Hy ASR 3.0:融合语义理解的语音识别

腾讯混元推出新一代语音识别模型 Hy ASR 3.0 preview,基于大语言模型 Hy3 与 MoE 架构,将高精度识别与语义理解相结合。在开源评测中,中文普通话 WER 3.34%、英语 2.62%、粤语 3.12%,并支持上下文纠错、热词注入及高噪耳语等场景。模型已上线腾讯云 API,元宝 App 首发并免费开放。多源:量子位 ↗ · AI Hot(卡兹克) ↗ · 8天前
3

Swiftlet:Mac/Phone 端运行 Qwen 大模型的轻量推理方案

Swiftlet 是一个基于 Swift + Metal 的运行时,可在普通 Apple 设备上本地运行 Qwen3-Next 及 Qwen3.5/3.6 MoE 混合模型。它仅将小规模稠密核心常驻内存(约 4.3 GB),按需从存储流式加载专家权重,在 Mac 上可跑 80B 版本,在 iPhone 上可跑 35B 版本,为端侧大模型推理提供了新路径。AI Hot(卡兹克) · 8天前 · 原文 ↗
4

面壁智能开源 ForgeStencil:一周全自动优化 100+ 工业软件

面壁智能联合 OpenBMB 开源全球首个支持 Stencil 自动研究、自动部署的 AI 优化系统 ForgeStencil,通过 Kernel Agent 与 App Agent 闭环协作,在一周内完成 100 余个工业与科学软件的全自动优化,全程无需人工介入。该系统将算子优化与应用集成打通为端到端流程,显著降低了高性能计算代码的优化门槛。AI Hot(卡兹克) · 8天前 · 原文 ↗
5

Circles借OpenAI API实现电信个性化运营

电信运营商Circles使用OpenAI API与Codex构建AI原生用户体验,ARPU提升22%,用户流失率降低9%,开发效率显著改善。这是OpenAI企业API在电信行业落地的典型案例,展示了生成式AI为传统通信运营商带来可量化的业务增长。多源:OpenAI ↗ · AI Hot(卡兹克) ↗ · 9天前
6

GPT-Live实时音频新架构发布

OpenAI 发布 GPT-Live 实时音频架构与全栈语音栈,可在说话的同时持续监听。从客户端到模型重建语音栈,使音频流不被打断,让深度推理和工具调用能在对话中无缝进行,提升 ChatGPT 语音交互的自然度。多源:AI Hot(卡兹克) ↗ · OpenAI ↗ · 8天前
7

Claude Code v2.1.221 新增 Focus 视图与凭据屏蔽

Claude Code 发布 v2.1.221 版本,在 VSCode 中新增 Focus 视图,可通过 Ctrl+Alt+F 切换,将工具活动隐藏在可展开的回合摘要之后,并显示实时运行工具指示器。同时新增 Linux/WSL 沙箱凭据文件 "mask" 模式,命令读取哨兵副本,由沙箱代理在出口替换真实值,macOS 回退为拒绝。多源:AI Hot(卡兹克) ↗ · Claude Code ↗ · 8天前
8

F1 与 AWS 用智能体 AI 将数据接入从 8 周缩至 40 分钟

Formula 1 与 AWS 合作构建 Data Accelerator,基于 Amazon Bedrock AgentCore 的智能体 AI 重构其 MarTech 数据平台,将数据源接入从最长 8 周压缩至约 40 分钟,并实现 schema 演化的自动化与端到端可观测性。值得关注的是,这一案例展示了智能体 AI 在企业数据工程场景中的实际落地能力,将原本高度依赖人工的接入流程大幅提速。AWS 机器学习 · 9天前 · 原文 ↗
9

Amazon Bedrock 新增自动推理策略优化功能

Amazon Bedrock 推出 Automated Reasoning 策略自动优化能力,可诊断失败测试并提出形式逻辑层面的规则与语言修复建议,用户审批后才生效。文章以完整的 API 和控制台流程展示了两种优化模式。AWS 机器学习 · 9天前 · 原文 ↗
10

AirLLM 实现单卡 4GB 显存运行 70B 模型推理

AirLLM 开源项目可在仅 4GB 显存的单块 GPU 上完成 70B 参数大模型推理,无需多卡或大显存配置。该项目登陆 Hacker News 后获 103 点热度,引发开发者社区对低资源部署大模型的广泛关注。AI Hot(卡兹克) · 9天前 · 原文 ↗
11

月之暗面发布Kimi Slides演示教程

月之暗面发布Kimi Slides使用教程,展示基于Kimi K3模型实现从结构研究、图表设计到最终下载的完整幻灯片生成流程。该功能体现了AI在办公自动化与内容创作领域的落地应用。Kimi 月之暗面 (X) · 9天前 · 原文 ↗

🏭行业

25
12

影石AI硬件接入阿里千问,Go Ultra口袋相机率先落地

影石Insta360正加速AI硬件布局,旗下产品将新增AI语音助手功能。该功能率先落地于Go Ultra系列口袋相机:海外调用谷歌Gemini,中国大陆接入阿里千问大模型,采用自研+大厂模型融合模式,由内部代号"Kira"的语音助手承载,端侧负责声纹识别与意图判断,云端承担问答、翻译等复杂任务。影石将于8月5日推送Go Ultra大更新,AI语音助手预计为本次发布重点。IT之家 · 8天前 · 原文 ↗
13

小鹏 G9L「珠峰白」「峡湾灰」官图发布,新车定位大五座科技旗舰 SUV

IT之家 8 月 4 日消息,小鹏汽车官方今日发布了小鹏 G9L「珠峰白」和「峡湾灰」车色的官图,新车定位大五座科技旗舰 SUV,号称“30 万级科技标杆”。 「珠峰白」 「峡湾灰」 据官方介绍,新车继承 GX 旗舰安全能力,标配航空级安全冗余设计,全球四大权威机构五星安全标准开发;首发全体型 AI 主动贴合座椅技术,适配全球各种体型;创造了同级别最快的麋鹿测试成绩,底盘和操控都堪称强悍;将搭载小鹏第二代 VLA 的首次重大升级版本;8IT之家 · 8天前 · 原文 ↗
14

微软漏洞赏金计划2026财年支出破2000万美元创新高

微软安全响应中心公布2026财年漏洞赏金计划成果,累计向来自64个国家的562名安全研究人员支付超2000万美元,双双刷新项目历史纪录,较上年度1700万美元和344名研究人员的成绩进一步增长。该计划覆盖微软云服务、AI系统及企业平台等产品的安全防护,反映出AI时代安全研究投入的持续扩大。IT之家 · 8天前 · 原文 ↗
15

玻璃基板企业巽霖科技半年内第三轮融资近2亿元

在电子级玻纤布涨价翻倍、FR-4覆铜板涨幅超270%、AI封装载板交期拉长至6个月以上的背景下,国内玻璃基板企业巽霖科技完成近2亿元B轮融资,半年内完成第三轮。资金将用于玻璃基板产能扩张、封装产线建设及光通讯应用布局,多元化股东结构反映产业资本对AI算力上游供应链瓶颈的押注。36氪 · 8天前 · 原文 ↗
16

前海母基金数亿元押注端侧物理AI公司Om AI联汇

前海母基金以数亿元投资Om AI联汇,加码端侧物理AI赛道。该公司聚焦将AI模型部署到终端设备,强调在芯片、机器人等场景中实现低延迟、本地化推理,推动端侧AI从技术走向规模化商业落地。量子位 · 8天前 · 原文 ↗
17

GPT-5.6 Luna降价80%永久生效,效率提升驱动

GPT-5.6 Luna 降价 80% 并非临时促销,而是永久调价,源自底层效率提升。这一调整意味着更低的使用门槛将长期持续,对开发者和调用方来说是一大利好。AI Hot(卡兹克) · 8天前 · 原文 ↗
18

激流:中国科技投资的势能与锚点|甲子引力X

8月,中国科技产业智库甲子光年将在北京举办“激流——2026甲子引力X科技产业投资大会”,共同探讨中国科技投资的新变化与新答案。量子位 · 8天前 · 原文 ↗
19

OpenAI回击苹果诉讼:指控无根据并公布内部信息

OpenAI公开回应苹果近期提起的诉讼,否认相关指控,并针对苹果声称的OpenAI员工不当行为作出澄清,同时披露相关通信记录以还原事实。此举意在反驳苹果的法律施压,并维护自身在AI人才竞争中的立场。OpenAI · 9天前 · 原文 ↗
20

追觅手机负责人俞雷拟离职,上任不足半年

追觅生态 Eclix 手机业务负责人、前金立全球副总裁俞雷拟从追觅系离职,其于 2026 年 3 月入职 MOVA 不足半年。该手机项目原计划主打高端 AI 手机,与国内头部大模型厂商合作,定于 2026 年 9 月发布、双十一前上市,负责人突然离职或打乱产品节奏。IT之家 · 8天前 · 原文 ↗
21

Linux 7.2-rc6 发布,AI 助推提交量创近年新高

Linux 内核 7.2 第六个候选版本上周日发布,提交数量为近年来同期最高。内核创始人 Linus Torvalds 表示,AI 是本轮提交规模显著扩大的主要原因。rc6 仍以驱动更新为主,约占全部变更的 60%,整体未出现重大问题,正式版仍有望两周后如期发布。IT之家 · 8天前 · 原文 ↗
22

精密减速器厂商陶世智能完成1.4亿元融资,估值破10亿

深圳精密减速器企业陶世智能完成1.4亿元融资,融资将用于研发、产线扩建及机器人领域市场拓展。其核心产品微型环面包络蜗轮蜗杆减速器已进入富士康、蓝思科技等供应链,并与近百家机器人企业合作,灵巧手关节模组已签署10万台供货协议。减速器作为机器人核心零部件,直接影响关节性能,公司融资标志着人形机器人产业链关键环节加速成熟。36氪 · 8天前 · 原文 ↗
23

亿级日活AI应用砍掉75% GPU,靠跨云架构破解推理成本倒挂

出海AI应用面临三重算力锁链难题:推理成本倒挂、云厂商绑定、规模化资源紧缺。团队通过跨云架构优化,将GPU集群规模削减75%,在不牺牲用户体验的前提下显著降低推理成本。该方案对亿级日活AI产品的工程实践有直接参考价值。量子位 · 8天前 · 原文 ↗
24

DeepSeek升至全球AI调用量第一,OpenAI下一代模型Astra曝光

今日AI领域两大热点:DeepSeek在全球大模型调用量上首次超越OpenAI等竞争对手升至第一;OpenAI下一代模型Astra曝光,据称以约2000美元算力成本在十项数学难题测试中取得突破。前者反映中国大模型在国际市场的实际渗透,后者显示前沿模型在推理能力上继续推进。36氪 · 8天前 · 原文 ↗
25

SQLite关键漏洞还是LLM垃圾内容?

Hacker News 社区热议 SQLite 关键 CVE 的真实性,质疑其是否为大语言模型生成的虚假内容。该讨论揭示了当前 AI 生成内容在技术社区传播中的可信度问题。Hacker News · 9天前 · 原文 ↗
26

EA 首席战略官谈生成式 AI 如何进入可游玩的实时游戏世界

EA 首席战略官 Mihir Vaidya 认为,游戏是 AI 的试验场,但生成式 AI 进入游戏面临 60 帧/秒、数千玩家同步和低延迟等严苛约束,不能只追求"看起来真实",而必须"行为正确"。他主张采用神经符号架构,在生成能力之外保留确定性与可控性,并称"控制是下一个前沿"。EA 将 AI 影响分为效率、扩展和转型三个层面,其中《模拟人生》已服务超 5 亿玩家,拥有近万亿种游玩排列组合。AI Hot(卡兹克) · 9天前 · 原文 ↗
27

AWS支持vibe coding创业公司Superblocks,将应用与模型解耦

AWS允许vibe coding工具Superblocks嵌入到AWS客户的私有云中,这是AWS推动AI应用层与底层模型解耦的又一举措。该合作意味着企业可以在自有云环境中使用AI编程工具,同时保持对数据和模型的灵活选择权,反映出云厂商正加码布局AI应用生态。TechCrunch AI · 9天前 · 原文 ↗
28

Design Arena获790万美元融资,为AI模型引入人类审美评判

Design Arena团队完成790万美元融资,其平台已服务全球530万用户,通过人类主观评分帮助前沿AI实验室评估模型的生成质量。该项目聚焦AI生成内容的审美与偏好判断,是AI评测与对齐领域的重要基础设施。TechCrunch AI · 9天前 · 原文 ↗
29

OpenAI 首次豪华网红营销活动遭舆论反弹

OpenAI 近日举办首次面向网红和博主的豪华品牌推广旅行,邀请众多有影响力的内容创作者参与体验,旨在借助社交媒体扩散品牌影响力。然而活动曝光后引发网友强烈反弹,反映出公众对 AI 行业高调营销与企业形象的负面情绪正在升温。TechCrunch AI · 9天前 · 原文 ↗
30

特朗普AI保护主义波及人形机器人产业

特朗普政府的AI保护主义政策开始影响人形机器人产业。文章指出,人形机器人技术仍处于早期阶段,在灵巧操作等方面远未成熟,而相关贸易与产业政策可能进一步制约这一新兴领域的发展,反映出地缘政治正深度介入前沿机器人技术。MIT 科技评论 · 9天前 · 原文 ↗
31

欧盟AI法案透明度规则生效,违规最高罚1500万欧元

欧盟《人工智能法案》下的新透明度义务于8月2日生效,要求企业披露用户何时与AI系统交互,并为合成音视频及文本添加机器可读标记,违规最高面临1500万欧元或全球年营业额3%的罚款。欧盟同步推出可选的AI披露标签供平台自愿采用,8月2日前已上线的模型获得4个月宽限期。这是全球首批落地的AI专门法规执行节点,将直接影响在欧运营的AI产品合规策略。多源:The Verge AI ↗ · AI Hot(卡兹克) ↗ · 9天前
32

国际刑警组织:AI 已成非洲网络犯罪核心驱动力

国际刑警组织报告显示,AI 已参与非洲 55% 的网络犯罪案件,推动网络诈骗攻击提速、规模化与跨国有组织化。自 2024 年以来,非洲网络犯罪经济损失从 1.92 亿美元飙升至 4.84 亿美元,其中 72% 的受访国家境内存在诈骗产业。值得关注的是,这一问题暴露出非洲数字化转型加速与执法能力滞后的巨大落差,AI 正成为加剧全球网络犯罪非对称威胁的关键变量。IT之家 · 9天前 · 原文 ↗
33

商汤预览SenseNova U1.5 Lite:国产开源4K直出

商汤预览了SenseNova U1.5 Lite模型,支持4K图像直出。该模型为国产开源方案,展示了在高分辨率生成领域的最新进展。量子位 · 9天前 · 原文 ↗
34

2026 ChinaJoy探讨AI工作流规模化落地挑战

2026 ChinaJoy AI未来生态大会聚焦AI工作流从实验到产线的规模化难题,探讨协作生态构建与工程化落地能力。阿里云、Funloom AI等企业代表参与圆桌,分析生成能力普及后的行业瓶颈。36氪 · 9天前 · 原文 ↗
35

阿里发布最强AI模型Qwen3.8-Max,对标中美顶尖水平

阿里巴巴发布迄今最大且能力最强的AI模型Qwen3.8-Max,宣称性能可媲美Anthropic、OpenAI及月之暗面Kimi K3。该模型已面向用户广泛开放,旨在挑战美国在AI领域的领先地位。The Verge AI · 9天前 · 原文 ↗
36

Kimi K3 与 DeepSeek V4,隔着原生多模态的时间差

Kimi K3 和即将到来的 DeepSeek V4 代表着国产大模型在 Agent 与 Coding 能力之外的新一轮竞赛焦点——原生多模态。随着 Agent 接管更多长链任务,视觉正从用户输入的图片演变为模型自检反馈,OpenAI 企业报告也将图片上传列为研发场景常用功能第三位。原生多模态要求图像与文本在预训练阶段共同塑造主模型,Kimi K3 的 2.8 万亿参数 MoE 已率先落地该能力。多源:Two Minute Papers ↗ · 量子位 ↗ · 36氪 ↗ · 8天前

🎬创作者

5
37

陶哲轩ICM大会谈AI对数学未来的影响

视频整理了陶哲轩7月底在ICM国际数学家大会上的发言。当AI能够完成相当部分研究级数学工作时,数学共同体应如何应对?数学研究真正追求的目标又是什么?其讨论对其他学科和产业研究也有启发意义。晓辉博士 · 8天前 · 原文 ↗
38

中国发布免费AI视频生成模型Fable

视频聚焦中国最新开源的AI视频生成模型Fable,主打免费可用。Fable的开放发布意味着创作者和开发者无需付费即可使用高质量文生视频能力,可能改变当前由闭源商业模型主导的市场格局,对开源AI生态值得关注。Wes Roth · 8天前 · 原文 ↗
39

开源AI正在赢得竞争

视频博主Matthew Berman发布新视频,主题围绕开源AI模型当前的发展态势及其竞争优势。视频结合Qwen3-8B基准测试数据,探讨开源大模型在性能、生态等方面的最新进展,看点在于用基准数据支撑开源阵营正在赶超闭源的观点。Matthew Berman · 8天前 · 原文 ↗
40

傅盛:懂AI的领导不好糊弄,15分钟完成4个月项目

傅盛分享观点,认为掌握AI能力的领导能极大提升效率,例如将原本需4个月研发的项目缩短至15分钟完成。该视频旨在强调AI工具对研发流程的重塑及领导者需具备的AI素养。傅盛 · 9天前 · 原文 ↗
41

AI如何识别负面评论逻辑漏洞以保护注意力

博主分享利用AI分析负面评论逻辑漏洞的经历,探讨如何避免被无效信息干扰。视频核心在于展示AI工具在信息筛选与注意力保护方面的实际应用价值。晓辉博士 · 9天前 · 原文 ↗

📄论文

7
42

AURORA-LM:面向连续潜空间扩散语言建模的自编码统一表征

针对文本生成仍依赖离散 token 的现状,提出 AURORA-LM:通过自编码器学习高容量、可解码的连续文本潜空间表征,并在此基础上进行扩散建模,避免了压缩潜空间带来的 token 级保真度损失。论文核心贡献在于不为了适配生成模型而简化表征,而是保留表达力同时支持从潜空间还原为离散文本。arXiv · 9天前 · 原文 ↗
43

可执行框架:弥合AI与电力系统教学鸿沟

提出一种基于Jupyter Notebook的可执行教学框架,将电力系统领域知识与AI工作流结合,强调AI建模应遵循工程与电力系统领域规则而非依赖大语言模型。框架提供可复用的实践材料,面向跨学科新手和工程教育者,支持建模、预测、优化与控制等电力AI任务的动手学习。arXiv · 9天前 · 原文 ↗
44

onepot-Bench 0:面向实验室感知能力的化学基准

提出 onepot-Bench 0 基准,旨在评估语言模型在真实化学实验室场景中的能力。当前化学 AI 评测多依赖公网数据,易被纳入训练集,且难以衡量模型在物理实验环境中做出可靠决策所需的实验规划、操作执行及事后分析等综合能力。该基准尝试弥补这一缺口,推动对模型实验级智能的精准衡量。arXiv · 9天前 · 原文 ↗
45

稀疏最小二乘的依赖条件数下界被证实

研究者在稀疏凸优化中证实了 Axiotis 与 Sviridenko 关于线性依赖受限条件数的猜想:基于随机精确体积小集扩张假设,证明了在最小二乘目标下,多项式时间算法无法将受限条件数的线性依赖改进为更优形式。该结果为稀疏回归的计算复杂度提供了精细下界。arXiv · 9天前 · 原文 ↗
46

GradCuit:信用分配梯度流提升测试时潜在推理

针对大语言模型在测试时通过优化连续潜变量进行隐式推理时,序列级信用分配不清晰、潜变量更新对后续推理影响难以解释的问题,作者提出 GradCuit(gradient through circuit)方法,在选定的 Transformer 层插入可优化潜变量状态,并通过梯度流直接连接这些状态与推理轨迹,从而实现更鲁棒、可解释的测试时潜在推理。该方法绕过了必须通过解码 token 进行间接信用分配的局限,使潜变量更新如何塑造后续推理过程变得可追踪。arXiv · 9天前 · 原文 ↗
47

微软研究院开源Orchard:可扩展的智能体AI训练框架

Orchard是微软研究院发布的开源框架,供研究社区跨任务类型训练和评估AI智能体。它通过复用同一套基础设施降低复杂度,同时支持较小模型取得强性能,为智能体AI研究提供可扩展的训练与评估工具。多源:AI Hot(卡兹克) ↗ · 微软研究院 ↗ · 9天前
48

多模态大模型对齐研究:解决幻觉与一致性

该研究深入探讨多模态大语言模型中的偏好对齐机制,指出其在抑制事实错误及图像内容不一致性方面的关键作用。论文系统分析了多模态场景下幻觉的独特表现,为提升模型可靠性提供了理论支撑。Apple 机器学习 · 9天前 · 原文 ↗

🛠️技巧与观点

6
49

LLMs 偏好奖励专家领域内容

Hacker News 高分热议话题,讨论大语言模型在训练与评估中表现出对"专家领域"内容的偏好倾向。这关乎模型对齐与奖励机制设计,对理解 LLM 行为偏性有参考价值。Hacker News · 9天前 · 原文 ↗
50

用 NVIDIA SkillSpector 构建 AI 技能安全审计流水线

教程演示如何利用 NVIDIA SkillSpector 评估 AI 技能的安全态势,构建包含干净、风险、恶意及 MCP 示例的合成技能市场,并通过 LangGraph 编排 YARA 与 SARIF 检查和 CI 策略门,实现自动化扫描与风险拦截。该方案为日益复杂的 AI 代理技能生态提供了一套可落地的安全审计参考实现。AI Hot(卡兹克) · 8天前 · 原文 ↗
51

Steve Yegge:Opus 4.7 导致 Gas Town 项目崩溃

Steve Yegge 指出,其原本设计为可复用的 Gas Town 项目在升级到 Opus 4.7 后崩溃。4.6 及之前版本运行良好,但 4.7 引入的"再来两件事"倾向使模型永远无法收敛,无法真正执行工作,只能不停修改 Gas Town 本身,成为项目失败的关键原因。Simon Willison · 8天前 · 原文 ↗
52

别做AI的传声筒

Simon Willison引用Niklas Gruhn提出的"肉质代理"(meat proxy)一词,指那些不思考、直接把AI输出转发给他人的人。建议用户可以向AI提问,但必须自己阅读、理解并验证结果,再用自己的话组织回复,这是人类能提供的真正增量价值。Simon Willison · 8天前 · 原文 ↗
53

用夜间 Cron 跑提示词自动 Rebase 软件

开发者 David Crawshaw 提出一种模式:设置定时任务,每天用提示词让 AI 拉取上游变更、rebase 本地修改并验证软件可用后替换原版本。这是一种把 LLM 作为软件维护自动化代理的工程实践思路。Simon Willison · 9天前 · 原文 ↗
54

自维持AI病毒原型现身:开源大模型成载体

研究人员利用开源大模型构建了具备自我复制能力的计算机病毒原型,展示了AI技术被滥用的新型风险。该发现揭示了AI安全领域的新挑战,引发对模型部署与内容过滤机制的关注。Import AI · 9天前 · 原文 ↗

📚教程 · 大家在学什么

14
T1

Hugging Face 智能体课程

Hugging Face 官方开源的 AI 智能体(Agent)学习课程,系统讲解智能体概念、主流框架(如 LangChain)与构建方法。课程面向开发者与 AI 学习者,适合希望从零入门并实操搭建 AI Agent 的读者,完成后可掌握智能体设计、工具调用与多步推理等核心能力。Hugging Face · ★ 30.7k · 原文 ↗
T2

easy-vibe:面向AI原生开发者的入门课程

easy-vibe 是一门面向 AI 原生开发者的入门级课程,主打帮助学习者掌握 AI 时代的开发范式与工具使用。适合希望从零开始转型为 AI-native builder 的工程师或产品创作者。课程内容聚焦 vibe coding 等 AI 辅助编程理念,强调在 AI 工具加持下高效构建产品。DataWhale · ★ 18.7k · 原文 ↗
T3

Hugging Face Transformers 官方课程

Hugging Face 官方推出的 Transformers 深度学习课程,内容涵盖 NLP 与 Transformer 模型原理、Transformers 库与 Datasets/Tokenizers 工具的使用,以及模型训练、微调与部署实践。适合 NLP 和深度学习初学者及希望系统掌握 Hugging Face 生态的开发者,完成课程可具备独立使用预训练模型并完成下游任务的能力。Hugging Face · ★ 4.1k · 原文 ↗
T4

世界模型完整学习指南

一个关于 World Model(世界模型)的系统性学习项目,旨在帮助学习者从基础概念到前沿进展全面掌握这一方向。适合对具身智能、强化学习或生成式 AI 感兴趣的学习者,可了解世界模型的核心理论、关键技术及代表性方法。DataWhale · ★ 353 · 原文 ↗
T5

从零搭建具身智能机器人全栈指南

从零到一搭建一台具身智能机器人:深入强化学习、World-Model、VLA 等智能决策方法的工程落地,贯穿仿真环境、控制器、运动规划、感知系统等技能树模块,并在真实项目中跑通"决策—控制—感知"完整链路。DataWhale · ★ 170 · 原文 ↗
T6

RAG 系统的三层工程架构:Prompt、Context 与 Loop

教程指出每个 RAG 系统都建立在 LLM 调用之上的三层工程结构:Prompt(调用本身)、Context(填充模型窗口的内容)、Loop(决定下一次调用何时触发与停止)。理解当前所处的层级是构建与调试 RAG 系统的关键一半。适合正在搭建或优化 RAG 应用的工程师学习系统化思维。TDS · 原文 ↗
T7

用Python和Ollama从零搭建本地CLI Agent

教程讲解如何基于Python和Ollama从零开始构建一个完全本地运行的命令行(CLI)AI Agent,无需付费即可使用。内容涵盖Ollama本地大模型调用、Agent逻辑编排以及CLI交互设计,适合想要动手实践AI Agent开发的Python开发者学习本地化AI应用开发全流程。TDS · 原文 ↗
T8

大语言模型解码策略与输出控制入门

这是一篇 LLM 解码策略教程,共九节,系统讲解模型如何从 logits 生成文本。涵盖贪心解码、温度采样、Top-k 采样、核采样、重复惩罚、波束搜索、停止条件与结构化输出约束等核心技术。适合已了解 Transformer 原理、希望掌握生成阶段可控性技巧的开发者学习,可学到在不同场景下选择合适解码方法来平衡质量、多样性与合规输出。MachineLearningMastery · 原文 ↗
T9

PyTorch Lightning 结构化 MLOps 开发教程

本教程系统讲解如何使用 PyTorch Lightning 构建可复现的 MLOps 训练流水线,涵盖开发环境配置、项目结构组织、DataModule 数据管道搭建以及 LightningModule 模块化深度学习模型设计。适合希望规范深度学习项目工程实践的中级开发者,能学到将 PyTorch 训练流程标准化、提升实验复现性的实用方法。PyImageSearch · 原文 ↗
T10

Transformer 模型从训练到推理全流程讲解

本文是一篇分章教程,系统讲解 decoder-only Transformer 模型从自回归生成、Prefill 与 Decode 阶段,到 KV 缓存原理及其内存占用的完整推理流程。适合想深入理解大语言模型推理机制的学习者和工程师,帮助搞懂模型如何在生成阶段高效利用显存与计算资源。MachineLearningMastery · 原文 ↗
T11

本周AI要闻:Opus超越Fable、Hugging Face遭入侵、AI公司重金砸算力

DeepLearning.AI《The Batch》本周汇编三条要闻:Anthropic的Claude Opus在创意写作基准上超越Fable等作品,展示了闭源大模型在生成质量上的领先地位;Hugging Face遭遇安全事件,暴露闭源模型防护机制的脆弱性,提醒行业重视AI供应链安全;多家AI公司持续大额投入算力,反映头部玩家对算力资源的军备竞赛愈演愈烈。DeepLearning.AI · 原文 ↗
T12

AI 周报:Kimi K3 重塑开源前沿、Muse Spark 1.1 低价竞争、Cloudflare 限制爬虫

本期 The Batch 聚焦三大动态:月之暗面发布 Kimi K3 模型,重新定义开源前沿模型的性能边界;新一代模型 Muse Spark 1.1 以更低价格对竞争对手形成压力;Cloudflare 推出新措施限制 AI 爬虫抓取网站数据,引发关于开放数据与模型训练权利的行业讨论。适合关注大模型行业格局、开源生态与 AI 数据治理的从业者阅读。DeepLearning.AI · 原文 ↗
T13

自我改进的Harness工程:机制、风险与实践

本文系统梳理LLM自我改进中的Harness工程,讲解模型在生成、评估、奖励建模等环节如何形成反馈循环以实现性能提升。内容涵盖自改进机制的设计原理、常见失败模式及安全风险,适合从事LLM训练与对齐研究的工程师与研究者。读者可深入理解递归自我改进(RSI)的理论基础,并掌握构建可控自改进系统的实践要点。lil'log · 原文 ↗
T14

I Don’t Want a Learning Dashboard for My Child

What analog and AI education both get wrongfast.ai · 原文 ↗