📡 每日 AI 信号

📦产品

18
IT之家蚂蚁百灵开源Ming-Image-0.1-Design,UI设计生成专精

蚂蚁百灵大模型开源Ming-Image-0.1-Design系列两款6B参数模型,分别用于从文字需求生成UI、信息图、海报等视觉设计,以及将创意图拆分为可独立编辑的透明图层。同时开源Design Skill和PPT Skill连接前端页面与演示文稿。据称在UI设计专项评测中位列开源第一,主打端到端生成以提升全局风格一致性。

IT之家 · 2天前 · 原文 ↗
AI Hot(卡兹克)通义千问 Qwen-Audio-3.1 全家桶发布,五模型覆盖理解生成交互

阿里通义千问发布 Qwen-Audio-3.1 音频模型系列,包含 ASR、TTS、Realtime 升级版本以及新增的 TTS-Next 与 ASR-Next,共五个模型覆盖音频理解、生成、实时交互与创作场景。全线大幅降价,TTS 约七折、Realtime 约八五折、ASR 最高近一五折;Realtime 支持边说边听与随时打断,并能识别低落情绪后放慢语速做共情回应。

AI Hot(卡兹克) · 2天前 · 原文 ↗
量子位斑马智能发布端侧全模态大模型AutoOmni 2.0

9月23日云栖大会上,斑马智能发布端侧全模态大模型AutoOmni 2.0-23B-A3B,主打车机与物联网场景的本地化多模态理解与交互能力,将接入其元神AI系统。模型面向端侧部署优化,意在降低对云端算力依赖,提升车载等场景的响应速度与隐私表现。

量子位 · 2天前 · 原文 ↗
vLLMvLLM v0.30.1rc0 新增 AMD MI355 密集 NVFP4 与 MoRI 内核镜像

vLLM 发布 v0.30.1rc0 版本,针对 AMD ROCm 平台新增 MI355 GPU 的密集 NVFP4 内核以及 MoRI 内核镜像支持,并完成相关 CI 适配。该更新扩展了 vLLM 在 AMD 数据中心加速器上的低精度推理覆盖范围,为后续 ROCm 后端的性能优化与功能完善奠定基础。

vLLM · 2天前 · 原文 ↗
IT之家小米米家智能洗碗机台式5套开售:1998元,支持AI脏污识别

小米米家智能洗碗机台式5套今日开售,售价1998元,部分地区补贴后低至1699元。该产品主打4组喷淋臂、80°C热风烘干与240小时UV长效存储,并结合光学检测与AI算法在10秒内判别脏污程度以匹配洗涤程序,支持米家App远程控制。

IT之家 · 2天前 · 原文 ↗
OllamaOllama v0.34.4 发布:修复模型未找到错误并优化推理性能

Ollama 发布 v0.34.4 版本,主要更新包括:修复 server 间歇性出现 "model not found" 错误;让 thinking 模型的结构化输出在单次传递中完成;绕过 System Events 进行 ChatGPT/Codex 检测;升级 llama.cpp 与 MLX 后端;为 Gemma 4 动态选择图像分辨率,并加快 Qwen 3.8 的 prompt 处理速度。属于例行小版本更新,提升稳定性与特定模型推理效率。

Ollama · 2天前 · 原文 ↗
AI Hot(卡兹克)Qwen-Image-2.1 双榜登顶开源图像模型第一

通义千问 Qwen-Image-2.1 在 LMArena 的 Image Edit Arena 与 Text-to-Image Arena 双双拿下开源模型第一。图像编辑榜得分 1367、总榜第 16,距第 15 名 GPT-Image-1.5-high-fidelity 仅 3 分,显示出开源模型已逼近闭源头部水平。

AI Hot(卡兹克) · 2天前 · 原文 ↗
IT之家华为WATCH 6系列今日开售,2799元起

华为WATCH 6系列鸿蒙AI手表于9月23日10:08正式开售,售价2799元起,国补后最低2379.15元。搭载HarmonyOS 7,配备腕上鸿蒙AI助手小艺建议,支持重要短信识别排序,联合瑞金医院提供24小时高血压风险评估及AI健康解读功能。

IT之家 · 2天前 · 原文 ↗
Claude CodeClaude Code v2.1.280:Opus 5.5 设为默认

Claude Code 发布 v2.1.280,将 Claude Opus 5.5 设为默认 Opus 模型,支持 1M 上下文,输入 4 美元、输出 20 美元每百万 token,缓存读取 0.20 美元每百万 token。全屏模式下列表支持鼠标交互,新增 CLAUDE_CODE_MAX_MCP_DESCRIPTION_LENGTH 环境变量以调整 MCP 工具描述上限,并记录 hook 输出大小与超限次数。

The Verge AIRabbit推出独立云端AI智能体OS3

Rabbit发布独立AI智能体系统OS3,无需依赖其R1硬件,可在云端运行并跨Windows、Mac和Linux设备本地操作。这是Rabbit从硬件公司向AI软件平台转型的关键一步,回应了此前R1设备市场表现不及预期的困境。

The Verge AI · 3天前 · 原文 ↗
ComfyUIComfyUI 发布 v0.37.1 版本

ComfyUI 发布 v0.37.1 版本更新。该项目是基于节点式工作流的开源 AI 图像生成界面,此次为常规小版本迭代,修复若干稳定性与兼容性问题,提升整体运行可靠性。

ComfyUI · 3天前 · 原文 ↗
量子位商汤发布图像生成模型U1 Pro

商汤正式推出图像生成模型U1 Pro,强调图像写实能力与细节表现。该模型主打真实感图像生成,面向内容创作、设计等场景。

量子位 · 3天前 · 原文 ↗
Kimi 月之暗面 (X)Kimi 推出浏览器扩展,支持侧边栏对话与表单自动化

月之暗面将原 Kimi WebBridge 升级为 Kimi Browser Extension,作为浏览器侧边栏工具,用户可与 Kimi 对话来导航网站、填写表单。重复性任务可录制成 skill,下次由 Kimi 自动执行,扩展已在 Chrome 应用商店上线。

Kimi 月之暗面 (X) · 3天前 · 原文 ↗
NVIDIANVIDIA发布Isaac ROS 5.0,加速开源具身智能机器人开发

NVIDIA推出Isaac ROS 5.0,基于ROS框架提供GPU加速功能包,面向自主机器人应用的感知、推理与执行开发。该版本聚焦物理AI模型与工具链,帮助开发者在动态环境中构建和部署复杂机器人系统。

NVIDIA · 3天前 · 原文 ↗
Hugging Face英国AISI与EvalEval推动基准测试结果可复现

英国AI安全研究所(AISI)联合EvalEval,致力于让AI模型基准测试结果具备可复现性。这意味着研究人员能够更可靠地验证模型表现,减少因评测流程不透明导致的结论偏差,对AI安全研究和方法对比具有重要价值。

Hugging Face · 3天前 · 原文 ↗
Hugging FaceTransformers 现已支持 llama.cpp 量化模型

Hugging Face Transformers 库新增对 llama.cpp 量化格式(quants)的支持,用户可直接在 Transformers 框架中加载并运行这些量化模型。该集成降低了在 Transformers 生态中使用 llama.cpp 量化权重的门槛,有助于提升大模型在消费级硬件上的部署效率。

Hugging Face · 3天前 · 原文 ↗
IT之家一加16跑分超538万,搭载第六代骁龙8至尊版

一加新机PYB110现身安兔兔后台,预计为一加16旗舰,跑分超538万,搭载第六代骁龙8超级至尊版(2nm制程,CPU主频超5.0GHz,性能提升13%)及Android 17系统。第六代骁龙8至尊版采用Adreno Matrix Cores AI专用GPU,AI算力提升为本次升级重点之一。

多源:IT之家 ↗ · TechCrunch AI ↗ · 2天前
AI Hot(卡兹克)OpenAI 发布 GPT-6 Sol 与 Luna,API 定价降至五折

OpenAI 推出 GPT-6 系列两款新模型 GPT-6 Sol 与 Luna,API 定价较 GPT-5.6 促销价下调约 50%。Sol 定价为每百万 tokens 输入 $2、输出 $10,Luna 为输入 $0.10、输出 $0.50,两款模型已上线 API 供开发者调用。

🏭行业

18
Hacker News五角大楼称过度依赖AI导致误炸伊朗学校

美国国防部承认,一枚导弹误击伊朗学校,原因是军方在决策过程中过度依赖人工智能系统。该事件暴露了AI在军事决策链路中的可靠性与伦理风险,引发业界对AI辅助/自主武器系统问责机制的广泛讨论。

Hacker News · 3天前 · 原文 ↗
IT之家英国拟要求安卓和Chrome列出搜索选项,含AI助手

英国竞争与市场管理局9月23日提出新规方案,要求谷歌在用户首次设置安卓手机或打开Chrome时列出可选搜索服务,此后每年提示重新选择一次。符合技术与安全标准的AI助手也将被纳入选择界面。该方案意味着AI搜索服务在英国市场将获得与谷歌搜索同等的默认入口竞争机会,目前公众咨询截止于10月9日。

IT之家 · 2天前 · 原文 ↗
量子位它石智航团队推动中国具身智能规模化落地

它石智航宣布将扩大研发团队并加快生产基地布局,全面提升机器人交付能力,意在推动具身智能从实验室阶段迈入规模化商用落地。此举反映国内具身智能企业在产业化能力建设上的加速布局。

量子位 · 2天前 · 原文 ↗
量子位通义千问新负责人确定:刘大一恒接棒

阿里通义千问(Qwen)团队迎来新一号位,刘大一恒正式接任负责人,与稚晖君同届的华为天才少年出身。该人事调整意味着Qwen系列的研发方向与团队架构将进入新阶段,备受开源社区关注。

量子位 · 2天前 · 原文 ↗
TechCrunch AI希腊总理坦言:各国政府尚未准备好应对AI

希腊总理米佐塔基斯在受访中坦率表示,尽管各国领导人通常只顾推介,但人工智能即将带来的冲击没有任何政府已做好准备。AI发展速度远超政策响应,这一表态凸显全球治理滞后于技术变革的现实困境。

TechCrunch AI · 2天前 · 原文 ↗
IT之家双一流高校本科4年将扩容7.6万人,重点支持AI等学科

教育部宣布2027—2030年“双一流”高校本科招生将再扩容7.6万人,扩容同步推进学科结构优化,重点支持人工智能、集成电路、生物医药、新能源等前沿与新兴交叉学科。同时将利用中央预算内投资和超长期特别国债支持高校新建校区及改善办学条件。

IT之家 · 2天前 · 原文 ↗
量子位岚图旗舰MPV搭载华为全域L3智驾架构上市

岚图推出旗舰MPV车型,全系搭载华为全新智驾系统与全域L3架构,配备120kWh大电池,售价42万元起。车辆自重与续航能力突出,展示了华为车BU智驾方案在高端MPV场景的落地。

量子位 · 2天前 · 原文 ↗
AI Hot(卡兹克)OpenRouter发布2026年嵌入模型选型指南覆盖37款

OpenRouter于2026年9月更新嵌入模型目录,共收录37个条目,并通过自家API对其中19个模型发起批量请求、执行28项检查以验证请求与响应行为一致性,为开发者选型提供实测参考。

AI Hot(卡兹克) · 2天前 · 原文 ↗
Hacker NewsTransformer 模型可视化详解(HN热帖)

Hacker News 热议 · 592 分 · 87 条评论

Hacker News · 4天前 · 原文 ↗
IT之家苹果搁置AI吊坠项目,曾设想以摄像头增强Siri

彭博社记者Mark Gurman透露,苹果曾研发一款配备摄像头的AI可穿戴设备,形态类似挂坠,可佩戴于颈部或衣物,原计划作为“始终在线”的视觉感知终端,将画面交由新一代Siri处理以实现识别与辅助。该项目目前已被搁置,苹果未公布重启计划。

IT之家 · 2天前 · 原文 ↗
TechCrunch AISnorkel AI融资3.5亿美元估值跃至35亿美元

数据即服务平台Snorkel AI完成3.5亿美元E轮融资,估值从约12亿美元提升至35亿美元。该公司专注于为AI模型训练提供数据标注与准备服务,本轮融资反映出市场对高质量训练数据需求的持续增长。

TechCrunch AI · 3天前 · 原文 ↗
The Verge AIa16z推出零作业创业学院,联手Palantir等10家AI巨头

a16z发起"Horowitz Andreessen Academy",联合Anduril、Anthropic、Google、Meta、Nvidia、OpenAI、Palantir等10家科技公司,提供4200万美元资金,面向年轻人打造进入硅谷创业生态的通道。该项目不设作业,强调实战与人才输送,反映顶级VC在AI时代争夺早期人才的战略布局。

The Verge AI · 3天前 · 原文 ↗
Ars Technica微软瓦解利用AI辅助的钓鱼平台EvilTokens

微软联合多国执法机构捣毁名为EvilTokens的钓鱼即服务平台,该平台提供端到端自动化工具,已被用于实施约1.2万起账户入侵。值得关注的是其核心能力由AI辅助,可大幅降低大规模定向攻击的门槛。

Ars Technica · 3天前 · 原文 ↗
AI Hot(卡兹克)Meta AI助手Muse曝0-day漏洞,亚马逊封禁其购物功能

Meta AI助手Muse存在严重0-day漏洞,本地应用或终端命令可窃取用户认证token,从而完全控制智能体。安全研究员已开发出包括写入恶意文件和拍照在内的多个概念验证攻击,Meta在大约12小时后发布热修复补丁。同时,亚马逊以Muse为未授权AI agent为由,开始封禁其购物功能。

量子位阿里预测三年内出现原生全模态统一生成模型

陆川用AI手搓历史现场短片,王珞丹用AI做卡牌游戏demo,体现AI在影视与游戏创意生产环节的实际落地。阿里在宣传片中表态,未来三年内将出现原生全模态统一生成模型,届时文本、图像、视频等模态边界不再限制生成体验。

量子位 · 3天前 · 原文 ↗
量子位Agent时代CPU价值重估:CPU与GPU配比趋近1:1

随着AI Agent成为主流计算负载,数据中心CPU与GPU的配比正从过去的悬殊比例向接近1:1靠拢,CPU在AI基础设施中的角色与价值需要被重新评估。这一变化反映出Agent任务对CPU侧的调度、推理和I/O能力提出了更高要求,将影响芯片厂商的产品路线与服务器架构设计。

量子位 · 3天前 · 原文 ↗
量子位WebArena作者Shuyan Zhou入职Meta超级智能实验室

梦想是做能帮妈妈订机票的AI浏览器。

量子位 · 3天前 · 原文 ↗
MIT 科技评论别被这轮 AI 炒作热潮蒙蔽双眼

近几个月 AI 领域炒作不断:4 月底 Anthropic 宣称其模型 Claude Mythos 在查找软件漏洞方面超越多数安全专家;随后 OpenAI 与 Hugging Face 也相继发声。作者提醒读者不要被夸大宣传迷惑,应冷静看待这些技术声明的真实价值与局限。

MIT 科技评论 · 3天前 · 原文 ↗

📅AI 活动

6
NVIDIANVIDIA AI Day新加坡站展示东南亚AI进展

NVIDIA于9月22-23日在新加坡莱佛士城会展中心举办AI Day Singapore活动,与合作伙伴展示东南亚地区的AI技术突破。活动设有实操培训、专家讲座及高性能计算工具,帮助开发者加速AI工作。活动本身为常规的区域性市场推广与技术展示,未发布新产品或重大技术成果。

NVIDIA · 2天前 · 原文 ↗
TechCrunch AITechCrunch 创始人峰会11月4日波士顿举行

TechCrunch 公布 Founder Summit 议程,聚焦创业公司在融资、招聘和 AI 方面的挑战与机会,活动将于11月4日在波士顿举办,为创始人提供经验分享与资源对接。

TechCrunch AI · 2天前 · 原文 ↗
Devpost · AI Hackathons (X)Devpost推出短时长AI学习黑客松

Devpost Learn 推出新型黑客松活动,主打短时长、以学习为核心,围绕与 AI 协作构建项目。开发者可在数小时内完整体验从 prompt 到调试的 AI 辅助开发流程,适合想要积累 AI 编程实战经验的初学者和中级开发者。原文未提供具体报名截止时间与活动地点,建议关注 Devpost 官网获取最新排期。

Devpost · AI Hackathons (X) · 3天前 · 原文 ↗
量子位直播预告:工业AI场景规模化落地讨论

两位嘉宾将围绕工业AI从“能用”走向“规模化”的关键问题展开讨论,覆盖真实工厂部署、产品复制、生态建设及下一批机会,聚焦未来两三年内有望率先爆发的工业AI场景。

量子位 · 3天前 · 原文 ↗
Google News · 国内 AI 活动第五届GMIF创新峰会9月23日开启

第五届GMIF(全球存储器创新论坛)创新峰会将于9月23日举办,聚焦AI存储主题,汇聚存储产业链上下游厂商围绕AI驱动的存储器技术演进与产业趋势展开讨论。原文未提供具体举办地点、线上线下形式及报名截止时间,需以主办方后续公告为准。

Google News · 国内 AI 活动 · 3天前 · 原文 ↗
Google News · 国内 AI 活动世界人工智能大会即将召开,第一财经提前探访

世界人工智能大会(WAIC)即将召开,第一财经记者提前探访现场。原文未提供具体时间、地点、报名方式及议程等细节。属于大型综合性 AI 行业展会,适合关注 AI 行业趋势、产业链及厂商动态的从业者与观众。

Google News · 国内 AI 活动 · 4天前 · 原文 ↗

🎬创作者

3
Wes RothAI公司或隐藏重大数学突破:先驱访谈引发讨论

视频围绕量子计算先驱 Scott Aaronson 的观点展开,他认为奇点已经开始,并透露 AI 公司可能握有未公开的重大数学突破。视频结合近期 OpenAI 拿下 Navier–Stokes 方程进展引发的争议,探讨当机器能够做出人类难以理解的发现时会发生什么,以及学界对这种趋势的反应与警示。

Dwarkesh Patel惩罚AI“坏想法”为何会适得其反

AI 研究者 Noam Brown 在节目中指出,训练时直接惩罚模型的“不良思维链”可能产生反效果,反而削弱其推理能力。这一发现对当前主流的 AI 安全训练方法具有重要参考意义。完整访谈可通过链接观看。

Dwarkesh Patel · 3天前 · 原文 ↗
晓辉博士ChatGPT连接Notion不耗Work额度的方法

视频介绍一种把ChatGPT与Notion打通的使用方式:将Notion作为云盘,借助ChatGPT的Chat模式实现Agent能力,且不消耗Work账户额度。属于实操层面的使用技巧分享,适合日常协作场景。

晓辉博士 · 3天前 · 原文 ↗

📄论文

12
IT之家康奈尔大学研发可感知并改变环境温度的微型机器人

康奈尔大学物理团队开发出首个能感知环境温度并协同改变局部温度的微型机器人,结合环境感知、人造纤毛液体操控与芯片间通信形成反馈回路,可将液体从高温区泵送至低温区,未来有望应用于医疗、农业等领域。

IT之家 · 2天前 · 原文 ↗
Nature Machine Intelligence用大模型预测分子编辑序列优化可合成性

Li 和 Lai 提出一种让大语言模型预测精确结构编辑的方法,用以修复计算药物设计中难以合成的分子。实验显示该方法在编辑准确性与关键特征保留上优于传统路径;同时还发布了用于基准测试的数据集。该工作为大语言模型参与药物设计的可合成性优化环节提供了新范式。

Nature Machine Intelligence · 2天前 · 原文 ↗
IT之家DeepSeek公开Agent训练基础设施论文,梁文锋署名

DeepSeek发布由梁文锋署名的新论文,公开其Agent训练基础设施DSec(DeepSeek Elastic Compute)的技术细节。DSec可每秒生成5000+沙盒、日均300万个、峰值38万个并发,依托约160节点、3万核CPU、250TB内存的单集群。该系统针对Agent训练中每步都会改变环境状态、需频繁创建销毁干净沙盒的挑战,提供了大规模沙盒的工程解决方案。

多源:IT之家 ↗ · 量子位 ↗ · 2天前
arXivFlash-dLLM:面向扩散语言模型的IO感知KV缓存与并行解码

针对扩散大语言模型(dLLM)缺乏有效KV缓存机制、并行解码效率受限的问题,本文提出Flash-dLLM,通过IO感知的KV缓存策略与并行解码方案,在保持生成质量的同时显著提升推理速度与显存效率。核心贡献在于将KV缓存与并行解码联合设计,缓解了缓存复用与并行token验证之间的I/O瓶颈,使dLLM的实用部署成为可能。

arXiv · 3天前 · 原文 ↗
arXiv · 视觉计算φ-RIE:让3D高斯重建场景支持物理交互

针对3D高斯泼溅(3DGS)重建出的逼真场景无法直接用于机器人仿真中的物理交互问题,提出φ-RIE方法,将场景分解为可独立运动的对象,使对象间可发生接触并暴露被遮挡区域,弥合了高保真重建与物体级可交互仿真之间的差距。

arXiv · 视觉计算 · 3天前 · 原文 ↗
arXiv · 视觉计算HARMONY:分层智能体推理的单图3D场景合成

论文提出HARMONY框架,将智能体推理与视觉几何基础模型相结合,从单张单目图像重建完整3D场景。智能体推理提供物体间空间关系的语义理解,视觉几何模型提供稠密点云预测,二者互补以同时获得准确的对象关系与高保真重建质量。

arXiv · 视觉计算 · 3天前 · 原文 ↗
arXiv · 视觉计算DreamStream:面向端到端驾驶策略的生成式闭环仿真器

现有自动驾驶仿真平台存在 sim-to-real 视觉差距,破坏策略感知,影响闭环评估。DreamStream 提出以仿真器为锚点的自回归视频生成方法,实现面向驾驶策略的视觉保真度,使生成的观测保留策略决策所依赖的场景特征,从而更可靠地评估端到端驾驶策略的闭环决策能力。

arXiv · 视觉计算 · 3天前 · 原文 ↗
arXiv面向延迟信息共享的分布式部分可观测团队决策方法

针对部分可观测马尔可夫决策过程中的分布式团队决策问题,提出结合团队理论等价与低秩潜在动力学表示的框架,在无需先验转移模型知识的前提下,使各成员基于本地私有信息和延迟共享的公共信息进行协作决策。该方法将低秩结构用于补偿未知系统模型带来的不确定性,为通信受限场景下的多智能体协作提供了理论支撑和实用算法。

arXiv · 3天前 · 原文 ↗
arXivAgensh:无中心编排的可扩展多智能体框架

提出 Agensh,一种无中心编排器的自组织多智能体框架,通过并发执行多智能体协作循环并持续收集状态来解决现有框架受限于中心调度器扩展性的问题,可将组织级智能扩展至 1,024 个智能体规模。

arXiv · 3天前 · 原文 ↗
arXivSpeakerMem-R1:以说话人为中心的双轨记忆框架

针对多方对话中长程记忆的难题,论文提出 SpeakerMem-R1,采用以说话人为中心的双轨记忆机制,同时建模“谁说了什么”“针对谁”“个体间相互认知”“群体共享信息”以及“状态随时间演变”五个维度。区别于通用 LLM 记忆系统仅检索相关内容的做法,该方法显式区分人物与群体关系,并整合跨成员、跨群体的分散线索。在多方对话基准上的实验表明,其在人物关系保持与状态追踪方面优于现有方法,为长期多方对话理解提供了更可控的记忆结构。

arXiv · 3天前 · 原文 ↗
arXivCliffCompaction:长任务编码Agent的降本压缩方法

针对长任务编码Agent需要跨会话压缩上下文的问题,提出CliffCompaction自动压缩技术。该方法在有界上下文下可降低最高50%成本,同时在Terminal-Bench上保持或提升性能,并在KernelBench上取得SOTA。该工作降低了每次rollout成本,为测试时扩展提供了更优的性能-成本权衡。

arXiv · 3天前 · 原文 ↗
arXiv · 视觉计算StableVQ:稳定向量量化分词器训练的实用指南

StableVQ针对离散视觉分词器中向量量化(VQ)的训练不稳定问题,提出根因在于Encoder-Decoder与Codebook训练的相互纠缠,并据此给出实用训练准则,以提升码本利用率与生成质量。

arXiv · 视觉计算 · 3天前 · 原文 ↗

🛠️技巧与观点

3
Simon WillisonSF 10月14日举办 Agentic Engineering 主题交流会

Simon Willison 与 Jesse Vincent 将于 10 月 14 日晚在旧金山举办一场聚焦 Agentic Engineering 的线下聚会,参与者可分享基于编程 Agent 构建的实验性项目、未公开的工作与踩坑经验,属于面向开发者的小型 show-and-tell 交流活动。

Simon Willison · 2天前 · 原文 ↗
Simon WillisonTikTok 创作者警示 AI 生成脚本的明显痕迹

博主 @therealcornpop 指出,使用 AI 撰写 TikTok 和 YouTube 脚本有明显特征,包括固定句式、缺乏个性化观点等。他在视频中列举了多种可被识别的 AI 写作模式,提醒内容创作者不要依赖 AI 生成脚本。

Simon Willison · 3天前 · 原文 ↗
Simon Willisonllm-typesafe 0.1a0 发布,支持 TypeSafe AI Jev 模型

Simon Willison 发布 llm-typesafe 0.1a0 插件,为其 LLM CLI 工具接入 TypeSafe AI 旗下 Jev 模型。该模型专用于 yes/no 判断或多选分类等受限输出场景,开发者可通过简单命令让 LLM 返回结构化的 JSON 结果,便于构建需要确定性输出的应用。

多源:Simon Willison ↗ · 量子位 ↗ · 3天前

📚教程 · 每日精选

14
GitHub 热门E2B Cookbook:云端代码解释器实战示例集
★ 1.4k

E2B Cookbook 是 E2B 团队维护的官方示例合集,展示如何在 AI Agent 和应用中调用 E2B 的云端代码解释器沙盒,涵盖数据可视化、文件处理、浏览器自动化、与 LLM 集成等典型用例。适合正在构建 AI Agent、代码执行工具或需要安全沙箱执行任意代码的开发者参考学习。

GitHub 热门 · 内容更新于 2天前 · 原文 ↗
推荐于 2026-09-23
DataWhale从零搭建具身AI机器人:决策到感知全链路实战
★ 498

从零到一搭建一台具身智能机器人:深入强化学习、World-Model、VLA 等智能决策方法的工程落地,贯穿仿真环境、控制器、运动规划、感知系统等技能树模块,并在真实项目中跑通"决策—控制—感知"完整链路。

DataWhale · 内容更新于 2天前 · 原文 ↗
推荐于 2026-09-23
Towards Data Science用对抗性测试集主动暴露 RAG 检索漏洞

文章介绍一种为 RAG(检索增强生成)系统设计的小型对抗性测试集方法,用于在用户使用前主动发现评估集无法捕捉的检索失败问题。适合做 RAG 系统开发的工程师学习,能学到如何构建针对性的对抗样本来压力测试检索环节,提升系统鲁棒性。

Towards Data Science · 内容更新于 3天前 · 原文 ↗
推荐于 2026-09-23
HF 官方课程Hugging Face 3D 机器学习课程
★ 184

Hugging Face 推出的免费课程,聚焦 3D 机器学习方向,系统讲解 3D 表征(如点云、体素、NeRF)、常用数据集与模型,以及在 Hugging Face 平台上加载、微调与部署 3D 相关模型的实践流程。适合具备一定深度学习基础,希望进入 3D 视觉、具身智能或 AR/VR 领域的开发者与研究人员,可作为该方向的入门到进阶学习路径。

HF 官方课程 · 内容更新于 3天前 · 原文 ↗
推荐于 2026-09-23
ML Mastery生产环境中 Scikit-LLM 嵌入漂移的监控方法

本文介绍嵌入漂移的概念及其对生产环境中大语言模型的重要性,并讲解两种实用的监控技术。嵌入漂移会显著影响模型输出质量,及时发现与应对可保障 LLM 流水线的稳定性与可靠性。

ML Mastery · 内容更新于 3天前 · 原文 ↗
推荐于 2026-09-23
DeepLearning.AI 课程用端侧内存构建AI助手:多模态记忆实战课
中级 · 1h4m

本课程聚焦本地设备端记忆系统,教你搭建一个不依赖云端、能跨文本、语音、图像存储与检索经验的AI助手。学员将学习将记忆编码为向量、按语义检索,并教会助手识别新对象。适合希望在端侧部署AI、保护隐私并实现多模态交互的开发者学习。

DeepLearning.AI 课程 · 原文 ↗
推荐于 2026-09-23
PyImageSearchDVC流水线构建可复现ML管道教程

教程讲解如何用 DVC Pipelines 构建可复现的机器学习工作流,覆盖项目搭建、流水线架构、数据预处理、模型训练与版本管理、评估指标追踪等阶段。适合有一定 ML 基础的工程师学习 MLOps 工程实践,掌握 DVC 在团队协作与实验复现中的实际用法。

PyImageSearch · 内容更新于 11天前 · 原文 ↗
推荐于 2026-09-23
GitHub 热门从零开始的 AI 工程学习教程
★ 55.5k

一个面向初学者的 AI 工程实战教程项目,主张"学—做—分享"三步走。内容覆盖 AI 智能体、计算机视觉等方向,通过项目实践帮助学习者掌握 AI 工程开发技能,适合想系统入门 AI 工程化的开发者。

GitHub 热门 · 内容更新于 2天前 · 原文 ↗
推荐于 2026-09-23
DataWhale《Easy Data x AI》数据与AI基础入门课程
★ 176

这是一门面向AI爱好者的入门级课程,通过数据与AI双轨学习路径,帮助学习者从数据驱动视角理解并构建AI Agent。课程聚焦基础概念与实践方法,适合编程与AI基础薄弱、希望系统了解数据与AI结合的学习者。

DataWhale · 内容更新于 3天前 · 原文 ↗
推荐于 2026-09-23
Towards Data Science用 Claude Code 构建声纹识别应用

教程展示如何利用 Claude Code 或 Codex 作为 AI 编程助手,开发一个内部用的说话人识别(声纹识别)工具。内容涵盖用 AI 编码工具搭建声纹识别应用的完整流程,适合想学习如何把 AI 编程助手用于实际音频处理项目的开发者。读者可以学到将语音嵌入与说话人识别逻辑集成到一个可用的内部工具中的方法。

Towards Data Science · 内容更新于 3天前 · 原文 ↗
推荐于 2026-09-23
HF 官方课程Hugging Face Datasets 课程:构建与共享 AI 数据集
★ 12

Hugging Face 官方推出的 Datasets 课程,系统讲解如何使用其开源数据集库加载、处理、分析和共享数据集,覆盖数据探索、流式读取、评估指标等内容。适合需要在 NLP、机器学习项目中处理数据的开发者与研究人员学习,完成后可掌握 Hugging Face Hub 数据集协作流程。

HF 官方课程 · 内容更新于 3天前 · 原文 ↗
推荐于 2026-09-23
ML Mastery将提示模板作为超参数用GridSearchCV调优

教程介绍如何借助 scikit-LLM 库,将 LLM 的提示模板视作可调超参数,并用 scikit-learn 的 GridSearchCV 系统化搜索最优模板组合。读者可学会把提示工程融入传统 ML 超参搜索流程,对构建 LLM 分类或评测流水线、希望自动化提示选择的工程师较为实用。

ML Mastery · 内容更新于 10天前 · 原文 ↗
推荐于 2026-09-23
DeepLearning.AI 课程《Transformers in Practice》课程:深入理解Transformer模型
中级 · 11h1m

本课程由Sharon Zhou主讲,聚焦Transformer模型的底层原理与实践能力。学习者将超越简单调用LLM的层面,建立对模型行为的直觉,掌握调试实际问题的方法,并学会在部署基于Transformer的模型时做出更明智的技术决策。适合希望深入理解大模型工作机制、而非仅停留在应用层面的工程师与研究者。

DeepLearning.AI 课程 · 原文 ↗
推荐于 2026-09-23
GitHub 热门中文 AI Agent 学习路线图资源合集
★ 7.1k

一个三语(繁体中文/英文/简体中文)AI Agent 学习路线图项目,从 LLM 基础知识讲起,覆盖单智能体与多智能体系统,收录 240+ 精选学习资源与动手实践示例。适合想要系统学习 Agent 开发的入门与进阶者,可作为按图索骥的自学索引。

GitHub 热门 · 内容更新于 2天前 · 原文 ↗
推荐于 2026-09-23