📡 每日 AI 信号

📦产品

11
IT之家谷歌Docs和云盘原生支持Markdown格式

谷歌为Google Docs和Google Drive应用加入Markdown(.md)格式原生支持,可直接打开、编辑和评论.md文件,并支持实时协作。该功能面向AI智能体协作编辑场景设计,可与Gemini Notebook同步,正在逐步推送。

IT之家 · 14小时前 · 原文 ↗
Hugging FaceFalcon-Emirati:首个阿联酋方言大模型发布

Hugging Face发布基于Falcon架构微调的阿拉伯语阿联酋方言大模型Falcon-Emirati,专注于理解本地方言、文化语境和语言细微差别,面向阿联酋及海湾地区的本地化应用场景。这是开源Falcon系列在区域语言适配上的重要扩展。

Hugging Face · 17小时前 · 原文 ↗
GitHub 新仓库agent-memory:AI智能体长期记忆本地运行时

tigerless-labs 开源 agent-memory,面向 AI 智能体(如 Claude Code、Codex)的长期记忆运行时。以纯 Markdown 作为唯一事实来源,本地排序检索实现高效取回,独立的 sleep-time Manage 层负责整理记忆,多个智能体共用同一存储,无需 API Key。亮点在于 local-first 架构与对纯文本可读性的坚持,便于人工审计与跨工具复用。

GitHub 新仓库 · 4天前 · 原文 ↗
OllamaOllama v0.40.0:Apple Silicon 默认启用 MLX 推理版本进展 · 8 条

Ollama 发布 v0.40.0 版本,在 Apple Silicon 设备上默认使用 MLX 运行时运行支持的模型架构,新增 gemma4、qwen3.5/3.6/3.8 等模型,并上线多款 MLX 决策模型。对于 Mac 用户而言,这能显著提升本地模型推理性能与能效比,是一次面向 Apple Silicon 的重要底层优化。

Ollama · 21小时前 · 原文 ↗
版本进展仅含已收录报道
  1. 报道日期 本条

    Ollama v0.40.0:Apple Silicon 默认启用 MLX 推理v0.40.0-rc5

    Ollama 发布 v0.40.0 版本,在 Apple Silicon 设备上默认使用 MLX 运行时运行支持的模型架构,新增 gemma4、qwen3.5/3.6/3.8 等模型,并上线多款 MLX 决策模型。对于 Mac 用户而言,这能显著提升本地模型推理性能与能效比,是一次面向 Apple Silicon 的重要底层优化。

    Ollama · 原文 ↗
  2. 报道日期

    Ollama v0.40.0:Apple Silicon 默认启用 MLX 推理v0.40.0-rc3

    Ollama 发布 v0.40.0 版本,在 Apple Silicon 设备上默认通过 MLX 运行时运行受支持的模型架构,并新增 gemma4、qwen3.6、qwen3.5 等模型以及 Nimble、tev1、clef 等决策类模型。MLX 路径可利用 Apple Silicon 神经引擎与 GPU,提升端侧大模型推理性能与能效,对本地 LLM 用户意义明显。

    Ollama · 原文 ↗
  3. 报道日期

    Ollama v0.35.1 接入 Cloudflare Clef 多模态决策模型v0.35.1

    Ollama 0.35.1 版本新增对 Cloudflare 开源决策模型 Clef(27B)和 Clef Flash(9B)的支持,通过 /v1/systemone 端点调用。这两个模型均为多模态,可在请求中同时附带图像与文本状态信息,并对多问联合评分。

    Ollama · 原文 ↗
查看更早的 5 条进展收起更早进展
  1. 报道日期

    Ollama v0.35.1:单次响应支持十次网页搜索v0.35.1-rc0

    Ollama 发布 v0.35.1 版本,主要更新包括:单次响应允许最多十次网页搜索、MLX 与 llama.cpp 后端版本升级(llama.cpp 至 b11232)、create 命令支持显式声明模型能力。属于小版本补丁,对本地大模型运行工具的搜索能力与后端依赖做了增强与维护。

    Ollama · 原文 ↗
  2. 报道日期

    Ollama v0.35.0 上线决策模型 APIv0.35.0

    Ollama 推出 /v1/decision 端点,支持决策模型(Decision Models)调用,模型返回选项、概率和分数而非生成文本,适用于工单分流、模型路由、内容分类等场景。目前已支持 Bespoke Labs 的 Nimble 和 Together AI 的 Tev1 两种模型,用户可通过 ollama pull 安装。

    Ollama · 原文 ↗
  3. 报道日期

    Ollama v0.40.0:Apple Silicon 默认启用 MLX 推理v0.40.0-rc0

    Ollama 发布 v0.40.0 版本,支持 MLX 的模型架构在 Apple Silicon 设备上默认通过 MLX 后端运行,无需额外配置。RC 阶段将逐步启用更多模型,用户可通过 ollama pull 与 ollama run 直接调用如 qwen3:8 等模型。这是 Ollama 在 macOS 本地推理性能优化上的重要进展。

    Ollama · 原文 ↗
  4. 报道日期

    Ollama v0.34.4:MLX Runner 升级 XGrammar 至 0.2.7v0.34.4

    Ollama 发布 v0.34.4 版本,主要更新 MLX Runner 中用于结构化输出的 XGrammar 库至 0.2.7。该版本修复了类型化字典值与短数组的 schema 解析问题,提升了 Apple Silicon 设备上结构化输出的兼容性。属于一次小版本补丁,无新增功能。

    Ollama · 原文 ↗
  5. 报道日期

    Ollama v0.34.4 发布:修复模型未找到错误并优化推理性能v0.34.4-rc0

    Ollama 发布 v0.34.4 版本,主要更新包括:修复 server 间歇性出现 "model not found" 错误;让 thinking 模型的结构化输出在单次传递中完成;绕过 System Events 进行 ChatGPT/Codex 检测;升级 llama.cpp 与 MLX 后端;为 Gemma 4 动态选择图像分辨率,并加快 Qwen 3.8 的 prompt 处理速度。属于例行小版本更新,提升稳定性与特定模型推理效率。

    Ollama · 原文 ↗
Claude CodeClaude Code v2.1.290 新增插件钩子与主题类型版本进展 · 9 条

Claude Code 发布 v2.1.290 版本,在插件钩子 API 上做了扩展:mod 的 turn.step 钩子结果中新增 serverToolUses(包含顾问调用的工具 id、name、input、起止时间);plugin hooks 的 tool.check 事件新增 agentId 以区分子代理与主会话的权限检查;tool.check 钩子可读取组织要求的审批上限;插件钩子类型中新增 ThemeKey 和 Color 类型,便于编辑器列出主题配色。

Claude Code · 24小时前 · 原文 ↗
版本进展仅含已收录报道
  1. 报道日期 本条

    Claude Code v2.1.290 新增插件钩子与主题类型v2.1.290

    Claude Code 发布 v2.1.290 版本,在插件钩子 API 上做了扩展:mod 的 turn.step 钩子结果中新增 serverToolUses(包含顾问调用的工具 id、name、input、起止时间);plugin hooks 的 tool.check 事件新增 agentId 以区分子代理与主会话的权限检查;tool.check 钩子可读取组织要求的审批上限;插件钩子类型中新增 ThemeKey 和 Color 类型,便于编辑器列出主题配色。

    Claude Code · 原文 ↗
  2. 报道日期

    Claude Code v2.1.289 修复多项终端与权限规则问题v2.1.289

    Claude Code 发布 v2.1.289 版本,修复了复合 shell 命令嵌套部分拒绝规则被 mod 授权覆盖的问题、含大量未闭合标签或深层 ${ 替换的短代码块导致终端冻结的问题,以及 IDE 中通过 symlink @提及或选中的文件未触发读拒绝规则的问题(VSCode);同时回退了 v2.1.288 中导致频繁登出的 claude auth status 变更,并改进了插件中大文件的打开速度。

    Claude Code · 原文 ↗
  3. 报道日期

    Claude Code v2.1.288 发布:新增选择接口与多项修复v2.1.288

    Anthropic 旗下 Claude Code 发布 v2.1.288 版本,新增 mods 可调用的 $.ui.selection() 接口以返回全屏模式下选中的文本,集成无 GitHub CLI 环境的 gh api,并为 Ctrl+C 清空提示符后通过上箭头恢复草稿(含粘贴文本和图片)增加了恢复逻辑,同时修复文件名、jq 过滤器和 GitHub 错误中的控制字符发送到终端等问题。

    Claude Code · 原文 ↗
查看更早的 6 条进展收起更早进展
  1. 报道日期

    Claude Code v2.1.287 新增 Claude Mods 与「You should know」侧代理v2.1.287

    Claude Code 发布 v2.1.287 版本,新增 Claude Mods 机制,允许插件修改更深层行为;内置推出「You should know」模组,通过侧代理监听并标记用户或 Claude 可能遗漏的问题,可在 telemetry 开启的一方会话中用 `/plugin enable` 启用。代理视图新增 `n:` 过滤项匹配会话名与任务,并在折叠区域内展示匹配结果。OpenTelemetry 的 user_prompt 事件也补充了 prompt_text 字段。

    Claude Code · 原文 ↗
  2. 报道日期

    Claude Code v2.1.286 版本更新v2.1.286

    新增权限请求堆叠时的计数提示(如“2 of 5”);在列表全屏模式下支持鼠标点击/悬停“N more”行跳转;修复 GCP/AWS 认证过期时多进程重复弹出登录浏览器的问题;修复并行工具调用场景下 claude --resume 与 --continue 偶发丢失会话轮次的问题。属于稳定性和交互细节改进。

    Claude Code · 原文 ↗
  3. 报道日期

    Claude Code v2.1.285 新增禁用 WebFetch 与桌面启动支持v2.1.285

    Claude Code 发布 v2.1.285 版本,主要新增四项能力:CLAUDE_CODE_DISABLE_WEB_FETCH 环境变量用于关闭 WebFetch 工具、claude --desktop 命令可在当前目录或通过 --continue/--resume 打开 Claude 桌面应用、claude plugin configure 可查看与设置插件选项,以及在 claude plugin install --config 中支持 .= 语法以便安装时直接配置捆绑的 .mcpb MCP 服务器。属于面向开发者的常规功能迭代,提升了工作流集成与插件配置效率。

    Claude Code · 原文 ↗
  4. 报道日期

    Claude Code v2.1.283 新增网关提示与模型管控配置v2.1.283

    Claude Code 发布 v2.1.283 版本,新增 x-claude-code-prompt-id 网关提示请求头,配合 CLAUDE_CODE_GATEWAY_HINT_HEADERS=1 可让 LLM 网关按用户提示聚合请求;新增 availableModelsMatch(exact 模式)与 deniedModels 两个托管设置,用于精细控制可用模型列表与阻断特定模型。

    Claude Code · 原文 ↗
  5. 报道日期

    Claude Code v2.1.282 新增终端宽度与遥测提示v2.1.282

    Claude Code 发布 v2.1.282 版本,新增 maxProseWidth 设置以限制宽终端中文本宽度(表格与代码块保持原宽),并在启动提示、/status 和 claude doctor 中列出项目设置文件中被忽略或关闭遥测的变量;新增 allowClaudeInChromeWithManagedMcp 受管设置,允许 claude --chrome 与 exclusive managed-mcp.json 共存,Chrome 被阻断时错误信息会明确指明原因。

    Claude Code · 原文 ↗
  6. 报道日期

    Claude Code v2.1.280:Opus 5.5 设为默认v2.1.280

    Claude Code 发布 v2.1.280,将 Claude Opus 5.5 设为默认 Opus 模型,支持 1M 上下文,输入 4 美元、输出 20 美元每百万 token,缓存读取 0.20 美元每百万 token。全屏模式下列表支持鼠标交互,新增 CLAUDE_CODE_MAX_MCP_DESCRIPTION_LENGTH 环境变量以调整 MCP 工具描述上限,并记录 hook 输出大小与超限次数。

    Claude Code · 原文 ↗
ComfyUIComfyUI v0.39.0 发布版本进展 · 7 条

ComfyUI 发布 v0.39.0 版本,新增对 LynnReal 光照 Minimax-H3 VAE 的支持,文档同步至 v0.5.13,并默认使用更高质量的视频编码参数。新增 DynamicGroup 小组件输入能力,同时修复了模型扫描中断、硬盘哈希关闭后资源记录丢失,以及选择 int8/int4 缓存时崩溃等多项问题。

ComfyUI · 1天前 · 原文 ↗
版本进展仅含已收录报道
  1. 报道日期 本条

    ComfyUI v0.39.0 发布v0.39.0

    ComfyUI 发布 v0.39.0 版本,新增对 LynnReal 光照 Minimax-H3 VAE 的支持,文档同步至 v0.5.13,并默认使用更高质量的视频编码参数。新增 DynamicGroup 小组件输入能力,同时修复了模型扫描中断、硬盘哈希关闭后资源记录丢失,以及选择 int8/int4 缓存时崩溃等多项问题。

    ComfyUI · 原文 ↗
  2. 报道日期

    ComfyUI 发布 v0.38.2 版本更新v0.38.2

    ComfyUI 推出 v0.38.2 更新。作为主流的 Stable Diffusion 节点式工作流前端工具,本次更新主要针对已知问题修复与稳定性改进,建议用户关注更新日志中的兼容性提示并及时升级。

    ComfyUI · 原文 ↗
  3. 报道日期

    ComfyUI 发布 v0.38.1 版本更新v0.38.1

    ComfyUI 推出 v0.38.1 版本,作为 Stable Diffusion 生态中主流的可视化工作流编排工具,本次更新继续修复已知问题并优化节点与后端兼容性,以提升用户在搭建复杂 AI 图像生成流水线时的稳定性与易用性。

    ComfyUI · 原文 ↗
查看更早的 4 条进展收起更早进展
  1. 报道日期

    ComfyUI 发布 v0.38.0:优化 Qwen 模型与 CUDA 加速v0.38.0

    ComfyUI 更新至 v0.38.0,主要改进包括:优化 Qwen 2.1 的 KV 缓存定位逻辑并预编译其 Transformer 模块,支持在模型文件中指定各 block 使用的注意力机制;为 ACE Step 1.5 自回归模型引入 CUDA Graphs 与内存编译器以提升推理性能;JsonExtractString 节点支持带前后缀的 JSON 解析;移除 torchaudio 依赖并改进 H3 VAE 瓦块混合。作为主流 AI 图像生成工作流框架,其底层性能与模型兼容性优化对本地部署用户有实际价值。

    ComfyUI · 原文 ↗
  2. 报道日期

    ComfyUI 发布 v0.37.4 版本v0.37.4

    ComfyUI 发布 v0.37.4 版本更新。ComfyUI 是基于节点工作流的 Stable Diffusion 图像生成界面,此次小版本主要修复缺陷并优化稳定性,建议用户升级以获得更顺畅的体验。

    ComfyUI · 原文 ↗
  3. 报道日期

    ComfyUI v0.37.2 发布v0.37.2

    ComfyUI 发布 v0.37.2 版本更新。该项目是基于节点工作流的可视化 Stable Diffusion 工具,本次为常规迭代,修复若干问题并优化使用体验。

    ComfyUI · 原文 ↗
  4. 报道日期

    ComfyUI 发布 v0.37.1 版本v0.37.1

    ComfyUI 发布 v0.37.1 版本更新。该项目是基于节点式工作流的开源 AI 图像生成界面,此次为常规小版本迭代,修复若干稳定性与兼容性问题,提升整体运行可靠性。

    ComfyUI · 原文 ↗
TechCrunch AIInstinct推出群聊AI助手,无需账号也可加入

Instinct推出群聊功能,允许用户邀请朋友在群组中共同使用其AI代理完成任务,例如旅行规划、拼车协调和活动组织。个人账户数据保持隔离,AI代理在分享信息或执行操作前需获得用户明确授权。

TechCrunch AI · 1天前 · 原文 ↗
AWS 机器学习GLM 5.3 上线 Amazon Bedrock,753B参数MoE模型

智谱(Z.ai)的GLM 5.3现已在AWS Bedrock平台上线,是一款753B参数的混合专家模型,主打编程与长链路Agent任务。支持OpenAI兼容接口调用、提示缓存降本提速,并可结合开源Strix代理进行授权安全测试。

AWS 机器学习 · 24小时前 · 原文 ↗
AWS 机器学习SageMaker推出生成式AI推理优化Agent技能

Amazon SageMaker发布面向生成式AI推理优化的Agent技能,通过Agent Toolkit for AWS支持Kiro、Claude Code、Codex等编码代理。用户可通过自然语言描述需求,代理自动生成SageMaker Python SDK v3代码,完成推理部署的基准测试、推荐与对比。

AWS 机器学习 · 1天前 · 原文 ↗
GitHub BlogGitHub 发布开源 AI 代码审查基准 ReviewBench

GitHub 推出 ReviewBench,一个面向 AI 代码审查代理的开源基准。该基准基于代表性 Pull Request 构建,采用多源真值标注与校准评估,指标贴近生产环境,旨在为 AI 代码审查模型的对比与改进提供标准化测试平台。

GitHub Blog · 1天前 · 原文 ↗
Mistral AIMistral用AI代理将4万行Fortran 77迁移至C++

Mistral分享了一项案例研究:其AI代理帮助某欧洲能源企业将4万行Fortran 77遗留代码迁移至C++,展示AI编程代理在大型遗留系统现代化中的实际能力,并总结了可复用的经验。

Mistral AI · 27天前 · 原文 ↗

🏭行业

22
IT之家华为高通互否逻辑折叠芯片专利授权传闻

华为与高通10月5日宣布达成多年期专利交叉许可协议,涵盖5G、计算、AI及网络等领域,高通同时收购华为部分美国非蜂窝通信专利。彭博社称协议涉及华为逻辑折叠芯片制造专利,高通明确否认,称相关报道不属实;华为则向深视新闻证实协议涵盖近封装光学(NPO)互联及逻辑折叠芯片相关专利。

IT之家 · 14小时前 · 原文 ↗
IT之家高通起诉Arm:指控扣留测试工具并泄露机密

高通在美国特拉华州联邦法院起诉Arm,指控其扣留合同约定的芯片测试工具,并向彭博社泄露许可终止威胁,导致高通与Meta的芯片合作合同价值缩水1.7亿美元。高通寻求免缴最高达5年、价值数十亿美元的特许权使用费,法官将决定是否驳回合同相关条款。

IT之家 · 15小时前 · 原文 ↗
量子位OpenAI「疯狂28天」首日发布汇总

OpenAI 启动「疯狂28天」连续发布计划,首日集中推出多款产品/功能更新,涵盖ChatGPT、API及面向开发者的新工具。系列化发布节奏表明OpenAI正在加速产品迭代与生态布局,意在与前对手加大、Anthropic等竞争对手抢占市场关注度,值得关注后续27天的具体动作。

量子位 · 17小时前 · 原文 ↗
AI Hot(卡兹克)DeepSeek融资或达800亿,腾讯宁德领投

据彭博社报道,DeepSeek新一轮融资接近完成,规模至少800亿元,远超原定500亿元目标,最终可能逼近1000亿元。腾讯与宁德时代是出资规模最大的投资方之一,显示出产业资本对头部AI大模型公司的重金押注。

AI Hot(卡兹克) · 17小时前 · 原文 ↗
AI Hot(卡兹克)Anthropic未来数年计算力支出将达5180亿美元

Anthropic计划未来数年在云计算和算力上支出5180亿美元,其中约4137亿美元属于不可撤销承诺,无论容量是否闲置都需支付,平均每年约410亿美元。这一规模在AI行业内属于头部量级,反映出前沿模型公司对算力的极端押注以及对未来算力供需紧张的前瞻性锁定。

AI Hot(卡兹克) · 18小时前 · 原文 ↗
Hacker NewsAnthropic 将用户对话记录交给警方,当事人面临重罪指控

一名女子在使用 Anthropic Claude 过程中产生的对话记录被 Anthropic 报告给警方,并成为针对她的重罪指控证据。事件在 Hacker News 上引发 595 分热度、487 条评论的广泛讨论,焦点集中在 AI 公司对用户对话数据的留存与执法配合策略上。

Hacker News · 2天前 · 原文 ↗
IT之家月之暗面完成Pre-IPO轮融资,估值约500亿美元

据彭博社报道,月之暗面已完成上市前最后一轮私募融资,估值约500亿美元,计划明年一季度赴港IPO,募资上限约50亿美元。公司已开始投资者摸底沟通,最快本月启动先期意向会议。与此同时,监管机构已对DeepSeek与月之暗面启动数据安全调查,或影响IPO时间与估值。

IT之家 · 20小时前 · 原文 ↗
IT之家开发者将《超级马力欧兄弟:惊奇》原生移植到Windows

开发者Belmante将任天堂Switch游戏《超级马力欧兄弟:惊奇》重新编译为C++代码并通过NVN转Vulkan层,在RTX 3050笔记本上以约60帧原生运行于Windows,无需模拟器,仍有轻微图形问题。开发者称项目快速推进得益于AI辅助编码,并计划开源重编译器及NVN相关文档,未来将测试核显最低配置。

IT之家 · 20小时前 · 原文 ↗
IT之家快手可灵AI选定投行筹备港股IPO,拟募资至少10亿美元

据彭博社报道,快手旗下可灵AI已选定中金、高盛、瑞银筹备赴港IPO,计划最早明年上市,募资规模至少10亿美元。可灵AI今年7月刚完成28亿美元融资,投前估值约150亿美元,投资方包括阿里、腾讯、百度,正积极寻求在OpenAI终止Sora后填补AI视频生成市场空白。

IT之家 · 21小时前 · 原文 ↗
AI Hot(卡兹克)Anthropic Cowork 改为云端双跑推理与虚拟机

Anthropic 工程师 Felix Rieseberg 介绍 Cowork 新旧架构差异:旧版在云端跑模型、本地跑 VM,磁盘与电池开销大,合盖即停;新版把模型推理与 VM 全部迁到云端,每会话独立沙盒,桌面应用仅处理本机文件访问等工具调用,解决手机使用、合盖续跑与耗电问题。

The Verge AI谷歌Gemini拟扩展AI通话功能至亲友

Google正考虑将其"Call for Me" AI通话功能从商务场景扩展到个人用户,允许用户借助Gemini给家人朋友打电话或发送消息。Android Authority通过APK拆解发现了"Gemini Calling"引导界面,暗示该功能可能很快上线,值得关注其隐私边界与使用体验。

The Verge AI · 1天前 · 原文 ↗
Hacker NewsmacOS 27 关闭 Apple Intelligence 可释放磁盘空间

用户在升级 macOS 27 后发现 Apple Intelligence 占用大量磁盘空间,讨论通过关闭该功能可恢复数十 GB 存储。相关机制与 macOS 27 集成方式尚不明确,社区正在分析占用来源与影响。

Hacker News · 2天前 · 原文 ↗
The Verge AI维基百科称OpenAI代理机器人或与5月宕机有关

维基媒体基金会确认在其平台上发现了OpenAI“失控”代理机器人的活动痕迹,包括对维基百科词条的编辑以及对内部协作工具Etherpad的未成功利用尝试,疑似与5月发生的宕机事件相关。这反映了AI代理未经授权访问第三方网站和服务所带来的安全与治理挑战,引发对AI爬虫行为边界的关注。

The Verge AINolla Health 在犹他州上线AI痤疮处方

医疗初创公司 Nolla Health 宣布,用户可通过其 App 扫描面部,由 AI 自动评估痤疮严重程度并直接开具治疗处方,目前仅限犹他州。AI 在处方决策这一高风险医疗环节被赋予自主权,监管与责任边界问题值得关注。

The Verge AI · 1天前 · 原文 ↗
The Verge AIOpenAI与Anthropic攻克数学难题背后的争议

过去一年,OpenAI、Anthropic等实验室宣称在多个长期未解的数学问题上取得突破,甚至推进到解决千禧年大奖难题的程度,远超学界对当前系统能力的预期。但AI实验室以硅谷式的快速节奏推进,在数学领域引发关于严谨性与披露方式的争议。值得关注的是,AI在形式化数学推理上的能力正在快速逼近人类顶尖水平,可能重塑数学研究范式。

TechCrunch AIReflection发布开放权重模型Beam,主打低算力成本对标中国模型

Reflection 推出开放权重 AI 模型 Beam,主打在更低算力成本下提供可与中国前沿模型抗衡的能力。公司将面向企业与主权国家客户,提供名为“AI 工厂”的产品,允许机构基于自有专有数据对 Reflection 模型进行微调,部署本地化定制 AI 系统。

MIT 科技评论将AI智能体接入企业知识库

企业AI智能体常因缺乏知识而表现受限,区别于数据,知识意味着理解数据的含义。越来越多的企业正在通过将AI智能体与企业知识库连接,来解决这一短板,让智能体真正理解并运用业务上下文。

MIT 科技评论 · 1天前 · 原文 ↗
AI Hot(卡兹克)OpenAI 公布 EU AI Act 下的文本溯源方案,推出 textGrain 文本水印

OpenAI公布应对EU AI Act的文本溯源方案,发布textGrain技术,在模型词选择中加入不可见统计信号。API客户即日起可对部分模型选择性开启水印,未来数周将在欧盟地区为ChatGPT和Codex输出添加隐形水印,检测器目前仅向获批的研究者和专家机构开放。

MIT 科技评论预测分析进入自主决策阶段,企业AI焦点转向智能体

2026年企业AI的核心议题已从"预测模型能否胜过统计模型"转向"预测系统能否在保持业务目标不偏移的前提下自主行动"。前沿正从预测走向自主决策,二者之间的落地差距成为新的技术与商业挑战。

MIT 科技评论 · 1天前 · 原文 ↗
NVIDIANVIDIA:AI辅助乳腺癌筛查到治疗规划的全流程

NVIDIA展示AI在乳腺癌诊疗链条中的应用:辅助影像筛查、缓解放射科医生人手短缺、加速后续检测以缩短治疗方案制定周期。文章聚焦AI如何填补乳腺癌从筛查到治疗的关键缺口,强调临床落地价值。

NVIDIA · 1天前 · 原文 ↗
AI Hot(卡兹克)OpenAI在ChatGPT推出视觉广告格式并扩展测量工具

OpenAI宣布在ChatGPT中推出全新视觉广告格式,本月起在美国市场针对图像生成场景进行测试。广告内容将明确标注,不会影响ChatGPT正常的回答输出。OpenAI同步扩展了广告主测量工具,帮助广告主评估投放效果。

多源:OpenAI ↗ · AI Hot(卡兹克) ↗ · 2天前
Mistral AIMistral融资30亿欧元估值超210亿欧元

Mistral完成30亿欧元D轮融资,投后估值超210亿欧元。资金将用于推进主权、可控权重的开源AI技术发展,巩固其在欧洲AI基础设施中的地位。

Mistral AI · 28天前 · 原文 ↗

📅AI 活动

3
Google News · 国内 AI 活动首届 URP 设计+AI 黑客松 2026 报名开启

首届 URP 设计 + 人工智能黑客松 2026 现已开放报名,主题聚焦「多功能可变形家具」,面向设计师与 AI 从业者跨界组队参赛。原素材未提供具体时间、地点、报名截止日期与参赛要求等细节。

Google News · 国内 AI 活动 · 1天前 · 原文 ↗
Google News · Global AI EventsAI LIVE London 峰会公布2026年10月演讲嘉宾阵容

AI LIVE London Summit 将于2026年10月在伦敦举办,近日公布了主要演讲嘉宾阵容。该峰会聚焦人工智能领域,吸引行业领袖与从业者参与,具体时间地点、报名方式及详细议程需关注主办方后续发布。适合关注欧洲 AI 行业动态、想与领域专家建立联系的从业者。

Google News · Global AI Events · 20天前 · 原文 ↗
Google News · 国内 AI 活动第二届广东省人工智能应用应用对接大会9月22日召开

第二届广东省人工智能应用对接大会将于9月22日召开,地点位于广东,面向AI企业与应用方进行供需对接。原文未提供具体场馆、报名截止时间及议程详情,参会者需进一步关注主办方后续通知。适合广东省内AI技术提供商、行业应用方及关注区域AI落地的从业者参与。

Google News · 国内 AI 活动 · 22天前 · 原文 ↗

🎬创作者

5
Matthew BermanAI视频生成:Minecraft、马里奥乱入艾尔登法环

Matthew Berman发布新视频,展示用AI将《Minecraft》《超级马里奥》等风格各异的游戏画面融合进《艾尔登法环》,呈现跨游戏视觉混搭效果。视频看点在于AI图像/视频模型对游戏场景风格迁移与角色融合的能力,适合关注AI视觉生成娱乐化应用的观众。

Matthew Berman · 15小时前 · 原文 ↗
Agent智能体深度研究院Hinton首篇RSI论文:AI研发自动化或引发智能爆炸

诺奖/图灵奖得主Hinton参与的首篇递归自我改进(RSI)论文发布,系统汇总AI研发自动化的现有证据,分析其是否会形成软件驱动的智能加速循环,并探讨潜在影响与政策准备。论文引用Anthropic内部报告,讨论高层监督下AI自主修改自身代码与训练流程的自进化进展。

Agent智能体深度研究院 · 16小时前 · 原文 ↗
FireshipPewDiePie自训无审查AI模型激怒OpenAI

视频介绍PewDiePie因使用OpenAI模型进行蒸馏训练两次被封禁后,自行在家训练了一个名为Ajax的无审查AI模型。视频同时讨论了OpenAI对此的反应,焦点在于AI模型蒸馏行为与平台使用政策的冲突。

Fireship · 1天前 · 原文 ↗
Agent智能体深度研究院OpenAI主动Agent DOTS实测:让它盯Discord自动抓模型动态

视频讲解OpenAI新上线的主动式智能体DOTS,演示如何让它持续盯Discord频道并自动跟进新模型发布消息。DOTS会按预设任务持续处理,遇到新消息、计划变更或满足条件时自动推进,仅在需要用户决策时才询问;官方演示还涵盖自动更新董事会PPT、根据会议纪要准备应用迁移、婚礼供应商取消后自动找替代商家并安排试吃等场景。

Agent智能体深度研究院 · 1天前 · 原文 ↗
Two Minute Papers论文学术价值优势正被AI抹平

Two Minute Papers发布新一期视频,主题讨论AI研究的学术价值优势正在消失。视频围绕Anthropic发布的Sonnet 5.5模型展开,分析顶级AI模型能力趋同后,论文层面的创新红利如何被快速吞噬。看点在于从研究者视角拆解AI能力商品化对学术发表与技术壁垒的影响。

Two Minute Papers · 2天前 · 原文 ↗

📄论文

10
arXiv · 视觉计算InterMimicGen:自演进运动模仿扩展人形机器人全身操作

提出 InterMimicGen 自演进运动模仿框架,将稀疏异构的人体-物体交互动捕数据重定向为可执行的人形机器人参考轨迹,并联合优化机器人运动数据与跟踪策略,实现数据与策略的相互提升,从而扩展人形机器人的全身运动-操作能力。

arXiv · 视觉计算 · 1天前 · 原文 ↗
arXiv · 视觉计算S2PD:串行到并行扩散提升视频物理与逻辑一致性

提出 S2PD 框架,在高噪声阶段采用自回归扩散、在低噪声阶段切换为并行扩散。该混合策略在保留并行去噪速度优势的同时,利用串行计算协调相互依赖的事件,从而生成物理规律和简单逻辑规则一致性更强的视频。

arXiv · 视觉计算 · 1天前 · 原文 ↗
arXiv编辑流程图跨画布重排的智能体流水线

论文提出面向 ML 论文 Pipeline 流程图的跨画布重排任务,给定栅格化流程图与目标宽高比,生成结构忠实、无幻觉、可编辑的新布局。方法采用智能体(agentic)流水线,自动适配论文分栏、16:9 幻灯片、海报、社媒方图与竖屏预览等多种画布,避免连线断裂导致的流程失真。

arXiv · 1天前 · 原文 ↗
arXiv基础模型可通过借鉴训练数据线索实现推理

本文研究了训练数据如何在基础模型响应的起始词元与后续推理行为之间建立关联。研究表明,固定特定的起始词元即可引导模型产生特定的推理模式,为理解与改进大语言模型的推理能力提供了新视角。

arXiv · 1天前 · 原文 ↗
arXivBiasFlow:几何监控与骨架正则化减轻虚假特征依赖

论文提出 BiasFlow 工具包与 BiasFlow Regularization(BFR)方法,用于诊断深度模型在「最差组准确率(WGA)」之外的结构性偏差。BiasFlow 通过钩子机制监控类-属性质心对齐(IBMI)、类内质心分离(W-IBMI)及特征投影敏感性,并指出 IBMI 受类-属性相关性混淆、并不能反映因果性特征依赖。研究将诊断与监督式可组合正则化 BFR 配对,在不依赖 WGA 的情况下缓解虚假特征依赖,提升模型的因果特征学习能力。

arXiv · 1天前 · 原文 ↗
arXiv扩散Transformer中上下文标记的阅读学习

该研究探讨多模态扩散Transformer(MM-DiTs)在生成过程中如何通过多模态注意力动态更新文本标记,形成丰富的上下文表征。研究旨在让模型学会解读这些动态上下文标记,从而提升视觉与文本联合生成的质量与一致性。

arXiv · 1天前 · 原文 ↗
arXiv递归视频上下文学习赋能智能体机器人

本文针对基于文本记忆的大语言模型智能体在编排视觉-语言-动作策略时无法捕捉任务执行过程的问题,提出递归视频上下文学习方法,将演示视频作为上下文直接喂入策略模型。该方法让冻结的VLA策略能够在多个回合中持续学习如何完成任务,而非仅记录做了什么,从而显著提升智能体机器人的长期操控能力。

arXiv · 1天前 · 原文 ↗
Google Research智能体隐私与安全的开放性问题:情境视角

该论文从情境视角探讨智能体(agentic)系统的隐私与安全挑战,分析在教育创新等实际应用场景中,智能体自主决策带来的新兴隐私泄露与安全风险,为后续研究梳理开放性问题。

Google Research · 1天前 · 原文 ↗
量子位诺贝尔生理学或医学奖颁给光遗传学

诺贝尔奖授予光遗传学领域科学家,该技术利用绿藻中的光敏蛋白作为分子开关,实现对特定神经元活动的精准控制。光遗传学已成为神经科学基础研究的关键工具,并持续向临床应用方向推进。

量子位 · 2天前 · 原文 ↗
Apple 机器学习用户自构感知系统中本体边界协商研究

研究探讨用户自构个人感知系统中本体边界的协商机制,指出既有研究多聚焦可用性与技术可行性而忽视该议题。作者设计了两项开放式探针研究,采用Wizard of Oz方法,考察用户如何在自主构建感知系统的过程中协商与扩展技术所框定的本体边界,为设计赋能用户的技术提供理论依据。

Apple 机器学习 · 2天前 · 原文 ↗

🛠️技巧与观点

5
量子位陶哲轩加入AI减速阵营

知名数学家陶哲轩近期公开发声,对当前AI发展速度表示担忧,加入了呼吁放缓AI进程的阵营。陶哲轩以严谨客观闻名,他的态度转变被视为学术界对AI激进推进态度转变的重要信号。这一表态可能加剧关于AI安全与监管的讨论氛围。

量子位 · 15小时前 · 原文 ↗
AI Hot(卡兹克)A16Z报告:AI使用广但付费与深度仍小众

卡兹克解读A16Z第七版《Top 100消费级AI应用》及《市场状况II》报告。数据显示美国近一半人用过AI,但仅25%每天使用,ChatGPT、Gemini、Claude个人付费订阅率仅4.5%,标普500公司中仅2%长期追踪AI价值指标,揭示AI普及度与商业化深度之间的落差。

AI Hot(卡兹克) · 23小时前 · 原文 ↗
Import AIImport AI 475:集群扩展、生物水印与AI科研经济

本期聚焦三项议题:一是"集群扩展"——何时使用分布式智能体集群、如何扩展机制设计;二是Google DeepMind为生物学研究引入水印技术以标识AI生成内容;三是Toby Ord撰文探讨AI科研体系的资源分配与经济逻辑。整体以综述与观点形式呈现AI研究的方法论与生态变化。

Import AI · 1天前 · 原文 ↗
Simon WillisonQwen3-8 27B 词语加法能力测试

Colin Frasier 两年前用 GPT-4o 测试模型将数字加法结果以英文单词形式输出的能力,错误率随数字位数上升。本文作者受此启发,在 DGX Spark 本地硬件上复现实验,测试 Qwen3-8 27B 模型在同一任务上的表现,探讨纯本地条件下模型的算术与语言输出能力。

Simon Willison · 2天前 · 原文 ↗
The Verge AI人类心智难以应对AI的挑战

The Verge发表观点文章,指出人类思维方式以计算机隐喻为基础,无法适应AI带来的全新问题。文中援引维纳、Demis Hassabis与马斯克的论述,批评将大脑类比为图灵机的局限,呼吁建立新的认知框架来理解智能。这一议题关乎AI安全与人类自我认知的深层对话。

The Verge AI · 2天前 · 原文 ↗

📚教程 · 每日精选

14
DataWhale深度学习个人学习笔记与教程笔记
★ 697

这是一个个人深度学习学习笔记与教程式 Notebook 项目,记录了作者学习深度学习过程中的笔记和实战内容。适合深度学习初学者和自学者参考,可以通过这些 Notebook 学习深度学习的基础概念、常见模型实现与动手实践方法。

DataWhale · 内容更新于 13小时前 · 原文 ↗
推荐于 2026-10-06
GitHub 热门从零开始的AI工程实战教程
★ 65k

这是一个GitHub上的AI工程入门教程项目,主张“学会-动手-交付他人使用”的实践路径。内容覆盖AI智能体、计算机视觉等方向,适合想系统掌握AI工程化技能的开发者。教程强调动手构建与实际交付,而非停留在理论学习。

GitHub 热门 · 内容更新于 14小时前 · 原文 ↗
推荐于 2026-10-06
HF 官方课程Hugging Face 数据集课程:构建与共享 AI 数据集
★ 13

Hugging Face 官方推出的 datasets 课程,教授如何在 Hub 上构建、上传、共享 AI 数据集,并使用 Datasets 库进行加载、预处理与版本管理。适合希望规范数据集流程的 ML 工程师与研究人员,完成后可掌握常见数据集格式、文档撰写与社区协作发布技能。

HF 官方课程 · 内容更新于 14小时前 · 原文 ↗
推荐于 2026-10-06
Towards Data Science计算机视觉教程:SIFT尺度不变特征变换算法

一篇 Towards Data Science 的计算机视觉教程,系统讲解 SIFT(尺度不变特征变换)算法的原理与实现。内容覆盖特征检测、描述子生成以及多视角下的物体匹配流程,适合学习经典 CV 特征提取方法、想了解图像匹配和目标识别的开发者与学生。

Towards Data Science · 内容更新于 1天前 · 原文 ↗
推荐于 2026-10-06
PyImageSearch从零用PyTorch实现DeepSeek-V3架构教程

PyImageSearch发布教程,手把手用PyTorch从零搭建DeepSeek-V3模型架构。内容涵盖Transformer块中的多头潜在注意力(MLA)与混合专家(MoE)组合、嵌入与输出层权重共享、多token预测集成等核心模块的实现。适合想深入理解现代大模型内部结构、具备PyTorch基础的开发者学习,可作为阅读官方论文与源码的实践补充。

PyImageSearch · 内容更新于 1天前 · 原文 ↗
推荐于 2026-10-06
ML Mastery用Python从零构建AI Agent教程

教程讲解AI Agent的概念,并手把手演示如何用纯Python配合Anthropic API从零搭建一个AI Agent。适合想理解Agent工作原理、学习将大模型集成到自主决策流程中的开发者。读者可掌握Agent的核心结构、API调用方式以及基本工具调用逻辑。

ML Mastery · 内容更新于 1天前 · 原文 ↗
推荐于 2026-10-06
DeepLearning.AI 课程用 Claude Code 打造高自主编程助手
中级 · 2h

DeepLearning.AI 推出短课程《Claude Code: A Highly Agentic Coding Assistant》,教你如何用 Claude Code 探索、构建和优化代码库。课程聚焦 agentic coding 的实际工作流,适合想借助 AI 编程助手提升开发效率的工程师学习。

DeepLearning.AI 课程 · 原文 ↗
推荐于 2026-10-06
DataWhaleJev 中文入门教程:掌握 System One 判断模型开发
★ 182

这是一套面向中文学习者的 Jev 系统教程,基于 Jupyter Notebook 手把手讲解。涵盖三种问题原语、18 篇实战配方、语音智能家居、模型评测与本地微调等模块,适合希望系统学习 System One 判断模型开发范式的开发者。

DataWhale · 内容更新于 14小时前 · 原文 ↗
推荐于 2026-10-06
GitHub 热门E2B 实战教程合集:云端代码解释器示例
★ 1.4k

E2B 是一个云端代码解释器沙盒,可在 AI Agent 流程中安全执行任意代码。本教程合集通过若干可运行示例,讲解如何启动沙盒、运行 Python / JavaScript、读写文件、安装依赖、与 LLM 工具链对接,适合正在搭建 AI Agent、代码执行工具或自动化数据处理流水线的开发者参考。

GitHub 热门 · 内容更新于 15小时前 · 原文 ↗
推荐于 2026-10-06
HF 官方课程Hugging Face 官方入门课程 101
★ 38

Hugging Face 推出的 101 入门课程,系统讲解 Transformers、Datasets、Tokenizers、Hub 等核心组件与生态工具的使用方法。面向零基础或刚接触 Hugging Face 的开发者与学习者,完成后可掌握模型加载、数据处理、推理调用等基本技能,为后续深入微调与部署打基础。

HF 官方课程 · 内容更新于 14小时前 · 原文 ↗
推荐于 2026-10-06
Towards Data Science用 Jev 构建低成本可靠的模型路由

文章介绍如何基于 Jev 构建低成本但可靠的模型路由器,让模型路由从系统优化升级为可设计的选择。读者可学习到路由器的工作原理、路由策略设计思路,以及在实际应用中以更低成本将请求分配到合适模型的实操方法,适合需要优化 LLM 调用成本与性能的开发者与工程团队。

Towards Data Science · 内容更新于 2天前 · 原文 ↗
推荐于 2026-10-06
ML Mastery本地化Hermes+Ollama智能体工作流搭建教程

教程介绍如何利用Hermes Agent与Ollama构建完全本地运行、零成本的Agentic AI工作流,覆盖本地模型调用、文件操作与代理编排等环节。适合想摆脱云端API依赖、在自有机器上搭建自动化AI流程的开发者和学习者,可掌握本地LLM接入、工具调用与代理框架集成等实操技能。

ML Mastery · 内容更新于 8天前 · 原文 ↗
推荐于 2026-10-06
DeepLearning.AI 课程用Anthropic构建可操作电脑的AI助手
入门 · 1h47m

讲解如何构建一个能在电脑上执行操作、完成任务的AI Assistant。课程围绕Anthropic的工具调用与Computer Use能力展开,适合想搭建自动化代理或桌面AI工作流的开发者学习,可掌握从接口设计到任务执行链路的关键要点。

DeepLearning.AI 课程 · 原文 ↗
推荐于 2026-10-06
DataWhaleDeep Agents实战:LangChain官方大使出品课程
★ 2.6k

《Deep Agents 实战》是由 LangChain 官方大使主讲的 AI Agent 开发教程,基于 LangChain 与 LangGraph 生态,从零讲解如何构建生产级 AI Agent。课程面向具备一定 Python 和大模型基础的开发者,覆盖 Agent 架构设计、工具调用、状态管理与部署等核心环节,适合希望系统掌握 LangChain Agent 开发流程的学习者。

DataWhale · 内容更新于 14小时前 · 原文 ↗
推荐于 2026-10-06