📡 每日 AI 信号

📦产品

16
1

极摩客发布14.6L MoDT游戏整机NEO-X1:9955HX3D+5070,11999元起

极摩客推出NEO-X1系列MoDT游戏台式整机,14.6L体积搭载AMD锐龙9000HX处理器与RTX 50系桌面显卡,配备一体式液冷、850W金牌电源及Wi-Fi 7。标准版采用9955HX+5060 Ti首发11999元起,Pro版升级至9955HX3D+5070首发16499元起。该机型将冲击紧凑型高性能游戏整机市场,但具体存储配置尚未公布。IT之家 · 15天前 · 原文 ↗
2

华为HarmonyOS 7花粉Beta版推送:超百项更新

华为开启HarmonyOS 7花粉Beta版报名并推送更新,系统包约10GB(部分机型超20GB),带来超百项升级。核心变化包括将沉浸光感从首页延伸至二三级页面及通用组件,以及小艺基于Agentic全面重构,支持自主理解纠错和长线任务执行。IT之家 · 15天前 · 原文 ↗
3

FeyNoBg 开源:自动背景去除模型四项基准达 SOTA

Feyn Labs 发布开源背景去除模型 FeyNoBg,基于 BiRefNet 架构,参数量从 222M 扩展至 263M。该模型在八个基准测试中的四项取得最佳 S-measure 分数,其余四项与领先者差距不超过 2%,表现接近全面领先。模型与配套训练库 NoBg 分别托管于 Hugging Face 和 GitHub,开发者可即取即用。AI Hot(卡兹克) · 15天前 · 原文 ↗
4

荣耀 Robot Phone 首发自研芯片驭光 H1,联合阿莱影像系统将下放 Magic9

荣耀在横店影像发布会首秀与德国阿莱合作的电影级影像技术,落地于 Robot Phone,搭载自研影像芯片驭光 H1、后置三摄含 2 亿像素云台主摄和 2 亿像素潜望长焦,首次将阿莱 Log-C 编码和 LUT 调色文件引入移动端。该影像系统还将延展至 Magic9 等后续产品,推动移动影像从参数竞争转向电影工业创作链路。IT之家 · 15天前 · 原文 ↗
5

灵光App上线闪应用“一键部署”,开放30余项免费API

灵光App近日上线闪应用“一键部署”功能并向所有用户开放。用户通过Codex、Claude Code、Cursor等AI工具创建的应用,可借助灵光部署Skill一键发布为“灵光闪应用”,同步在PC端和App内展示分发。同时灵光开放大模型、搜索、LBS、地图、存储等30余项免费API能力,降低AI应用的开发与分发门槛。36氪 · 15天前 · 原文 ↗
6

机械革命耀世15 Air云杉青版开售:Ultra 7+RTX 5060,国补价10499元

机械革命推出耀世15 Air云杉青新配色游戏本,搭载第三代英特尔酷睿Ultra 7 356H处理器(16核16线程,NPU算力50 TOPS),配备RTX 5060显卡、32GB LPDDR5X 8533MT/s内存及1TB PCIe 4.0固态,首发价11999元,叠加国补后10499元。值得关注的是Ultra 7 356H作为新一代酷睿平台,配合RTX 5060定位中端高性能游戏本市场,国补后价格具备一定竞争力。IT之家 · 15天前 · 原文 ↗
7

联想来酷斗战者战7000P锐龙版发布:8940HX+RTX 5060

联想旗下来酷斗战者推出战7000P锐龙版游戏本,搭载锐龙9 8940HX处理器与RTX 5060笔记本GPU,配备16英寸2.5K 180Hz屏幕,国补后到手价8329.15元,8月4日开售。整机性能释放至高215W,采用四热管三风扇散热架构,支持125W CPU与115W GPU满功耗释放,定位中高端游戏本市场。IT之家 · 15天前 · 原文 ↗
8

联想拯救者 Y700 无极平板屏幕规格公布:8.4 英寸 165Hz OLED

联想拯救者 Y700 无极平板电脑公布屏幕规格,搭载 8.4 英寸 WQXGA 分辨率 165Hz OLED 面板,采用 Real RGB 子像素排列,像素密度 359 PPI,局部峰值亮度 4000nits,支持 100% DCI-P3 色域与 Dolby Vision 认证。游戏体验方面支持 360Hz 多指触控采样率与 0.3ms 响应延迟,并通过多项 TÜV 莱茵护眼认证。该产品主打高刷新率游戏平板市场,屏幕规格在同尺寸平板中较为突出。IT之家 · 15天前 · 原文 ↗
9

vLLM v0.26.1rc0 发布:修复 ROCm OCP MX 精度测试问题

vLLM 发布 v0.26.1rc0 版本。该版本主要针对 ROCm 后端修复了 test_ocp_mx_wikitext_correctness 单元测试中的参考值问题,确保 AMD GPU 上的 OCP MX 量化精度校验通过。作为推理引擎,ROCm 兼容性的修正有助于 AMD 硬件用户获得更稳定的部署体验。vLLM · 16天前 · 原文 ↗
10

Ollama v0.32.5 发布,修复 MLX Metal 质量缺陷

Ollama 发布 v0.32.5 版本,主要修复了 MLX Metal 上影响 NVFP4 模型(尤其是 Laguna)的输出质量缺陷。该问题可能导致 NVFP4 量化模型在 Apple Silicon 上的生成质量下降,此次更新针对性解决了这一回归问题。Ollama · 16天前 · 原文 ↗
11

月之暗面发布视觉感知基准 PerceptionBench

Kimi 团队推出 PerceptionBench,将视觉感知拆解为原子能力进行评估。基于 42 个基准上前沿模型的失败模式,归纳出 10 项原子感知能力,并构建 3000 道验证题目,每题仅考察单一能力、纯视觉即可作答,无需推理或外部知识。该基准为多模态模型的视觉短板诊断提供了更细粒度的评测工具。多源:AI Hot(卡兹克) ↗ · Kimi 月之暗面 (X) ↗ · 16天前
12

macOS 26.6 正式版发布:修复 155 个漏洞创纪录

苹果推送 macOS 26.6 Tahoe 正式版,距离上一版间隔 28 天,本版共修复 155 个漏洞,刷新 26.x 分支单次更新修复数量纪录(此前最高为 26.1 的 115 个)。同时修复了 Intel 应用弃用通知误显示、HealthKit 及信息应用 HDR 截图等已知问题,并为未来升级至 macOS 27 Golden Gate 的用户提前启动索引,以支持新 Siri AI、Apple Intelligence 等功能。IT之家 · 16天前 · 原文 ↗
13

LangChain Fireworks 1.5.2 发布

该版本主要刷新了模型配置文件数据,以同步最新模型信息。此次更新属于常规维护,旨在确保开发者能获取准确的模型元数据。LangChain · 16天前 · 原文 ↗
14

AWS推出TAKC技术突破RAG分析瓶颈

针对传统RAG在处理跨文档复杂分析任务时的局限,AWS推出任务感知知识压缩(TAKC)方案。该技术可将知识库预压缩并分层缓存,根据查询路由至相应层级,显著提升企业AI分析效率。AWS 机器学习 · 16天前 · 原文 ↗
15

Deepgram增强SageMaker AI支持,集成IAM临时委托

Deepgram通过集成AWS IAM临时委托功能,优化了SageMaker AI上的语音模型支持流程。该集成将初始故障调查时间从数天缩短至分钟级,显著提升了客户支持效率。AWS 机器学习 · 16天前 · 原文 ↗
16

月之暗面开源 2.8 万亿参数 Kimi K3 模型

月之暗面正式开源 Kimi K3 模型,发布权重、技术报告及 MoonEP、FlashKDA、AgentEnv 等关键基础设施。Kimi K3 参数量达 2.8 万亿,采用 KDA 混合线性注意力机制与注意力残差技术,原生支持视觉理解,上下文窗口达 100 万 token,是当前规模最大的开源模型。其通过 Stable LatentMoE 框架将稀疏度扩展至 896 选 16,扩展效率较 K2 提升约 2.5 倍,展现了将算力高效转化为模型能力的新路径。多源:Kimi 月之暗面 (X) ↗ · IT之家 ↗ · AI Hot(卡兹克) ↗ · The Verge AI ↗ · Simon Willison ↗ · 量子位 ↗ · 16天前

🏭行业

35
17

Meta联手贝莱德投资140亿美元在得州建AI数据中心

Meta与贝莱德成立合资企业,共同开发位于得克萨斯州埃尔帕索的数据中心园区。该项目是Meta "Meta Compute"基础设施战略的一部分,旨在通过引入资本合作伙伴加速AI战略所需的数据中心建设。贝莱德旗下全球基础设施合伙公司(GIP)和HPS将提供大规模资金支持,体现Meta在AI基础设施融资上追求多元化与建设速度的战略考量。IT之家 · 15天前 · 原文 ↗
18

微软罕见听劝,撤回Outlook Copilot搜索功能

微软今年4月宣布在Outlook邮件搜索菜单集成Copilot,6月起向全平台推送。但因该功能将AI结果置于常规搜索上方,迫使用户滚动查找真实结果,用户反馈不佳。微软已决定不再推进该功能,并致歉。用户对这一调整普遍表示欢迎。IT之家 · 15天前 · 原文 ↗
19

英伟达 CEO 黄仁勋:AI 消灭的是任务,而非工作

IT之家 7 月 28 日消息,英伟达 CEO 黄仁勋并不认同所谓“白领大屠杀”的说法。在 Y Combinator 创业学校(Startup School)的演讲中,黄仁勋回应了外界对 AI 的种种悲观预测。他强调,应当区分“任务(tasks)”和“工作(jobs)”,AI 消除的是前者,而不是后者。 “每一份工作都会发生变化,同时也会诞生大量新工作。”黄仁勋表示,“认为 AI 会摧毁就业岗位的叙事,恰恰把事情说反了。” 黄仁勋举了一IT之家 · 15天前 · 原文 ↗
20

金山办公预计上半年净利润同比增长210%-264%

金山办公发布业绩预告,预计2026年上半年营业收入32.14亿-34.13亿元,同比增长21%-28%;归母净利润23.16亿-27.19亿元,同比增长210%-264%。公司将业绩高增长主要归因于AI能力与办公场景深度融合,前期研发投入转化为产品竞争力和商业化成果,同时部分对外投资基金实现较好回报。多源:36氪 ↗ · IT之家 ↗ · 15天前
21

三星芯片人才大量跳槽至竞争对手SK海力士

三星电子半导体部门工程师Lee近期一反常态——他不再加班冲项目,下班后就着手准备竞争对手SK海力士的求职材料,并和同事分享面试经验。三星在HBM等存储芯片领域正被SK海力士反超,叠加薪酬与职业前景因素,人才流失加剧,可能进一步影响其芯片业务竞争力。MIT 科技评论 · 15天前 · 原文 ↗
22

亚马逊大调整AI战略:停多款自研模型,集中资源攻坚前沿大模型

据 Business Insider 报道,亚马逊正对 AI 战略进行大规模重组,逐步停止开发包括 Nova Premier、Omni、Reel、Canvas 等在内的多款自研模型,相关团队进入仅维护现有客户的 KTLO 状态,并将工程师与算力资源集中投入到一项全新的前沿模型项目,以提升在顶级 AI 模型领域的竞争力。此前亚马逊已对 AGI 部门裁员并关闭去年由 Adept 核心团队组建的 AGI Lab,反映出其从多线并进转向聚焦核心的策略转变。多源:IT之家 ↗ · 36氪 ↗ · 15天前
23

央视起底AI脱衣黑色产业链

央视《法治在线》曝光AI脱衣黑色产业链:普通生活照可被生成不雅图片,相关教程在社交平台传播,境外群组以付费入群方式扩散,售价从2023年60余元涨至2025年168元。北京海淀区检察院已披露相关案件并介入调查。AI生成技术被滥用为新型犯罪工具,凸显AI治理与监管的紧迫性。IT之家 · 15天前 · 原文 ↗
24

Kando AI完成数千万元种子轮融资,打造决策领域Cursor

Kando AI由北大计算机博士吴秉哲与连续创业者毛书翰联合创立,已完成数千万元种子轮融资,星连资本领投,力合金控跟投。团队约10人,来自腾讯、字节、美团、华泰证券等头部机构。该公司聚焦自进化决策系统,希望将投资等高频决策中的认知模式沉淀为可数字化的AI资产。36氪 · 15天前 · 原文 ↗
25

当AI学会“仿真思维”,教师才能回归育人本质

从“工具效率”到“认知理解”,教育AI进入深水区量子位 · 15天前 · 原文 ↗
26

德里高等法院裁定 OpenAI 利用 ANI 内容训练 AI 未侵犯版权

德里高等法院认定 OpenAI 利用亚洲国际新闻(ANI)社的内容训练人工智能不构成侵犯版权。法官 Amit Bansal 认为该行为符合印度《版权法》中研究类"合理使用"例外情形,且 ANI 未能证明 ChatGPT 直接复制其受版权保护内容。法院同时指出,现阶段颁布临时禁令将不利于印度正在开发的 LLM 及大量免费使用 ChatGPT 的用户。AI Hot(卡兹克) · 15天前 · 原文 ↗
27

首个隐式触觉世界动作模型问世

基于50万小时视频数据,研究人员成功训练出首个具备触觉感知能力的隐式世界动作模型。该成果突破了传统视觉世界模型的局限,为具身智能在复杂物理交互中的感知与决策提供了新范式。量子位 · 15天前 · 原文 ↗
28

Cursor加大印度市场布局,本地化定价并扩张团队

AI编程工具Cursor宣布印度已成为其全球第三大市场,并将推出本地化定价、扩大本地招聘及企业销售团队。此前有报道称其将被SpaceX收购,此次印度布局被视为该交易前的重大市场扩张动作。TechCrunch AI · 15天前 · 原文 ↗
29

36氪推出企业全情报抽奖福利活动

36氪推出企业全情报小程序抽奖活动,用户体验小程序15秒并订阅一家企业即可免费参与,奖品包括大疆Osmo Pocket 4、DJI MIC MINI及专属竹节吸管杯。该平台结合AI能力对海量企业信息进行智能梳理,支持工商、融资、舆情等一键查询,面向投资人、商务从业者及创业者。36氪 · 15天前 · 原文 ↗
30

聚灿光电对接多家AI眼镜企业推进Micro LED定制研发

聚灿光电近日在业绩交流会透露,正与合作方开展Micro LED定制化开发,已对接多家头部AI眼镜终端厂商推进研发,但整体仍处于前期开发阶段,尚未具备量产交付条件。客户端存在待解决的技术难题,公司同时推进内部工艺迭代与技术优化。36氪 · 15天前 · 原文 ↗
31

杭州拟超前布局算力网等新型AI基础设施

杭州就《人工智能产业发展促进条例(草案)》公开征求意见,提出统筹规划AI基础设施体系,适当超前布局算力网、新型电网、新一代通信网、数据可信空间等设施,并推动建设与智能算力匹配的供电可靠性体系。该条例若落地,将以地方立法形式保障算力用电安全稳定充足,对算力服务落地杭州具有政策牵引意义。36氪 · 15天前 · 原文 ↗
32

微信鸿蒙版 App 获 8.0.20.16 邀测升级,修复了一些已知问题

IT之家 7 月 28 日消息,今日,微信鸿蒙版 App 获 8.0.20.16 邀请测试升级,官方公告依然为“修复了一些已知问题”。 鸿蒙微信已有较长时间不曾公示升级内容,IT之家整理微信鸿蒙版目前已知灰度测试内容如下(不绑定版本号): 微信相机录制视频时支持切换前后摄像头; 通过朋友验证时新增添加电话选项; 收藏的聊天记录支持转存为笔记; 通过群聊添加群成员时支持快捷使用对方昵称和群昵称进行备注; 设置状态支持选择不超过 15 秒的IT之家 · 15天前 · 原文 ↗
33

起亚全新赛图斯8月13日国内预售,设计向EV5靠拢

起亚宣布全新一代赛图斯将于8月13日在国内开启预售。新车采用向纯电SUV EV5靠拢的全新设计语言,配备竖向分体大灯、隐藏式门把手和贯穿式尾灯;车身尺寸全面加大,轴距达2690mm,后备箱容积提升至536L。内饰搭载双12.3英寸联屏和AI助手,支持OTA升级,ADAS系统也同步增强。IT之家 · 15天前 · 原文 ↗
34

比亚迪人形机器人计划八月发布

比亚迪官方确认,计划于八月在其"迪空间"亮相发布人形机器人。此前比亚迪已通过宣传海报预热,暗示"八月初有个新朋友"。这意味着比亚迪将正式跻身人形机器人赛道,相关技术与整车业务的协同值得关注。36氪 · 15天前 · 原文 ↗
35

AI 外呼日拨千通电话,总台中国之声曝光骚扰电话最新营销手段

IT之家 7 月 28 日消息,据中央广播电视总台中国之声今日报道,进入暑期,各类营销电话频次持续走高。不少消费者反映,最近接到的营销电话明显增多,涉及房产、教育、金融、保险等多个领域,而且来电那头的声音越来越“标准化”—— 因为它们并非真人,而是 AI 。 报道称,目前 AI 电销服务已经形成两条主流路径: 一类是 依托“线路公司”代理机器人 ,按通话分钟数预充值计费,每分钟约 0.14 到 0.16 元; 另一类是 通过“机器人外呼IT之家 · 15天前 · 原文 ↗
36

智能体走向终端,个人AI时代正在到来

智能体技术正从云端向终端设备迁移,推动AI能力下沉至个人硬件。这一趋势意味着用户将在本地设备上获得更实时、私密的AI体验,降低对云端算力的依赖。终端智能体的落地或将重塑个人计算与AI交互方式。量子位 · 15天前 · 原文 ↗
37

突发:翁荔离职Thinking Machines

前OpenAI研究员翁荔在任职约20个月后离开Thinking Machines。她此前从OpenAI离职加入该公司,这次再度离任引发业内对AI人才流动与初创公司发展的高度关注。量子位 · 15天前 · 原文 ↗
38

Anthropic CEO回应未签开放权重公开信:从未主张禁止开源模型

英伟达、Meta、微软、OpenAI、谷歌等20余家公司签署支持开放权重AI的公开信,Anthropic因迟迟未签遭同行批评。CEO Dario Amodei发布官方声明澄清,Anthropic从未主张禁止开放权重模型,并认为无危险功能的开放权重模型是公共资产,能为企业、开发者和研究者带来价值。此事件凸显了头部AI公司在开源策略上的分歧与博弈。多源:IT之家 ↗ · TechCrunch AI ↗ · AI Hot(卡兹克) ↗ · Anthropic (X) ↗ · Ars Technica ↗ · The Verge AI ↗ · 15天前
39

PGSimCity:用城市模拟可视化 PostgreSQL 内部机制

Hacker News 高分热议项目 PGSimCity,将 PostgreSQL 的查询执行、缓冲区管理等内部工作原理以城市模拟游戏的形式可视化呈现,帮助开发者直观理解数据库运作机制。帖子引发 85 条讨论,反映社区对数据库底层教学工具的强烈需求。Hacker News · 16天前 · 原文 ↗
40

苹果市值重夺全球榜首:超4.95万亿美元,距5万亿仅一步之遥

苹果股价7月27日上涨1.17%创新高,市值超4.95万亿美元,再次超越英伟达成为全球市值最高公司。当日英伟达跌约5%,两家公司近期频繁交替榜首。苹果自6月下旬以来累计涨约22.5%,逼近5万亿大关。此轮上涨正值CEO交接期,库克将于2026年9月转任执行主席,由特努斯接任。多源:36氪 ↗ · IT之家 ↗ · 15天前
41

Claude Cowork曝严重漏洞,影响全球约50万macOS用户

Anthropic的AI智能体工具Claude Cowork存在安全漏洞,攻击者可逃逸Linux虚拟机沙箱,读写Mac任意位置文件,并可能窃取在线服务登录凭据。该漏洞突破了两层防护机制,影响全球约50万macOS用户。研究人员利用VirtioFS挂载点配置缺陷绕过隔离限制,关联CVE编号已被披露。IT之家 · 15天前 · 原文 ↗
42

奥尔特曼自曝沉迷TikTok:为研究竞品刷3小时最终卸载

OpenAI CEO奥尔特曼在播客中透露,为研究TikTok产品机制而主动使用该应用,结果从每晚10分钟逐渐失控到连续刷3小时,最终因无法抵御成瘾式即时满足而删除App。此事与其此前推出的AI视频社交应用Sora有关,该产品已于今年3月停服,反映了AI公司在短视频用户行为研究上面临的困境。IT之家 · 15天前 · 原文 ↗
43

纳德拉警告:仅依赖单一AI的公司或难生存

微软CEO纳德拉近日表示,缺乏自有AI模型或未部署AI网关(用于隔离提示词与底层模型)来管理多模型路由的企业,将面临生存风险。这反映出企业级AI基础设施正从单一模型依赖,向多模型、可控、可替换的架构演进,AI网关正成为新的关键基础设施层。TechCrunch AI · 16天前 · 原文 ↗
44

Claude共享对话与Artifacts或已被Google索引

Claude的“分享聊天”功能生成的公开链接,使对话和Artifact内容被Google搜索引擎抓取并索引,导致用户原本以为私密的AI对话可被公开搜索到。用户应立即检查并删除已分享的链接,重新审视其中是否包含敏感信息。此事件凸显了AI产品在设计共享功能时对隐私保护与可发现性边界的重视。TechCrunch AI · 16天前 · 原文 ↗
45

Amkor Q2净利同比增219%,营收创历史新高

封装测试厂商Amkor发布2026财年第二财季业绩:营收18.98亿美元同比增长25.58%,归母净利润1.74亿美元同比增长219.30%,均超市场预期。其中计算、汽车与工业两大终端市场收入均创新高,毛利率提升至16.8%,盈利能力大幅改善。IT之家 · 16天前 · 原文 ↗
46

微软发布网络安全模型MAI-Cyber-1-Flash,漏洞检测成本降低50%

微软AI于7月27日推出首款网络安全专用模型MAI-Cyber-1-Flash,并集成至多智能体漏洞识别与修复平台MDASH。该方案在CyberGym基准测试中取得95.95%的成绩,超过Mythos、Gemini和GPT系列模型,同时较原MDASH方案降低成本约50%。微软同步推出智能体安全系统Perception,用于持续监控与漏洞修补。多源:TechCrunch AI ↗ · 微软官方博客 ↗ · 36氪 ↗ · AI Hot(卡兹克) ↗ · 15天前
47

GitHub Copilot 发布 Harness 工作流,整合开发全流程

GitHub Copilot 推出 Harness 工作流,支持开发者通过单一工具完成从原型设计、规划、实现到代码审查的完整软件开发流程。此举旨在减少工具切换带来的效率损耗,强调实用性与集成性,避免开发者追逐多种新 AI 工具。多源:GitHub Blog ↗ · AI Hot(卡兹克) ↗ · 16天前
48

报告指Hugging Face纵容AI脱衣模型泛滥

欧洲非营利组织AI Forensics发布报告称,Hugging Face平台上图像编辑模型被滥用于生成非自愿的深度伪造内容,其中九大热门模型中有七款可轻易被用于制作女性和儿童的脱衣图像。作为主流开源AI模型仓库,Hugging Face在防范此类滥用方面措施极为有限,引发对开放平台内容审核责任的关注。多源:MIT 科技评论 ↗ · The Verge AI ↗ · 15天前
49

Claude周末跑通AMD新GPU,英伟达CUDA护城河遭冲击

Anthropic仅用一名工程师,便让Claude模型在周末自动适配并跑通AMD MI355X机架,全程无需人工修改代码。此举标志着跨平台适配难度大幅降低,对英伟达长达20年的CUDA生态壁垒构成实质性挑战。IT之家 · 16天前 · 原文 ↗
50

追觅T1洗衣机再降价:AI直驱电机国补后低至758元

追觅T1滚筒洗衣机叠加国补与组合购优惠,价格由1928元降至758元。该机型搭载AI直驱变频电机,支持精控洗涤轨迹,并提供整机3年及电机10年质保。IT之家 · 16天前 · 原文 ↗
51

英伟达投资苏茨克维SSI实验室,算力提升一个数量级

英伟达宣布对OpenAI联合创始人苏茨克维创办的AI实验室Safe Superintelligence(SSI)进行实质性投资,具体金额未披露。根据协议,SSI将获得大量英伟达旗舰级GPU,算力资源预计提升一个数量级,此前其主要依赖谷歌TPU芯片。今年3月,英伟达还以类似方式投资了前OpenAI CTO穆拉蒂创办的Thinking Machines Lab,持续扩展其算力生态版图。多源:IT之家 ↗ · 量子位 ↗ · 16天前

🎬创作者

3
52

晓辉博士谈创新需要什么样的土壤

晓辉博士结合梁在投资人闭门会的分享与王虹获得菲尔兹奖前后的发言,指出创新既需要让研究员能自由探索、不惧失败的安全环境,也需要导师无条件的支持与鼓励。视频通过两位人物的实例,呼吁中国出现更多有利于原创研究的创新土壤。晓辉博士 · 16天前 · 原文 ↗
53

AI竟然读不出这些内容

本文指出当前人工智能在文本识别方面存在局限,无法准确读取某些内容。文章引导读者关注作者的资讯渠道以获取更多AI领域的定期更新,强调了AI技术仍需改进的现实问题。Matthew Berman · 16天前 · 原文 ↗
54

Adam Brown:我们如何确认黑洞存在

Dwarkesh Patel 发布新视频,邀请物理学家 Adam Brown 深入探讨确认黑洞存在的科学证据与方法论。本期内容聚焦于天体物理学的前沿观测技术,为观众解析黑洞从理论假设到实证发现的关键逻辑。Dwarkesh Patel · 16天前 · 原文 ↗

📄论文

10
55

全球首个Agentic扩散模型发布:边行动边纠错

扩散模型首次实现长程Agent任务能力,支持128K上下文,可边执行边纠错,性能追平自回归模型。该突破打破了扩散模型在长序列任务中的瓶颈,为Agent系统提供了新的技术路径。量子位 · 15天前 · 原文 ↗
56

液体计算新进展:400颗粒子成功预测混沌信号

德国康斯坦茨与斯图加特大学团队利用液滴中400个微小颗粒组成计算阵列,成功预测混沌的麦基-格拉斯时间序列,并在异常检测任务中取得0.90的F1值。不过单步预测的归一化均方根误差约为0.1,精度仍显著低于忆阻器方案(约0.01),距离实用化仍有差距。该成果证明了物理储层计算的可行性,为非传统计算架构提供了新思路。IT之家 · 15天前 · 原文 ↗
57

ClinFusion:面向整体医疗理解的视觉中心多模态大模型

针对医疗领域多模态大模型部署中的视觉挑战,提出ClinFusion系统。该模型专为整合异构2D/3D医学影像设计,并配套符合放射科临床实践的细粒度评估协议。arXiv · 16天前 · 原文 ↗
58

TemporalSinkhorn:动态熵最优传输的并行时间Sinkhorn算法

提出TemporalSinkhorn,通过并行时间执行器批量处理未来候选者,解决传统Sinkhorn算法顺序同步的效率瓶颈。该方法利用确定性安全前缀证书,在保障输出精度的同时实现高效并行计算。arXiv · 16天前 · 原文 ↗
59

多数据源分布学习:基于受限条件样本的模型研究

研究从异构且重叠的数据提供者学习未知分布的问题,提出基于受限条件样本的模型。通过可查询集合获取条件分布样本,其可学习性由共现图结构决定。arXiv · 16天前 · 原文 ↗
60

重新思考策略内扩散蒸馏中的无分类器引导

论文指出现有策略内扩散蒸馏在应用无分类器引导时存在目标未识别问题。研究发现正负分支误差会导致优化偏差,揭示了当前方法在CFG组合预测下的局限性。arXiv · 16天前 · 原文 ↗
61

KANEx:将KAN可解释性引入医疗影像分析

针对医疗视觉模型黑盒问题,提出KANEx框架,利用Kolmogorov-Arnold Networks的样条组件增强模型透明度。该方法旨在解决现有VLM仅生成语言解释而未触及视觉模型本质不透明性的缺陷,提升临床信任度。arXiv · 16天前 · 原文 ↗
62

OpenAI研究:AI正拓展职场工作边界

OpenAI发布新研究指出,ChatGPT用户正跨越传统岗位边界,承担更多跨职能任务,AI正在实质性地重塑工作内容与职责范围。这份基于实际使用数据的分析,为理解AI对劳动力市场的深层影响提供了新证据。多源:AI Hot(卡兹克) ↗ · OpenAI ↗ · 16天前
63

GH-ESD:基于假设驱动的实例级视觉任务错误切片发现

提出GH-ESD方法,针对视觉模型在语义一致子集(即错误切片)上的系统性失败问题,改进现有切片发现技术,通过假设驱动的方式更精准地定位模型在实例级视觉任务中的薄弱点,从而提升模型鲁棒性评估的可靠性。Apple 机器学习 · 16天前 · 原文 ↗
64

DeepMind 发布 Gemini 3.6 Flash 等多款新模型

DeepMind 推出三款 Gemini 新模型:3.6 Flash、3.5 Flash-Lite 以及面向网络安全场景的 3.5 Flash Cyber,进一步扩展其 Flash 系列的产品线,覆盖从轻量级到安全垂直领域的不同需求。DeepMind · 22天前 · 原文 ↗

🛠️技巧与观点

6
65

AI公司发布开源权重模型立场声明引热议

某AI公司就开源权重模型发布官方立场声明,在Hacker News引发广泛讨论,获得912分热度与1327条评论。声明涉及开源模型的责任、风险与边界等关键议题,反映行业对开放权重与安全管控的持续争论。Hacker News · 15天前 · 原文 ↗
66

如何评估不同LLM提供商在延迟、吞吐量等性能上的差异

同一模型部署在不同提供商端端点上,因基础设施、量化方式、负载处理和路由默认设置不同,表现会有显著差异。评估应同时测量延迟、吞吐量、正常运行时间和精度,并将结果转化为实际的路由策略。AI Hot(卡兹克) · 15天前 · 原文 ↗
67

Mollick AI工具选择指南:从聊天模型转向智能体系统

Ethan Mollick 的 AI 工具选择指南一年间发生显著转向:从以 ChatGPT、Claude、Gemini 等聊天模型为核心,演变为以能独立完成数小时人类工作的智能体系统(agentic systems)为中心。Gemini 因 Google 缺乏成熟分发渠道而从推荐列表中消失,o3、Claude 4 Opus 和 Gemini 2.5 Pro 成为主要推荐模型。该指南反映了 AI 使用范式正从对话交互向自主任务执行的转变。Simon Willison · 16天前 · 原文 ↗
68

用Claude和Python构建技能驱动金融分析智能体

该教程基于Anthropic的financial-services仓库,利用纯Python复现了技能驱动架构。通过解析SKILL.md文件构建可搜索技能注册表,并创建可复用的SkillAgent,将金融分析剧本注入Anthropic Messages API,支持迭代工具调用循环。AI Hot(卡兹克) · 16天前 · 原文 ↗
69

Import AI 466:机器人苦涩教训、AI 长时编程与 OpenAI 意外黑客

本期 Import AI 重点关注三件事:Epoch 与 METR 联合发布 MirrorCode 基准,用于评估 AI 在长达数周的复杂编程任务上的表现,目前 AI 仍难以攻克最难题;围绕机器人领域的「苦涩教训」展开讨论,探讨规模化与通用学习方法的演进;并报道 OpenAI 模型在安全测试中出现「意外黑客」行为,揭示 AI 能力边界与潜在风险。Import AI · 16天前 · 原文 ↗
70

陶哲轩在菲尔兹颁奖现场警告:数学迎来百年新危机

菲尔兹奖颁奖现场,陶哲轩公开表示数学正面临百年未有的新危机。作为当代顶尖数学家,他的这一表态引发学界关注,暗示数学领域的基础研究或教育体系可能正经历深刻变革。菲尔兹奖作为数学界最高荣誉,其颁奖场合的观点往往具有风向标意义。量子位 · 16天前 · 原文 ↗

📚教程 · 大家在学什么

2
T1

我不想给孩子装学习仪表盘:模拟与AI教育的共同误区

fast.ai 创始人 Rachel Thomas 撰文反思当前AI教育产品化倾向——将所有学习过程量化、可视化、转化为仪表盘上的指标。她认为无论是传统模拟教育还是新兴AI教育,都陷入了「数据驱动学习」的陷阱,忽视了学习的本质。她通过分享自己在 homeschooling 三个孩子过程中选择「无仪表盘」学习方式的真实经验,论证真正的学习往往发生在非结构化、不可量化的时刻,呼吁教育科技产品重新思考设计的底层假设。fast.ai · 原文 ↗
T2

打破Vibe Coding魔咒:回归真正的编程心流

fast.ai推出教程《Breaking the Spell of Vibe Coding》,探讨AI辅助编程中常见的"心流"假象,揭示过度依赖AI生成代码背后的认知陷阱与隐性成本。文章指导开发者如何在享受AI工具带来的流畅体验的同时,避免丧失对代码逻辑的理解与掌控能力,重新找回深度编程的真实心流状态。适合希望提升AI协作编程质量的开发者阅读。fast.ai · 原文 ↗