📰 每日 AI 资讯

2026年07月23日

最后更新:2026-07-23 08:03:55 UTC+8

🔹 Hacker News

Safari 技术预览版 248 发布

文章网址:https://webkit.org/blog/18162/release-notes-for-safari-technology-preview-248/ 评论网址:https://news.ycombinator.com/item?id=49013356 积分:65 # 评论: 26

📅 Wed, 22 Jul 2026 🔗 原文链接

可塑计算、Emacs 和你

文章网址:http://yummymelon.com/devnull/malleable-computing-emacs-and-you.html 评论网址:https://news.ycombinator.com/item?id=49013538 积分:58 # 评论: 7

📅 Wed, 22 Jul 2026 🔗 原文链接

任何文本到 SQL 基准测试都应该解决现实世界数据存储的困难

文章网址:https://cacm.acm.org/blogcacm/if-you-think-you-can-do-real-world-text-to-sql/ 评论网址:https://news.ycombinator.com/item?id=49013995 积分:23 # 评论: 4

📅 Wed, 22 Jul 2026 🔗 原文链接

美第奇家族400多年之谜或将解开

文章网址:https://www.cnn.com/2026/07/15/science/medici-family-mystery-dna-malaria 评论网址:https://news.ycombinator.com/item?id=49014007 积分:58 # 评论: 11

📅 Wed, 22 Jul 2026 🔗 原文链接

儿童与 LLM 聊天机器人互动中的拟人化

文章网址:https://arxiv.org/abs/2607.18250 评论网址:https://news.ycombinator.com/item?id=49014537 积分:5 # 评论: 0

📅 Wed, 22 Jul 2026 🔗 原文链接

🔹 arXiv 人工智能

从智能体故障路径到量化残余风险:弹性智能体人工智能的组合框架

arXiv:2607.18243v1 公告类型:新 摘要:代理人工智能跨越信任边界的速度比当前风险模型所能代表的速度更快。现有方法提供了两种局部视图之一。它们要么描述故障机制而不产生可转移的剩余风险估计,要么在将内部故障路径视为黑匣子的同时产生风险估计。我们将这两个视图结合起来......

📅 Wed, 22 Jul 2026 🔗 原文链接

大规模人工智能工具发现:您所需要的只是 DNS

arXiv:2607.18242v1 公告类型:新 摘要:即将到来的自主人工智能代理时代需要一种能够导航数百万种工具的发现机制,但现有的解决方案在 O(N) 复杂性和集中式治理下不堪重负。我们提出了 ToolDNS,而不是构建另一个脆弱的覆盖层,这是一个激进的框架,它将语义工具发现改进到互联网上最具弹性的系统上。

📅 Wed, 22 Jul 2026 🔗 原文链接

BatchDAG:LLM 规划的执行图,用于对企业数据进行可扩展的临时分析

arXiv:2607.18241v1 公告类型:新 摘要:大型语言模型(LLM)擅长分析单个文档,但由于上下文溢出、每个实体归因的丢失以及顺序工具调用的线性延迟,无法解决企业级数据集上的详尽的跨实体分析问题。我们提出了 BatchDAG,一个由法学硕士生成类型化有向非循环网格的系统...

📅 Wed, 22 Jul 2026 🔗 原文链接

通过证据链评估进行校准选择性事实核查

arXiv:2607.18240v1 公告类型:新 摘要:大型语言模型(LLM)可以实现强大的事实检查准确性,但强制二元决策掩盖了一个关键的可靠性问题:即使支持证据薄弱、稀疏或内部不一致,系统也可能会发布自信的判决。我们通过证据链评估(ECE)来解决这个问题,这是一个选择性的事实检查框架......

📅 Wed, 22 Jul 2026 🔗 原文链接

系统管理员:测量前沿 AI 中的工具性寻电

arXiv:2607.18239v1 公告类型:新 摘要:权力寻求被定义为人工智能系统获取资源、逃避监督或抵制超出任务要求的终止的行为,被认为是失控(LoC)风险的关键驱动因素。在这项工作中,我们介绍了 SysAdmin,这是一个基准测试,它将前沿语言模型定位为高保真 Linux 沙盘中的自治系统管理员......

📅 Wed, 22 Jul 2026 🔗 原文链接

🔹 Reddit 机器学习

询问如何与教授或研究实验室合作 [D]

大家好,我已经不再上大学了。在全职工作的同时是否可以与教授或任何研究实验室一起进行研究?如果是,接触并参与的最佳方式是什么?另外,如果有人正在寻找合作研究项目或类似项目的人,可以私信我。 由 /u/VastThen1742 提交 [链接] [评论]

📅 2026-07-22 21:09 🔗 原文链接

祝所有庆祝的人快乐开放审查刷新日 [D]

...愿机会对你有利。更严肃地说,作为 Neurips 的区域主席,我可以说他们今年设置的激励措施有点起作用(如果他们不负责任,就有拒绝审稿人论文的风险)。自从我开始为大型会议进行 ACing 以来(大概有 5 年左右的时间),我需要追逐的审稿人/紧急招募的审稿人数量是最少的。希望评论...

📅 2026-07-22 12:25 🔗 原文链接

NeurIPS 2026 评论今日发布(7 月 22 日,AoE)——讨论主题 [D]

今天评论下降。此帖子用于反应、庆祝、同情以及介于两者之间的任何有用的内容。首先:如果你得到好评,请说出来。这些帖子中有一个常态,即只传播坏消息,这扭曲了每个人对正常情况的看法。发布你的胜利。其次,每个周期都值得重复的事情:审查过程很吵闹,而且噪音是衡量的,而不是民间传说......

📅 2026-07-22 08:30 🔗 原文链接

SkewAdam:一种分层优化器,可将 MoE 状态内存减少 97%(适合 40GB GPU 上的 6.7B MoE)[R]

论文:https://arxiv.org/abs/2607.19058 代码 (GitHub):https://github.com/nuemaan/skewadam 大家好,我刚刚发布了一篇关于新优化器的预印本,该优化器旨在解决专家混合 (MoE) 训练中的巨大 VRAM 瓶颈。如果您训练过 MoE,您就会知道优化器状态通常是内存预算中最大的单行项目。例如,AdamW 花费了 50.6 GB 的状态内存......

📅 2026-07-22 07:04 🔗 原文链接

🔹 51AllAI

通义发布Qwen-Image-3.0,支持4.5K Token长指令和12种语言

通义发布 Qwen-Image-3.0,最长可处理 4.5K Token 的图像生成指令,并支持 10px 小字、12 种语言和 100 多种艺术风格。新版本面向信息图、报纸、分镜、试卷与界面等文字密集型图片,普通用户可从发布页面进入千问网页端体验。最长可处理 4.5K Token 指令Qwen-Image-3.0 是 Qwen-Image 系列的第三代图像生成基础模型。它把可接受的指令长度提高到 4.5K Token。Token 是模型处理文字时使用的基本单位;可用长度越高,一条提示词就能容纳越多场景、文字、位置和版式要求。长指令主要服务于信息密度较高的图片。用户可以在一次生成中描述报纸、分...

📅 2026-07-22 03:08 🔗 原文链接

Google 发布第三款 Gemini 模型,3.6 Flash 足球输出 代币用量降低 17%

Google 发布 Gemini 3.6 Flash、3.5 Flash-Lite 和 3.5 Flash Cyber。其中,3.6 Flash 在一组综合评测中比 3.5 Flash 少用 17% 输出 Token;前两款已开放 API,Cyber 版将通过 CodeMender 限量提供。三款模型分别处理通用任务、高吞吐任务和代码安全Gemini 3.6 Flash 是这次更新中的通用型号,面向编程、知识工作、多模态理解和需要连续调用工具的多步任务。多模态指模型可以同时处理文字、图片、音频、视频和 PDF,而不是只接收文字。Gemini 3.5 Flash-Lite 把重点放在高吞吐和低成...

📅 2026-07-22 01:43 🔗 原文链接

阿里上线Qwen-Audio-3.0-TTS,提供Flash与Plus两个版本

阿里上线 Qwen-Audio-3.0-TTS,分为 Flash 和 Plus 两个版本。两者支持语音合成、自然语言指令与情绪、拟声标签,开发者可通过 DashScope API 调用。国际服务按输入字符计费,Flash 每万字符 0.15 美元,Plus 为 0.20 美元。Flash 和 Plus 面向不同场景Qwen-Audio-3.0-TTS 把文字转换为可播放的语音,支持边接收文字边返回音频的流式输出。Flash 主要用于语音助手、智能客服等对响应速度敏感的互动场景;Plus 面向有声书、新闻播报和内容配音等更重视成品质量的任务。两个版本的模型 ID 分别是 qwen-audio-3...

📅 2026-07-21 09:18 🔗 原文链接

字节跳动发布 Seed Audio 1.0,一条提示词可联合生成人声、音效和环境声

字节跳动发布 Seed Audio 1.0,一条提示词可以同时安排多角色对白、背景音乐、音效和环境氛围。它支持文本、参考音频或参考图片输入,单次最长生成 2 分钟音频。一条提示词完成一段声音场景普通 TTS(文字转语音)的主要任务是把文字读出来。Seed Audio 1.0 处理的对象是完整声音场景:同一次生成里可以包含多角色对白、笑声和叹息等非语言声音、背景音乐、拟音与环境声。提示词需要像一份简短的声音脚本。可以写清场景、角色、台词、语言、语气、背景声和音效出现的时机。例如,想做一段雨夜咖啡店对话,可以把两个角色的声线与台词、窗外雨声、室内杯碟碰撞声和音乐风格写在同一条指令里。模型返回的是混...

📅 2026-07-20 05:07 🔗 原文链接

Kimi 暂停新订阅,会员权益将拆分为 Kimi 与 Kimi Code

Kimi 暂停接受新会员订阅,并把算力优先分配给现有订阅用户。7 月 20 日起,Kimi 与 Kimi Code 会员权益分开:前者覆盖网页端、App 和 Work,后者面向编程工作流;老套餐可以继续使用和自动续费。Kimi 暂停接受新订阅Kimi 在 7 月 19 日宣布暂停接受新会员订阅。过去 48 小时的需求已接近现有算力容量上限,平台将计算资源优先分配给当前订阅用户,已经订阅的用户不受这次调整影响。暂停是临时措施。Kimi 正在增加算力,并会分批重新开放订阅名额。会员权益从 7 月 20 日起拆分Kimi 会员与 Kimi Code 会员将覆盖不同的产品:Kimi 会员用于网页端、A...

📅 2026-07-19 15:48 🔗 原文链接

阿里预告 Qwen3.8,2.4T 参数模型将开放权重

阿里千问预告 Qwen3.8 即将发布并开放模型权重,参数规模为 2.4T。面向用户的 Qwen3.8-Max-Preview 已进入 Token Plan、Qoder 和 QoderWork,可先在阿里旗下订阅与智能编程、桌面办公产品中体验。Qwen3.8 将以开放权重方式发布Qwen3.8 的参数规模为 2.4T,也就是 2.4 万亿参数。参数是模型在训练中学到的数值,数量反映模型规模,但不能单独代表实际效果。“开放权重”指训练完成后的模型参数文件对外提供,便于开发者在本地或自有服务器上运行和适配模型。它与同时公开训练代码、训练数据不是同一件事,因此本次预告更准确的说法是“开放模型权重”。...

📅 2026-07-19 08:55 🔗 原文链接

Anthropic 延长 Claude Code 每周中断加码至 8 月 19 日

Anthropic 将 Claude Code 每周使用限额提高 50% 的活动延长至 2026 年 8 月 19 日,覆盖 Pro、Max、Team 和传统按席位计费的 Enterprise 用户。活动自动生效,只适用于 Claude Code 的周限额,不改变 5 小时限额。周限额提高 50% 延长到 8 月 19 日此次活动从 2026 年 5 月 13 日持续到 8 月 19 日 23:59(太平洋时间)。适用用户的 Claude Code 每周使用限额在标准额度上提高 50%,不需要领取或修改账户设置。8 月 19 日活动结束后,Claude Code 周限额恢复到标准水平,用户的套...

📅 2026-07-19 01:31 🔗 原文链接

Anthropic 将克劳德寓言 5 纳入 Max 与 Team Premium 订阅

Anthropic 将从 7 月 20 日起把 Claude Fable 5 纳入所有 Max 与 Team Premium 计划,最多可占每周额度的 50%。Pro 与 Team Standard 用户仍通过用量积分使用,并获得一次性 100 美元积分。7 月 20 日起纳入两类订阅Claude Fable 5 将从 2026 年 7 月 20 日起成为 Max 和 Team Premium 计划的订阅内模型,覆盖所有对应个人账户和团队高级席位。用户最多可以把每周使用额度的 50% 用在 Fable 5 上。这里的 50% 是 Fable 5 在现有周额度中的使用上限,不是额外增加一份额度。...

📅 2026-07-18 10:48 🔗 原文链接

腾讯 WorkBuddy 国内版接入 Kimi K3,订阅用户优先可用

腾讯 Buddy 全系内置模型接入 Kimi K3,WorkBuddy 国内版同步可用。企业专享版与个人订阅用户优先获得使用资格;WorkBuddy 和 CodeBuddy 共用账号与积分体系。WorkBuddy 国内版接入 Kimi K3腾讯已将 Kimi K3 加入 Buddy 全系产品的内置模型。Buddy 是 WorkBuddy、CodeBuddy 等产品的统称,因此 WorkBuddy 国内版也进入这次接入范围。Kimi K3 是月之暗面推出的大模型,支持文字、图像和视频输入,拥有 100 万 Token 上下文窗口。Token 是模型处理文字、代码等内容的基本单位;更大的窗口适合在...

📅 2026-07-17 14:00 🔗 原文链接

月之暗面发布 Kimi K3,上线百万 Token 上下文与视觉输入

月之暗面发布 Kimi K3,模型总参数为 2.8 万亿,支持 100 万 Token 上下文和图像、视频输入。产品已接入 Kimi 网页端、Kimi Work、Kimi Code 与 API,开发者可用 kimi-k3 模型名调用。Kimi K3 已进入网页端、桌面端和 API普通用户可以在 Kimi 网页端使用 Kimi K3,也可以通过 iOS、Android 和 HarmonyOS 版 Kimi App 访问。需要处理本地文件和知识工作的用户,可在 Kimi Work 3.1.0 或更高版本中选择 K3;桌面客户端支持 Windows 和 Apple 芯片 Mac。开发者有两条入口。终...

📅 2026-07-17 00:08 🔗 原文链接