📰 每日 AI 资讯

2026年07月24日

最后更新:2026-07-24 08:03:51 UTC+8

🔹 Hacker News

基于 ATProto 构建

文章网址:https://lukekanies.com/writing/building-on-atproto/ 评论网址:https://news.ycombinator.com/item?id=49025984 积分:117 # 评论: 58

📅 hu, 23 Jul 2026 🔗 原文链接

显示 HN:Echo – 使用开放权重模型以 1/3 成本获得寓言级结果

我一直在构建 Echo (https://echo.tracerml.ai/),这是一项从开放权重模型池中构建一个人工智能系统的实验,而不是选择单个模型并将其用于每项任务。它从一个简单的实验开始。我选取了一组模型,包括 GLM-5.2、Kimi K2.7 等,并对它们进行相同的评估。然后我测量了如果对于每个问题你以某种方式......

📅 hu, 23 Jul 2026 🔗 原文链接

告诉 HN:Namecheap 将我的帐户提供给了未经验证的第三方

我成为 NameCheap 客户已有 13 年了。我还帮助一个老大学俱乐部支付他们使用的 .com 费用(该网站以我的姓名、地址和电话号码注册)。在最近的领导层换届期间,即将上任的俱乐部领导想要对 DNS 进行更改,但不知道与我联系。他们发现该域名被停放在NameCheap,因此他们发起了密码重置...

📅 hu, 23 Jul 2026 🔗 原文链接

98.CSS

文章网址:https://jdan.github.io/98.css/#status-bar 评论网址:https://news.ycombinator.com/item?id=49028927 积分:72 # 评论: 8

📅 hu, 23 Jul 2026 🔗 原文链接

涉及人工智能的全杀未来的分类

文章网址:https://arxiv.org/abs/2507.09369 评论网址:https://news.ycombinator.com/item?id=49029133 积分:18 # 评论: 6

📅 hu, 23 Jul 2026 🔗 原文链接

🔹 arXiv 人工智能

FormulaSPIN:自然语言到电子表格公式生成的自玩微调

arXiv:2607.19354v1 公告类型:新 摘要:全球有数亿人使用电子表格应用程序,但编写公式仍然是一个重大障碍。现有方法依赖于静态监督数据,这些数据很快就会饱和于有限的注释。在本文中,我们介绍了 FORMULASPIN,这是一个自我对弈框架,它通过启用迭代来打破监督微调的天花板......

📅 hu, 23 Jul 2026 🔗 原文链接

在 Intel TDX 下对 NVIDIA H100 上的机密 GPU 推理进行基准测试

arXiv:2607.19353v1 公告类型:新 摘要:机密计算正在成为处理敏感输入或保护专有模型资产的人工智能推理工作负载的实际部署要求。然而,为 GPU 加速的大型语言模型服务启用机密执行的性能成本仍然依赖于工作负载并且在操作上很重要。本文提出...

📅 hu, 23 Jul 2026 🔗 原文链接

OpenEvoShield:针对开放世界多代理系统攻击的双重非稳态持续防御

arXiv:2607.19351v1 公告类型:新 摘要:基于 LLM 的多代理系统(LLM-MAS)越来越多地部署在安全关键型应用中,攻击者通过代理间通信注入恶意指令来传播有害行为。与静态威胁不同,这些攻击具有双重动态性:对手针对已部署的防御完善注入策略,而正常攻击...

📅 hu, 23 Jul 2026 🔗 原文链接

用于稳健金融欺诈检测和对抗弹性的混合 LSTM-图神经框架

arXiv:2607.19350v1 公告类型:新 摘要:由于极端的数据不平衡(0.13% 的欺诈率)和不断发展的对抗性逃税策略,金融机构在检测复杂的洗钱模式(例如小额洗钱和分层)方面面临着重大挑战。本文提出了 FraudShield AI,这是一种将长短期记忆 (LSTM) 网络与手工制作相集成的混合框架。

📅 hu, 23 Jul 2026 🔗 原文链接

FineServe:全球 LLM 服务工作负载的细粒度数据集和特征

arXiv:2607.19349v1 公告类型:新 摘要:大型语言模型 (LLM) 越来越多地部署为始终在线的在线服务,这使得高效的 LLM 服务成为一项关键的系统挑战。在需求波动的情况下实现低延迟和高吞吐量需要深入了解现实世界的服务工作负载,但现有研究通常依赖于代理跟踪或粗粒度特征...

📅 hu, 23 Jul 2026 🔗 原文链接

🔹 Reddit 人工智能

Substack 推出了“人工智能制造”仪表。人们正在失去理智。

本周早些时候,Substack 与 AI 检测工具 Pangram 合作,在其平台上推出了一项新功能。目标:提醒读者注意完全由人工智能编写或在人工智能协助下编写的内容。 Chris Best Substack 的首席执行官写道:“我们正在与领先的人工智能检测工具 Pangram 合作。您将能够扫描笔记、回复、评论和帖子,以查看对...的估计。

📅 2026-07-23 17:22 🔗 原文链接

审美热潮即将到来。它看起来不像人工智能。

由 /u/Independent-Key-1621 提交 [链接] [评论]

📅 2026-07-23 12:55 🔗 原文链接

我曾经为这些技能感到自豪。现在人工智能代理做得更好。

多年来,我为自己能够快速扫描代码库、高效地导航终端并比我共事的大多数开发人员更快地找到正确的信息而感到自豪。不过,最近我意识到人工智能代理在许多方面都优于我。我过去通过精心设计 Google 搜索和通过 Stack Overflow 挖掘获得的答案现在可以通过人工智能在几分钟内找到。某些型号...

📅 2026-07-23 11:14 🔗 原文链接

🔹 Reddit 机器学习

NeurIPS E 和 D,平均评分 3,平均置信度 4,我可以反驳并解决他们所有的担忧吗?我还有机会还是不太可能?[R]

NeurIPS E 和 D 轨道审核今天发布,我收到的平均评分是 3,信心是 4。我可以纠正并解决他们所有的担忧。我是否仍然有真正的机会被录取,或者因为我的分数都不是 4 或 5,所以目前基本上不可能?我应该退出吗? 由 /u/Ok-Ball-2546 提交 [链接] [评论]

📅 2026-07-23 21:07 🔗 原文链接

GPT-5.5 在 ActiveVision 上得分 10.6%,人类得分 96.1% [R]

一篇新的 [arXiv 论文](https://arxiv.org/abs/2607.16165) 的有趣发现并不是前沿视觉模型未能通过每周发生的新基准,而是失败的具体形式以及模型无法通过编写自己的代码来修补它的事实。该基准名为 ActiveVision,包含 3 个类别的 17 项任务,用作者的话说,旨在“强制重复...

📅 2026-07-23 19:20 🔗 原文链接

NeurIPS 2026 中的即时注入? [D]

评论刚刚发布,我从 OpenReview 下载了我的论文,以确定需要改进的领域。然而,GPT 警告我该 PDF 包含提示注入。我从来没有插入过这样的提示。将我的原始提交内容与从 OpenReview 下载的版本进行比较后,看来该注入可能是由 NeurIPS 添加的。我想知道是否还有人...

📅 2026-07-23 16:34 🔗 原文链接

NeurIPS 评论出来了吗? OpenReview 未加载哈哈 [D]

祝你好运! 由 /u/Business-Kale-1406 提交 [链接] [评论]

📅 2026-07-23 12:13 🔗 原文链接

🔹 51AllAI

OpenAI 发布 Presence,把语音与聊天智能体交付给企业

OpenAI 发布 Presence,为企业部署语音与聊天智能体。它可以连接企业知识和业务系统,在明确权限内处理请求、执行获批操作或转交人工,并通过模拟评估和受控更新覆盖上线前后的管理流程。Presence 不是一个新的聊天机器人OpenAI Presence 是一套面向企业的智能体交付产品,覆盖客户服务和内部工作流程。它支持实时语音与聊天,可用于处理账单问题、保险理赔或员工 IT 服务请求等具体工作。每个智能体从一个明确任务开始,只获得完成这项任务所需的知识和系统访问权限。企业负责设定它可以执行哪些操作、哪些操作需要审批,以及什么情况下必须转交人工。智能体可以查询账户信息、应用业务规则并执行...

📅 2026-07-23 13:50 🔗 原文链接

通义发布Qwen-Image-3.0,支持4.5K Token长指令和12种语言

通义发布 Qwen-Image-3.0,最长可处理 4.5K Token 的图像生成指令,并支持 10px 小字、12 种语言和 100 多种艺术风格。新版本面向信息图、报纸、分镜、试卷与界面等文字密集型图片,普通用户可从发布页面进入千问网页端体验。最长可处理 4.5K Token 指令Qwen-Image-3.0 是 Qwen-Image 系列的第三代图像生成基础模型。它把可接受的指令长度提高到 4.5K Token。Token 是模型处理文字时使用的基本单位;可用长度越高,一条提示词就能容纳越多场景、文字、位置和版式要求。长指令主要服务于信息密度较高的图片。用户可以在一次生成中描述报纸、分...

📅 2026-07-22 03:08 🔗 原文链接

Google 发布第三款 Gemini 模型,3.6 Flash 足球输出 代币用量降低 17%

Google 发布 Gemini 3.6 Flash、3.5 Flash-Lite 和 3.5 Flash Cyber。其中,3.6 Flash 在一组综合评测中比 3.5 Flash 少用 17% 输出 Token;前两款已开放 API,Cyber 版将通过 CodeMender 限量提供。三款模型分别处理通用任务、高吞吐任务和代码安全Gemini 3.6 Flash 是这次更新中的通用型号,面向编程、知识工作、多模态理解和需要连续调用工具的多步任务。多模态指模型可以同时处理文字、图片、音频、视频和 PDF,而不是只接收文字。Gemini 3.5 Flash-Lite 把重点放在高吞吐和低成...

📅 2026-07-22 01:43 🔗 原文链接

阿里上线Qwen-Audio-3.0-TTS,提供Flash与Plus两个版本

阿里上线 Qwen-Audio-3.0-TTS,分为 Flash 和 Plus 两个版本。两者支持语音合成、自然语言指令与情绪、拟声标签,开发者可通过 DashScope API 调用。国际服务按输入字符计费,Flash 每万字符 0.15 美元,Plus 为 0.20 美元。Flash 和 Plus 面向不同场景Qwen-Audio-3.0-TTS 把文字转换为可播放的语音,支持边接收文字边返回音频的流式输出。Flash 主要用于语音助手、智能客服等对响应速度敏感的互动场景;Plus 面向有声书、新闻播报和内容配音等更重视成品质量的任务。两个版本的模型 ID 分别是 qwen-audio-3...

📅 2026-07-21 09:18 🔗 原文链接

字节跳动发布 Seed Audio 1.0,一条提示词可联合生成人声、音效和环境声

字节跳动发布 Seed Audio 1.0,一条提示词可以同时安排多角色对白、背景音乐、音效和环境氛围。它支持文本、参考音频或参考图片输入,单次最长生成 2 分钟音频。一条提示词完成一段声音场景普通 TTS(文字转语音)的主要任务是把文字读出来。Seed Audio 1.0 处理的对象是完整声音场景:同一次生成里可以包含多角色对白、笑声和叹息等非语言声音、背景音乐、拟音与环境声。提示词需要像一份简短的声音脚本。可以写清场景、角色、台词、语言、语气、背景声和音效出现的时机。例如,想做一段雨夜咖啡店对话,可以把两个角色的声线与台词、窗外雨声、室内杯碟碰撞声和音乐风格写在同一条指令里。模型返回的是混...

📅 2026-07-20 05:07 🔗 原文链接

Kimi 暂停新订阅,会员权益将拆分为 Kimi 与 Kimi Code

Kimi 暂停接受新会员订阅,并把算力优先分配给现有订阅用户。7 月 20 日起,Kimi 与 Kimi Code 会员权益分开:前者覆盖网页端、App 和 Work,后者面向编程工作流;老套餐可以继续使用和自动续费。Kimi 暂停接受新订阅Kimi 在 7 月 19 日宣布暂停接受新会员订阅。过去 48 小时的需求已接近现有算力容量上限,平台将计算资源优先分配给当前订阅用户,已经订阅的用户不受这次调整影响。暂停是临时措施。Kimi 正在增加算力,并会分批重新开放订阅名额。会员权益从 7 月 20 日起拆分Kimi 会员与 Kimi Code 会员将覆盖不同的产品:Kimi 会员用于网页端、A...

📅 2026-07-19 15:48 🔗 原文链接

阿里预告 Qwen3.8,2.4T 参数模型将开放权重

阿里千问预告 Qwen3.8 即将发布并开放模型权重,参数规模为 2.4T。面向用户的 Qwen3.8-Max-Preview 已进入 Token Plan、Qoder 和 QoderWork,可先在阿里旗下订阅与智能编程、桌面办公产品中体验。Qwen3.8 将以开放权重方式发布Qwen3.8 的参数规模为 2.4T,也就是 2.4 万亿参数。参数是模型在训练中学到的数值,数量反映模型规模,但不能单独代表实际效果。“开放权重”指训练完成后的模型参数文件对外提供,便于开发者在本地或自有服务器上运行和适配模型。它与同时公开训练代码、训练数据不是同一件事,因此本次预告更准确的说法是“开放模型权重”。...

📅 2026-07-19 08:55 🔗 原文链接

Anthropic 延长 Claude Code 每周中断加码至 8 月 19 日

Anthropic 将 Claude Code 每周使用限额提高 50% 的活动延长至 2026 年 8 月 19 日,覆盖 Pro、Max、Team 和传统按席位计费的 Enterprise 用户。活动自动生效,只适用于 Claude Code 的周限额,不改变 5 小时限额。周限额提高 50% 延长到 8 月 19 日此次活动从 2026 年 5 月 13 日持续到 8 月 19 日 23:59(太平洋时间)。适用用户的 Claude Code 每周使用限额在标准额度上提高 50%,不需要领取或修改账户设置。8 月 19 日活动结束后,Claude Code 周限额恢复到标准水平,用户的套...

📅 2026-07-19 01:31 🔗 原文链接

Anthropic 将克劳德寓言 5 纳入 Max 与 Team Premium 订阅

Anthropic 将从 7 月 20 日起把 Claude Fable 5 纳入所有 Max 与 Team Premium 计划,最多可占每周额度的 50%。Pro 与 Team Standard 用户仍通过用量积分使用,并获得一次性 100 美元积分。7 月 20 日起纳入两类订阅Claude Fable 5 将从 2026 年 7 月 20 日起成为 Max 和 Team Premium 计划的订阅内模型,覆盖所有对应个人账户和团队高级席位。用户最多可以把每周使用额度的 50% 用在 Fable 5 上。这里的 50% 是 Fable 5 在现有周额度中的使用上限,不是额外增加一份额度。...

📅 2026-07-18 10:48 🔗 原文链接

腾讯 WorkBuddy 国内版接入 Kimi K3,订阅用户优先可用

腾讯 Buddy 全系内置模型接入 Kimi K3,WorkBuddy 国内版同步可用。企业专享版与个人订阅用户优先获得使用资格;WorkBuddy 和 CodeBuddy 共用账号与积分体系。WorkBuddy 国内版接入 Kimi K3腾讯已将 Kimi K3 加入 Buddy 全系产品的内置模型。Buddy 是 WorkBuddy、CodeBuddy 等产品的统称,因此 WorkBuddy 国内版也进入这次接入范围。Kimi K3 是月之暗面推出的大模型,支持文字、图像和视频输入,拥有 100 万 Token 上下文窗口。Token 是模型处理文字、代码等内容的基本单位;更大的窗口适合在...

📅 2026-07-17 14:00 🔗 原文链接