📰 每日 AI 资讯

2026年07月27日

最后更新:2026-07-27 08:12:22 UTC+8

🔹 Hacker News

我们现在有证明自动化

文章网址:https://www.imperialviolet.org/2026/07/26/zstd-lean.html 评论网址:https://news.ycombinator.com/item?id=49062291 积分:37 # 评论: 4

📅 Sun, 26 Jul 2026 🔗 原文链接

教导孩子们前进

文章网址:https://gracefulliberty.com/articles/teaching-kids-forth/ 评论网址:https://news.ycombinator.com/item?id=49062700 积分:36 # 评论: 8

📅 Sun, 26 Jul 2026 🔗 原文链接

Cursor Bridge – 在您的 Cursor 订阅上运行无限的 Claude 代码

文章网址:https://github.com/hkc5/cursor-bridge 评论网址:https://news.ycombinator.com/item?id=49063186 积分:12 # 评论: 13

📅 Sun, 26 Jul 2026 🔗 原文链接

59岁的日本传奇人物三浦知良打进2022年以来的首个进球

文章网址:https://www.bbc.com/sport/football/articles/c3r087181ndo 评论网址:https://news.ycombinator.com/item?id=49063266 积分:32 # 评论: 6

📅 Sun, 26 Jul 2026 🔗 原文链接

Show HN:以一半的成本蒸馏和提供具有前沿品质的小型模型

您好,HN,我们构建了世界模型优化器,这是一个开源工具,用于不断改进专门针对代理的模型。今天,我们推出了“wmoserve”,这是一种将重复任务路由到精简的较小模型的工具。您已经捕获的代理跟踪是获得有关如何使模型更便宜、更快、更好的信号的机会。我们不断改进 - 您的专业模型通过蒸馏...

📅 Sun, 26 Jul 2026 🔗 原文链接

🔹 Reddit 机器学习

CICD / KAFKA / KUBERNETES / 面试问题(MLE)[R]

在直播部署的技术面试中我应该准备哪些问题? (寻求好友)由 /u/trouble_sleeping_ [链接] [评论] 提交

📅 2026-07-26 23:38 🔗 原文链接

Neurips 2026 主赛道理论论文跟踪器 - 讨论主题 [D]

对今年主轨理论论文的初步审稿分布感到好奇。我们的论文获得了 4/3/3,置信度为 3/3/3。从前几年来看,我的印象是,理论论文的初始分数往往比其他一些领域更保守,而且我也听到人们说,这个周期许多学科的初始分数似乎普遍较低。如果你有一个理论...

📅 2026-07-26 15:57 🔗 原文链接

开放权重 4B 模型接近 o3 级瑞典语医学问答 [P]

我一直在与规模较小的开放权重法学硕士一起针对瑞典医学执照考试的多项选择题进行一些实验。在名为 MedQA-SWE 的数据集上,GPT-4 在 2024 年的准确率达到 84%,而 o3 在较小的重叠数据集上的准确率在 2025 年达到 88%。通过对前几年数据的后培训 (SFT),我在最后一年的考试中使 MedGemma-1.5-4B 的及格分数达到了 60%。找到实现...

📅 2026-07-26 11:58 🔗 原文链接

我使用ARM64汇编语言从头实现了YOLO26n模型推理(无框架)[P]

这是我的学士期末项目:使用 ARM64 汇编语言和 C 完全从头开始实现 YOLO26n 推理,而不依赖于现有的推理框架。目标是了解现代神经网络推理引擎如何在低级别工作,并探索优化技术,以便在 Raspberry Pi 4 上更快、更高效地执行边缘 AI。实现包括...

📅 2026-07-26 06:43 🔗 原文链接

🔹 51AllAI

Codex 接入 GPT-Live,支持语音启动和调度任务

OpenAI 为桌面端 Codex 接入由 GPT-Live 驱动的 ChatGPT Voice。用户可以边说边启动任务、询问进度、打断执行并调整方向,语音对话与后台工作不必轮流等待。Codex 从语音输入变成实时语音协作2026 年 7 月 23 日发布的 ChatGPT 桌面应用 26.715,把 ChatGPT Voice 带到了 Codex。它与原有的语音听写不是同一种交互:听写会先把一段录音转成文字,再作为提示词发送;GPT-Live 支持实时双向语音,用户可以在系统说话时插话,也可以要求它先听完再回应。这套语音能力不会替代 Codex 的任务执行界面。它更像一层实时控制入口:用户负...

📅 2026-07-24 03:29 🔗 原文链接

OpenAI 发布 Presence,把语音与聊天智能体交付给企业

OpenAI 发布 Presence,为企业部署语音与聊天智能体。它可以连接企业知识和业务系统,在明确权限内处理请求、执行获批操作或转交人工,并通过模拟评估和受控更新覆盖上线前后的管理流程。Presence 不是一个新的聊天机器人OpenAI Presence 是一套面向企业的智能体交付产品,覆盖客户服务和内部工作流程。它支持实时语音与聊天,可用于处理账单问题、保险理赔或员工 IT 服务请求等具体工作。每个智能体从一个明确任务开始,只获得完成这项任务所需的知识和系统访问权限。企业负责设定它可以执行哪些操作、哪些操作需要审批,以及什么情况下必须转交人工。智能体可以查询账户信息、应用业务规则并执行...

📅 2026-07-23 13:50 🔗 原文链接

通义发布Qwen-Image-3.0,支持4.5K Token长指令和12种语言

通义发布 Qwen-Image-3.0,最长可处理 4.5K Token 的图像生成指令,并支持 10px 小字、12 种语言和 100 多种艺术风格。新版本面向信息图、报纸、分镜、试卷与界面等文字密集型图片,普通用户可从发布页面进入千问网页端体验。最长可处理 4.5K Token 指令Qwen-Image-3.0 是 Qwen-Image 系列的第三代图像生成基础模型。它把可接受的指令长度提高到 4.5K Token。Token 是模型处理文字时使用的基本单位;可用长度越高,一条提示词就能容纳越多场景、文字、位置和版式要求。长指令主要服务于信息密度较高的图片。用户可以在一次生成中描述报纸、分...

📅 2026-07-22 03:08 🔗 原文链接

Google 发布第三款 Gemini 模型,3.6 Flash 足球输出 代币用量降低 17%

Google 发布 Gemini 3.6 Flash、3.5 Flash-Lite 和 3.5 Flash Cyber。其中,3.6 Flash 在一组综合评测中比 3.5 Flash 少用 17% 输出 Token;前两款已开放 API,Cyber 版将通过 CodeMender 限量提供。三款模型分别处理通用任务、高吞吐任务和代码安全Gemini 3.6 Flash 是这次更新中的通用型号,面向编程、知识工作、多模态理解和需要连续调用工具的多步任务。多模态指模型可以同时处理文字、图片、音频、视频和 PDF,而不是只接收文字。Gemini 3.5 Flash-Lite 把重点放在高吞吐和低成...

📅 2026-07-22 01:43 🔗 原文链接

阿里上线Qwen-Audio-3.0-TTS,提供Flash与Plus两个版本

阿里上线 Qwen-Audio-3.0-TTS,分为 Flash 和 Plus 两个版本。两者支持语音合成、自然语言指令与情绪、拟声标签,开发者可通过 DashScope API 调用。国际服务按输入字符计费,Flash 每万字符 0.15 美元,Plus 为 0.20 美元。Flash 和 Plus 面向不同场景Qwen-Audio-3.0-TTS 把文字转换为可播放的语音,支持边接收文字边返回音频的流式输出。Flash 主要用于语音助手、智能客服等对响应速度敏感的互动场景;Plus 面向有声书、新闻播报和内容配音等更重视成品质量的任务。两个版本的模型 ID 分别是 qwen-audio-3...

📅 2026-07-21 09:18 🔗 原文链接

字节跳动发布 Seed Audio 1.0,一条提示词可联合生成人声、音效和环境声

字节跳动发布 Seed Audio 1.0,一条提示词可以同时安排多角色对白、背景音乐、音效和环境氛围。它支持文本、参考音频或参考图片输入,单次最长生成 2 分钟音频。一条提示词完成一段声音场景普通 TTS(文字转语音)的主要任务是把文字读出来。Seed Audio 1.0 处理的对象是完整声音场景:同一次生成里可以包含多角色对白、笑声和叹息等非语言声音、背景音乐、拟音与环境声。提示词需要像一份简短的声音脚本。可以写清场景、角色、台词、语言、语气、背景声和音效出现的时机。例如,想做一段雨夜咖啡店对话,可以把两个角色的声线与台词、窗外雨声、室内杯碟碰撞声和音乐风格写在同一条指令里。模型返回的是混...

📅 2026-07-20 05:07 🔗 原文链接

Kimi 暂停新订阅,会员权益将拆分为 Kimi 与 Kimi Code

Kimi 暂停接受新会员订阅,并把算力优先分配给现有订阅用户。7 月 20 日起,Kimi 与 Kimi Code 会员权益分开:前者覆盖网页端、App 和 Work,后者面向编程工作流;老套餐可以继续使用和自动续费。Kimi 暂停接受新订阅Kimi 在 7 月 19 日宣布暂停接受新会员订阅。过去 48 小时的需求已接近现有算力容量上限,平台将计算资源优先分配给当前订阅用户,已经订阅的用户不受这次调整影响。暂停是临时措施。Kimi 正在增加算力,并会分批重新开放订阅名额。会员权益从 7 月 20 日起拆分Kimi 会员与 Kimi Code 会员将覆盖不同的产品:Kimi 会员用于网页端、A...

📅 2026-07-19 15:48 🔗 原文链接

阿里预告 Qwen3.8,2.4T 参数模型将开放权重

阿里千问预告 Qwen3.8 即将发布并开放模型权重,参数规模为 2.4T。面向用户的 Qwen3.8-Max-Preview 已进入 Token Plan、Qoder 和 QoderWork,可先在阿里旗下订阅与智能编程、桌面办公产品中体验。Qwen3.8 将以开放权重方式发布Qwen3.8 的参数规模为 2.4T,也就是 2.4 万亿参数。参数是模型在训练中学到的数值,数量反映模型规模,但不能单独代表实际效果。“开放权重”指训练完成后的模型参数文件对外提供,便于开发者在本地或自有服务器上运行和适配模型。它与同时公开训练代码、训练数据不是同一件事,因此本次预告更准确的说法是“开放模型权重”。...

📅 2026-07-19 08:55 🔗 原文链接

Anthropic 延长 Claude Code 每周中断加码至 8 月 19 日

Anthropic 将 Claude Code 每周使用限额提高 50% 的活动延长至 2026 年 8 月 19 日,覆盖 Pro、Max、Team 和传统按席位计费的 Enterprise 用户。活动自动生效,只适用于 Claude Code 的周限额,不改变 5 小时限额。周限额提高 50% 延长到 8 月 19 日此次活动从 2026 年 5 月 13 日持续到 8 月 19 日 23:59(太平洋时间)。适用用户的 Claude Code 每周使用限额在标准额度上提高 50%,不需要领取或修改账户设置。8 月 19 日活动结束后,Claude Code 周限额恢复到标准水平,用户的套...

📅 2026-07-19 01:31 🔗 原文链接

Anthropic 将克劳德寓言 5 纳入 Max 与 Team Premium 订阅

Anthropic 将从 7 月 20 日起把 Claude Fable 5 纳入所有 Max 与 Team Premium 计划,最多可占每周额度的 50%。Pro 与 Team Standard 用户仍通过用量积分使用,并获得一次性 100 美元积分。7 月 20 日起纳入两类订阅Claude Fable 5 将从 2026 年 7 月 20 日起成为 Max 和 Team Premium 计划的订阅内模型,覆盖所有对应个人账户和团队高级席位。用户最多可以把每周使用额度的 50% 用在 Fable 5 上。这里的 50% 是 Fable 5 在现有周额度中的使用上限,不是额外增加一份额度。...

📅 2026-07-18 10:48 🔗 原文链接