2026年07月21日
最后更新:2026-07-21 08:03:55 UTC+8
文章网址:https://xenaproject.wordpress.com/2026/07/20/ human-mathematicians-are-being-outcounterexampled/ 评论网址:https://news.ycombinator.com/item?id=48983382 积分:158 # 评论: 59
文章网址:https://www.scottrlarson.com/presentations/overcoming-surveillance-capitalism-with-awareness/ 评论网址:https://news.ycombinator.com/item?id=48984231 积分:36 # 评论: 3
文章网址:https://vincentwoo.com/3d/grace_cathedral/ 评论网址:https://news.ycombinator.com/item?id=48984254 积分:44 # 评论: 6
文章网址:https://numerlab.org/2025/07/20/bashumerate-enumerator/ 评论网址:https://news.ycombinator.com/item?id=48984270 积分:33 # 评论:29
文章网址:https://www.appenmedia.com/opinion/letter-to-the-editor-the-creepiest-sales-demo-of-all-time/article_a8f0cc6c-29d3-41f7-8668-8a855f760efb.html 评论网址:https://news.ycombinator.com/item?id=48984555 积分:57 # 评论: 26
arXiv:2607.15388v1 公告类型:新 摘要:许多面向数学和科学的代理系统使用具有专门审阅者角色的分层设计,假设专门的审阅阶段应该有助于将错误的候选人变成正确的候选人。我们使用匹配的 gpt-oss-120b actor 在 4,181 个基于验证者的 Omni-MATH 问题上测试了这个假设。协作在最简单的层面上几乎没有增加什么,但是......
arXiv:2607.15367v1 公告类型:新 摘要:桌面语音助手仍然以云管道为主,这些管道将原始音频从机器上传输出来并公开一组固定的技能。我们描述了 AnovaX,这是一个小型的本地优先助手,完全在用户的计算机上运行,并将桌面本身视为其操作界面。单个 Python 进程将唤醒词门、语音管道连接在一起......
arXiv:2607.15314v1 公告类型:新 摘要:医疗保健涵盖高风险的沟通、专家推理和工作流程执行,但涵盖这些用例的专业法学硕士仍然有限。医疗保健模型必须处理患者咨询、文本和图像临床推理、交互式诊断以及电子健康记录 (EHR) 工具的使用。这些功能在不同程度上会失败...
arXiv:2607.15281v1 公告类型:新 摘要:基于因果和干预的问答对于推进大型语言模型(LLM)超越表面相关性和理解潜在因果机制的推理至关重要。然而,现有的基于LLM的方法通常依赖于隐式语言级推理,导致因果假设不透明、推理无法验证......
arXiv:2607.15280v1 公告类型:新 摘要:顺序诊断需要通过迭代信息收集来平衡诊断准确性和资源成本。现有的大型语言模型(LLM)方法表现出严重的知识推理差距:尽管编码了广泛的医学知识,但它们在成本限制下难以系统地推理,往往诉诸于过多的...
大家好,我是CSE本科三年级学生。我最近一直在从事几个 CNN 和 ConvLSTM 项目。我渴望为开源项目做出贡献,我可以: 解决具有挑战性的现实世界机器学习问题 与强大的工程师合作 学习新事物,同时回馈 /u/LordArpit42069 [链接] [评论]
已向 ACL ARR 2026 年 5 月周期提交了一篇论文。不幸的是,在作者与审稿人讨论期间,没有一个审稿人承认反驳,我很想知道本周期自愿审稿论文的人 - 你们是否仍然能够更新评级,甚至根据反驳更新您的评论?还有元审稿人讨论正在进行吗? 由 /u/Forsaken 提交...
大家好,我一直在持续学习领域做一些工作,想分享一个我们搭建的名为 Coincidex 的开源框架,以及我们在此过程中发现的一些架构见解和故障模式。大多数传统的顺序任务学习方法严重依赖重播缓冲区(这会带来严重的内存/隐私开销)或复杂的手动调整的任务掩码。我们想要...
所以,我刚刚读了 LeCun 对 Nebius Science 的采访。我觉得他有一些很酷的观点,关于法学硕士能够回答问题,但不能真正理解物理世界的物理学。 (比如,能够解释一项任务和实际执行它是两件完全不同的事情。)但我想了解其他人对他的问题解决方案的看法。他认为 JEPA 可能...
字节跳动发布 Seed Audio 1.0,一条提示词可以同时安排多角色对白、背景音乐、音效和环境氛围。它支持文本、参考音频或参考图片输入,单次最长生成 2 分钟音频。一条提示词完成一段声音场景普通 TTS(文字转语音)的主要任务是把文字读出来。Seed Audio 1.0 处理的对象是完整声音场景:同一次生成里可以包含多角色对白、笑声和叹息等非语言声音、背景音乐、拟音与环境声。提示词需要像一份简短的声音脚本。可以写清场景、角色、台词、语言、语气、背景声和音效出现的时机。例如,想做一段雨夜咖啡店对话,可以把两个角色的声线与台词、窗外雨声、室内杯碟碰撞声和音乐风格写在同一条指令里。模型返回的是混...
Kimi 暂停接受新会员订阅,并把算力优先分配给现有订阅用户。7 月 20 日起,Kimi 与 Kimi Code 会员权益分开:前者覆盖网页端、App 和 Work,后者面向编程工作流;老套餐可以继续使用和自动续费。Kimi 暂停接受新订阅Kimi 在 7 月 19 日宣布暂停接受新会员订阅。过去 48 小时的需求已接近现有算力容量上限,平台将计算资源优先分配给当前订阅用户,已经订阅的用户不受这次调整影响。暂停是临时措施。Kimi 正在增加算力,并会分批重新开放订阅名额。会员权益从 7 月 20 日起拆分Kimi 会员与 Kimi Code 会员将覆盖不同的产品:Kimi 会员用于网页端、A...
阿里千问预告 Qwen3.8 即将发布并开放模型权重,参数规模为 2.4T。面向用户的 Qwen3.8-Max-Preview 已进入 Token Plan、Qoder 和 QoderWork,可先在阿里旗下订阅与智能编程、桌面办公产品中体验。Qwen3.8 将以开放权重方式发布Qwen3.8 的参数规模为 2.4T,也就是 2.4 万亿参数。参数是模型在训练中学到的数值,数量反映模型规模,但不能单独代表实际效果。“开放权重”指训练完成后的模型参数文件对外提供,便于开发者在本地或自有服务器上运行和适配模型。它与同时公开训练代码、训练数据不是同一件事,因此本次预告更准确的说法是“开放模型权重”。...
Anthropic 将 Claude Code 每周使用限额提高 50% 的活动延长至 2026 年 8 月 19 日,覆盖 Pro、Max、Team 和传统按席位计费的 Enterprise 用户。活动自动生效,只适用于 Claude Code 的周限额,不改变 5 小时限额。周限额提高 50% 延长到 8 月 19 日此次活动从 2026 年 5 月 13 日持续到 8 月 19 日 23:59(太平洋时间)。适用用户的 Claude Code 每周使用限额在标准额度上提高 50%,不需要领取或修改账户设置。8 月 19 日活动结束后,Claude Code 周限额恢复到标准水平,用户的套...
Anthropic 将从 7 月 20 日起把 Claude Fable 5 纳入所有 Max 与 Team Premium 计划,最多可占每周额度的 50%。Pro 与 Team Standard 用户仍通过用量积分使用,并获得一次性 100 美元积分。7 月 20 日起纳入两类订阅Claude Fable 5 将从 2026 年 7 月 20 日起成为 Max 和 Team Premium 计划的订阅内模型,覆盖所有对应个人账户和团队高级席位。用户最多可以把每周使用额度的 50% 用在 Fable 5 上。这里的 50% 是 Fable 5 在现有周额度中的使用上限,不是额外增加一份额度。...
腾讯 Buddy 全系内置模型接入 Kimi K3,WorkBuddy 国内版同步可用。企业专享版与个人订阅用户优先获得使用资格;WorkBuddy 和 CodeBuddy 共用账号与积分体系。WorkBuddy 国内版接入 Kimi K3腾讯已将 Kimi K3 加入 Buddy 全系产品的内置模型。Buddy 是 WorkBuddy、CodeBuddy 等产品的统称,因此 WorkBuddy 国内版也进入这次接入范围。Kimi K3 是月之暗面推出的大模型,支持文字、图像和视频输入,拥有 100 万 Token 上下文窗口。Token 是模型处理文字、代码等内容的基本单位;更大的窗口适合在...
月之暗面发布 Kimi K3,模型总参数为 2.8 万亿,支持 100 万 Token 上下文和图像、视频输入。产品已接入 Kimi 网页端、Kimi Work、Kimi Code 与 API,开发者可用 kimi-k3 模型名调用。Kimi K3 已进入网页端、桌面端和 API普通用户可以在 Kimi 网页端使用 Kimi K3,也可以通过 iOS、Android 和 HarmonyOS 版 Kimi App 访问。需要处理本地文件和知识工作的用户,可在 Kimi Work 3.1.0 或更高版本中选择 K3;桌面客户端支持 Windows 和 Apple 芯片 Mac。开发者有两条入口。终...
SpaceXAI 已公开 Grok Build 的终端客户端、智能体运行时和工具层,第一方代码采用 Apache 2.0 许可。开发者可以阅读、修改和自行构建这套 Rust 工程,但此次开放不包含 Grok 4.5 模型权重。开源的是编程智能体框架Grok Build 是一款运行在终端里的编程智能体。用户输入任务后,它可以读取项目文件、修改代码、执行命令、搜索网页,并在长任务中持续管理执行进度。除了全屏交互界面,它还支持无界面运行,可以放进脚本和持续集成流程;ACP(Agent Client Protocol)则让编辑器和其他应用接入同一套智能体。这次公开的是 grok 命令背后的 CLI、T...
百度正在参与中国版 Apple 智能的 AI 搜索开发,搜索可处理文字和图片,并与中国版 Siri 的升级配合。Apple 智能已完成手机端侧生成式 AI 服务备案,但国行设备当前仍需等待系统更新开放。百度负责的是系统内 AI 搜索百度开发的搜索功能属于中国版 Apple 智能套件,可同时处理文字和图片查询,并与中国版 Siri 的升级配合。用户以后向系统提交的内容不再局限于一句文字,也可以包含图片,让搜索理解画面里的对象和问题。这项合作聚焦 Apple 智能的系统体验,不是一次百度 App 的独立产品更新。搜索能力会如何进入 Siri 和其他系统功能,要以国行版本正式开放后的界面为准。百度与...
国行 iPhone 使用千问的方式将从独立 App 扩展到系统级调用:Apple 智能已完成备案,千问确定参与文本、图像理解和内容生成能力。但备案不等于立即上线,苹果尚未公布推送版本和开放日期。备案完成,但现在还不能打开Apple 智能的手机端侧生成式 AI 服务备案于 2026 年 7 月 8 日办结,7 月 15 日对外公示,适用场景标注为苹果手机。这个节点解决的是向公众提供端侧生成式 AI 服务的合规前置条件,不是一轮面向用户的软件推送。截至 7 月 15 日,国行 iPhone 仍被标注为不能使用 Apple 智能,备案公告也没有给出上线日期。把“完成备案”写成“已经上线”,会让用户在...