2026年07月29日
最后更新:2026-07-29 08:04:10 UTC+8
文章网址:https://github.com/openai/codex-security 评论网址:https://news.ycombinator.com/item?id=49089755 积分:283 # 评论: 60
文章网址:https://mac-classic.com/news/half-life-ported-to-mac-os-9/ 评论网址:https://news.ycombinator.com/item?id=49089814 积分:101 # 评论: 33
文章网址:https://github.com/anthropics/cryptography-research-demo 评论网址:https://news.ycombinator.com/item?id=49090083 积分:49 # 评论: 2
HN 非常适合人们分享的链接,但我获得的很大一部分价值来自阅读围绕它们的讨论。我意识到我总是在一个选项卡中打开文章,在另一个选项卡中打开评论,不断地来回切换。我想可能有一种更简单的方法,所以我将这个用户脚本放在一起来合并两者。1。单击 Hacker News 中的链接将打开带有 s... 的文章
文章网址:https://scripps.ucsd.edu/news/underwater-oxygen-loss-threatens-earths-stability-researchers-warn 评论网址:https://news.ycombinator.com/item?id=49090867 积分:87 # 评论: 36
arXiv:2607.22555v1 公告类型:新 摘要:医学诊断是一个多阶段的过程:提取事实、查阅知识、进行差异分析并选择最佳诊断和解释。前沿法学硕士是很强的通才,但单次提示往往会产生脆弱的诊断推理。我们推出 DeepLens 诊断代理,这是一个五阶段的利用管道(结合...
arXiv:2607.22554v1 公告类型:新 摘要:大型语言模型(LLM)通常在基准测试中取得很高的准确性,但当同一问题以不同但等效的方式表达时,尚不清楚它们应用这些知识的可靠性如何。在这项工作中,我们研究了模型答案在事实问答和数学推理的意义保留释义下如何变化。
arXiv:2607.22549v1 公告类型:新 摘要:混合量子经典蛋白质结构预测在很大程度上取决于哈密顿罚权,但现有的基于晶格的工作流程通常手动修复这些系数,并在模拟中仅评估非常短的片段。我们提出了 QFoldAgent,一个用于 5 残基四面体晶格折叠的闭环多智能体框架,其中设计...
arXiv:2607.22548v1 公告类型:新 摘要:数据中心及其计算节点需要准确、灵活的数字孪生,能够对工作负载、环境参数和物理指标的复杂相互作用进行建模。当前 HPC 及其遥测的机器学习方法通常依赖于针对单个任务定制的匿名、固定位置传感器变量的静态子集......
arXiv:2607.22544v1 公告类型:新 摘要:视觉反事实解释旨在回答“该图像的最小变化会改变模型的预测?”,并且随着视觉模型在安全关键领域(例如医学)中的部署,视觉反事实解释变得越来越重要。现有的基于扩散的方法可以产生真实的编辑,但它们依赖于必须可靠工作的外部分类器......
由 /u/PsychologicalBox5208 提交 [链接] [评论]
AI 编码工具节省了我的时间,但我真的无法判断自己是否变得更笨。独自运行一个自举的 SaaS,同时大部分时间都在家带孩子,这意味着如果我幸运的话,我实际专注的编码时间可能是 90 分钟。因此,我努力依靠 Cursor 和 Claude 来加快交付速度。它正在发挥作用。我一直坐立不安的事情是:我正在发布我本来会花几天时间的功能......
几年前,懂得如何使用计算机是一个很大的优势。今天,这是预料之中的。我觉得人工智能可能会走类似的道路。了解如何有效地使用人工智能工具可能会成为许多工作的基本技能。并不是每个人都需要构建人工智能模型,但了解如何使用它们、验证输出和改进工作流程可能变得很重要。您认为人工智能技能会成为常态吗?
人工智能公司实际上是在销毁实体书籍来训练他们的模型。他们使用液压切割机从旧书中撕下页面,用工业设备扫描它们,然后将其输入人工智能系统。这种受到首次销售原则和合理使用保护的做法现在已经变得如此普遍,以至于图书销售商正在从人工智能的繁荣中获利。珍本和绝版书籍是...
整个周末我都在思考这个问题,但我总是回到同一件事上。雅各布·齐默曼刚刚获得菲尔兹奖。如果你不熟悉的话,这是数学界的最高荣誉,每四年颁发一次,大致相当于该领域的诺贝尔奖。他因解决了一个近 40 年来悬而未决的问题而获得这一奖项。然后,在同一天的新闻发布会上,他宣布......
我审阅的一篇论文似乎完全是法学硕士生成的反驳,而原始论文也显然是法学硕士生成的,到处都是克劳德的说法。虽然作者在清单中承认了 LLM 写作帮助,但这确实让我个人感到恼火 - 显然克劳德的写作风格很难解析,并且表明我缺乏努力。当我试图挽回...
大家好,作者-审稿人讨论期已经开始,但看起来反驳仍然只有程序主席和作者可见 - 所以审稿人看不到它们?我也看不到我审阅过的论文的反驳。有谁知道这是否是一些奇怪的延迟,或者审稿人何时可以访问反驳?任何信息将不胜感激! 由 /u/grumpket 提交...
我真的很困惑提示注入的意义是什么(作为作者发言)。这只是一项研究吗?我真的希望他们对人工智能生成的评论采取行动。显然,我们不能假设审稿人在没有任何查看的情况下就复制粘贴了法学硕士的输出,但在某些情况下,情况确实如此。事实上,在某些情况下,我...
机器学习研究正在以极快的速度发展,学术界和工业界的前沿实验室都可以使用相当大的计算 (GPU)。在这种背景下,小型实验室或独立研究人员该何去何从?您是否遇到过 ML/DL 及其应用(视觉、语言、语音等)方面的最新成果,这些成果很好,但使用的计算量非常有限?甚至可能是单 GPU 工作站......
火山引擎在 2026 年 7 月 28 日上线豆包搜索服务,面向企业和开发者提供 API、Skill、MCP 与 Agent Plan 接入。服务可返回原文 Markdown 和结构化数据,每月含 500 次免费搜索额度。豆包搜索从 App 功能变成可接入服务这次开放的不是一个新的消费级搜索入口,而是给企业和开发者使用的联网信息服务。开发者可以把它接到 AI Agent,也就是能够自动拆解任务、调用工具并交付结果的智能体。当任务涉及新闻、产品更新、行业信息或其他实时内容时,智能体可以先搜索,再根据返回的材料继续处理任务。服务覆盖跨语言、多模态和垂直领域查询。“多模态”指搜索对象不只有纯文本,还...
月之暗面开放 Kimi K3 完整模型权重并发布技术报告。模型共 2.8 万亿参数,每次计算激活 1040 亿参数,支持约 100 万 Token 上下文和原生图像理解;权重已在 Hugging Face 提供下载。Kimi K3 完整权重已开放下载Kimi K3 的模型权重已经放到 Hugging Face,下载页面无需申请访问权限。仓库包含 96 个 Safetensors 权重分片,全部文件占用约 1.56 TB。Safetensors 是大模型常用的权重文件格式,可以在加载前读取文件结构,也避免执行文件中夹带的代码。这次开放的是完整 Kimi K3 权重,不是缩小版模型。模型总参数为 ...
7 月 27 日,多名在中国使用 giffgaff 的用户收到内容一致的停服通知。通知称,服务主要供英国境内使用,漫游只面向短期旅行;被判定长期或永久在英国境外使用的号码将被断开。依赖该号码接收验证码的用户应立即迁移账号,并尽快申请 PAC 携号转网。多名在华用户收到相同停服通知2026 年 7 月 27 日,多名在中国使用 giffgaff 的用户公开了收到的英文邮件。邮件正文基本一致:giffgaff 在审查账户使用情况后,决定断开相关号码的服务。通知把原因指向使用地点和持续时间。邮件写明,giffgaff 服务主要供英国境内使用,漫游用于短期旅行;当使用模式显示号码被长期或永久用于英国境...
腾讯于7月27日在安卓和iOS版手机QQ上线全新QQ宠物。用户可搜索“QQ宠物”进入,领养3D企鹅、狗狗或蒜头鹅,并通过喂食、洗澡、打工和好友串门互动;宠物接入Hy3大模型,可主动回应并生成每日宠物日记。QQ宠物回到手机QQQQ宠物已在安卓和iOS版手机QQ上线。打开手机QQ后,直接搜索“QQ宠物”就能进入,不需要另外安装一款宠物应用。原版QQ宠物主要在电脑端运行,并于2018年停止服务。这次上线的是面向手机QQ重新设计的产品:宠物换成3D形象,互动入口也进入聊天列表和对话等手机QQ场景。从单一企鹅变成三类3D宠物新版保留了经典企鹅,同时加入狗狗和蒜头鹅。领养时可以选择宠物类型,再设置昵称和性...
OpenAI 计划在 2026 年 8 月 9 日停止运行 ChatGPT Atlas,浏览器智能体能力将转入 ChatGPT 与 Codex。Atlas 用户应在停用前导出书签、保存重要标签页和历史记录;ChatGPT 对话与 Atlas 浏览器数据分开,不受这次迁移影响。Atlas 将在 8 月 9 日停止运行ChatGPT Atlas 是 OpenAI 在 2025 年 10 月推出的 macOS 浏览器,把 ChatGPT、网页浏览和智能体操作放在同一个窗口中。用户可以让 ChatGPT 理解当前页面,也可以用智能体模式打开标签页、点击网页并完成多步任务。这款独立浏览器计划于 2026...
千问办公已提供 macOS 与 Windows 桌面客户端,以“任务”而不是单轮问答组织工作。它可生成和编辑 Office 文件、分析数据、处理本地文件并执行网页操作,个人版包含免费、标准和高级三个档位。从聊天窗口变成任务工作台千问办公是由钉钉科技有限公司、钉钉(中国)信息技术有限公司及其关联公司提供的 AI 办公 Agent。Agent 可以理解目标、拆解步骤并调用工具执行,不只是在对话框里生成一段文字。产品以“任务对话”作为主要工作方式。用户可以在一个任务中提供目标、附件、格式要求和交付形式,再通过多轮对话调整内容。任务中可切换标准模型与旗舰模型:前者面向格式转换、翻译和模板邮件等规则明确...
OpenAI 为桌面端 Codex 接入由 GPT-Live 驱动的 ChatGPT Voice。用户可以边说边启动任务、询问进度、打断执行并调整方向,语音对话与后台工作不必轮流等待。Codex 从语音输入变成实时语音协作2026 年 7 月 23 日发布的 ChatGPT 桌面应用 26.715,把 ChatGPT Voice 带到了 Codex。它与原有的语音听写不是同一种交互:听写会先把一段录音转成文字,再作为提示词发送;GPT-Live 支持实时双向语音,用户可以在系统说话时插话,也可以要求它先听完再回应。这套语音能力不会替代 Codex 的任务执行界面。它更像一层实时控制入口:用户负...
OpenAI 发布 Presence,为企业部署语音与聊天智能体。它可以连接企业知识和业务系统,在明确权限内处理请求、执行获批操作或转交人工,并通过模拟评估和受控更新覆盖上线前后的管理流程。Presence 不是一个新的聊天机器人OpenAI Presence 是一套面向企业的智能体交付产品,覆盖客户服务和内部工作流程。它支持实时语音与聊天,可用于处理账单问题、保险理赔或员工 IT 服务请求等具体工作。每个智能体从一个明确任务开始,只获得完成这项任务所需的知识和系统访问权限。企业负责设定它可以执行哪些操作、哪些操作需要审批,以及什么情况下必须转交人工。智能体可以查询账户信息、应用业务规则并执行...
通义发布 Qwen-Image-3.0,最长可处理 4.5K Token 的图像生成指令,并支持 10px 小字、12 种语言和 100 多种艺术风格。新版本面向信息图、报纸、分镜、试卷与界面等文字密集型图片,普通用户可从发布页面进入千问网页端体验。最长可处理 4.5K Token 指令Qwen-Image-3.0 是 Qwen-Image 系列的第三代图像生成基础模型。它把可接受的指令长度提高到 4.5K Token。Token 是模型处理文字时使用的基本单位;可用长度越高,一条提示词就能容纳越多场景、文字、位置和版式要求。长指令主要服务于信息密度较高的图片。用户可以在一次生成中描述报纸、分...
Google 发布 Gemini 3.6 Flash、3.5 Flash-Lite 和 3.5 Flash Cyber。其中,3.6 Flash 在一组综合评测中比 3.5 Flash 少用 17% 输出 Token;前两款已开放 API,Cyber 版将通过 CodeMender 限量提供。三款模型分别处理通用任务、高吞吐任务和代码安全Gemini 3.6 Flash 是这次更新中的通用型号,面向编程、知识工作、多模态理解和需要连续调用工具的多步任务。多模态指模型可以同时处理文字、图片、音频、视频和 PDF,而不是只接收文字。Gemini 3.5 Flash-Lite 把重点放在高吞吐和低成...