2026年08月06日
最后更新:2026-08-06 08:10:11 UTC+8
文章网址:https://www.wired.com/story/meta-ran-ads-that-contained-ai- generated-child- Sex-abuse-imagery/ 评论网址:https://news.ycombinator.com/item?id=49187977 积分:227 # 评论: 186
文章网址:https://runarcn.no/android-to-linux/ 评论网址:https://news.ycombinator.com/item?id=49188022 积分:170 # 评论: 142
文章网址:https://www.primeintellect.ai/blog/prime-agent 评论网址:https://news.ycombinator.com/item?id=49189075 积分:75 # 评论: 10
文章网址:https://chipsandcheese.com/p/nvidias-vera-whitepaper-has-a-thread 评论网址:https://news.ycombinator.com/item?id=49189234 积分:64 # 评论: 6
文章网址:https://randsinrepose.com/archives/blade-runner-title-cards/ 评论网址:https://news.ycombinator.com/item?id=49189287 积分:106 # 评论: 31
arXiv:2608.02650v1 公告类型:新 摘要:大型语言模型(LLM)代理越来越依赖外部工具来完成复杂的现实任务。然而,由于隐式推理的局限性和现实世界执行环境不断变化的性质,可靠的工具使用规划仍然具有挑战性。现有的工具使用代理通常依赖法学硕士来推断工具的组成......
arXiv:2608.02630v1 公告类型:新 摘要:知识图工程通常将接受的状态、观察、约束、过程和假设场景分布在工件之间,而这些工件的组合执行契约仍然是外部的。我们提出了 PULSE,一种受对象过程方法论启发的语言,它将四个操作角色及其写入效果本地化在一个类型的运行时中。这里,...
arXiv:2608.02618v1 公告类型:新 摘要:最近的研究发现,大型语言模型(LLM)中存在“人工蜂巢思维”效应,导致模型即使对于开放性问题也能收敛于狭窄的、同质化的共识。这种语义崩溃限制了人工智能的多样性,导致即使在高温采样下也具有很高的响应间相似度($\approx 0.80-0.90$)。在这篇论文中...
arXiv:2608.02606v1 公告类型:新 摘要:经典计算中的容错传统上依赖于硬件冗余和纠错码等静态策略。相比之下,生物系统表现出适应性可塑性,通过围绕损伤进行动态重组来维持功能。受这一原理的启发,我们引入了自组织数字电路,框架......
arXiv:2608.02604v1 公告类型:新 摘要:基于 LLM 的代理越来越多地被部署用于数据相关任务,包括数据感知、探索和检索。然而,它们的性能在很大程度上取决于数据语义的清晰度和完整性。在实践中,许多字段描述仍然不明确或不完整,就像基本上下文(例如,c 的含义...
在过去的一个月里,我一直在构建 LiveTranscriber,这是一款开源 iOS 应用程序,用于完全在设备上运行现代语音和语言模型。目标是看看最近的开源模型是否可以转化为实用的移动产品,而不仅仅是技术演示。目前支持的本地模型包括: - 用于离线转录的 Whisper - 用于多语言语音识别的 Qwen3-ASR ...
现在反驳期结束了,我很好奇今年理论论文的分数分布情况。如果您愿意分享,请删除: • 分数:x / x / x • 置信度:x / x / x • 反驳后分数是否改变 • 广泛区域(可选) 我得到 4 / 4 / 4,置信度为 3 / 3 / 3。根据我的经验,理论论文通常似乎得分较低,而且...
我训练了一个小型 MLP 来记住经典的 Bad Apple 动画,大约 27 亿像素的视频被压缩为 79 万个参数(3.2 MB float32、1.6 MB float16)。该网络采用 3D 坐标 (t, y, x)(帧索引和像素位置)并输出 0 到 1 之间的灰度值。要“播放”视频,您可以在整个网格上评估该函数。 “视频”隐式存储在 5 行中......
我见过很多人的审稿人在初次审稿后就沉默了,但我也注意到异常安静的作者。我最终撤回了我的论文,但仍然是一名积极的审稿人。在我的一批 4 篇论文中,一篇撤回,一篇发表反驳,还有两篇完全沉默。在两篇无线电静默的论文中,我认为其中一篇的分数处于临界点。我也是唯一一个评论者...
Cloudflare 发布 Wallets,并开放 cloudflare.pay 账户标识认领。完整支付功能将随后上线,计划支持稳定币收付,以及供 AI Agent 使用的虚拟钱包;账户所有者可设置额度、允许名单和单笔交易上限。现在开放的是账户标识认领Cloudflare Wallets 面向需要在网络上自动购买服务的 AI Agent。8 月 4 日开放的第一项能力,是让 Cloudflare 账户在 cloudflare.pay 认领一个唯一的 Wallet handle,也就是容易记忆的账户标识。完整的钱包充值、付款和收款功能将随后提供。这一区别很重要。用户现在可以前往 cloudfla...
Cloudflare 发布 @cloudflare/computer 早期预览版,为 AI 智能体提供可持续保存文件的工作区,并把轻量 Worker 隔离环境与完整 Linux 容器放在同一套运行接口下。项目采用 MIT 许可证,当前只适合实验和原型开发。它不是一台远程桌面云电脑@cloudflare/computer 是给开发者使用的开源智能体运行时。它把文件系统、命令执行和 Git 操作整理成一套工作区接口,让 AI 智能体可以读取代码、改写文件、运行测试,再继续处理下一步任务。这里的“computer”不是带桌面窗口的消费级云电脑。它更接近一间给智能体使用的持久工作室:文件留在工作区中,...
OpenAI 已取消创建新账号和使用 ChatGPT 时的手机验证要求。这项变化不适用于所有场景:开发者在 API 平台首次生成密钥时仍需验证手机号,账户安全触发的登录验证和用户自行开启的 MFA 也没有被取消。注册和使用 ChatGPT 不再强制验证手机号新用户创建 OpenAI 账号时,不再需要先提交手机号并输入短信验证码。只使用 ChatGPT 聊天、保存对话或管理账号的普通用户,不会因为这项基础手机验证要求而被卡在注册流程中。已有账号的用户仍应按原来的方式登录。例如,通过 Google、Microsoft、Apple 或企业 SSO 注册的账号,需继续使用对应的登录入口。取消手机验证并...
阿里于 8 月 3 日正式上线 Qwen3.8-Max。新模型采用 2.4 万亿参数的混合专家架构,支持图像与文本输入、100 万 Token 上下文、混合思考、函数调用、内置工具和结构化输出。普通用户可用图像与长文档提问,开发者可通过 QwenCloud API 接入模型。Qwen3.8-Max 从预览转为正式模型QwenCloud 在 8 月 3 日的模型更新中加入 qwen3.8-max。这个正式模型 ID 可用于 API 请求,与 7 月先行开放的 qwen3.8-max-preview 区分开来。模型规模为 2.4 万亿参数,采用 MoE(Mixture of Experts,混合专...
giffgaff 停号后,只有英国网络 O2 与 Lebara 能通过 PAC 接收原号码;新西兰 Skinny 和美国 Ultra Mobile PayGo 不能接收英国号码,只能另办新号。四种方案的维护周期分别是 O2 六个月、Lebara 90 天、Skinny 12 个月和 Ultra 每 30 天扣费。选择前还要检查本地激活、漫游、付款和设备条件,不能只比较保号成本。先确认是限制服务还是正式停号“封号”不是一个准确的运营商状态。账户显示 disabled 时,可能是付款异常、安全检查或使用情况审查造成的服务限制。此时应先登录账户查看套餐和余额是否显示为 Not available,再...
OpenAI公开一份249页研究文档,整理内部模型Astra参与获得的十项数学与理论计算机科学成果,覆盖高维球堆积、群论、量子复杂性、格问题和图论;同时发布一份解释这些思路如何形成的推理笔记。OpenAI这次公开的是什么这次公开内容的主体不是模型规格表,而是一份249页的研究文档。文档把成果分成十个章节,主题从高维几何、编码理论一路延伸到群论、量子复杂性和极值图论。文档摘要将这些结果归因于一个内部OpenAI模型,这个模型称为Astra。对普通读者来说,可以先把它理解为一组由模型参与探索、再整理成数学论文的研究结果。它讨论的不是常见的问答题或考试题,而是数学家和理论计算机科学家长期研究的开放问...
MiniMax H3 于 7 月 31 日发布并开放 API,可统一接收文字、图片、视频与音频参考,输出 4 至 15 秒的 2K 双声道音视频。2K 视频按 0.80 元/秒计费,开发者可通过同一个 V2 接口完成文生视频、首尾帧控制和多模态参考生成。一个模型接收四种素材MiniMax H3 是面向视频创作的多模态生成模型。它把文字提示词、图片、视频和音频放进同一个上下文中处理,最终输出带原生双声道声音的视频。当前 API 输出分辨率为 2K,时长可以选择 4 至 15 秒的整数值。这套输入方式解决的是“参考关系”问题。用户可以用一张图片指定人物或画面,用一段视频提供动作、镜头或剪辑节奏,再...
字节跳动正式发布视频创作模型 Seedance 2.5。新模型单次可生成 30 秒视频,支持多轮延长、图片视频音频混合参考和时间戳定向编辑,正在陆续上线即梦 AI 网页端与豆包专业版。单次生成时长提升到 30 秒Seedance 2.5 延续统一的音视频联合生成架构,一次生成画面与声音。单次视频长度从 Seedance 2.0 的 15 秒提升到 30 秒,创作者可以在一个结果中安排更多镜头和更完整的情节,不必先把内容拆成多个短片段。模型还支持在已有结果上继续延长视频。延长不是简单重复最后一帧,而是接着原有主体、场景和叙事节奏生成后续镜头。对剧情短片、广告分镜和教学演示来说,这种方式可以减少手...
DeepSeek-V4-Flash 正式版 API 于 7 月 31 日上线公测,版本更新为 DeepSeek-V4-Flash-0731。模型结构和尺寸保持不变,主要变化来自重新后训练,并新增原生 Responses API 与 Codex 接入能力;本次更新只作用于 Flash API。这次更新只更换 Flash API 模型版本调用 deepseek-v4-flash 的开发者现在使用的是 DeepSeek-V4-Flash-0731。它仍是 2840 亿总参数、单次激活 130 亿参数的混合专家模型,支持 100 万 Token 上下文。Token 是模型处理文本时使用的计量单位,10...
giffgaff 在华号码停用后,先保护仍依赖旧号码的银行、邮箱和社交账号,再在停用日起 30 天内通过客服申请 PAC。拿到 PAC 后交给新的英国运营商完成携号转网,同时关闭自动续费,并在同一期限内处理账户余额,避免号码被回收。先迁移仍依赖旧号码的账号把验证码迁移放在第一位。先检查邮箱、密码管理器、银行、支付工具、社交平台、云服务和开发者账号,找出仍把 giffgaff 号码用于登录、短信双重验证或找回密码的服务。如果某个账号仍保持登录,不要主动退出。进入安全设置,把短信验证换到能够长期控制的新号码;支持验证器应用、通行密钥或硬件安全密钥的服务,可以同时增加一种不依赖手机号码的验证方式。下...