2026年07月22日
最后更新:2026-07-22 08:02:54 UTC+8
文章网址:https://ai.google.dev/gemini-api/docs/latest-model 评论网址:https://news.ycombinator.com/item?id=48998606 积分:20 # 评论: 4
嘿,我们是可计算的。我们花了数年时间在 Jump Trading 和 Coinbase 构建交易基础设施。从这个角度来看,计算看起来就像 2000 年之前的能源市场:一切都通过私人双边租赁进行交易,没有可见的价格,而且没有任何东西可以转售。同样的 H100 租金可以加 2 倍,具体取决于谁提出要求,而且一旦您签署了 24 个月的租约,它就永远不会转手......
文章网址:https://fireworks.ai/blog/kimik3-fable 评论网址:https://news.ycombinator.com/item?id=48999291 积分:142 # 评论: 78
文章网址:https://github.com/MatheuZSecurity/Furtex 评论网址:https://news.ycombinator.com/item?id=48999323 积分:4 # 评论: 0
文章网址:https://www.ti.com/lit/eb/slyy228/slyy228.pdf 评论网址:https://news.ycombinator.com/item?id=48999376 积分:15 # 评论: 2
arXiv:2607.16199v1 公告类型:新 摘要:多代理 LLM 系统越来越依赖 Planner 将目标分解为子任务序列,供下游执行器和 Critic 代理执行和审核。我们将规划阶段视为关键的攻击面:对规划器上下文的单次注入可实现级联放大,同时破坏所有下游子任务。 ...
arXiv:2607.16198v1 公告类型:新 摘要:图神经网络(GNN)已成为链接预测的领先范例,可以推断缺失的连接并预测潜在的未来链接。然而,现有的评论缺乏专门针对底层 GNN 架构和多样化图结构的系统探索。为了解决这一关键差距,这...
arXiv:2607.16197v1 公告类型:新 摘要:随着人工智能系统部署在开放式、高风险的环境中,一个关键维度仍然无法衡量:感知的风险如何转化为行动。我们测试大型语言模型(LLM)在不确定性下是否表现出系统且一致的风险态度。我们引入了一个跨域框架,可以解耦上下文关系...
arXiv:2607.16196v1 公告类型:新 摘要:柔软的传感伴侣为社交辅助技术提供了物理安全和情感直观的界面,但它们的变形性和多通道触觉感知使人类情感的稳健解释变得复杂。这项研究提出了一个完整的基于 MATLAB 的开源框架,用于开发和验证紧凑型深度...
arXiv:2607.16195v1 公告类型:新 摘要:我们发现了人类反馈强化学习(RLHF)中的结构性混淆。成对偏好标签旨在反映比较的输出,但它们也可能反映评分者在注释期间的状态。在持续的压力或痛苦的情况下,评估者的偏好可能会随着时间的推移而改变。因此,偏好数据可以...
最近提交了我的摘要,提交号是32xxx。距离比赛还有一天,我只是想知道我们要去哪里。 希望这些会议至少开始对撤回/拒绝的论文进行评论和公开姓名。这样人们至少要接受 /u/Fantastic-Nerve-4056 [链接] [评论] 提交的责任
TL;DR:我正在一台 RTX 3090 上重现 arXiv:2606.24014 的特征持久性结果。在测试持久性之前,我需要通过 RL 安装一个特征 - 当我需要 ~+15 时,我的 GRPO 运行仅使该特征移动 +2.4 点(95% CI [+0.2, +4.8])。训练在机械上是健康的,我已经排除了明显的罪魁祸首。向做过小规模 RLHF/GRPO 特质或角色的人寻求建议...
大家好,我们开源了 Tri-Net v2,这是我们最近发表的科学报告(自然组合)论文“Tri-Net:用于皮肤病变和基于症状的猴痘检测的统一深度学习”的官方实现,我们不是只发布训练脚本,而是将该项目重建为可重复的研究框架。亮点: • 无泄漏数据准备管道 •...
所以,我刚刚读了 LeCun 对 Nebius Science 的采访。我觉得他有一些很酷的观点,关于法学硕士能够回答问题,但不能真正理解物理世界的物理学。 (比如,能够解释一项任务和实际执行它是两件完全不同的事情。)但我想了解其他人对他的问题解决方案的看法。他认为 JEPA 可能...
阿里上线 Qwen-Audio-3.0-TTS,分为 Flash 和 Plus 两个版本。两者支持语音合成、自然语言指令与情绪、拟声标签,开发者可通过 DashScope API 调用。国际服务按输入字符计费,Flash 每万字符 0.15 美元,Plus 为 0.20 美元。Flash 和 Plus 面向不同场景Qwen-Audio-3.0-TTS 把文字转换为可播放的语音,支持边接收文字边返回音频的流式输出。Flash 主要用于语音助手、智能客服等对响应速度敏感的互动场景;Plus 面向有声书、新闻播报和内容配音等更重视成品质量的任务。两个版本的模型 ID 分别是 qwen-audio-3...
字节跳动发布 Seed Audio 1.0,一条提示词可以同时安排多角色对白、背景音乐、音效和环境氛围。它支持文本、参考音频或参考图片输入,单次最长生成 2 分钟音频。一条提示词完成一段声音场景普通 TTS(文字转语音)的主要任务是把文字读出来。Seed Audio 1.0 处理的对象是完整声音场景:同一次生成里可以包含多角色对白、笑声和叹息等非语言声音、背景音乐、拟音与环境声。提示词需要像一份简短的声音脚本。可以写清场景、角色、台词、语言、语气、背景声和音效出现的时机。例如,想做一段雨夜咖啡店对话,可以把两个角色的声线与台词、窗外雨声、室内杯碟碰撞声和音乐风格写在同一条指令里。模型返回的是混...
Kimi 暂停接受新会员订阅,并把算力优先分配给现有订阅用户。7 月 20 日起,Kimi 与 Kimi Code 会员权益分开:前者覆盖网页端、App 和 Work,后者面向编程工作流;老套餐可以继续使用和自动续费。Kimi 暂停接受新订阅Kimi 在 7 月 19 日宣布暂停接受新会员订阅。过去 48 小时的需求已接近现有算力容量上限,平台将计算资源优先分配给当前订阅用户,已经订阅的用户不受这次调整影响。暂停是临时措施。Kimi 正在增加算力,并会分批重新开放订阅名额。会员权益从 7 月 20 日起拆分Kimi 会员与 Kimi Code 会员将覆盖不同的产品:Kimi 会员用于网页端、A...
阿里千问预告 Qwen3.8 即将发布并开放模型权重,参数规模为 2.4T。面向用户的 Qwen3.8-Max-Preview 已进入 Token Plan、Qoder 和 QoderWork,可先在阿里旗下订阅与智能编程、桌面办公产品中体验。Qwen3.8 将以开放权重方式发布Qwen3.8 的参数规模为 2.4T,也就是 2.4 万亿参数。参数是模型在训练中学到的数值,数量反映模型规模,但不能单独代表实际效果。“开放权重”指训练完成后的模型参数文件对外提供,便于开发者在本地或自有服务器上运行和适配模型。它与同时公开训练代码、训练数据不是同一件事,因此本次预告更准确的说法是“开放模型权重”。...
Anthropic 将 Claude Code 每周使用限额提高 50% 的活动延长至 2026 年 8 月 19 日,覆盖 Pro、Max、Team 和传统按席位计费的 Enterprise 用户。活动自动生效,只适用于 Claude Code 的周限额,不改变 5 小时限额。周限额提高 50% 延长到 8 月 19 日此次活动从 2026 年 5 月 13 日持续到 8 月 19 日 23:59(太平洋时间)。适用用户的 Claude Code 每周使用限额在标准额度上提高 50%,不需要领取或修改账户设置。8 月 19 日活动结束后,Claude Code 周限额恢复到标准水平,用户的套...
Anthropic 将从 7 月 20 日起把 Claude Fable 5 纳入所有 Max 与 Team Premium 计划,最多可占每周额度的 50%。Pro 与 Team Standard 用户仍通过用量积分使用,并获得一次性 100 美元积分。7 月 20 日起纳入两类订阅Claude Fable 5 将从 2026 年 7 月 20 日起成为 Max 和 Team Premium 计划的订阅内模型,覆盖所有对应个人账户和团队高级席位。用户最多可以把每周使用额度的 50% 用在 Fable 5 上。这里的 50% 是 Fable 5 在现有周额度中的使用上限,不是额外增加一份额度。...
腾讯 Buddy 全系内置模型接入 Kimi K3,WorkBuddy 国内版同步可用。企业专享版与个人订阅用户优先获得使用资格;WorkBuddy 和 CodeBuddy 共用账号与积分体系。WorkBuddy 国内版接入 Kimi K3腾讯已将 Kimi K3 加入 Buddy 全系产品的内置模型。Buddy 是 WorkBuddy、CodeBuddy 等产品的统称,因此 WorkBuddy 国内版也进入这次接入范围。Kimi K3 是月之暗面推出的大模型,支持文字、图像和视频输入,拥有 100 万 Token 上下文窗口。Token 是模型处理文字、代码等内容的基本单位;更大的窗口适合在...
月之暗面发布 Kimi K3,模型总参数为 2.8 万亿,支持 100 万 Token 上下文和图像、视频输入。产品已接入 Kimi 网页端、Kimi Work、Kimi Code 与 API,开发者可用 kimi-k3 模型名调用。Kimi K3 已进入网页端、桌面端和 API普通用户可以在 Kimi 网页端使用 Kimi K3,也可以通过 iOS、Android 和 HarmonyOS 版 Kimi App 访问。需要处理本地文件和知识工作的用户,可在 Kimi Work 3.1.0 或更高版本中选择 K3;桌面客户端支持 Windows 和 Apple 芯片 Mac。开发者有两条入口。终...
SpaceXAI 已公开 Grok Build 的终端客户端、智能体运行时和工具层,第一方代码采用 Apache 2.0 许可。开发者可以阅读、修改和自行构建这套 Rust 工程,但此次开放不包含 Grok 4.5 模型权重。开源的是编程智能体框架Grok Build 是一款运行在终端里的编程智能体。用户输入任务后,它可以读取项目文件、修改代码、执行命令、搜索网页,并在长任务中持续管理执行进度。除了全屏交互界面,它还支持无界面运行,可以放进脚本和持续集成流程;ACP(Agent Client Protocol)则让编辑器和其他应用接入同一套智能体。这次公开的是 grok 命令背后的 CLI、T...
百度正在参与中国版 Apple 智能的 AI 搜索开发,搜索可处理文字和图片,并与中国版 Siri 的升级配合。Apple 智能已完成手机端侧生成式 AI 服务备案,但国行设备当前仍需等待系统更新开放。百度负责的是系统内 AI 搜索百度开发的搜索功能属于中国版 Apple 智能套件,可同时处理文字和图片查询,并与中国版 Siri 的升级配合。用户以后向系统提交的内容不再局限于一句文字,也可以包含图片,让搜索理解画面里的对象和问题。这项合作聚焦 Apple 智能的系统体验,不是一次百度 App 的独立产品更新。搜索能力会如何进入 Siri 和其他系统功能,要以国行版本正式开放后的界面为准。百度与...