产品与创业

互联网产品、创业公司、增长、商业模式、效率工具和产品设计。

Today’s live brief

AI 模型竞速白热化:Gemini 3.8 Flash 发布、司法部力挺训练合理使用

今日 AI 领域动态密集:Google 六周内第三次更新 Flash 模型,推出 Gemini 3.8 Flash 及网络安全专用版;OpenAI Astra 发布在即但安全隐忧浮现;美国司法部正式主张 AI 训练属合理使用,或重塑版权诉讼格局。此外,Uber 在伦敦首发机器人出租车、Anthropic 开源电商智能体蓝图、Meta Muse Spark 1.3 跻身第一梯队等消息也值得关注。

Sep 308:00 AM
AI HOT — 全部 AI 动态AI curated

arXiv 论文提出运行时无关的持久智能体架构

一篇 arXiv 论文提出运行时无关的持久智能体架构,将智能体拆分为持久的身份、私有记忆和带版本历史的代码,以及可替换的模型、harness、宿主服务器和交互界面,支持跨模型和主机迁移。

  • 提出运行时无关的持久智能体架构
  • 智能体组件可替换,支持跨模型迁移
Read source
Sep 307:48 AM
AI HOT — 全部 AI 动态AI curated

Qwen 团队开源 zg:统一 ripgrep、BM25 与向量搜索的本地优先搜索层

Qwen 开发者团队发布开源工具 zg(zvec-grep),将 ripgrep、BM25 与向量搜索统一到本地优先接口,Apache 2.0 许可,可通过 npm 安装,默认模型无需 GPU,适合本地高效搜索。

  • 统一三种搜索方式,本地优先
  • Apache 2.0 开源,npm 安装
Read source
Sep 307:46 AM
AI HOT — 全部 AI 动态AI curated

GPT-6-Astra 模型代号现身 OpenAI API

TestingCatalog 发现 GPT-6-Astra 模型 slug 已出现在 OpenAI API 上,推测若明天发布将是重要一周,并猜测可能先上线路由功能。

  • GPT-6-Astra 模型代号出现在 API
  • 可能近期发布,或先上线路由功能
Read source
Sep 307:45 AM
AI HOT — 全部 AI 动态AI curated

Replit 设立伦敦国际办公室,与 OpenAI 合办 Paul Graham 炉边对话

Replit 宣布在伦敦设立首个国际办公室,并与 OpenAI 合办活动,9月10日举行,包含 Amjad Masad 与 Paul Graham 的炉边对话,报名已开放。

  • Replit 首个国际办公室落地伦敦
  • 与 OpenAI 合办活动,Paul Graham 参与
Read source
Sep 307:43 AM
AI HOT — 全部 AI 动态AI curated

Fable 5.1 增强 Claude Tag,可在 Slack 中生成汇报并核对数据

Fable 5.1 让 Claude Tag 更易用,可根据指标表格和 Slack 数据生成领导层汇报,并发现数据矛盾。Claude Tag 已面向 Team 和 Enterprise 套餐在 Slack 中开放。

  • Claude Tag 生成汇报并核对数据
  • 发现供应商报告不一致
Read source
Sep 307:29 AM
AI HOT — 全部 AI 动态AI curated

Meta 发布 Muse Spark 1.3,强化编码与长周期智能体任务

Meta 发布 AI 模型 Muse Spark 1.3,专为延长智能体工作流与增强编码能力设计,Meta 首席 AI 官称其编码能力超越 GPT-5.6 Sol、与 Claude Fable 5.1 持平。

  • Muse Spark 1.3 发布,聚焦编码和智能体
  • 编码能力对标 GPT-5.6 Sol 和 Claude Fable 5.1
Read source
Sep 307:29 AM
AI HOT — 全部 AI 动态AI curated

fable51-worlds 开源:用代码重建真实街区的 3D 应用

fable51-worlds 项目发布由自主 Claude Fable 5.1 智能体集群端到端研究、建模并质检的真实街区重建,以纯 Three.js 应用交付,无需游戏引擎或专有 3D 格式。

  • 智能体集群自动重建真实街区
  • 纯 Three.js 交付,开源
Read source
Sep 307:24 AM
News Hacker | 极客洞察AI curated

Uber 突撤尼日利亚和乌干达:高抽成、本地竞争与合规争议

Uber 宣布立即停止在尼日利亚和乌干达运营,引发对其非洲业务收缩原因的讨论。在尼日利亚,Bolt 和 inDrive 等竞争者更贴近本地价格水平;乌干达则有本地出行创业公司。评论将停运与 Uber 过去的合规争议(如警方突袭、Uber Files 中的 kill switch)联系起来,指出在监管弱、价格敏感、竞争本地化的市场,平台需在抽成、服务质量和扩张速度间权衡。

  • Uber 立即停止尼日利亚和乌干达运营
  • 当地竞争者 Bolt、inDrive 更贴近价格敏感市场
Read source
Sep 307:18 AM
AI HOT — 全部 AI 动态AI curated

BestBlogs 早报 09-03:Gemini 3.8 Flash 系列与 Agent 评测要点

BestBlogs 09-03 早报汇总十条 AI 内容,包括 Google 发布 Gemini 3.8 Flash 与 Cyber,提升长周期编程与漏洞修复推理能力,以及 Claude Code 实践与 Agent 评测要点。

  • Gemini 3.8 Flash 系列发布
  • 提升编程和漏洞修复能力
Read source
Sep 307:16 AM
AI HOT — 全部 AI 动态AI curated

西班牙公司推出 Quasar 438B 模型,1M 词元上下文

西班牙 AI 公司 Multiverse Computing 推出 4380 亿参数的推理模型 Quasar 438B,在 Artificial Analysis Intelligence Index v4.1.1 得分 43,为参与比较的欧洲模型中最高。

  • Quasar 438B 参数规模大,上下文 1M
  • 欧洲模型中得分最高
Read source
Sep 307:01 AM
AI HOT — 全部 AI 动态AI curated

TechCrunch Disrupt 2026 公布 Builders Stage 议程,聚焦创业扩展策略

TechCrunch Disrupt 2026 将于 10 月 13-15 日在旧金山 Moscone Center 举行,首次公布 Builders Stage 议程,涵盖 Gamma CEO Grant Lee、Google 产品 VP Robby Stein 等嘉宾,聚焦创业公司规模化策略。

  • TechCrunch Disrupt 2026 日期和地点确定
  • Builders Stage 首次公布议程
Read source
Sep 307:00 AM
The VergeAI curated

Uber 击败 Waymo 在伦敦首发机器人出租车

Uber 在伦敦推出首个商业机器人出租车服务,击败 Waymo。车辆采用英国初创公司 Wayve 的自动驾驶技术,初期配备安全驾驶员。这是 Uber 与 Wayve 多年合作的里程碑,也是其自动驾驶战略的重要一步。

  • Uber 在伦敦首发机器人出租车,领先 Waymo
  • 技术来自英国初创 Wayve
Read source
Sep 306:49 AM
News Hacker | 极客洞察AI curated

1975年Altair BASIC源码公开:4KB、打印即删与微软50周年

1975年微软为Altair 8800编写的BASIC解释器源码扫描版公开,仅4KB,当时因存储限制需打印后删除。评论补充了6502汇编源码仓库,并提及2025年盖茨发文庆祝微软50周年。讨论聚焦早期软件工程的极致压缩、代码保存方式及能否在模拟器中重跑。

  • 1975年Altair BASIC源码以PDF扫描版公开,仅4KB
  • 评论补充了Microsoft BASIC的6502汇编源码仓库
Read source
Sep 306:44 AM
AI HOT — 全部 AI 动态AI curated

Palo Alto Networks 以 5 亿美元收购 AI IT 服务台创企 Console

据知情人士,Palo Alto Networks 以 5 亿美元现金加股票收购成立两年的 AI IT 服务台初创 Console,官方未披露条款。Console 曾融资 2900 万美元,出售前估值 1.57 亿美元。其 AI 智能体将并入 Cortex 平台,让安全团队用自然语言调查和解决告警,这是该公司 2026 年第七笔收购。

  • 收购金额 5 亿美元,现金加股票
  • Console 成立两年,融资 2900 万美元
Read source
Sep 306:33 AM
AI HOT — 全部 AI 动态AI curated

Claude Code v2.1.259 发布:新增托管 MCP 服务器与无人值守权限模式

Claude Code 发布 v2.1.259,新增 managedMcpServers 托管设置供组织向所有用户提供 HTTP/SSE MCP 服务器,新增 --permission-prompts none 支持无人值守 headless 场景,并支持 GitLab MR 命令识别。

  • 新增托管 MCP 服务器配置
  • 支持无人值守 headless 模式
Read source
Sep 306:24 AM
AI HOT — 全部 AI 动态AI curated

TechCrunch Disrupt 2026推出Real World AI舞台

TechCrunch Disrupt 2026大会新增Real World AI舞台,聚焦数字与物理世界的融合,将涵盖Nvidia、机器人及灭绝动物等元素。该舞台旨在探讨AI在现实世界的应用与影响,为科技创业者提供前沿视角。

  • TechCrunch Disrupt 2026新增Real World AI舞台
  • 主题聚焦数字与物理世界交汇
Read source
Sep 306:23 AM
AI HOT — 全部 AI 动态AI curated

Ethan Mollick:廉价低推理模型在法律基准上表现不佳

Ethan Mollick引述Prinz的法律基准测试,最新模型表现良好,但廉价低推理模型表现不佳。案例显示法律部门用AI生成的备忘录格式精美,却在监管判断上完全错误,遗漏关键禁止原因。Mollick追问如何激励厂商提供高质量模型。

  • 法律基准测试显示廉价低推理模型表现不佳
  • AI生成的备忘录在监管判断上得出错误结论
Read source
Sep 306:22 AM
AI HOT — 全部 AI 动态AI curated

ProximalHQ 发布 FrontierSWE v2 超长程编码基准,Claude Fable 5.1 大幅领先

ProximalHQ 发布 FrontierSWE v2 超长程编码基准,用于评估 AI 在复杂编码任务上的能力。结果显示 Claude Fable 5.1 大幅领先其他模型,表明其在长上下文和复杂问题解决上的优势。

  • FrontierSWE v2 是超长程编码基准
  • Claude Fable 5.1 大幅领先
Read source
Sep 306:22 AM
AI HOT — 全部 AI 动态AI curated

Fable 5.1让Slack中的Claude Tag更实用:快速构建领导层汇报

Boris Cherny演示Fable 5.1在Slack中增强Claude Tag功能,可从metrics电子表格和Slack数据快速生成领导层汇报幻灯片,并能发现供应商报告中的数字不符问题。Claude Tag现已在Team和Enterprise套餐的Slack中提供。

  • Fable 5.1提升Slack中Claude Tag的实用性
  • 可快速构建领导层汇报幻灯片
Read source
Sep 306:20 AM
AI HOT — 全部 AI 动态AI curated

Broadcom 财报:预计 AI 芯片收入 2027 年翻倍至 1150 亿美元

Broadcom 最新季度财报显示,AI 半导体收入达 167 亿美元,同比增长 221%,占总收入约 56%。公司预计 2027 年 AI 半导体收入达 1150 亿美元、2028 年达 2300 亿美元,连续两年翻倍;Q4 指引 AI 收入 217 亿美元,同比增长 236%。

  • AI 半导体收入同比增长 221%
  • 预计 2027 年收入 1150 亿美元,2028 年 2300 亿美元
Read source
Sep 306:13 AM
AI HOT — 全部 AI 动态AI curated

东锡 NLP 谈 AI 从 token 编号起步学语言与人类组合理解的差异

作者提出人类先学单个词再通过组合与经历理解复杂意义,例如从流、星、雨理解流星雨。AI 则先在庞大语料中建立 token 与编号的对应关系,再通过神经网络学习编号间的联系来逼近语言意义。作者认为 AI 语言的苍白感从起点就已注定。

  • 人类通过组合和经历理解语言
  • AI 从 token 编号学习语言
Read source
Sep 306:05 AM
AI HOT — 全部 AI 动态AI curated

FM-Bench:让15个前沿模型运营足球俱乐部20年检验长时程决策

arXiv论文FM-Bench构建足球管理基准,让15个前沿模型在20个模拟赛季、约340-400个决策点中管理俱乐部,涉及转会、合同、现金和投资。该基准旨在评估AI在长时程、复杂决策场景下的能力。

  • FM-Bench模拟20个赛季的足球俱乐部管理
  • 15个前沿模型参与测试
Read source
Sep 305:57 AM
AI HOT — 全部 AI 动态AI curated

Muse Spark 1.3 vs Fable 5.1:速度与成本对比测试

Alexandr Wang转发对比测试:同一提示词下,muse spark 1.3一分钟完成且费用几乎可忽略,而fable 5.1耗时70分钟、花费13美元。Wang评价muse spark 1.3表现相当不错,凸显了模型在速度和成本上的优势。

  • muse spark 1.3一分钟完成,费用极低
  • fable 5.1耗时70分钟,花费13美元
Read source
Sep 305:42 AM
AI HOT — 全部 AI 动态AI curated

Meta Muse Spark 1.3 智能指数得 62 分,价格远低于同级模型

Meta 的 Muse Spark 1.3 在 Artificial Analysis Intelligence Index 得 62 分,追平 Claude Fable 5,输入价格低 8 倍、输出价格低近 12 倍。评分高于 GPT-5.6 Sol、Grok 4.6 等,Meta 进入前沿模型第一梯队。

  • Muse Spark 1.3 智能指数 62 分,追平 Claude Fable 5
  • 输入价格低 8 倍,输出价格低近 12 倍
Read source
Sep 305:39 AM
AI HOT — 全部 AI 动态AI curated

Meta发布Muse Spark 1.3,智能指数逼近Claude与GPT-5.6

Meta发布Muse Spark 1.3,这是五个月内第四个版本。其max变体在Artificial Analysis Intelligence Index得62分,接近Claude和GPT-5.6的水平,显示Meta在AI模型竞争中的快速迭代。

  • Meta发布Muse Spark 1.3,五个月内第四个版本
  • max变体在Intelligence Index得62分
Read source
Sep 305:39 AM
AI HOT — 精选AI curated

Meta 发布 Muse Spark 1.3,智能指数逼近 Claude 与 GPT-5.6

Meta 发布 Muse Spark 1.3,为五个月内第四个版本。max 变体在 Artificial Analysis Intelligence Index 得 62 分,逼近 Claude 与 GPT-5.6,显示 Meta 在 AI 领域的快速迭代能力。

  • 五个月内第四个 Muse Spark 版本
  • max 变体智能指数 62 分
Read source
Sep 305:37 AM
AI HOT — 全部 AI 动态AI curated

Perplexity 开源本地推理引擎 Lily,支撑 Mac 混合计算

Perplexity 开源本地推理引擎 Lily,专为 Apple Silicon 上的 Qwen3.6-35B-A3B 优化,用于 Mac 应用新推出的混合计算功能,避免端侧算力成为 Computer 任务瓶颈。

  • 开源本地推理引擎 Lily
  • 针对 Apple Silicon 优化
Read source
Sep 305:37 AM
Product Hunt 热门产品AI curated

Parasocial:一款用于分享的播客播放器

Parasocial 是一款专注于分享功能的播客播放器,旨在让用户更方便地分享播客内容,可能通过社交集成或剪辑分享等功能吸引用户。

  • 播客播放器
  • 主打分享功能
Read source
Sep 305:29 AM
News Hacker | 极客洞察AI curated

Muse Spark 1.3 发布引发 AI 竞争格局讨论

Muse Spark 1.3 发布引发关于 AI 竞争格局的讨论,涉及 DeepSeek、OpenAI、Anthropic 等公司的技术路线对比,以及 Meta 是否凭借算力和 Llama 4 重回前沿的争议。评论聚焦于模型进步是否放缓、谁还能继续追赶。

  • Muse Spark 1.3 发布引发 AI 前沿竞争讨论
  • 对比 DeepSeek RLVR、OpenAI o1、Anthropic 技术路线
Read source
Sep 305:25 AM
AI HOT — 全部 AI 动态AI curated

Gemini 3.8发布,作者指其复制去年2.5 Pro到3的节奏

Gemini 3.8发布,表现亮眼。有评论指出Google似乎在复制去年从2.5 Pro到3的节奏:夏季发力,年底用ultra年票折扣绑定用户,再持续半年。这种策略可能影响用户选择和市场竞争。

  • Gemini 3.8发布,表现亮眼
  • 评论认为Google复制去年发布节奏
Read source
Sep 305:24 AM
News Hacker | 极客洞察AI curated

Fable 5.1 用地图数据生成可漫游 3D 城市

Fable 5.1 展示将旧金山 Union Square 地图数据转化为可漫游 3D 场景,引发关于“世界模型”定义的讨论。评论指出其可能基于 OpenStreetMap 和 USGS 数据,并探讨该技术在游戏、AR 等领域的生产应用潜力。

  • Fable 5.1 生成可交互 3D 城市场景
  • 讨论世界模型是智能理解还是程序化生成
Read source
Sep 305:16 AM
AI HOT — 全部 AI 动态AI curated

Alexandr Wang 称 Muse Spark 1.3 编码智能体成绩被低估

Scale AI 创始人 Alexandr Wang 表示 Muse Spark 1.3 的编码智能体成绩被低估,并提供了 muse code 的安装命令,暗示该模型在编码任务上表现优于基准测试。

  • Alexandr Wang 认为 Muse Spark 1.3 编码智能体成绩被低估
  • 提供了 muse code 安装命令
Read source
Sep 305:09 AM
News Hacker | 极客洞察AI curated

AI Agent 让代码重构更便宜,也更易迷路

讨论 AI coding agents 对代码重构的影响。支持者认为能清理遗留代码,怀疑者指出在大型代码库中可能漏读文件、导致复杂度失控。延伸讨论 AGENTS.md、测试覆盖率和长期维护原则,关注 AI 辅助开发的可持续性。

  • AI Agent 降低重构成本但可能增加复杂度
  • 讨论在大型代码库中的可靠性和维护问题
Read source
Sep 305:06 AM
AI HOT — 全部 AI 动态AI curated

Ethan Mollick 对比 10 个月间 ChatGPT 智能体工作方式构想

Ethan Mollick 发文对比两张相隔 10 个月的图,展示 ChatGPT 智能体工作方式的演变:从简单流程图到包含越狱防护栏、分类智能体、if/else 分支及多个下游智能体的复杂架构,反映 AI 智能体设计的快速进化。

  • 10 个月间智能体设计演变
  • 从简单流程到复杂多智能体架构
Read source
Sep 305:01 AM
AI HOT — 全部 AI 动态AI curated

SemiAnalysis:Co-Packaged光学趋势下光纤对准的取舍

SemiAnalysis分析随着行业转向Co-Packaged和Near-Packaged Optics,光纤连接需直接落在PIC上,耦合需微米级精度。主动对准难以支撑高光纤数量且不可拆卸,被动对准依靠机械结构可实现可重复连接。文章探讨了两种方案的工程权衡。

  • Co-Packaged光学趋势要求光纤直接落在PIC上
  • 边缘耦合器需半微米级对准精度
Read source
Sep 305:00 AM
AI HOT — 全部 AI 动态AI curated

Meta 首席 AI 官转发 Muse Spark 1.3 一次生成整站实测

Meta 首席 AI 官 Alexandr Wang 转发用户实测,称用简单提示词和 2 个自定义技能,Muse Spark 1.3 一次生成完整网站,被认为有创造力、擅长前端。该反馈展示了模型在网站生成方面的实际能力。

  • Muse Spark 1.3 一次生成完整网站
  • 用户评价模型有创造力、擅长前端
Read source
Sep 305:00 AM
AI HOT — 全部 AI 动态AI curated

GitHub 播客解读 AI 开发新术语:loop engineering、squads 等

GitHub Podcast 节目配套文章由 Cassidy Williams 与 Marlene Mhangami 等解读当下 AI 开发常见新术语,如 loop engineering、Ralph loops、squads、harness 与 hill climbing,帮助开发者理解最新概念。

  • 解读 AI 开发新术语
  • 涵盖 loop engineering、squads 等
Read source
Sep 304:59 AM
AI HOT — 全部 AI 动态AI curated

Muse Spark 1.3 上线 OpenCode Zen 免费使用

Alexandr Wang 宣布 Muse Spark 1.3 已在 OpenCode Zen 上线,以 Contributor Free 档位提供,输入输出与缓存读取均免费。此举可能降低开发者使用门槛,促进模型普及。

  • Muse Spark 1.3 在 OpenCode Zen 免费提供
  • 输入输出和缓存读取均免费
Read source
Sep 304:50 AM
AI HOT — 全部 AI 动态AI curated

HarnessEvolve论文:用参考轨迹实现可靠的智能体自我进化

DAIR.AI推荐arXiv论文HarnessEvolve,指出自进化智能体存在三类失败:终态反馈导致错误归因不清、记住任务特定模式而非通用能力、无防护更新抹掉已有能力。该工作提出用参考轨迹实现可靠进化。

  • 自进化智能体存在三类失败模式
  • HarnessEvolve提出用参考轨迹解决
Read source
Sep 304:46 AM
AI HOT — 全部 AI 动态AI curated

Muse Spark 1.3 冲进智能指数第 3 名,跻身 Claude 与 GPT 之间

Muse Spark 1.3(max)在 Artificial Analysis Intelligence Index v4.11 中以 62 分升至第 3 名,是首个排名插在 Claude 和 GPT 之间的模型。定价更低,Alexandr Wang 转发推荐。

  • 智能指数第 3 名
  • 首个排名在 Claude 和 GPT 之间
Read source
Sep 304:45 AM
AI HOT — 全部 AI 动态AI curated

Mostik 称潜空间桥接让 4B 模型接近 753B 模型表现

Mostik 称其潜空间桥接协议让前沿模型与 4B 边缘模型直接传递 hidden states,无需文本、双方均不微调;753B 模型读题、4B 模型作答时达到前沿模型约 80% 的准确率、速度快 20 倍,且算力消耗更少。

  • 潜空间桥接协议
  • 4B 模型达到 753B 模型 80% 准确率
Read source
Sep 304:37 AM
AI HOT — 全部 AI 动态AI curated

美国商务部长表态信任 Anthropic,创始人参与 G20 技术外交

美国商务部长 Lutnick 表示信任 Anthropic,称其“做了我们要求的事”,标志该公司重回政府支持阵营。Anthropic 联合创始人 Tom Brown 出席 G20 创新部长级会议,体现前沿 AI 公司需开展创始人层面的技术外交。

  • Lutnick 公开表达对 Anthropic 的信任
  • Tom Brown 参与 G20 创新部长级会议
Read source
Sep 304:37 AM
AI HOT — 精选AI curated

Meta 发布 Muse Spark 1.3,智能体与科学推理能力提升

Meta 发布 Muse Spark 1.3,这是五个月内第四个版本,重点提升智能体与编码任务表现,并聚焦真实可用性。xhigh 版在 Artificial Analysis Intelligence Index 得 61 分,模型可在单线程中跨多个工作流维持长程任务,更主动与用户协作,减少工具调用和 token 消耗。

  • 五个月内第四个 Muse Spark 版本
  • xhigh 版在 Artificial Analysis Intelligence Index 得 61 分
Read source
Sep 304:37 AM
AI HOT — 全部 AI 动态AI curated

Meta 发布 Muse Spark 1.3,智能体与科学推理能力提升

Meta 发布 Muse Spark 1.3,是五个月内第四个版本。xhigh 版在 Artificial Analysis Intelligence Index 得 61 分,显示智能体与科学推理能力提升。快速迭代反映 Meta 在 AI 模型竞争中的积极策略。

  • Muse Spark 1.3 发布,五个月内第四版
  • xhigh 版智能指数 61 分
Read source
Sep 304:33 AM
AI HOT — 全部 AI 动态AI curated

Meta 发布 Muse Spark 1.3 模型

Meta 发布了 Muse Spark 1.3 模型,该模型在编码和长周期任务上有显著改进,并针对这些任务进行了专门训练。开发者可通过 Meta 官方渠道获取。

  • Meta 发布 Muse Spark 1.3 模型
  • 重点改进编码和长周期任务能力
Read source
Sep 304:32 AM
AI HOT — 全部 AI 动态AI curated

Muse Spark 1.3 第三方实测对比 1.2 版本

Meta 发布 Muse Spark 1.3 后,@aimlapi 用同一提示词对比 1.2 版本,任务为生成三个 3D 雕塑。结果显示 1.3 消耗 22,474 tokens、花费 $0.10,1.2 消耗 19,324 tokens、花费 $0.08。Alexandr Wang 称有明显改进。

  • 第三方用同一任务对比 Muse Spark 1.3 和 1.2
  • 1.3 消耗更多 tokens 和费用
Read source
Sep 304:29 AM
AI HOT — 全部 AI 动态AI curated

Meta 发布 Muse Spark 1.3,Artificial Analysis 评测智能指数升至 61-62

Meta 发布 Muse Spark 1.3,是五个月内第四个版本。xhigh 变体在 Artificial Analysis Intelligence Index 得 61 分,显示智能水平提升。评测机构数据为模型能力提供第三方参考。

  • Muse Spark 1.3 发布,五个月内第四版
  • xhigh 变体智能指数 61 分
Read source
Sep 304:26 AM
AI HOT — 全部 AI 动态AI curated

分析师称 SpaceX 成为 Anthropic 竞争者,看好 Grok Bot 前景

Oppenheimer 分析师 Timothy Horan 表示 SpaceX 在 AI 领域表现出色,已成为 Anthropic 的竞争者。他看好 Grok Bot 作为智能体的潜力,认为其将逐渐替用户打理生活并走红。

  • SpaceX 被视为 Anthropic 的竞争者
  • Grok Bot 被看好为生活智能体
Read source
Sep 304:24 AM
News Hacker | 极客洞察AI curated

Google 广告技术业务免遭拆分,反垄断转向行为救济

美国针对 Google 广告技术业务的反垄断诉讼中,法官未选择强制拆分,而是倾向行为性救济。评论聚焦法律程序、政治影响及地名数据源争议,反映出对科技巨头监管路径的多元看法。

  • 法官倾向行为性救济而非拆分
  • 讨论涉及政治任命与游说影响
Read source
Sep 304:24 AM
AI HOT — 全部 AI 动态AI curated

Insight Partners 联合创始人预测 OpenRouter 模式将遭重大颠覆

Insight Partners 联合创始人 Jerry Murdock 预测,OpenRouter 的模式在未来 3-5 个月内将遭遇重大颠覆。该观点出自 20VC 播客,Insight Partners 管理资产超 900 亿美元,其观点对 AI 基础设施投资有影响。

  • Jerry Murdock 预测 OpenRouter 模式将遭颠覆
  • 观点出自 20VC 播客
Read source
Sep 304:20 AM
News Hacker | 极客洞察AI curated

后 AI 互联网:网页内容泛滥,用户或转向线下与私密空间

讨论指出 AI 生成内容正使公开网页质量下降,引发对互联网未来的担忧。评论提出黑暗森林假说、零知识证明身份系统及替代协议等方案,探索更可控的网络形态。

  • AI 生成内容导致网页质量下滑
  • 用户可能转向私密或线下空间
Read source
Sep 304:20 AM
AI HOT — 全部 AI 动态AI curated

Artificial Analysis 更新图像编辑基准,MAI-Image-2.6-Preview 居首

Artificial Analysis 更新 Image Editing Arena,新增身份保持编辑、UI/UX 设计等任务,基于人类偏好对 7 类编辑动作和 10 个真实用例排名。新榜单已上线并开放投票。

  • 新增身份保持编辑与 UI/UX 设计任务
  • 基于人类偏好进行排名
Read source
Sep 304:19 AM
AI HOT — 全部 AI 动态AI curated

OpenAI 新推理技术引发 AI 安全专家担忧

据 The Information 报道,OpenAI 新模型 Astra 将使用 recurrent depth 推理技术,让模型以循环方式多次处理同一查询,留下更少可读痕迹,可能使链式思维更难监控,引发 AI 安全专家担忧。

  • OpenAI Astra 将使用不透明循环推理技术
  • 可能使链式思维更难监控
Read source
Sep 304:11 AM
AI HOT — 全部 AI 动态AI curated

Google 发布 Gemini 3.8 Flash:推理更强但 token 消耗可能增加

Google 发布 Gemini 3.8 Flash,相比 3.7 Flash 在复杂任务上执行更多推理步骤并迭代调用工具,定价维持每百万输入 token 0.75 美元、输出 3.75 美元,但警告模型可能消耗更多 token 导致实际成本上升。

  • Gemini 3.8 Flash 推理能力增强,但 token 用量可能更高
  • 定价不变,但实际成本可能因 token 消耗增加而上升
Read source
Sep 304:11 AM
The VergeAI curated

谷歌发布 Gemini 3.8 Flash:推理更强但成本可能更高

谷歌推出 Gemini 3.8 Flash 模型,距上一代仅数周。官方称新模型在复杂任务上执行更多推理步骤并迭代调用工具,因此"更努力"。定价与 3.7 Flash 相同,输入每百万 token 0.75 美元,输出每百万 3.75 美元。

  • Gemini 3.8 Flash 发布,推理能力增强
  • 定价与 3.7 Flash 持平
Read source
Sep 304:09 AM
News Hacker | 极客洞察AI curated

H-1B 争议:招天才还是压工资的廉价外包通道

围绕 H-1B 签证的讨论聚焦于其定位:是吸引全球顶尖人才,还是为企业提供廉价劳动力。评论指出 H-1B 常被用于压低薪资和绕开本地招聘,而 O-1 签证更接近'天才通道'。讨论延伸到移民法案、外包公司和国防科技公司等具体场景。

  • H-1B 签证定位争议
  • 对比 O-1 签证
Read source
Sep 304:08 AM
AI HOT — 全部 AI 动态AI curated

Inworld 发布 Realtime TTS-2 与 TTS-2 Flash,支持 5-15 秒语音克隆

Inworld 发布 Realtime TTS-2(GA)与面向低延迟高并发的 TTS-2 Flash。Realtime TTS-2 可用 5-15 秒音频克隆真实声音,专业级语音克隆处于 beta 阶段需 10 分钟音频,内置 verbatim 标签可正确读出订单号和代码。

  • Realtime TTS-2 支持 5-15 秒语音克隆
  • TTS-2 Flash 面向低延迟高并发场景
Read source
Sep 304:04 AM
AI HOT — 全部 AI 动态AI curated

Perplexity 开源本地推理引擎 Lily,针对 Apple silicon 优化

Perplexity 宣布开源 Lily,这是其为 Perplexity Computer 的混合计算构建的本地推理引擎。Lily 专为 Apple silicon 上的 Qwen3.6-35B-A3B 优化,使设备端算力不会成为 Computer 任务的瓶颈。

  • Perplexity 开源本地推理引擎 Lily
  • 针对 Apple silicon 优化 Qwen3.6-35B-A3B
Read source
Sep 304:04 AM
News Hacker | 极客洞察AI curated

Muse Spark 1.3 发布:SVG 生成增强,但定价与数据政策引争议

Meta AI 发布 Muse Spark 1.3,SVG 生成细节改进,但社区质疑其定价策略及用户数据使用政策。讨论指出模型在自行车等产品图生成上存在训练数据偏置,且 OpenCode 平台免费可用性存疑。

  • SVG 生成质量提升
  • 定价与数据政策受质疑
Read source
Sep 304:03 AM
AI HOT — 全部 AI 动态AI curated

Muse Spark 1.3 上线 OpenRouter,面向长时运行智能体

Meta 的 Muse Spark 1.3 现已上线 OpenRouter,面向长时运行的智能体、多智能体和编码工作流。官方称其能记录所学内容、处理冲突输入,并在需要时请求澄清或确认,可通过 OpenRouter 使用。

  • Muse Spark 1.3 上线 OpenRouter
  • 面向长时运行智能体、多智能体和编码工作流
Read source
Flowtify — AI Reading, Knowledge & Creation Workspace