分类 人工智能 下的文章

最近读到一篇很有意思的讨论,主题看起来有点耸动——"What Happens If OpenAI Dies?"——但作者真正想聊的并不是八卦,而是一个相当严肃的问题:当一家公司深度嵌入了全球技术栈,它一旦出问题,影响会扩散到多远?

文章从一个反事实场景切入:假设 OpenAI 明天就不存在了——无论是倒闭、被收购、还是核心技术团队解体——整个 AI 生态会怎样?

作者认为冲击会沿着几条线展开:

  • API 与产品层面:数以万计的应用、创业项目、企业级集成都跑在 OpenAI 的 API 之上。一旦接口不可用,很多产品会直接挂掉,或者被迫在极短时间内寻找替代方案。
阅读全文
如果 OpenAI 倒了,会发生什么?

最近围绕 Claude 模型权重条款修改的消息在技术圈炸开了锅,简单来说:Anthropic 收紧了 Claude 模型开源版的商用许可,而这一变化,让很多人重新审视"负责任发布"这四个字到底是理想主义还是商业策略。

发生了什么

根据社区流传的消息以及相关报道,Anthropic 修改了其模型权重的使用条款,关键变化包括:

  • 禁止将模型用于竞争目的:也就是说,基于 Claude 权重微调出的新模型,不能拿来反哺其他 AI 提供商的商业产品。
  • 限制服务规模化:对使用 Claude 权重提供托管服务、做 SaaS 转售的设了更明确的阈值。
  • 品牌使用收紧:不能在没有授权的情况下拿 Claude 的名字给你的产品背书。
阅读全文
Anthropic 这波操作,开源社区真的坐不住了

最近看到一篇挺有意思的文章,聊的是一个被很多人忽略的角落:AI 算力额度(credits)的二手倒卖经济

简单说,随着各大模型厂商推出 API 套餐,企业和开发者会提前购买一批 tokens 或算力配额。但用着用着,总会有"剩下的"——项目砍掉、预算重估、模型换掉,这些没花完的额度就成了沉睡资产。

于是,一批专门做这门生意的人出现了:

  • 聚合平台:号称能帮你批量调度多家模型 API,价格通常是大厂官网的 5–7 折
  • 积分经纪人:专门从初创公司手里收没用完的 credits,再打包转卖给需要短期算力的小团队
  • 场外交易圈:Discord、Telegram 上的非公开渠道,按"条"计价,谈得拢就能成交
阅读全文
AI 算力正在变成一种可以倒卖的"期货

DeepSeek 最近悄悄在 GitHub 上放出了一个叫 DeepSeek Harness 的开发者预览版。从命名也能猜到,它的核心定位就是给 Agent 做"测试场"——一个统一、可复现的评估框架。

先说它解决的问题。

做 Agent 研究的人都知道,最大的痛点不是写不出 Agent,而是怎么评估 Agent。同一个任务,换一个 prompt、换一种工具调用顺序、换一个大模型版本,结果可能天差地别。如果没有统一的跑分基准,每篇论文里的数字都像是在自说自话。

Harness 想做的就是这件事:把"任务定义、Agent 行为、环境交互、结果评分"这几件事标准化。具体来说,它有几个值得关注的设计点:

  • 任务描述与执行分离:任务以结构化方式定义(输入、工具、评判标准),Agent 运行时只关心执行,方便横向对比不同 Agent 实现。
阅读全文
DeepSeek 开源了一个 Agent 评测工具:Harness 是什么?

本来以为 DeepSeek 会安静一阵子,结果又丢出了一个新版本——V4 Pro 0813。光看这个名字就挺有意思,"0813" 这种日期式的版本号在大模型圈里并不常见,更像是工程团队在快速迭代时给自己留的标记。

简单梳理一下这次更新的几个看点。

一、它到底更新了什么?

官方这次没有铺天盖地的发布博客,更像是通过 API 文档静默上线。从目前能拿到的信息来看,0813 主要是一次"打磨型"迭代:响应质量、推理稳定性、长上下文场景下的表现都有微调,但没有架构层面的剧变。换句话说,不是换发动机,更像是给发动机重新做了动平衡。

二、为什么值得留意?

阅读全文
DeepSeek V4 Pro 0813 上线:版本号背后的几个细节