<?xml version="1.0" encoding="utf-8" standalone="yes"?><rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom" xmlns:content="http://purl.org/rss/1.0/modules/content/"><channel><title>Posts.dedup_backup.20260917_115132s on AI 实战派 · 从技术到赚钱</title><link>https://guijiagi.com/posts.dedup_backup.20260917_115132/</link><description>Recent content in Posts.dedup_backup.20260917_115132s on AI 实战派 · 从技术到赚钱</description><generator>Hugo</generator><language>zh-cn</language><copyright>本站内容采用 CC BY-NC-SA 4.0 国际许可协议授权</copyright><lastBuildDate>Mon, 14 Sep 2026 10:00:00 +0800</lastBuildDate><atom:link href="https://guijiagi.com/posts.dedup_backup.20260917_115132/index.xml" rel="self" type="application/rss+xml"/><item><title>GPT-6 Astra深度解析：AGI时代的真正到来</title><link>https://guijiagi.com/posts.dedup_backup.20260917_115132/gpt-6-astra-deep-dive/</link><pubDate>Mon, 14 Sep 2026 10:00:00 +0800</pubDate><guid>https://guijiagi.com/posts.dedup_backup.20260917_115132/gpt-6-astra-deep-dive/</guid><description>&lt;h2 id="引子被重新定义的通用智能">引子：被重新定义的&amp;quot;通用智能&amp;quot;&lt;/h2>
&lt;p>2026年9月3日，OpenAI在得克萨斯州Stargate基地的发布会上正式推出GPT-6 Astra。如果说过去几年的每一代模型发布只是&amp;quot;能力又涨了一截&amp;quot;，那么这一次，整个行业的评价体系都被迫重写。原因很简单：当一个模型在最难的抽象推理基准上拿到99.9%的分数时，你已经没法再用&amp;quot;更强的聊天机器人&amp;quot;来描述它了。&lt;/p>
&lt;p>OpenAI总裁Greg Brockman在台上说出的那句&amp;quot;欢迎进入AGI时代&amp;quot;，并非营销话术那么简单。这是OpenAI历史上第一次由核心管理层在正式发布场合使用&amp;quot;AGI&amp;quot;这个词。在GPT-5系列已经把人类专业考试刷到中位数以上之后，Astra跨过的，是另一道门槛——不只是会答题，而是会在全新问题上自己推理。&lt;/p>
&lt;h2 id="三张成绩单999意味着什么">三张成绩单：99.9%意味着什么&lt;/h2>
&lt;p>要理解Astra的分量，必须把它的三项核心成绩放在一起看，而不是孤立地看某一个数字。&lt;/p>
&lt;table>
&lt;thead>
&lt;tr>
&lt;th>基准测试&lt;/th>
&lt;th>测试什么&lt;/th>
&lt;th>GPT-6 Astra成绩&lt;/th>
&lt;th>上一代水平&lt;/th>
&lt;/tr>
&lt;/thead>
&lt;tbody>
&lt;tr>
&lt;td>ARC-AGI-3&lt;/td>
&lt;td>全新抽象问题泛化&lt;/td>
&lt;td>99.9%&lt;/td>
&lt;td>约7.8%&lt;/td>
&lt;/tr>
&lt;tr>
&lt;td>FrontierMath Tier 4&lt;/td>
&lt;td>前沿数学自主证明&lt;/td>
&lt;td>97.6%&lt;/td>
&lt;td>个位数区间&lt;/td>
&lt;/tr>
&lt;tr>
&lt;td>ExploitBench&lt;/td>
&lt;td>自主漏洞发现与利用&lt;/td>
&lt;td>100%&lt;/td>
&lt;td>未公开&lt;/td>
&lt;/tr>
&lt;/tbody>
&lt;/table>
&lt;p>ARC-AGI-3是这三张成绩单里最硬的一张。它不考记忆、不考刷题，专门设计成模型在训练中绝不可能见过的全新抽象问题。三个月前GPT-5.6 Sol在同一测试集上只有7.8%——这个数字本身已经说明问题的难度。一个季度内从7.8%拉到99.9%，不是渐进式优化，而是训练方法发生了代际变化。&lt;/p>
&lt;p>FrontierMath Tier 4的97.6%同样关键。这一等级要求模型在没有人类提示的情况下，自主完成前沿数学猜想的形式化证明链条。ExploitBench拿到100%则是另一回事——它意味着Astra被OpenAI内部评估为具备&amp;quot;Critical&amp;quot;级别的网络安全能力，也就是能自主发现并利用真实软件中的漏洞。&lt;/p>
&lt;blockquote>
&lt;p>数据来源：OpenAI官方发布会与技术报告，2026年9月3日&lt;/p>&lt;/blockquote>
&lt;h2 id="105万token上下文与10万张gpu">105万Token上下文与10万张GPU&lt;/h2>
&lt;p>Astra在工程层面的两个数字同样值得拆开看。&lt;/p>
&lt;p>&lt;strong>上下文窗口：105万Token。&lt;/strong> 这意味着Astra可以一次性吞进一整套代码仓库、几十万页的法律文书，或者一部长篇小说的全文，然后在这个完整语境下回答问题、做修改。对企业用户来说，这直接消灭了过去&amp;quot;RAG检索召回不全&amp;quot;的痛点——与其费劲做分块检索，不如直接把全部材料塞进去。&lt;/p>
&lt;p>&lt;strong>训练集群：超过10万块GPU。&lt;/strong> 这是AI训练史上前所未有的规模。作为参照，GPT-5系列的训练集群大约在2万张GPU量级。从2万到10万+，背后是得州Stargate基地的整座电力与散热工程。这种投入也直接反映到了定价上。&lt;/p>
&lt;table>
&lt;thead>
&lt;tr>
&lt;th>项目&lt;/th>
&lt;th>GPT-6 Astra&lt;/th>
&lt;th>上一代旗舰&lt;/th>
&lt;th>倍数&lt;/th>
&lt;/tr>
&lt;/thead>
&lt;tbody>
&lt;tr>
&lt;td>输入价格&lt;/td>
&lt;td>$10 / 百万Token&lt;/td>
&lt;td>$4&lt;/td>
&lt;td>2.5×&lt;/td>
&lt;/tr>
&lt;tr>
&lt;td>输出价格&lt;/td>
&lt;td>$50 / 百万Token&lt;/td>
&lt;td>$20&lt;/td>
&lt;td>2.5×&lt;/td>
&lt;/tr>
&lt;tr>
&lt;td>上下文窗口&lt;/td>
&lt;td>105万Token&lt;/td>
&lt;td>约100万Token&lt;/td>
&lt;td>—&lt;/td>
&lt;/tr>
&lt;/tbody>
&lt;/table>
&lt;p>2.5倍的溢价透露出明确的商业定位：Astra不打大众消费市场，而是面向愿意为&amp;quot;Critical级能力&amp;quot;付费的头部企业。&lt;/p>
&lt;h2 id="真正的变化从会说话到会操作">真正的变化：从&amp;quot;会说话&amp;quot;到&amp;quot;会操作&amp;quot;&lt;/h2>
&lt;p>Astra最被低估的一点，是它对专业软件的操作深度。公开Demo显示，Astra可以像人一样通过GUI操作Power BI完成数据报表、用KiCad走完PCB布线与DRC校验、在FreeCAD里完成三维机械建模与工程图纸导出。&lt;/p>
&lt;p>这是一种范式转移。过去的模型输出文本或代码，再由人去执行；Astra直接进入操作系统层面，把&amp;quot;理解—决策—执行&amp;quot;闭环一次性走完。当一个模型能自主发现软件漏洞（ExploitBench 100%），又能自主操作任何GUI软件，它的角色就从&amp;quot;工具&amp;quot;变成了&amp;quot;数字员工&amp;quot;。&lt;/p>
&lt;p>也正因如此，OpenAI在训练过程中&lt;strong>主动暂停了两周&lt;/strong>。这个动作比任何安全承诺都更有信息量：当模型能力越过某条线之后，连开发者自己都需要停下来重新评估风险边界。&lt;/p>
&lt;h2 id="行业冲击波三层连锁反应">行业冲击波：三层连锁反应&lt;/h2>
&lt;p>Astra的发布至少会在三个层面重塑行业。&lt;/p>
&lt;p>&lt;strong>企业级Agent落地加速。&lt;/strong> 当模型能直接操作Power BI、KiCad这类专业软件，企业IT工作流的&amp;quot;读取数据→分析→出报告&amp;quot;闭环可以一键完成。过去需要一个初级分析师一周的工作，现在压缩到分钟级。&lt;/p></description></item><item><title>GPT-6 Astra深度解析：AGI时代真的来了吗？</title><link>https://guijiagi.com/posts.dedup_backup.20260917_115132/gpt-6-astra-agi-era/</link><pubDate>Mon, 14 Sep 2026 00:00:00 +0000</pubDate><guid>https://guijiagi.com/posts.dedup_backup.20260917_115132/gpt-6-astra-agi-era/</guid><description>OpenAI于9月3日发布GPT-6 Astra，ARC-AGI-3得分99.9%，Greg Brockman宣称欢迎进入AGI时代。但Nature提醒测试集有局限性，OpenAI自身也曾因安全担忧暂停训练两周。本文深度解析这一里程碑事件背后的技术与博弈。</description></item><item><title>72小时四大厂商连发11款模型：Meta Muse冲榜首，买方市场出现模型疲劳</title><link>https://guijiagi.com/posts.dedup_backup.20260917_115132/72h-model-arms-race-model-fatigue/</link><pubDate>Thu, 10 Sep 2026 20:00:00 +0800</pubDate><guid>https://guijiagi.com/posts.dedup_backup.20260917_115132/72h-model-arms-race-model-fatigue/</guid><description>2026年9月1-3日，Anthropic、Meta、Google、OpenAI四大厂商在72小时内密集发布11款前沿大模型。Meta Muse Spark 1.3一举冲至全球排行榜首位，但IT采购人员表示迭代速度令人疲惫，买方市场出现模型疲劳。</description></item><item><title>72小时四大厂商连发新模型：“模型疲劳”时代来临</title><link>https://guijiagi.com/posts.dedup_backup.20260917_115132/model-fatigue-72h-four-vendors/</link><pubDate>Thu, 10 Sep 2026 20:00:00 +0800</pubDate><guid>https://guijiagi.com/posts.dedup_backup.20260917_115132/model-fatigue-72h-four-vendors/</guid><description>9月1-3日Anthropic、Meta、Google、OpenAI密集发布新模型，Meta Muse Spark 1.3冲全球榜首。但买方市场出现“模型疲劳”——企业用户对周级迭代感到麻木，选型成本和集成疲劳成为新痛点。</description></item><item><title>AI商业化实战：从Devin到Cognition——AI程序员的480亿美元估值逻辑</title><link>https://guijiagi.com/posts.dedup_backup.20260917_115132/cognition-devin-48b-valuation-ai-commercialization/</link><pubDate>Thu, 10 Sep 2026 20:00:00 +0800</pubDate><guid>https://guijiagi.com/posts.dedup_backup.20260917_115132/cognition-devin-48b-valuation-ai-commercialization/</guid><description>Cognition完成20亿美元E轮融资，估值480亿美元。Devin AI程序员智能体的商业化路径跑通了。2026上半年AI融资突破3000亿元超去年全年，占全市场48.6%。拆解AI Agent商业化三种模式与开发者赚钱路径。</description></item><item><title>AI赚钱案例：从Cognition 480亿估值看AI程序员的商业化路径</title><link>https://guijiagi.com/posts.dedup_backup.20260917_115132/ai-monetization-cognition-480b-case/</link><pubDate>Thu, 10 Sep 2026 20:00:00 +0800</pubDate><guid>https://guijiagi.com/posts.dedup_backup.20260917_115132/ai-monetization-cognition-480b-case/</guid><description>Cognition以480亿美元估值成为AI商业化的标杆案例。Devin AI程序员的成功，验证了AI Agent在专业领域的商业价值。本文拆解Cognition的商业化路径，为AI创业者提供可复制的方法论。</description></item><item><title>Cognition完成20亿美元E轮融资估值480亿：Devin AI程序员的商业化验证</title><link>https://guijiagi.com/posts.dedup_backup.20260917_115132/cognition-2b-devin-48b-valuation/</link><pubDate>Thu, 10 Sep 2026 20:00:00 +0800</pubDate><guid>https://guijiagi.com/posts.dedup_backup.20260917_115132/cognition-2b-devin-48b-valuation/</guid><description>Cognition完成超过20亿美元E轮融资，估值达到480亿美元。Devin AI程序员的商业化成功，验证了AI Agent在专业领域的巨大价值。从AI辅助编程到AI自主编程，软件开发的范式正在被重构。</description></item><item><title>DeepSeek双响炮：KV Cache压缩到1/4 + 冲刺科创板IPO</title><link>https://guijiagi.com/posts.dedup_backup.20260917_115132/deepseek-kv-cache-compression-ipo/</link><pubDate>Thu, 10 Sep 2026 20:00:00 +0800</pubDate><guid>https://guijiagi.com/posts.dedup_backup.20260917_115132/deepseek-kv-cache-compression-ipo/</guid><description>DeepSeek新模型结构把KV Cache大幅压缩，HBM需求减至1/4、SSD需求减至1/8，直接导致SK海力士跌超3%。9月9日委托中信证券筹备科创板IPO，首轮融资510亿元，推理成本战再升级。</description></item><item><title>DeepSeek双响炮：新模型HBM需求砍至1/4 + 冲刺科创板IPO首轮融资510亿</title><link>https://guijiagi.com/posts.dedup_backup.20260917_115132/deepseek-dual-innovation-ipo-hbm/</link><pubDate>Thu, 10 Sep 2026 20:00:00 +0800</pubDate><guid>https://guijiagi.com/posts.dedup_backup.20260917_115132/deepseek-dual-innovation-ipo-hbm/</guid><description>DeepSeek新一代模型结构将KV Cache大幅压缩，HBM需求减至1/4、SSD减至1/8，Agent场景成本大降，导致SK海力士跌超3%。同时9月9日消息称DeepSeek已委托中信证券筹备科创板IPO，首轮融资510亿元。</description></item><item><title>GPT-6 Astra：10万GPU训练集群与3.1倍自动化研究效率</title><link>https://guijiagi.com/posts.dedup_backup.20260917_115132/gpt6-astra-100k-gpu/</link><pubDate>Thu, 10 Sep 2026 20:00:00 +0800</pubDate><guid>https://guijiagi.com/posts.dedup_backup.20260917_115132/gpt6-astra-100k-gpu/</guid><description>9月3日OpenAI发布GPT-6 Astra：105万Token上下文，由超10万张英伟达Grace Blackwell NVLink72芯片集群训练，黄仁勋确认并预告40万张GPU即将上线。自动化研究实习生已达人类研究员3.1倍工作量。</description></item><item><title>GPT-6 Astra发布：10万GPU训练、105万上下文、自动化研究实习生3.1倍效率</title><link>https://guijiagi.com/posts.dedup_backup.20260917_115132/gpt-6-astra-100k-gpu-agi/</link><pubDate>Thu, 10 Sep 2026 20:00:00 +0800</pubDate><guid>https://guijiagi.com/posts.dedup_backup.20260917_115132/gpt-6-astra-100k-gpu-agi/</guid><description>OpenAI 9月3日发布GPT-6 Astra，由10万张英伟达Grace Blackwell NVLink72芯片集群训练，105万Token上下文，自动化研究实习生工作量达人类研究员3.1倍。黄仁勋确认该规模并预告下一批40万张GPU即将上线。</description></item><item><title>从Cognition 480亿估值拆解AI赚钱路径：Devin怎么收费、客户是谁、和Cursor/Copilot差在哪</title><link>https://guijiagi.com/posts.dedup_backup.20260917_115132/ai-monetization-cognition-devin-48b-valuation-path/</link><pubDate>Thu, 10 Sep 2026 15:00:00 +0800</pubDate><guid>https://guijiagi.com/posts.dedup_backup.20260917_115132/ai-monetization-cognition-devin-48b-valuation-path/</guid><description>以Cognition/Devin为核心案例，拆解AI程序员的商业化路径：按席位订阅、按项目收费、按代码产出计费三种定价模式，从初创公司到大型企业的客户画像，以及与Cursor、Copilot等辅助工具的差异化竞争。AI不是取代开发者，而是重构协作模式。</description></item><item><title>Cognition完成20亿美元E轮：估值480亿，Devin验证AI程序员商业化路径</title><link>https://guijiagi.com/posts.dedup_backup.20260917_115132/cognition-2b-series-e-48b-valuation-devin-ai-coder/</link><pubDate>Thu, 10 Sep 2026 13:30:00 +0800</pubDate><guid>https://guijiagi.com/posts.dedup_backup.20260917_115132/cognition-2b-series-e-48b-valuation-devin-ai-coder/</guid><description>Cognition完成20亿美元E轮融资，估值达480亿美元。旗下Devin是全球首个AI软件工程师产品，此轮融资验证了AI程序员的商业化路径。企业级客户采用率持续增长，AI编程从辅助工具走向独立交付。</description></item><item><title>72小时模型军备竞赛：四大厂商连发11款模型，Meta Muse Spark登顶，买方出现'模型疲劳'</title><link>https://guijiagi.com/posts.dedup_backup.20260917_115132/72-hour-ai-model-arms-race-11-models/</link><pubDate>Thu, 10 Sep 2026 10:30:00 +0800</pubDate><guid>https://guijiagi.com/posts.dedup_backup.20260917_115132/72-hour-ai-model-arms-race-11-models/</guid><description>9月1日至3日，Anthropic、Meta、Google、OpenAI四大厂商在72小时内密集发布11款新模型，Meta Muse Spark 1.3冲上全球模型排行榜首。但买方机构已出现&amp;#39;模型疲劳&amp;#39;现象——选型速度跟不上发布速度，模型迭代速度超过企业消化能力。</description></item><item><title>DeepSeek双响炮：KV Cache压缩砍HBM需求至1/4，同时冲刺科创板IPO首轮融资510亿</title><link>https://guijiagi.com/posts.dedup_backup.20260917_115132/deepseek-kv-cache-hbm-quarter-ipo-star-market/</link><pubDate>Thu, 10 Sep 2026 10:00:00 +0800</pubDate><guid>https://guijiagi.com/posts.dedup_backup.20260917_115132/deepseek-kv-cache-hbm-quarter-ipo-star-market/</guid><description>DeepSeek新模型采用KV Cache压缩技术，HBM需求降至原来的1/4、SSD需求降至1/8，Agent推理成本大幅下降，消息导致SK海力士股价跌超3%。同期DeepSeek委托中信证券冲刺科创板IPO，首轮融资510亿元，技术降本与资本化双线推进。</description></item><item><title>GPT-6 Astra发布：10万GPU训练、105万上下文，自动化研究实习生效率3.1倍</title><link>https://guijiagi.com/posts.dedup_backup.20260917_115132/gpt6-astra-100k-gpu-1m-context/</link><pubDate>Thu, 10 Sep 2026 09:30:00 +0800</pubDate><guid>https://guijiagi.com/posts.dedup_backup.20260917_115132/gpt6-astra-100k-gpu-1m-context/</guid><description>2026年9月3日OpenAI发布GPT-6 Astra，训练集群动用10万张Grace Blackwell NVLink72芯片，上下文窗口达105万Token，&amp;#39;自动化研究实习生&amp;#39;功能达到人类研究员3.1倍工作量。黄仁勋预告未来将扩展至40万张GPU，大模型训练规模再创新高。</description></item></channel></rss>