<?xml version="1.0" encoding="UTF-8"?><rss version="2.0"
	xmlns:content="http://purl.org/rss/1.0/modules/content/"
	xmlns:wfw="http://wellformedweb.org/CommentAPI/"
	xmlns:dc="http://purl.org/dc/elements/1.1/"
	xmlns:atom="http://www.w3.org/2005/Atom"
	xmlns:sy="http://purl.org/rss/1.0/modules/syndication/"
	xmlns:slash="http://purl.org/rss/1.0/modules/slash/"
	>

<channel>
	<title>Token计费 &#8211; mylogs.cn</title>
	<atom:link href="https://mylogs.cn/tag/token%E8%AE%A1%E8%B4%B9/feed/" rel="self" type="application/rss+xml" />
	<link>https://mylogs.cn</link>
	<description>发现、记录、分享</description>
	<lastBuildDate>Sun, 02 Aug 2026 05:38:43 +0000</lastBuildDate>
	<language>zh-Hans</language>
	<sy:updatePeriod>
	hourly	</sy:updatePeriod>
	<sy:updateFrequency>
	1	</sy:updateFrequency>
	
	<item>
		<title>同一个功能，模型选错贵 277 倍：一个免费算价工具</title>
		<link>https://mylogs.cn/%e5%90%8c%e4%b8%80%e4%b8%aa%e5%8a%9f%e8%83%bd%ef%bc%8c%e6%a8%a1%e5%9e%8b%e9%80%89%e9%94%99%e8%b4%b5-277-%e5%80%8d%ef%bc%9a%e4%b8%80%e4%b8%aa%e5%85%8d%e8%b4%b9%e7%ae%97%e4%bb%b7%e5%b7%a5%e5%85%b7/</link>
					<comments>https://mylogs.cn/%e5%90%8c%e4%b8%80%e4%b8%aa%e5%8a%9f%e8%83%bd%ef%bc%8c%e6%a8%a1%e5%9e%8b%e9%80%89%e9%94%99%e8%b4%b5-277-%e5%80%8d%ef%bc%9a%e4%b8%80%e4%b8%aa%e5%85%8d%e8%b4%b9%e7%ae%97%e4%bb%b7%e5%b7%a5%e5%85%b7/#respond</comments>
		
		<dc:creator><![CDATA[steve, zhang]]></dc:creator>
		<pubDate>Sun, 02 Aug 2026 05:37:58 +0000</pubDate>
				<category><![CDATA[科技]]></category>
		<category><![CDATA[AI工具]]></category>
		<category><![CDATA[AI成本]]></category>
		<category><![CDATA[DeepSeek]]></category>
		<category><![CDATA[Token计费]]></category>
		<category><![CDATA[大模型API]]></category>
		<category><![CDATA[模型选型]]></category>
		<guid isPermaLink="false">https://mylogs.cn/%e5%90%8c%e4%b8%80%e4%b8%aa%e5%8a%9f%e8%83%bd%ef%bc%8c%e6%a8%a1%e5%9e%8b%e9%80%89%e9%94%99%e8%b4%b5-277-%e5%80%8d%ef%bc%9a%e4%b8%80%e4%b8%aa%e5%85%8d%e8%b4%b9%e7%ae%97%e4%bb%b7%e5%b7%a5%e5%85%b7/</guid>

					<description><![CDATA[同一个功能，模型选错贵 277 倍：一个免费算价工具]]></description>
										<content:encoded><![CDATA[
<p class="wp-block-paragraph">做 AI 应用的团队大多有过同一种经历：演示阶段觉得调用费用不值一提，等到真的跑起来，月底账单才让人清醒。问题往往不出在用量估错，而出在没人真正算清一次调用到底花了多少钱。</p>



<figure data-wp-context="{&quot;imageId&quot;:&quot;6a7347b2efc1d&quot;}" data-wp-interactive="core/image" data-wp-key="6a7347b2efc1d" class="wp-block-image size-large aligncenter wp-lightbox-container"><img fetchpriority="high" decoding="async" width="1200" height="821" data-wp-class--hide="state.isContentHidden" data-wp-class--show="state.isContentVisible" data-wp-init="callbacks.setButtonStyles" data-wp-on--click="actions.showLightbox" data-wp-on--load="callbacks.setButtonStyles" data-wp-on--pointerdown="actions.preloadImage" data-wp-on--pointerenter="actions.preloadImageWithDelay" data-wp-on--pointerleave="actions.cancelPreload" data-wp-on-window--resize="callbacks.setButtonStyles" src="https://mylogs.cn/wp-content/uploads/2026/08/744346400f687f74ac048ff509ec0899_header.webp" alt="同一个功能，模型选错贵 277 倍：一个免费算价工具" class="wp-image-3255" style="max-width:100%;height:auto;" srcset="https://mylogs.cn/wp-content/uploads/2026/08/744346400f687f74ac048ff509ec0899_header.webp 1200w, https://mylogs.cn/wp-content/uploads/2026/08/744346400f687f74ac048ff509ec0899_header-300x205.webp 300w, https://mylogs.cn/wp-content/uploads/2026/08/744346400f687f74ac048ff509ec0899_header-1024x701.webp 1024w, https://mylogs.cn/wp-content/uploads/2026/08/744346400f687f74ac048ff509ec0899_header-768x525.webp 768w" sizes="(max-width: 1200px) 100vw, 1200px" /><button
			class="lightbox-trigger"
			type="button"
			aria-haspopup="dialog"
			data-wp-bind--aria-label="state.thisImage.triggerButtonAriaLabel"
			data-wp-init="callbacks.initTriggerButton"
			data-wp-on--click="actions.showLightbox"
			data-wp-style--right="state.thisImage.buttonRight"
			data-wp-style--top="state.thisImage.buttonTop"
		>
			<svg xmlns="http://www.w3.org/2000/svg" width="12" height="12" fill="none" viewBox="0 0 12 12">
				<path fill="#fff" d="M2 0a2 2 0 0 0-2 2v2h1.5V2a.5.5 0 0 1 .5-.5h2V0H2Zm2 10.5H2a.5.5 0 0 1-.5-.5V8H0v2a2 2 0 0 0 2 2h2v-1.5ZM8 12v-1.5h2a.5.5 0 0 0 .5-.5V8H12v2a2 2 0 0 1-2 2H8Zm2-12a2 2 0 0 1 2 2v2h-1.5V2a.5.5 0 0 0-.5-.5H8V0h2Z" />
			</svg>
		</button><figcaption class="wp-element-caption">AI生成配图</figcaption></figure>





<p class="wp-block-paragraph">最近在 Hacker News 上被讨论的 CostPerPrompt 就是冲着这件事去的。它是一个免费的网页工具，收录了 232 个以上模型的实时价格，并且自动刷新，同时提供一整套按真实业务场景设计的成本计算器。</p>



<h2 class="wp-block-heading">先看一张价格表，差距比想象中大</h2>



<p class="wp-block-paragraph">这套工具最直观的价值，是把各家模型的单价放在同一张表里。以每百万 tokens 计算的输入 / 输出价格为例（数据更新于 2026 年 8 月 2 日）：</p>



<ul class="wp-block-list">

<li>OpenAI GPT-5.6 Sol：5.00 美元 / 30.00 美元，上下文 110 万</li>


<li>OpenAI GPT-5.4：2.50 美元 / 15.00 美元</li>


<li>Anthropic Claude Fable 5：10.00 美元 / 50.00 美元</li>


<li>Anthropic Claude Sonnet 5：2.00 美元 / 10.00 美元</li>


<li>谷歌 Gemini 3.1 Pro Preview：2.00 美元 / 12.00 美元</li>


<li>xAI Grok 4.5：2.00 美元 / 6.00 美元，上下文 50 万</li>


<li>月之暗面 Kimi K3：3.00 美元 / 15.00 美元</li>


<li>深度求索 DeepSeek V4 Pro：0.435 美元 / 0.87 美元</li>


<li>深度求索 DeepSeek V4 Flash 0731：0.09 美元 / 0.18 美元</li>


<li>智谱 GLM 5.2：0.4186 美元 / 1.32 美元</li>

</ul>



<p class="wp-block-paragraph">把两端放在一起对比：Claude Fable 5 的输出单价是 50 美元，DeepSeek V4 Flash 0731 是 0.18 美元，相差约 277 倍。输入端的差距同样悬殊，10 美元对 0.09 美元，约 111 倍。国产模型在这张表里的位置相当扎眼——DeepSeek 与 GLM 的定价比第一梯队旗舰低了一到两个数量级。</p>



<h2 class="wp-block-heading">为什么大部分成本估算都是错的</h2>



<p class="wp-block-paragraph">该工具在说明中给出了一个关键判断：多数&#8221;这功能要花多少钱&#8221;的文章，估算结果通常偏离真实值两到三倍，原因是漏掉了两项折扣。</p>



<p class="wp-block-paragraph">第一项是提示词缓存（prompt caching）。聊天类应用每轮对话都要把历史记录重新发一遍，这部分重复输入可以享受最高 90% 的折扣。第二项是批量处理（batch），只要业务能接受延迟出结果，整体费用可以省下约一半。这两项不计入，账就算不准。</p>



<p class="wp-block-paragraph">计价规则本身并不复杂：所有主流厂商都按 token 计费，1 个 token 大致相当于四分之三个英文单词，输入和输出分开定价，输出通常比输入贵 3 到 5 倍。一个标注 5 美元 / 25 美元的模型，意味着每发送一百万 tokens 花 5 美元，每生成一百万 tokens 花 25 美元。</p>



<h2 class="wp-block-heading">六个计算器，覆盖六种花钱方式</h2>



<p class="wp-block-paragraph">CostPerPrompt 没有停留在报价表层面，而是按业务形态拆成了多个计算器：</p>



<ul class="wp-block-list">

<li><strong>API 成本计算器</strong>：任意工作负载在全部 232 个模型上横向对比，并计入缓存与批量折扣。</li>


<li><strong>聊天机器人成本</strong>：模拟真实对话，考虑历史记录不断增长、上下文重复发送、缓存命中等因素。</li>


<li><strong>智能体成本</strong>：多步循环、工具调用的结构描述、失败重试都会计入——该工具明确指出，智能体的实际开销通常是直觉估算的 10 到 30 倍。</li>


<li><strong>RAG 成本</strong>：把索引、检索、生成三段分开计价，其结论是嵌入向量那部分其实便宜到可以忽略。</li>


<li><strong>语音 AI 成本</strong>：语音识别、大模型、语音合成三段账单合并计算，可按分钟、按通话、按月查看。</li>


<li><strong>GPU 租用价格</strong>：覆盖 H100、A100、RTX 4090 在 10 家供应商处的报价，同一块芯片的价差可以达到 5 倍。</li>

</ul>



<p class="wp-block-paragraph">此外还有图像 API 价格页（单张 0.003 美元到 0.17 美元，分三档市场）以及一个完全在浏览器本地运行的 token 计数器，粘贴文本即可看到 token 数与各模型对应费用，内容不会上传。</p>



<h2 class="wp-block-heading">对什么人有用</h2>



<p class="wp-block-paragraph">这类工具的价值不在于替人做决策，而在于把&#8221;到底贵在哪一步&#8221;摊开。对于正在做技术选型的团队，它至少能回答三个常见问题：同一个任务换个模型能省多少；把智能体的重试次数从三次降到一次值不值；以及自建 GPU 与调 API 之间的分界线大致在哪里。</p>



<p class="wp-block-paragraph">需要提醒的是，各家厂商的价格调整相当频繁，任何第三方汇总页面都只能作为参考起点，真正要签合同或做预算，仍应以厂商官方定价页为准。</p>



<p class="wp-block-paragraph">来源：CostPerPrompt（costperprompt.com），经 Hacker News「Show HN」板块发布</p>

]]></content:encoded>
					
					<wfw:commentRss>https://mylogs.cn/%e5%90%8c%e4%b8%80%e4%b8%aa%e5%8a%9f%e8%83%bd%ef%bc%8c%e6%a8%a1%e5%9e%8b%e9%80%89%e9%94%99%e8%b4%b5-277-%e5%80%8d%ef%bc%9a%e4%b8%80%e4%b8%aa%e5%85%8d%e8%b4%b9%e7%ae%97%e4%bb%b7%e5%b7%a5%e5%85%b7/feed/</wfw:commentRss>
			<slash:comments>0</slash:comments>
		
		
			</item>
		<item>
		<title>Palantir CEO公开炮轰AI行业：Token计费模式已经彻底走偏了</title>
		<link>https://mylogs.cn/palantir-ceo%e5%85%ac%e5%bc%80%e7%82%ae%e8%bd%b0ai%e8%a1%8c%e4%b8%9a%ef%bc%9atoken%e8%ae%a1%e8%b4%b9%e6%a8%a1%e5%bc%8f%e5%b7%b2%e7%bb%8f%e5%bd%bb%e5%ba%95%e8%b5%b0%e5%81%8f%e4%ba%86/</link>
		
		<dc:creator><![CDATA[steve, zhang]]></dc:creator>
		<pubDate>Sun, 12 Jul 2026 06:54:59 +0000</pubDate>
				<category><![CDATA[科技]]></category>
		<category><![CDATA[AI]]></category>
		<category><![CDATA[Alex Karp]]></category>
		<category><![CDATA[Palantir]]></category>
		<category><![CDATA[Token计费]]></category>
		<category><![CDATA[企业软件]]></category>
		<category><![CDATA[商业模式]]></category>
		<guid isPermaLink="false">https://mylogs.cn/palantir-ceo%e5%85%ac%e5%bc%80%e7%82%ae%e8%bd%b0ai%e8%a1%8c%e4%b8%9a%ef%bc%9atoken%e8%ae%a1%e8%b4%b9%e6%a8%a1%e5%bc%8f%e5%b7%b2%e7%bb%8f%e5%bd%bb%e5%ba%95%e8%b5%b0%e5%81%8f%e4%ba%86/</guid>

					<description><![CDATA[最近，Palantir的CEO Alex Karp做了一件很多企业高管只敢在心里想的事——他公开把AI行业最赚 [&#8230;]]]></description>
										<content:encoded><![CDATA[
<p class="wp-block-paragraph">最近，Palantir的CEO Alex Karp做了一件很多企业高管只敢在心里想的事——他公开把AI行业最赚钱的商业模式骂了个底朝天。<br></p>



<p class="wp-block-paragraph">7月1日，Karp受邀上了CNBC的《Squawk Box》节目，一开口就直奔主题：OpenAI、Anthropic这些头部AI公司搞的&#8221;按Token计费&#8221;模式，已经完全走偏了。他的原话很直接：&#8221;这件事已经彻底出了问题。美国企业的普遍心态就是：躺平刷token混日子。我得不到任何价值，他们却拿走了我的知识产权。&#8221;<br></p>



<p class="wp-block-paragraph">Karp的核心逻辑其实很简单，但很少有人敢这么直白地说出来。他说，Token的单价这些年确实降了不少，大概降了70%到90%，但企业的总账单反而越来越贵。为什么？因为使用量在爆炸式增长，而企业根本说不清楚这些Token到底带来了多少实际业务价值。<br></p>



<p class="wp-block-paragraph">更有意思的是Karp提出的&#8221;双重收费&#8221;理论。他认为这些AI公司不仅收你的Token费，还在偷偷用你通过API提交的数据——你的工作流程、客户信息、战略文档——来训练他们的模型。换句话说，你花钱喂了别人的模型，而这个模型未来可能反过来抢你的生意。<br></p>



<p class="wp-block-paragraph">Karp还抛出了一个很尖锐的问题：如果AI真的像他们宣传的那么有价值，比如明天就能帮你多赚10个亿，那AI公司为什么不肯按效果收费？&#8221;如果真有那么值钱，我应该分30%，而不是按Token卖算力。&#8221;他觉得AI公司选择按Token定价本身，就说明他们自己也不确定自己的产品到底能创造多少价值。<br></p>



<p class="wp-block-paragraph">采访播出后，Palantir的股价当天涨了8%到9%。不过话说回来，Karp批评完之后给出的&#8221;解药&#8221;，恰好就是Palantir自己正在卖的东西——把开源模型部署在客户自己的环境中，帮企业掌控自己的算力和数据。有分析人士指出，从他6月底与NVIDIA官宣合作、到Palantir发布官方声明、再到上电视开炮，三天一套组合拳下来，这更像是一场精心策划的商业营销。<br></p>



<p class="wp-block-paragraph">但不管Karp的动机如何，他说的那些问题确实戳中了很多企业高管的痛点。他自己也说了，每一个他接触过的CEO私下都很愤怒，但没人敢公开站出来——因为谁也不想得罪AI公司之后，发现自己的竞争对手正在用自己泄露的数据训练出来的模型。<br></p>
]]></content:encoded>
					
		
		
			</item>
	</channel>
</rss>
