7月19日
阿里云推出个人Token计划,覆盖多模态
一个计划。所有模态。超值价格。🚀 阿里云个人Token计划:✅ 文本、图像和视频的统一额度 ✅ Qwen3.8-Max-Preview · GLM-5.…
7月19日
阿里 Qoder 上线 Qwen3.8-Max-Preview 模型,限时 1 折、夜间 0.2 折起
阿里 Qoder 今日上线通义千问系列最新基座模型 Qwen3.8-Max-Preview,参数量 2.4T。
7月19日
谷歌 Gboard 键盘将支持"手语转文字"功能
谷歌正在为 Gboard 键盘开发"手语转文字"输入功能,
7月19日
百度千帆发布Token Plan个人版:首购五折最低4.9元
7月13日,百度千帆发布面向个人开发者的订阅服务Token Plan个人版,定位为"个人的AI算力流量包"。
7月19日
中国工程院院士郑纬民:智能体时代,产出稳定且低成本Token(词元)的能力非常稀缺
中国工程院院士、清华大学计算机科学与技术系教授郑纬民在Agentic时代AI基础设施创新发展论坛上表示,
7月19日
transcribe.cpp 发布:基于 ggml 的跨平台语音转录库,支持 16 个 ASR 模型族
transcribe.cpp v0.1.0 发布,一个基于 ggml 的语音转录库,支持 16 个 ASR 模型族(60+ 模型),
7月19日
X Premium+会员:Grok 4.5 能力媲美 Opus 4.8 性价比高
X Premium+ 会员被指性价比极高:可屏蔽广告、提高推文曝光、发推赚钱、免费向 Grok 提问、免费生成图像和视频。
7月19日
Mozilla:开源AI能力差距缩小至3.3%,推理成本降50倍
开源模型与闭源模型在Chatbot Arena上的能力差距从24个月前的8.04%缩小至3.3%,在编程、指令遵循和通用知识上已接近持平。
7月19日
MOSS-Transcribe-Diarize-0.9B 开源,长音频一键转写带说话人标注
OpenMOSS 开源的 MOSS-Transcribe-Diarize-0.9B 模型,可将长音频一次性转换为带精确时间戳和说话人标注的结构化文本,
7月19日
Kimi 每美元效率达 Fable 2.8 倍
每花费 100 美元,Kimi 完成 14.7 个任务,而 Fable 完成 5.3 个,每美元工作量是后者的 2.8 倍。
7月19日
Kimi K3 进入前沿模型梯队,GLM-5.2 可在 25GB 显存设备运行
月之暗面(Moonshot)的 Kimi K3 模型将中国 AI 带入"Fable 级"前沿领域。
7月19日
Kimi K3 试用困难,API 稳定性存疑
我非常想在 Kimi 网页应用上试用 Kimi K3,但过去两天反复尝试,始终没有收到回复。
7月19日
Kimi K3 以一半成本击败 Opus 4.8,成功制作自玩复古游戏
Kimi K3 在制作自玩复古游戏任务中,以 18.4K tokens、$0.28 的成本击败 Opus 4.8(21.3K tokens、$0.54)…
7月19日
Kimi K3 上线 AI/ML API,价格仅为 Claude Fable 5 四分之一
Kimi K3 在 AI/ML API 上线首日即提供,与 Claude Fable 5 共用同一 API 密钥。
7月19日
Claude Code 与 OpenCode token 消耗实测对比
一项实测显示,在相同模型、机器和任务下,Claude Code 在读取用户提示前会发送约 3.3 万个 token(系统提示、工具架构和注入脚手架),
7月19日
AI与互联网是不同技术革命,成本逻辑决定未来
AI与互联网是不同技术革命:互联网改变信息分发,边际成本趋近于零;AI带来智能生产,每次调用都需要计算成本。
7月18日
阿里Qwen-Audio-3.0-TTS-Plus登顶Artificial Analysis语音竞技场排行榜
阿里巴巴最新文本转语音模型Qwen-Audio-3.0-TTS-Plus在Artificial Analysis语音竞技场排行榜上以1,
7月18日
铭凡公布本地 AI 边缘工作站 MS-03 更多信息
铭凡公布 MS-03 本地 AI 边缘工作站更多信息。
7月18日
用户一天清空GPT-5.6 Sol一周额度
一天清空GPT-5.6 Sol一周额度成就达成
7月18日
我国日均 Token 调用量 2 年增长超 1000 倍,AI 智能体催生"词元经济"
截至 2026 年 3 月,我国日均 Token 调用量达 140 万亿,较 2024 年年初的约 1000 亿增长超 1000 倍。
7月18日
开源模型降低token价格或拖慢AGI进程
Nathan Lambert 认同"开源权重模型可能延缓AGI"的逻辑链:开源模型压低可接受的token价格,导致利润率下降,
7月18日
京东发布 JoyAI-Talker 实时语音交互模型与 JoyAI-Video-Edit 视频编辑模型
京东在 WAIC 2026 上推出 JoyAI-Talker 实时语音交互模型与 JoyAI-Video-Edit 实时视频编辑模型。
7月18日
Grok Build 语音交互功能上线
试试 Grok Build
7月18日
Emad Mostaque:腾讯近前沿300B模型1-bit量化仅降5%性能,对RAM厂商利空
Emad Mostaque 指出,腾讯在近前沿300B模型上实现1-bit精度量化,性能仅下降约5%,
7月18日
ChatGPT语音识别用户打鼓动作引热议
这周跟 ChatGPT 语音聊天时,我开始练鼓,结果它居然察觉到了?!
7月17日
阿里千问输入法移动版上线:无广告无弹窗无需注册,支持 AI 自动润色
阿里旗下千问输入法 iOS 版 7 月 16 日上线 App Store,安卓版同日陆续上架各大商店。
7月17日
金山办公 CEO 章庆元:订阅与 Token 计费长期并存,AI 办公商业模式将更灵活
金山办公在"2026 AI 生产力大会"上发布面向个人的灵犀专业版和面向企业的 WPS Comate,后者在 WPS 365 中落地"企业大脑"概念。
7月17日
速率限制被量化引热议
天哪,他们量化了自己的速率限制!
7月17日
用6GB显存旧显卡训练AI底鼓模型:KickWithReverb项目全解析
作者在配备7年前NVIDIA GTX 1660 SUPER(6GB显存)的Linux台式机上,从零训练并部署了一个生成式潜在扩散底鼓模型。
7月17日
曦智科技将发布首款基于光电混合计算芯片的一体化边缘计算盒
曦智科技将发布首款基于光电混合计算芯片的一体化边缘计算盒
7月17日
智能体落地要迈过三道坎 AI智能体耗电是聊天机器人136倍
中国信息通信研究院副院长魏亮表示,智能体落地必须迈过三道坎。
7月17日
原型构建可节省大量模型token
构建原型、示意图、数据模型、概念验证等,是避免在意识到不想要输出前消耗大量模型token的最佳方式
7月17日
【VIP日报】电力板块逆势活跃 栏目解读行业供需情况 焦点公司收获涨停
①上海电网最高用电负荷创历史新高,电力板块逆势活跃,焦点公司收获涨停;
7月17日
Qwen3 ASR 解决 Whisper 三大痛点,0.6B 本地运行
Qwen3 ASR 配合 Qwen3-ForcedAligner 模型,能精准对齐词级时间戳,
7月17日
Oran Ge 分析 A 社 Fable 5 定价策略与 GPT 5.6 竞争影响
Oran Ge 分析 A 社的定价策略:Fable 5 因占用 GPU 资源过多、在 coding plan 中缺乏 ROI,
7月17日
Ollama 0.32.1 改进 Gemma 4 工具调用
话说我还没有使用过Pi ,不知道效果如何。 ollama 我发现现在更新和支持模型都很久及时和到位,
7月17日
Google Cloud 为 AlloyDB 嵌入 Gemini 模型,支持语义搜索
Google Cloud 将 Gemini 模型嵌入 AlloyDB,封装为 SQL 函数。
7月17日
Bonsai 27B 现可通过 HF Claude 使用
Bonsai 27B 现在可通过 hf claude 在 claude code 中使用
7月17日
AI模型竞争进入成本战 OpenAI、Meta相继竞逐token性价比
过去一周,三家知名人工智能开发企业相继发布了新模型,他们都宣称性能有所增强,但眼下最大的卖点或许并非能力提升,而是以更低成本完成同样的工作。
7月16日
阿里云EMR Serverless Spark推出AI Functions,SQL分析自动驾驶影像
阿里云在EMR Serverless Spark中推出AI Functions,将多模态AI能力集成至数据管道,
7月16日
模型token赠送成惊喜,规划支出如赌博
我觉得有趣的是,大家总是意外收到更多模型token作为惊喜礼物,但奇怪的是,规划token支出如今成了一场赌博游戏
7月16日
企业AI基础设施支出增速远超成本可见性,VentureBeat调查揭示"算力缺口"
对107家企业的调查显示,83%的企业GPU利用率不超过50%,仅44%能严格追踪AI算力实际成本。
7月16日
不送Token便落后于人?算力权益获客模式卷向中小银行,资产提升成为新赛道
AI Token营销热潮正从大型持牌信用卡机构传导至缺乏信用卡牌照的中小银行。
7月16日
Sam Altman称ChatGPT语音交互超打字
我现在和ChatGPT说话比打字更多了 新的语音模型真的跨过了一个门槛
7月16日
NVIDIA 发布 Nemotron-3-Embed-8B 嵌入模型,登顶 RTEB 榜首
NVIDIA 推出 Nemotron-3-Embed-8B 嵌入模型,在 RTEB 上平均 NDCG@10 达 78.46,
7月16日
Mesh LLM:在 iroh 上进行分布式人工智能计算
Mesh LLM 是一个开源项目,能将用户多台机器上的 GPU 和内存池化,对外暴露兼容 OpenAI 的 API。
7月16日
Kimi 推出 K3 模型与 Coding Plan 订阅
博主推荐用户立即在 Kimi 购买 Coding Plan 并使用 K3 模型,称其为目前国内最好的模型。
7月16日
Google DeepMind 发布有效模型路由策略新论文
Google DeepMind 新研究指出,仅凭准确率和成本评估大语言模型路由器可能产生误导。
7月16日
Codex Plus/Pro 取消5小时限制引讨论
我们取消 Codex Plus 和 Pro 的 5 小时限制已有几天。
7月16日
Claude与Codex相继重置用量
Claude 宣布重置几分钟后 Codex也宣布重置 我喜欢现在这种氛围… hhh
7月16日
Claude Devs 重置所有用户速率限制
精彩的开发者周仍在继续.. 充分利用它
7月16日
Anthropic 回应 1662 万美元 AI 天价账单:计费系统 Bug 导致,未实际扣款
Anthropic 承认韩国开发者收到的 1662 万美元及 160 万美元两笔账单是计费系统 Bug 导致,并未实际扣款。
7月15日
需求井喷 高端算力服务大单频现
行云科技最新公告显示,公司今年4月签订的算力服务合同迎来大幅提价,合计上调租金28.79亿元,较原签约金额上调79%。
7月15日
荣耀 MagicOS 10 系统 7 月版本推送,覆盖 Magic8、数字 600 等系列
荣耀 MagicOS 10 系统 7 月版本(10.0.0.170)今日开启首批机型推送,覆盖 Magic8、600 等系列。
7月15日
网信部门公布 7 款手机端侧生成式 AI 服务备案,Apple 智能在列
网信部门发布 7 款提供手机端侧生成式人工智能服务的已备案信息,
7月15日
独家|阿里千问将作为AI能力集成至苹果智能
独家获悉,阿里千问将作为AI能力集成至Apple智能,为 iOS、iPadOS、macOS和visionOS的中国用户带来智能体验。
7月15日
独家|百度为苹果智能提供AI搜索功能
据知情人士向透露,苹果与百度将合作,为中国iPhone用户开发人工智能功能。
7月15日
北京亦庄联合京东云上线全国首个"模型券"即时补贴平台
北京经济技术开发区(北京亦庄)联合京东科技集团上线全国首个"模型券"即时补贴平台,企业购买模型服务时可在京东云优惠价基础上叠加最高65%的即时补贴。
7月15日
PrismML 发布 Bonsai 27B:27B 参数开源推理模型,可装入 iPhone
PrismML 发布 Bonsai 27B,一个基于 Qwen3.6-27B 的 27B 参数开源推理模型,支持多步推理、工具调用和智能体任务。
7月15日
PrismML 发布 Bonsai 27B,全球首个可在手机本地运行的27B级大模型
PrismML 发布 Bonsai 27B,通过极致低比特技术将模型压缩至1-bit(3.9GB)和Ternary(5.9GB)版本,
7月15日
OpenAI 模型定价:为每项任务提供最优价格
我们的模型旨在为任何给定任务提供最优价格。 如果你能在任何工作负载上获得更好的性价比,我们很乐意听取细节并共同研究--gdb@openai.com
7月15日
MacWhisper 14 发布:新增编辑器视图,修复 CPU 占用过高问题
MacWhisper 14.0 更新发布,新增编辑器视图(Editor View),允许用户在主界面直接编辑转录稿、添加段落、重新分配发言人。
7月15日
Inkling 最终 RL 训练规模估算约 500 万美元
让我们估算一下 Inkling 最终强化学习运行的规模?初步猜测约 1K 块 GB300,运行约 1 周,
7月14日
阿里云百炼宣布 GLM-5.2 Fast mode 模式降价 20%,7 月 15 日生效
阿里云大模型服务平台百炼宣布,自 2026 年 7 月 15 日起,GLM-5.2 模型的 Fast mode 模式计费单价下调 20%。
7月14日
腾讯混元发布 Hy3 模型 1-bit/4-bit 量化版,单 GPU 可运行
腾讯混元发布旗舰级 295B MoE 模型 Hy3 的 1-bit 与 4-bit 量化版本。
7月14日
曦智科技将发布首款基于光电混合计算芯片的一体化边缘计算盒
2026世界人工智能大会将于7月17日至7月20日在上海举行。
7月14日
微软 Win11 测试 PC Insights:目标替代任务管理器排查拖慢 PC 原因
微软正为 Copilot 测试 PC Insights 功能,通过读取 CPU、RAM、GPU 占用等数据,以聊天形式告知用户设备运行缓慢的原因。
7月14日
对冲基金大佬谈Neocloud:CoreWeave利用率高2-3倍
Gavin Baker ( @GavinSBaker ),一位顶级对冲基金经理,谈及Neoclouds时表示:"要做好真的很难。
7月14日
国产模型API禁用自定义temperature原因探讨
为什么很多国产模型API的 temperature 不允许自定义了? 是因为蒸馏的原因吗?
7月14日
Sunrun 启动边缘 AI 推理节点部署试点,将分布式电力转化为算力
Sunrun 宣布启动边缘 AI 推理计算节点部署试点。
7月14日
OpenAI 推理团队应对需求激增
闻起来就是胜利的味道 【引用 @sama】:5.6 sol 的增长太疯狂了。 推理团队为支撑需求做出了英雄般的工作。
7月14日
LMSYS 与 SGLang 团队为 GLM-5.2 NVFP4 推出推理优化,8×B300 单 batch 解码超 500 TPS
LMSYS 与 SGLang 团队针对智谱 GLM-5.2 NVFP4 模型在 Grace Blackwell 硬件上推出多项优化。
7月14日
GPT-5.6 更新后消耗仍偏高,期待重置
我本周的额度几乎用完了,但幸运的是还有两次累积重置可用。不过真的很期待下一次重置。 GPT-5.6 在更新后消耗速率有所改善,但在我看来仍然偏高
7月13日
豆包输入法鸿蒙版开启招募:适配 HarmonyOS 5.0,支持豆包同款语音识别
豆包输入法鸿蒙版开启招募,适配 HarmonyOS 5.0 及以上系统的华为手机。
7月13日
编排器支持跨模型无缝切换应对变更
这比我预期的还要火爆。 为了尽量减少这些变更的负面影响,我的编排器现在可以在任何提供商/模型之间平滑切换/交接(例如,
7月13日
微软:Windows 团队正全面利用 AI 挖掘漏洞,后续 Patch Tuesday 安全更新将包含更多修复补丁
微软 Windows 与设备部门执行副总裁 Pavan Davuluri 透露,Windows 团队正全面利用 AI 挖掘漏洞。
7月13日
和面壁智能相约WAIC:开启端侧AI规模化落地之旅
和面壁智能相约WAIC:开启端侧AI规模化落地之旅
7月13日
中国电信联合北邮、鹏城实验室完成高轨卫星跨模态语义通信试验,传输效率较 H.265 提升 3.5 倍
中国电信研究院联合北京邮电大学、鹏城实验室,基于亚洲九号卫星完成高轨卫星跨模态语义通信试验。
7月13日
actAVAai Cura:1T参数医疗智能体模型,推理成本降20-100倍
actAVAai 发布 Cura,一个 1T 参数(1万亿)的医疗领域智能体模型,通过递归自我改进(RSI)训练,专为长临床与健康管理工作流设计。
7月13日
Siri AI 在 iOS 27 公测版中已开始改变 iPhone 使用方式
iOS 27 首个公开测试版今日发布。Siri AI 是本次更新的核心亮点,已在日常使用中显著改变 iPhone 交互方式。
7月13日
OpenRouter 新增服务层级与路由功能
服务层级现已成为 OpenRouter 的一级功能。
7月13日
OpenAI 慷慨重置额度获社区好评
我非常感激 OpenAI 目前在重置和累积速率重置方面的慷慨。 但谦虚也是一种美德。OpenAI 目前正在做杰出的社区工作。我希望它能继续保持下去
7月13日
Grok 在韩国日本特斯拉车辆上线
突发:Grok 现已在韩国和日本的特斯拉车辆内推出。🇰🇷🇯🇵
7月13日
GPT-Live 语音体验实现新突破
GPT-Live 是一种全新水平的体验
7月13日
GPT-Live 实时视频翻译功能上线
GPT-Live 杀死了同传!! 就在这一刻
7月13日
Emil Kowalski 推出 /improve-animations 技能,用昂贵模型审计动效、廉价模型执行
Emil Kowalski 为设计工程师推出新 Skills 库技能 `/improve-animations`。
7月13日
ChatGPT 付费用户获赠一次额外重置
ICYMI 👀: ChatGPT 付费用户已获得一次额外累积重置,正如承诺的那样。 休息也是一种资产 🤖
7月11日
三星 One UI 9 版录音机应用曝光:加入云端转录,增强文件管理
科技媒体 SamMobile 通过挖掘 One UI 9 系统发现,三星录音机应用将新增"云端转录"功能,可将语音录音上传至三星服务器,
7月10日
构建 T4 友好的自主数据科学智能体:DeepAnalyze-8B + 沙盒代码执行
本教程演示如何围绕 DeepAnalyze-8B 构建一个自主数据科学智能体。
7月10日
Grok 4.5 登陆 Perplexity 编排模型
在 Perplexity 中试用 Grok 4.5
7月9日
人麻了 阿里把Token消耗纳入绩效考核了, 低于团队平均值直接扣分 本以为AI是来减负的 结果先成了打工人新KPI😭
人麻了 阿里把Token消耗纳入绩效考核了, 低于团队平均值直接扣分 本以为AI是来减负的 结果先成了打工人新KPI😭
7月9日
Google 推出 LiteRT.js:高性能 Web AI 推理运行时
Google 发布 LiteRT.js,这是 LiteRT 跨平台边缘 AI 运行时的最新成员,专为 JavaScript 开发者设计,
7月7日
感谢NVIDIA等团队实现3.7倍交互提升
向NVIDIA、SGLang和RadixArk的各位致敬,他们出色的性能带来了比B300快高达3.7倍的交互速度
7月6日
Sakana AI 推出 Sakana Translate:基于 Namazu 的日英中翻译工具,支持翻译、校对与追问模式
Sakana AI 在 Sakana Chat 中新增 Sakana Translate 功能,支持日语、英语、中文双向翻译。
7月5日
智谱 zcode 图片分析会把网页截图传到自己的cdn。 但从路径名看,很尴尬啊!
智谱 zcode 图片分析会把网页截图传到自己的cdn。 但从路径名看,很尴尬啊!
6月30日
平安银行联合腾讯云、中国银联推出"AI 智算卡"借记卡,AI 主题信用卡下月登场
腾讯云联合平安银行与中国银联推出"AI 智算卡"借记卡,面向AI算力个人消费用户。
6月21日
超10亿!边缘算力赛道诞生今年最大单笔融资
当算力网被正式纳入国家“六张网”战略核心,边缘算力从技术名词跃升为万亿级新基建的聚光灯下,赛道头部企业正在加速卡位。
5月31日
我花200英镑把一台数据中心级GPU装进了我的游戏电脑
一名用户以200英镑的价格购入了一块数据中心级GPU,并将其成功安装到自己的游戏电脑中。