OpenAI大幅下调GPT-5.6价格:Luna降80%,Terra降20%,Sol Fast速度提升至2.5倍
OpenAI下调了GPT-5.6模型系列的价格。Luna版本降价80%,Terra版本降价20%。Sol Fast推理服务速度提升至最高2.5倍。这些举措被视为直接针对中国AI模型的竞争举措。同时,Grok 4.5 High仍处于成本与性能的帕累托前沿。
Loading / 加载中
Thinkgap 信息流
OpenAI下调了GPT-5.6模型系列的价格。Luna版本降价80%,Terra版本降价20%。Sol Fast推理服务速度提升至最高2.5倍。这些举措被视为直接针对中国AI模型的竞争举措。同时,Grok 4.5 High仍处于成本与性能的帕累托前沿。
一位“opencode go”订阅用户尝试使用 DeepSeek V4 Flash 时收到了 HTTP 403 错误。错误信息为 RegionError,指出该模型的最新版本仅在中国部署,需要主动选择加入。这表明 DeepSeek 已将 V4 Flash 模型的地理访问限制为仅限中国 IP 或账户。即使通过原先可用的第三方服务,非中国用户也会受到此限制的影响。这一情况可能反映了 DeepSeek 最新模型部署策略的变动。
ThinkyMachines 发布了 Inkling-Small,一个开源的全模态模型,能够处理音频、文本和图像输入。该模型被描述为前沿的开源全模态模型。它可在推理端点(Inference Endpoints)上运行,简化了开发者的部署流程。此次发布将开放多模态 AI 模型的覆盖面从文本和图像扩展到了音频。
Thinking Machines 发布了拥有 2760 亿参数的全新开源模型 Inkling-Small。UnslothAI 宣布该模型现已可运行,支持推理使用。据称,Inkling-Small 在同尺寸开源模型中性能最强。
Thinking Machines 发布了全新模型 Inkling Small。该模型采用 NVFP4 精度,拥有 120 亿活跃参数,总参数量达 2760 亿。消息来源称该模型性能优于更大的模型,但未提供具体基准或对比细节。
8月6日,Together Compute将举办一场直播演示,展示其推理平台的重大更新,这些更新旨在简化开源权重模型的生产部署。新功能包括安全发布策略(金丝雀、蓝绿部署及自动回滚)、基于实时流量的A/B和影子测试,以及SLO驱动的自动伸缩。该平台现在支持任何模型约4倍更快的预热启动。会议将由推理产品经理Nikitha和开发者关系负责人Zain Has主持。