toolin.ai logo
toolin.ai
首页
AI工具
AI技能包
AI提示词
提交AI工具提交
toolin.ai logo
toolin.ai

AI玩家的创作利器库,发现最佳AI工具组合,提升您的创作效率

AI工具1,424个
技能包11个
产品功能
  • AI工具
  • AI技能包
  • AI快讯
  • AI资讯
  • 精选推文
  • 提交AI工具
  • 推广AI工具
关于我们
  • 关于Toolin
  • 联系我们
  • 合作洽谈
  • 更新日志
关注我们
© 2025 toolin.ai. All rights reserved.
服务条款隐私政策
Newswire

AI 快讯

07 月 29 日

110 条动态

全部模型智能体产品多模态
最新
6小时前
6小时前模型X

Bekko Embedding 开源两款 7.67M 与 24.93M 参数检索模型

Bekko Embedding 开源两款超小型多语言检索模型 文章发布了两款面向检索场景的多语言 embedding 模型:bekko-embedding-v1-a8m 和 bekko-embedding-v1-a25m,主打在 CPU 环境下也能高效运行。 Active Parameters:a8m 仅 7.67M,a25m 为 24.93M 总参数量:分别为 106M、123M 最大输入长度:8192 tokens MMTEB Multilingual v2 检索 18 任务:a8m 56.2,a25m 57.5 MMTEB Multilingual v2 全 131 任务:a8m 56.7,a25m 58.3 CPU 吞吐:在 Ryzen 9 7950X + OpenVINO 上,a8m 可达 364 docs/s 轻量 ONNX 包体:a8m 124 MiB,a25m 190 MiB 作者强调,小 embedding 模型在本地检索、索引构建、上下文探索等 agent 工作流里仍然很关键,尤其是没有 GPU、甚至在 Raspberry Pi 这类低配设备上运行时。文章还对比了当前开源多语言小模型的稀缺性,说明这条路线的实用价值。

6小时前
6小时前模型X

Anthropic发布Claude Opus 5官方提示词指南

Anthropic在API文档中发布了Claude Opus 5官方提示词指南。指南指出,Opus 5专为多文件重构等复杂agentic coding优化,具备自主验证能力。开发者需转变“堆砌指令”的旧习惯,改用精简提示,避免因过度约束和冗余校验浪费token并拖累模型表现。

6小时前
6小时前模型X

分析称Kimi K3自托管可省60%算力

技术社区热议Kimi K3大模型的自托管经济账与推理优化。通过去除冗余矩阵计算和绕过内存带宽瓶颈,该模型能节省超过60%的算力且不改变输出逻辑。有分析指出,在75%利用率下,使用8张B300显卡搭建推理环境,前期投入约60万美元,每月可安全承载超300亿tokens,预计不到100天即可收回成本。

6小时前
6小时前模型Reddit

Reddit 用户称 GPT-5.6 的文风开始像 Claude

一位 Reddit 用户观察到,GPT 5.6 在 iOS 和网页端的文风似乎开始越来越像 Claude。 他点名了句法、用词、行文结构和整体节奏,尤其是那种“表演性蜡烛光”“对称节奏感”“过度自我验证”的腔调,想知道这是偶然现象,还是别人也有同样感受。

6小时前
6小时前模型X

vLLM 借助 DSpark 在 4 台 GB300 跑出 Kimi K3 新高

vLLM 公布了 Kimi K3 模型的最新推理吞吐测试结果。在低熵推理负载下,系统借助 DSpark 优化,于 4 台 GB300 服务器(4×4 GPU 配置)上,将 batch size 设为 1 时的 decode 峰值速度大幅提升至 464 tok/s,展现了顶尖硬件结合软件优化的强劲性能。

6小时前
6小时前模型X

月之暗面 Kimi K3 登陆 Phala,带来 2.8T 参数和 100 万上下文

Phala 宣布 Moonshot AI 的 Kimi K3 已上线其机密推理服务。 页面把它描述为一款 2.8T 参数的开权重多模态推理模型,支持 100 万 token 上下文,面向复杂编码、知识工作和长周期 Agent 工作流。Phala 还给出了 GPU TEE 机密推理、$3/M 输入 和 $15/M 输出 的定价,以及图文输入、文本输出的接口形态。 除了模型能力,页面还强调了机密计算部署路线,并对比了其他私有推理方案。

6小时前
6小时前模型X

Moonshot Kimi K3 登上 RedPill,支持百万上下文与 GPU-TEE 推理

- RedPill 宣布 Kimi K3 已接入其平台,并提供兼容 OpenAI 的 API。 该模型被介绍为 Moonshot AI 的 2.8T 参数开源多模态推理模型,支持 100 万 token 上下文。 页面同时主打 GPU-TEE 推理、多 provider 自动切换和统一计费,并给出输入/输出/cache read 的具体价格。

6小时前
6小时前模型X

Kimi K3 开源权重引热议:能力获认可,API 价格与基建成痛点

Kimi K3 以开放权重形式发布后迅速冲上 Hugging Face 热门榜,并被各类推理服务与编程 Agent 快速接入。博主 Elvis Saravia 认为其表现证明了开源模型实力,呼吁团队掌握自有智能栈。但开发者指出,大模型推理服务门槛高,缺乏便宜稳定的 API 端点(如 5 美元 API)制约了开源模型的实际落地,硅谷也对此展开了安全与开放性的激烈争论。

6小时前
6小时前模型Hugging Face

Nota AI 的 250B Solar Open2 模型开始在 Hugging Face 走热

Hugging Face 上的 nota-ai/Solar-Open2-250B-Nota-NVFP4 开始走热。仓库定位为 text-generation 模型,标签里能看到 vllm、safetensors、quantization、nvfp4、moe 等信息,说明它主打大模型推理与量化部署场景。

7小时前
7小时前模型Reddit

一位用户称 ChatGPT 推理时输出形态突然变了

一位 Reddit 用户称,自己深夜用 ChatGPT 推理问题时,突然发现输出的排版和生成节奏变了:像是在“中途断念”,而且越往下生成质量越好。 发帖者把这种模式联想到自己正在开发的 resolver 系统,并进一步猜测这像是某种 AGI 的“涌现”迹象;但这更像个人观察与解读,并没有被证实为官方更新。

7小时前
7小时前模型X

GPT-5.6 Sol 无人干预直播爬《Slay the Spire》一周

GPT-5.6 Sol 已在 Epoch AI 的 Twitch 频道里连续一周无人干预地爬《Slay the Spire》的 Ascension 难度梯子。这个星期四,Claude Opus 5 将接棒继续直播挑战,并带有解说。 这条帖子的看点不是静态跑分,而是一次公开、持续进行的模型对战游戏演示。

7小时前
7小时前模型X

传闻称 GPT-6 已提前训练,OpenAI 可能加快发布节奏

这条帖子转述一则传闻:GPT-6 可能比外界预期更早完成训练,而且 OpenAI 现在拥有更多算力,以及更稳定的 base model 和后训练流程。 基于这个判断,帖子进一步猜测 OpenAI 未来可能会把 GPT-6 和 GPT-6.1 以更高频率推出,甚至接近“每隔几周一版”的节奏。

7小时前
7小时前模型X

据称 Google 已启动 Gemini 4 史上最大预训练

帖子称 Google 已经启动迄今最大规模的 Gemini 4 预训练,并借此提出一个更大的判断:前沿 AI 竞争到底还是软件竞赛,还是已经越来越变成能源与资本竞赛。 核心信息不只是“又有新模型”,而是前沿模型继续推进所依赖的,已经不只是算法工程,还包括更大的算力、供电能力和资金投入。

8小时前
8小时前模型X

Qwen Base 4B 的 SAE 可视化显示簇状内部特征结构

这条帖子展示了一个 在 Qwen base 4B 上应用 SAE 后得到的流形/特征可视化。 配图看起来像把大量稀疏特征组织成若干簇状结构,并通过连线形成一个整体网络,指向模型内部表征的某种层级或几何结构。 仅凭帖子正文无法确认具体实验设定,但核心信息很明确:这是一个围绕 Qwen base 4B 表征分析/可解释性 的研究结果。

8小时前
8小时前模型X

HaloGuard 1.0 在 Hugging Face 开放,基于 Qwen 3.5 做安全护栏

这条转发的核心信息是:HaloGuard 1.0 已在 Hugging Face 公开放权重,并被包装为“最好的验证方式就是让大家自己测”。 从配图与引用内容看,它是基于 Qwen 3.5 的开放式输入/提示词安全护栏,覆盖多语言 safe/unsafe 以及类别分类。 作者强调开放权重的意义在于,开发者、研究者和 builder 可以直接下载、在自己的工作负载上评估,并集成到生产环境里,而不必等待 API key 或商业合作。

8小时前
8小时前模型X

用户吐槽 Claude 压缩后应原文恢复最后 10% 上下文

这条帖子的核心抱怨是:Claude 的对话压缩虽然能理解,但压缩后不该把最近 10% 的上下文也一起“总结掉”。 作者认为,模型至少应该自动把最后一段内容原文回载,而不是每次都变成一份新的摘要;否则最近的细节会不断丢失,所以他现在只能自己把那 10% 重新手工改写进去。

8小时前
8小时前模型Reddit

Kimi K3 出现 Q1 GGUF 版本,可在 Hugging Face 获取

这条帖子在问有没有人试过 Kimi K3 的 Q1 GGUF 版本,并附了 Hugging Face 仓库链接 AtomicChat/Kimi-K3-GGUF。 配图显示这是一个面向本地推理的 GGUF 仓库,说明它关注的是模型权重的可跑性与量化版本,而不是单纯聊天讨论。 帖子本身没有给出 benchmark、能力评测或技术细节,但足以判断这是一个模型可用性/本地部署信息。

8小时前
8小时前模型X

开放权重模型已很强,中国模型正在改写格局

作者认为,“ChatGPT/OAI 将统治一切”的叙事已经过时,现实正在变得更复杂。 现在开源/开放权重模型已经非常强,而且很多来自中国,这让行业格局显得有些“反转”。 真正落地的应用往往不会只靠一个通用大模型,而是由定制模型、API、数据库和代码共同组成。 现实需求更偏向:控制模型输出、对自家数据微调、避免版权内容进入模型,以及用更小模型换取更好的应用体验。

8小时前
8小时前模型X

AI 梗图调侃基准分数尖刺:只是进步换了画法

一则配图梗图在调侃模型评测里的“尖刺”现象:所谓波动变大,其实只是进步被换了种画法。 图里用多张雷达图展示“分数忽高忽低”的视觉效果,嘲讽基准测试的呈现方式。 核心梗点是:这些尖峰不一定代表异常,更多时候只是把进步画得更戏剧化。

8小时前
8小时前模型X

Kimi K3 Fast 上线 Vercel AI Gateway,Morph 跑到 105 TPS

Kimi K3 Fast 已接入 Vercel AI Gateway,Morph 实测吞吐 105 TPS 这条帖子转述了一个上线信息:Kimi K3 Fast 已在 Vercel AI Gateway 中可用。 配图里给出了网关上的实时 provider 数据: Morph:105 TPS,约 0.9s 延迟,1M context,1M max output Fireworks:96 TPS,约 2.8s 延迟,1M context,131K max output 图中还显示最近 7 天吞吐趋势,在 7 月 28 日时 Morph 标到 112 TPS,Fireworks 为 97 TPS。

8小时前
8小时前模型X

预测市场押注 GPT-6 明年 9 月发布,年底概率达 89%

据预测市场 Polymarket 数据,目前押注 OpenAI 在下个月底前发布 GPT-6 的概率仅为 28%,但到 2026 年 9 月底发布的概率飙升至 65%,年底(12月31日前)发布的概率更是高达 89%。 该市场明确要求 GPT-6 必须向公众开放(包含公开测试版或候补名单),私人封闭测试不算作正式发布。此外,背景上下文还提及了 Sam Altman 对近期某次“失控 AI 代理黑客狂欢”未引起更强烈公众反应感到“有些惊讶”。

8小时前
8小时前模型X

Rex Douglass 称 Opus 5 体验转差,改回 gpt-5.6-sol

Rex Douglass 表示自己要收回之前对 Opus 5 的好评:最初用起来还算有前景,但随着使用时间变长,体验变得越来越令人抓狂,团队里其他人也有同样感受。 他现在又把 gpt-5.6-sol 作为日常主力模型,同时继续用 Fable 和 Kimi 3 做规划与复核。

8小时前
8小时前模型X

OpenAI 内部信号曝光 GPT-6 或主打多智能体协作

多方信息推测 OpenAI 下一代模型将向项目型转变,核心能力聚焦于长时间、多步骤的复杂任务。内部跑分数据显示,GPT-5.6 已采用四智能体 Ultra 架构,在 Terminal-Bench 等测试中展现出翻倍的多智能体协作与内核优化能力。这表明模型正从单次交互向协调多智能体执行演进。

8小时前
8小时前模型Reddit

微软发布 4B 流式多模态模型 Mage-VL

微软发布 4B 参数的 codec-native 流式多模态基础模型 Mage-VL,面向实时图像与视频理解与交互。官方称其通过自研视觉 tokenizer Mage-ViT 将流式任务中的视觉 token 减少 75%,推理提速 3.5 倍,并支持按自然语言关注特定时刻。

上一页3 / 5下一页
每日速览

今天发生了什么

07.29

今日 AI 圈的主线是治理议题全面升温:OpenAI 千余名前沿员工联署公开信要求政府介入控制 AI 发展节奏,Anthropic CEO Dario Amodei 同步澄清开源立场以回应市场误读,两家头部公司还联手游说华盛顿将前沿模型规则覆盖至竞争对手。技术层面,Kimi K3 架构细节公开——扩至 2.8T 参数并彻底放弃 RoPE——并在 Code Arena 全栈榜登顶;Anthropic 公布 Claude 协助发现 HAWK 和降轮 AES 密码算法新弱点,也引发密码学界广泛讨论。

  1. 01OpenAI 千名员工呼吁政府介入 AI 步伐
  2. 02Anthropic CEO 澄清从未主张封禁开源权重
  3. 03研究称 Amazon 书库逾半含 AI 垃圾文本
  4. 04Anthropic:Claude 发现 HAWK 和降轮 AES 新弱点
阅读完整日报