旗舰指令模型快速高效执行的秘诀:可靠基础设施与优化
SGLang团队(隶属于LMSYS Org)揭示了其旗舰指令模型实现快速、高效…
本期共收录 30 条,覆盖 5 个版块。
SGLang团队(隶属于LMSYS Org)揭示了其旗舰指令模型实现快速、高效…
腾讯开源了Hy-MT1.5-1.8B-1.25bit翻译模型,其参数量为18亿,经量化后仅440MB…
是的,SenseNova U1 现已在 Hugging Face 和 GitHub 上发布!
inclusionAI 发布了 Ling-2.6-1T 模型,这是一个包含 1 万亿参数的大型语言模型。
Cursor 正式推出 SDK 公开测试版,开发者仅需几行 TypeScript 代码即可构建和部署智能体。
运行 `stripe projects add openrouter/api` 命令…
通过Figma插件,Codex现在可以将实施计划转化为可视化的FigJam白板。
2025年数据显示,美国员工工作AI使用率已从2023年的20%升至40%。
Claude Security 现已面向所有 Claude Enterprise 客户开放公开测试。
⚙️ 我们通过 Responses API 中的 WebSockets 让代理循环运行得更快 随着 Codex 速度提…
Google正式发布Gemini Embedding 2统一嵌入模型…
现在您可以在与Gemini的聊天中直接生成多种可下载文件…
OpenAI 正在扩展其代号为“Stargate”的计算基础设施项目…
OpenAI DevDay 再次回归。 旧金山 9月29日
2026年第一季度,三大云服务巨头资本支出合计1120亿美元。
👀 🚀 🙌 [引用 @SiliconFlowAI]:开发者们正在用他们的 token 投票 🔥 SiliconFlow…
小米MiMo-V2.5-Pro模型在最新Arena排行榜中表现卓越。
一项基于百万次对话的隐私保护分析显示,约6%的用户会向Claude寻求个人生活指导…
针对消费级GPU服务器内存有限和PCIe互联慢的问题,研究团队提出了RoundPipe流水线调度方案。
在新的Anthropic Fellows研究中,我们探讨了“内省适配器”…
研究提出了一种名为“自适应思考”的新方法,使大型语言模型能够动态决定是否需要执行链式思考推理。
研究团队提出DSO方法,旨在缓解视觉语言模型决策中的社会偏见。
Moxt的核心是为AI构建了一个原生工作空间,通过将Word、PDF等文档自动转换为Markdown等AI原生格式…
一个很棒的Codex教程: 这些是7种知识工作能力... 在超级应用Codex内部 00:00 介绍 02:19 能力…
针对AI初创公司是否必须被大模型实验室收购的讨论,Cognition公司的经验表明…
《哈佛商业评论》文章指出,AI的首要经济影响并非自动化,而是制造了巨大的不确定性“迷雾”,导致“预见能力的崩溃”。
FlashQLA是基于TileLang开发的高性能线性注意力内核,专为提升个人设备上智能体AI性能而设计。
Claude Code 团队分享了大规模优化提示缓存的核心策略。
你完全可以构建网络应用
AI评估成本已突破关键阈值,正重塑其可及性。Holistic Agent Leaderboard花费约4万美元运行了2…