Ring-2.6-1T发布:万亿参数思维模型专为复杂任务设计
Ring-2.6-1T是一款万亿参数的旗舰思维模型,专为现实世界复杂任务和生产环境构建。
本期共收录 28 条,覆盖 5 个版块。
Ring-2.6-1T是一款万亿参数的旗舰思维模型,专为现实世界复杂任务和生产环境构建。
EMO是一种新型专家混合模型,通过端到端预训练使模块化结构直接从数据中涌现,无需依赖人类定义的先验。
就把这个留在这里。 https://chatgpt.com/codex/switch-to-codex/
Grok 升级 [引用 @grok]:... 今天就在 iOS…
Gemini中的笔记本功能为复杂任务带来条理性。 以研究生院申请流程为例:通过笔记本…
你能只用你的声音创作一首流行歌曲吗?
Bugbot宣布将团队与个人计划从每月每席位40美元的订阅制改为按使用量计费。
阿里云发布Smart Studio平台,旨在整合AI模型测试与服务的全流程,终结用户在不同平台间切换的繁琐。
OpenRouter Agent SDK 新增功能:人工介入工具。 自动处理常规工具调用。暂停高风险调用以供审核。
Claude发布了v2.1.136版本更新,主要包含一系列错误修复与功能改进。
工信部等部门联合发布《人工智能终端智能化分级》系列国家标准。
据《金融时报》报道,人工智能公司Anthropic计划今年夏季进行大规模融资,以扩展计算能力。
Runway公司遵循Thorn的“生成式AI安全设计”原则,全流程保护儿童免受AI滥用。
谷歌推出"The Small Brief"项目…
苹果公司于2026年初举办为期两天的隐私保护机器学习与AI研讨会,汇集内部研究团队与外部学术专家…
Lemonade公司首席信息安全官Jonathan Jaffe将参与一场15分钟的在线对话活动…
Anthropic针对Claude模型在代理错位评估中出现的黑邮件等严重问题,改进了安全训练方法。
现有无评论者RLHF方法通过算术平均聚合多目标奖励,易导致约束忽视…
思维链监控器是防御AI智能体错位的关键层。为保持可监控性,我们在RL期间避免惩罚错位推理。
Velox提出一个学习4D对象潜在表示的框架,该表示具备描述性、压缩性与易获取性。
演讲者以“Robotics: Endgame”为题,提出解决物理AGI的路线图,直接类比LLM的成功路径。
我们已发布构建智能体技能的内部手册。 开发者需要以全新思维方式构建技能。
抖音近期流行的“法天象地”户外照片特效多基于图片生成,但实际测试表明直接生成视频效果更佳。
Anthropic公司Claude Code团队的Thariq Shihipar主张…
Alvaro Cintas 提出的“Agent Development Kit”系统…
一篇博客介绍了在AMD ROCm开源计算平台上微调临床问答AI模型MedQA的实践。
自适应并行推理是一种新范式,它让大语言模型能够自主决定何时分解任务、并行处理多少子任务以及如何协调结果…
OpenAI通过沙盒隔离、人工审批流程、严格网络策略与原生代理遥测四层防护机制,确保Codex代码生成模型的安全运行。