开发者沸腾了!
刚刚,DeepSeek Harness开源。
一夜星标超过40k,fork超过3k。openclaw都没这么火热。
DeepSeek Harness采用一切皆插件的架构,由Cordis驱动,设计理念源于论文A Programming Paradigm for Spatiotemporal Composability。
目前处于开发者预览(v0.1 版本)阶段,面向全球Harness开发者开放测试,以 MIT 协议开放源代码,正在快速迭代。未来会出现破坏兼容性的变更。
一切皆插件开放架构,模型、工具、技能、会话、沙箱、存储、循环、调度、UI等所有Agent能力均由插件组合而成,可自由替换、灵活重组。
开发者无需改动DeepSeek Harness的源码本身,就能以插件的方式独立选择、替换或扩展其中的任一能力。
针对不同的使用场景,提供四种模式,每种模式会默认加载不同的插件集合。
标准模式提供完整的工具组合。PTC模式程序化工具调用(Programmatic Tool Calling),由模型生成的一段代码来组合多轮工具调用。极简模式仅保留一个shell工具与一个文件编辑工具,用于最小环境下的模型基准测试。创造模式可以检查当前运行时、在内存中试验Cordis插件,并据此组合和创作新的模式。
模型看到的一切,都会写入仅追加(append-only)设计的会话日志,包括系统提示词、思维链、工具调用与结果、子Agent调度,以及每一次上下文注入。
在Trajectory视图中,你可以按来源查看这些信息。恢复、分叉、检索与回放也都共享同一份事件流。
从此,每个人手中的AI助手都可以变得不同,权力交到每个人手中,而不是Claude、Codex们掌控。
这或许也是自进化AI的起点,Agent自己更新自己。一个能在运行中改自己代码的现代软件,就可以实现自进化。
新一代适用于生产的多功能音乐模型MiniMax Music 3开源。
先来感受一下它的效果。官方Demo地址:
https://minimax-ai.github.io/music3-demo/
MiniMax Music 3天然支持生成长达五分钟的完整歌曲。该模型能够保持音乐的主题、节奏、主唱的特点以及曲调的连贯性,从而可以构建出完整的音乐结构,包括引言部分、主段、前副歌、副歌部分、过渡段、乐器演奏部分以及结尾部分等。
模型基于歌词和详细的音乐描述进行创作,能够生成结构紧凑、富有表现力的歌曲,同时具备稳定的长音频质量。
模型结合了一个 8 亿参数的全局语言模型,用于构建长期的音乐结构,以及一个 0.6 亿参数的局部语言模型,用于处理帧级的声音细节。
还采用了基于流匹配和流变显式贝叶斯算法的连续隐藏状态合成系统。最终,该模型能够生成32 kHz采样率、16位立体声的WAV音频文件。
谷歌迄今为止,在编程和智能Agent领域最先进的模型,Gemini 3.7 Flash发布。
3.7 Flash在软件工程、知识工作以及网页开发流程方面有显著的改进。
在调试和问题解决等编程任务上,FrontierCode 1.1 Main中,准确率43.6%,而在DeepSWE v1.1中则达到了65.3%。均大幅超越前代3.6 Flash。
在网页开发,UI生成方面,Arena.ai的WebDev Arena测试中,Elo评分为1588。排在全球第8。
金融、法律和生物科学等知识密集型领域,在GDP.pdf基准测试中,表现明显优于3.6 Flash,得分提高到34.0%。
在AutomationBench测试中,得分达到了30.4%,而3.6 Flash仅为17.0%。
3.7 Flash在性能和精度方面表现优异,其效果明显优于3.6 Flash,但成本更低。
下面是完整的定价和性能比较。
GPT 5.6 Terra降价,Meta的Muse Spark 1.2打骨折,Gemini 3.7 Flash持续低价,大模型价格战的火越烧越猛了。
参考资料:
https://x.com/deepseek_ai/status/2087887408440164663
https://github.com/deepseek-ai/deepseek-harness
https://x.com/MiniMax_AI/status/2087934657354678421
https://github.com/MiniMax-AI/MiniMax-Music3
https://huggingface.co/MiniMaxAI/MiniMax-Music3
https://x.com/GoogleAIStudio/status/2087953811931320341
免责声明:本文来自AIGC开放社区客户端,不代表超天才网的观点和立场。文章及图片来源网络,版权归作者所有,如有投诉请联系删除。