Binance Square
Not 歸藏
29 Publicações

Not 歸藏

0 A seguir
2 Seguidores
2 Gostaram
Publicações
·
--
Ver tradução
GPT-6 Astra + Blender + Godot Engine GPT-6 仅用 20X 3% 的额度,帮我做出了一个完整的 3D Roguelike 游戏关卡 昼夜循环、天气系统、3D 建模、贴图、武器切换、技能系统,以及近战和远程的小怪
GPT-6 Astra + Blender + Godot Engine

GPT-6 仅用 20X 3% 的额度,帮我做出了一个完整的 3D Roguelike 游戏关卡

昼夜循环、天气系统、3D 建模、贴图、武器切换、技能系统,以及近战和远程的小怪
Ver tradução
跟杨攀、橘子、乔木一起做了一个播客,叫 NEXT Token,拿下了昨天的小宇宙新星榜! 主要是借着当周的一些新闻,聊聊我们对这些事情的看法和认知。 一期大概一个多小时,非常像 AI 圈的谐星聊天会,后续也会有视频播客。 这一期尤其推荐厂商听,我们提了非常多关于模型厂商和大厂我觉得应该做的事情
跟杨攀、橘子、乔木一起做了一个播客,叫 NEXT Token,拿下了昨天的小宇宙新星榜!

主要是借着当周的一些新闻,聊聊我们对这些事情的看法和认知。

一期大概一个多小时,非常像 AI 圈的谐星聊天会,后续也会有视频播客。

这一期尤其推荐厂商听,我们提了非常多关于模型厂商和大厂我觉得应该做的事情
Ver tradução
跟杨攀、橘子、乔木一起做了一个播客,叫 NEXT Token应该会周更。 主要是借着当周的一些新闻,聊聊我们对这些事情的看法和认知。 内容会很长,一期大概一个多小时,非常像 AI 圈的卸心聊天会,后续也会有视频播客。 这一期尤其推荐厂商听,我们提了非常多关于模型厂商和大厂我觉得应该做的事情
跟杨攀、橘子、乔木一起做了一个播客,叫 NEXT Token应该会周更。

主要是借着当周的一些新闻,聊聊我们对这些事情的看法和认知。

内容会很长,一期大概一个多小时,非常像 AI 圈的卸心聊天会,后续也会有视频播客。

这一期尤其推荐厂商听,我们提了非常多关于模型厂商和大厂我觉得应该做的事情
Caramba! O GPT-6 Astra com esse recurso de modelagem 3D e Computer Use é absurdo! No modo lento, levou só 10 minutos para me ajudar a renderizar no Blender um modelo de donut super detalhado Puta merda, eu ainda me lembro de que toda vez que eu aprendia Blender eu começava por isso, e nunca terminei de aprender; até os vídeos de ensino levam uma ou duas horas para explicar isso
Caramba! O GPT-6 Astra com esse recurso de modelagem 3D e Computer Use é absurdo!

No modo lento, levou só 10 minutos para me ajudar a renderizar no Blender um modelo de donut super detalhado

Puta merda, eu ainda me lembro de que toda vez que eu aprendia Blender eu começava por isso, e nunca terminei de aprender; até os vídeos de ensino levam uma ou duas horas para explicar isso
Comprei aquele teclado e microfone da Ulanzi, e a qualidade é boa A única coisa que tenho a reclamar é que esse aparelho nem sequer consegue se conectar ao computador diretamente por Bluetooth; ainda precisa ligar um receptor
Comprei aquele teclado e microfone da Ulanzi, e a qualidade é boa

A única coisa que tenho a reclamar é que esse aparelho nem sequer consegue se conectar ao computador diretamente por Bluetooth; ainda precisa ligar um receptor
Ver tradução
买了个 PS5 Pro 备战 GTA 6。 我操,这东西现在怎么这么贵呀!很难想象, PS5 能卖他妈一万块钱
买了个 PS5 Pro 备战 GTA 6。

我操,这东西现在怎么这么贵呀!很难想象, PS5 能卖他妈一万块钱
Ver tradução
买了个 PS5 Pro 备战 GTA 6。 我操,这东西现在怎么这么贵呀!很难想象, S5 能卖他妈一万块钱
买了个 PS5 Pro 备战 GTA 6。

我操,这东西现在怎么这么贵呀!很难想象, S5 能卖他妈一万块钱
Ver tradução
GPT-6 Astra 的第一个任务,很快就发现了昨晚 GPT5.6 Sol 修复时搞的两个 Bug 确实可以,要以前这种 bug 我得让 Fable 5 找
GPT-6 Astra 的第一个任务,很快就发现了昨晚 GPT5.6 Sol 修复时搞的两个 Bug

确实可以,要以前这种 bug 我得让 Fable 5 找
Ver tradução
Grok bot 里边自带的虚拟机玩法真的很多。 让它在虚拟机里装了个 Pi,后面就可以并发了。 让它写些代码,就可以调用虚拟机里的 Pi Agent 和其他模型,它就能统筹并并行处理其他事情。
Grok bot 里边自带的虚拟机玩法真的很多。

让它在虚拟机里装了个 Pi,后面就可以并发了。

让它写些代码,就可以调用虚拟机里的 Pi Agent 和其他模型,它就能统筹并并行处理其他事情。
Ver tradução
我去 Suno V6 音乐生成模型要发布了
我去 Suno V6 音乐生成模型要发布了
Ver tradução
GPT 6 Astra 发布,但是还不能用。这可能是个好事,因为每推迟一天,他们就会送一次重置。 由于这次架构的变化,以及他们想直接给所有的付费用户(Plus 也会有权限),并且所有人都可以将额度 100% 用于 GPT-6 Astra。 所以有很多新的系统需要部署,没办法同一时间上线。他们送的重置次数是可以存起来的,而不是立刻重置。 回到 GPT-6 Astra,从目前公布的一些演示来看,这个模型在任务持续时长上非常恐怖: 比如有人让它给小米 17 Ultra 做一个 ROM(也就是系统),它持续运行了 8 天,调用了超过 1600 个 sub-agent。 另一个特点是,它在 3D 建模和渲染上的能力非常强。 它几乎可以所见即所得地把你给它的图片在 Blender 里从零开始建模,构建整个环境并渲染出来。所以在虚幻 5 或者 Unity 里做 3D 游戏也非常厉害。 我觉得这对于 3D 生成模型和视频模型来说,是一次非常重大的打击。 在成本方面: 价格上,它的定价是 5.6 的 2.5 倍,缓存读取享有 90% 的折扣。 同样的任务它消耗的 token 数量只有 Claude Opus 5 的 1/5,不到 Claude Fable 5 一半的成本就可以得到跟它一样的得分。
GPT 6 Astra 发布,但是还不能用。这可能是个好事,因为每推迟一天,他们就会送一次重置。

由于这次架构的变化,以及他们想直接给所有的付费用户(Plus 也会有权限),并且所有人都可以将额度 100% 用于 GPT-6 Astra。

所以有很多新的系统需要部署,没办法同一时间上线。他们送的重置次数是可以存起来的,而不是立刻重置。

回到 GPT-6 Astra,从目前公布的一些演示来看,这个模型在任务持续时长上非常恐怖:

比如有人让它给小米 17 Ultra 做一个 ROM(也就是系统),它持续运行了 8 天,调用了超过 1600 个 sub-agent。

另一个特点是,它在 3D 建模和渲染上的能力非常强。

它几乎可以所见即所得地把你给它的图片在 Blender 里从零开始建模,构建整个环境并渲染出来。所以在虚幻 5 或者 Unity 里做 3D 游戏也非常厉害。
我觉得这对于 3D 生成模型和视频模型来说,是一次非常重大的打击。

在成本方面:
价格上,它的定价是 5.6 的 2.5 倍,缓存读取享有 90% 的折扣。
同样的任务它消耗的 token 数量只有 Claude Opus 5 的 1/5,不到 Claude Fable 5 一半的成本就可以得到跟它一样的得分。
Meu Deus… qual provedor upstream explodiu aqui? A OpenAI, a Cloudflare, a Cursor e a SpaceX foram todas derrubadas
Meu Deus… qual provedor upstream explodiu aqui?

A OpenAI, a Cloudflare, a Cursor e a SpaceX foram todas derrubadas
Ontem à noite, Claude lançou Fable 5.1 e Mythos 5.1, e ambos têm o mesmo peso. Os preços de entrada e saída são os mesmos do Fable 5, e o preço de cache caiu 75%. A explicação oficial é que, cobrando por token, uma carga típica ficará cerca de 25% mais barata, e uma carga pesada de Agent ficará cerca de 45% mais barata. Mas, nas redes, todo mundo está dizendo que a cota de assinatura do Fable 5.1 acaba muito rápido — talvez em 20 minutos ou meia hora, a cota inteira já se esgote. Além disso, esse modelo ainda tem alguns problemas mais sérios: Não suporta choice forçado de ferramenta; modelos anteriores não conseguem ler seu bloco de pensamento, o que impede trocar de modelo no meio do processo, e editar mensagens históricas fará com que o thinking deixe de funcionar. A saída vem com uma marca d'água de texto invisível (já falamos disso antes; é extremamente irritante e faz a qualidade do texto gerado piorar). O feedback do pré-lançamento que a Artificial Analysis fez para a Anthropic mostra que: mesmo com o cache 75% mais barato, o custo real para executar uma tarefa no Fable 5.1 Max ainda é 20% mais caro do que no Fable 5 Max, porque os tokens de saída dele são cerca de 1,7 vez os do Fable 5. Parece ainda bem fraco; na verdade ficou mais caro, e isso sem contar os problemas da marca d'água invisível e da impossibilidade de trocar de modelo. Isso significa que, assim que ele aciona a barreira de segurança, se você trocar para o Opus 5, o cache simplesmente deixa de valer, e então o custo da chamada aumenta drasticamente?
Ontem à noite, Claude lançou Fable 5.1 e Mythos 5.1, e ambos têm o mesmo peso.

Os preços de entrada e saída são os mesmos do Fable 5, e o preço de cache caiu 75%.

A explicação oficial é que, cobrando por token, uma carga típica ficará cerca de 25% mais barata, e uma carga pesada de Agent ficará cerca de 45% mais barata.

Mas, nas redes, todo mundo está dizendo que a cota de assinatura do Fable 5.1 acaba muito rápido — talvez em 20 minutos ou meia hora, a cota inteira já se esgote.

Além disso, esse modelo ainda tem alguns problemas mais sérios:

Não suporta choice forçado de ferramenta; modelos anteriores não conseguem ler seu bloco de pensamento, o que impede trocar de modelo no meio do processo, e editar mensagens históricas fará com que o thinking deixe de funcionar.

A saída vem com uma marca d'água de texto invisível (já falamos disso antes; é extremamente irritante e faz a qualidade do texto gerado piorar).

O feedback do pré-lançamento que a Artificial Analysis fez para a Anthropic mostra que: mesmo com o cache 75% mais barato, o custo real para executar uma tarefa no Fable 5.1 Max ainda é 20% mais caro do que no Fable 5 Max, porque os tokens de saída dele são cerca de 1,7 vez os do Fable 5.

Parece ainda bem fraco; na verdade ficou mais caro, e isso sem contar os problemas da marca d'água invisível e da impossibilidade de trocar de modelo.

Isso significa que, assim que ele aciona a barreira de segurança, se você trocar para o Opus 5, o cache simplesmente deixa de valer, e então o custo da chamada aumenta drasticamente?
Faça uma Skill para ajudar a compartilhar as antigas construções que fotografei e cenas com estilo guofeng para todos. Vamos iterar e enviar nas próximas postagens destes dias.
Faça uma Skill para ajudar a compartilhar as antigas construções que fotografei e cenas com estilo guofeng para todos.

Vamos iterar e enviar nas próximas postagens destes dias.
Ver tradução
感觉 AI 领域的竞争已经到了下一个阶段: 现在大家除了拼模型能力以外,也在拼成本以及整个供应链的整合。 OpenAI 发布了他们自研的第一代芯片,而且直接击败了英伟达、AMD 和谷歌所有可比可测芯片的推理 ASIC。 这款芯片专为大语言模型推理从零设计,从 2024 年中开始设计到流片只用了 16 个月。 它是通用的推理芯片,并非只能跑 OpenAI 自己的模型。在文章展示中,他们测试了 DeepSeek R1 以及 Kimi 2.5 的推理效率,可以跑各种模型和工作负载,甚至能跑 Doom 游戏。 目前该芯片只有工程样品,量产爬坡会在 2027 年开始,大部分产能预计在明年年底铺开。 这款芯片专门针对每瓦性能(能效比)进行设计。因为当前数据中心的核心瓶颈是电力,而非预算或占地面积,所以它必须在极低功耗下实现尽可能高的推理效率。 它的每瓦吞吐量全面碾压英伟达的 Blackwell,甚至超过了采用 HBM4 的 Rubin: DeepSeek R1 超过 700 token/s/用户 GPT OSS 超过 1400 token/s Kimi 2.5 接近 700 token/s/用户 值得一提的是,OpenAI 尚未发布的 Astra AI 模型也深度参与了这款芯片的设计,这或许是它拥有极高能效且开发周期极短的关键原因。 芯片团队通过 Codex 和 GPT Astro,在两个月内把三个原本不在生产计划内的开源模型优化到了最高性能;AI 生成的部分模块比人类专家编写的模块还要快 1.5 到 1.8 倍。 颇具讽刺意味的是,跑在英伟达 GPU 上的 OpenAI 模型,正在帮助设计旨在击破英伟达 CUDA 护城河的芯片。 OpenAI 的下一个目标是达到 100MW 的部署规模,并计划于今年年底开始在自家的基础设施中正式部署该芯片。
感觉 AI 领域的竞争已经到了下一个阶段:

现在大家除了拼模型能力以外,也在拼成本以及整个供应链的整合。

OpenAI 发布了他们自研的第一代芯片,而且直接击败了英伟达、AMD 和谷歌所有可比可测芯片的推理 ASIC。

这款芯片专为大语言模型推理从零设计,从 2024 年中开始设计到流片只用了 16 个月。

它是通用的推理芯片,并非只能跑 OpenAI 自己的模型。在文章展示中,他们测试了 DeepSeek R1 以及 Kimi 2.5 的推理效率,可以跑各种模型和工作负载,甚至能跑 Doom 游戏。

目前该芯片只有工程样品,量产爬坡会在 2027 年开始,大部分产能预计在明年年底铺开。

这款芯片专门针对每瓦性能(能效比)进行设计。因为当前数据中心的核心瓶颈是电力,而非预算或占地面积,所以它必须在极低功耗下实现尽可能高的推理效率。

它的每瓦吞吐量全面碾压英伟达的 Blackwell,甚至超过了采用 HBM4 的 Rubin:

DeepSeek R1 超过 700 token/s/用户
GPT OSS 超过 1400 token/s
Kimi 2.5 接近 700 token/s/用户

值得一提的是,OpenAI 尚未发布的 Astra AI 模型也深度参与了这款芯片的设计,这或许是它拥有极高能效且开发周期极短的关键原因。

芯片团队通过 Codex 和 GPT Astro,在两个月内把三个原本不在生产计划内的开源模型优化到了最高性能;AI 生成的部分模块比人类专家编写的模块还要快 1.5 到 1.8 倍。

颇具讽刺意味的是,跑在英伟达 GPU 上的 OpenAI 模型,正在帮助设计旨在击破英伟达 CUDA 护城河的芯片。

OpenAI 的下一个目标是达到 100MW 的部署规模,并计划于今年年底开始在自家的基础设施中正式部署该芯片。
Ver tradução
T3 Code 的这个 Agent 和模型选择结合在一起的选择器挺不错的,给 Code Pilot 参考了一下,用上了
T3 Code 的这个 Agent 和模型选择结合在一起的选择器挺不错的,给 Code Pilot 参考了一下,用上了
O Codex agora permite que você ofereça uma cota para seus amigos, de forma semelhante a um cartão-presente. Você pode escolher cotas de diferentes valores. A outra pessoa recebe um link ou pode resgatá-la por e-mail. Acho que, no futuro, dar brindes pode ser feito dessa forma
O Codex agora permite que você ofereça uma cota para seus amigos, de forma semelhante a um cartão-presente.

Você pode escolher cotas de diferentes valores. A outra pessoa recebe um link ou pode resgatá-la por e-mail. Acho que, no futuro, dar brindes pode ser feito dessa forma
A Byte lançou o “Trabalho do Doubao”, bem imponente: já começa oferecendo um mês de assinatura padrão gratuitamente. Se você já comprou a assinatura, também vai receber uma prorrogação gratuita de mais um mês — pode-se dizer que é uma chuva de benefícios para todo mundo. O Doubao realmente já deveria ter lançado há muito tempo um aplicativo separado voltado para cenários de trabalho (ou, mais amplamente, para trabalho em geral, incluindo alguns tipos de coding). Isso porque a percepção das pessoas sobre o app do Doubao já ficou cristalizada: acham que ele serve para resolver problemas do dia a dia e concluir tarefas simples e rápidas. Acho que a grande vantagem desta vez é que, no ambiente de escritório, a Byte tem o “truque de mestre” chamado Feishu. O Feishu é, há tempos, uma das melhores ferramentas de produtividade do mercado chinês em infraestrutura de IA e adaptação de capacidades de IA — eu mesmo uso todos os dias para lidar com coisas do trabalho como atas de reuniões. Ao entrar no cenário de escritório com o Doubao Trabalho, especialmente quando combinado com o Feishu, surgem muitas experiências únicas: Primeiro, obter contexto completo: todo o contexto dentro do Feishu pode ser capturado pelo Doubao. Ele pode te ajudar a gerenciar informações de chats em grupo, atas de reuniões e documentos; lembrar o que você deve fazer hoje, o que pode ter ficado de fora; e até ajudar a operar o calendário, criar grupos e adicionar pessoas — tudo isso, que costuma consumir muito tempo com tarefas maçantes, fica por conta dele. Depois, a base de conhecimento dedicada: muitas atas e documentos de reuniões das pessoas ficam armazenadas no Feishu. Naturalmente, isso vira uma base de conhecimento pessoal ou da equipe. O Doubao pode então criar diretamente com base nesses contextos completos. Eu já disse antes: quanto mais contexto houver, melhor o efeito; às vezes, um modelo comum combinado com um contexto completo tem desempenho muito superior a um modelo avançado sem contexto.  Impulsionar a transformação da organização rumo ao AI Native: após integrar dados internos da empresa, o Doubao pode ser usado para montar painéis (dashboards), fazer processamento de dados e, diretamente, puxar informações de fontes como planilhas multidimensionais — acelerando bastante o ritmo da transformação da empresa para um modelo AI Native. O Doubao Trabalho basicamente tem praticamente todas as capacidades comuns dos Agentes atuais. Capacidades gerais de Agent: possui habilidades para gerar documentos, planilhas e PPT, além de também oferecer capacidades de criação e geração de páginas web e aplicações. Também suporta navegador (browser) e Computer Use. Um ecossistema rico de MCP (conectores): dá para se conectar a vários lugares para obter contexto — por exemplo Feishu, Notion — e também conectores das diversas indústrias na China (abrangendo jurídico, mídia, deslocamento/transporte, programação, acadêmico e até cenários de estudantes). Há várias “skills” de diversos setores e MCPs embutidos; não é preciso ficar procurando por toda parte — é só escolher as opções mais adequadas. Otimização para o cenário Windows e colaboração com computadores em nuvem: o foco do Computer Use é otimizar o sistema Windows mais popular entre escritórios na China. Além disso, a função de computador em nuvem é bem fluida: o controle remoto a partir da nuvem para o dispositivo local, bem como a coordenação entre celular, computador em nuvem e o app do Doubao, ocorre de forma muito suave, permitindo sincronizar e controlar com rapidez. Geração de páginas web e modificações locais: as páginas geradas à direita permitem selecionar rapidamente e de modo prático posições específicas para ajustes finos, anotações e modificações locais, oferecendo uma ótima experiência ao usuário.
A Byte lançou o “Trabalho do Doubao”, bem imponente: já começa oferecendo um mês de assinatura padrão gratuitamente.

Se você já comprou a assinatura, também vai receber uma prorrogação gratuita de mais um mês — pode-se dizer que é uma chuva de benefícios para todo mundo.

O Doubao realmente já deveria ter lançado há muito tempo um aplicativo separado voltado para cenários de trabalho (ou, mais amplamente, para trabalho em geral, incluindo alguns tipos de coding).

Isso porque a percepção das pessoas sobre o app do Doubao já ficou cristalizada: acham que ele serve para resolver problemas do dia a dia e concluir tarefas simples e rápidas.

Acho que a grande vantagem desta vez é que, no ambiente de escritório, a Byte tem o “truque de mestre” chamado Feishu. O Feishu é, há tempos, uma das melhores ferramentas de produtividade do mercado chinês em infraestrutura de IA e adaptação de capacidades de IA — eu mesmo uso todos os dias para lidar com coisas do trabalho como atas de reuniões.

Ao entrar no cenário de escritório com o Doubao Trabalho, especialmente quando combinado com o Feishu, surgem muitas experiências únicas:

Primeiro, obter contexto completo: todo o contexto dentro do Feishu pode ser capturado pelo Doubao. Ele pode te ajudar a gerenciar informações de chats em grupo, atas de reuniões e documentos; lembrar o que você deve fazer hoje, o que pode ter ficado de fora; e até ajudar a operar o calendário, criar grupos e adicionar pessoas — tudo isso, que costuma consumir muito tempo com tarefas maçantes, fica por conta dele.

Depois, a base de conhecimento dedicada: muitas atas e documentos de reuniões das pessoas ficam armazenadas no Feishu. Naturalmente, isso vira uma base de conhecimento pessoal ou da equipe. O Doubao pode então criar diretamente com base nesses contextos completos.

Eu já disse antes: quanto mais contexto houver, melhor o efeito; às vezes, um modelo comum combinado com um contexto completo tem desempenho muito superior a um modelo avançado sem contexto.

Impulsionar a transformação da organização rumo ao AI Native: após integrar dados internos da empresa, o Doubao pode ser usado para montar painéis (dashboards), fazer processamento de dados e, diretamente, puxar informações de fontes como planilhas multidimensionais — acelerando bastante o ritmo da transformação da empresa para um modelo AI Native.

O Doubao Trabalho basicamente tem praticamente todas as capacidades comuns dos Agentes atuais.

Capacidades gerais de Agent: possui habilidades para gerar documentos, planilhas e PPT, além de também oferecer capacidades de criação e geração de páginas web e aplicações. Também suporta navegador (browser) e Computer Use.

Um ecossistema rico de MCP (conectores): dá para se conectar a vários lugares para obter contexto — por exemplo Feishu, Notion — e também conectores das diversas indústrias na China (abrangendo jurídico, mídia, deslocamento/transporte, programação, acadêmico e até cenários de estudantes). Há várias “skills” de diversos setores e MCPs embutidos; não é preciso ficar procurando por toda parte — é só escolher as opções mais adequadas.

Otimização para o cenário Windows e colaboração com computadores em nuvem: o foco do Computer Use é otimizar o sistema Windows mais popular entre escritórios na China.

Além disso, a função de computador em nuvem é bem fluida: o controle remoto a partir da nuvem para o dispositivo local, bem como a coordenação entre celular, computador em nuvem e o app do Doubao, ocorre de forma muito suave, permitindo sincronizar e controlar com rapidez.

Geração de páginas web e modificações locais: as páginas geradas à direita permitem selecionar rapidamente e de modo prático posições específicas para ajustes finos, anotações e modificações locais, oferecendo uma ótima experiência ao usuário.
Ver tradução
Anthropic 现在封号真稳啊,新号一天就没,尤其 200 美元的号
Anthropic 现在封号真稳啊,新号一天就没,尤其 200 美元的号
A Xiaomi enviou um host local de IA, equipado com os três chips recém-lançados, O3, O100 e D100, com suporte para modelos duplos de 120B e 3B e para alternar entre sistemas rápido e lento.
A Xiaomi enviou um host local de IA, equipado com os três chips recém-lançados, O3, O100 e D100, com suporte para modelos duplos de 120B e 3B e para alternar entre sistemas rápido e lento.
Inicia sessão para explorar mais conteúdos
Junta-te a utilizadores de criptomoedas de todo o mundo na Binance Square
⚡️ Obtém informações úteis e recentes sobre criptomoedas.
💬 Com a confiança da maior exchange de criptomoedas do mundo.
👍 Descobre perspetivas reais de criadores verificados.
E-mail/Número de telefone
Mapa do sítio
Preferências de cookies
Termos e Condições da Plataforma