2026-07-22, 10:10
  #1933
Medlem
RandomNPCs avatar
Citat:
Ursprungligen postat av JadesDJxT
Såhär.

https://drive.google.com/file/d/1me-SVdRJbo4sFdGBR-plFoVY-V5SkvuI/view?usp=sharing
Verkar funktionsnedsatt men kanske kul som leksak.
Citera
2026-07-22, 10:12
  #1934
Medlem
Citat:
Ursprungligen postat av RandomNPC
Verkar funktionsnedsatt men kanske kul som leksak.

Själv har jag inte lärt mig tolka den data den ger, men visst.


Får väl försöka göra det nån dag.
Citera
2026-07-22, 20:51
  #1935
Medlem
Det här är Titan som jag pratade om innan.


https://drive.google.com/file/d/1T3rOKReia6bBStLdkp4lXFB6RvNYy77Z/view?usp=sharing
Citera
2026-07-24, 22:20
  #1936
Medlem
DAGGER[X]s avatar
Stora hopp i kapacitet och kostnad för nya Anthropic modellen. När blev den här modellen färdig för dom internt och började jobba med dom med deras nästa modell? Jag vet inte men skulle inte förvåna om dom suttit på den här sedan april eller ännu tidigare.
Citat:
Claude Opus 5

Anthropic·Jul 24, 2026·2 reasoning variantsClaude Opus 5 sets a new high score on ARC-AGI-3. As of July 24, 2026, Claude Opus 5 (High) is the highest-performing model on ARC-AGI-3, scoring 30.2%. It completed five additional Public Demo environments that no model had previously beaten, demonstrating strong logical reasoning. At Max reasoning effort, Opus 5 scores 97.5% on ARC-AGI-1 and 90.4% on ARC-AGI-2 Semi-Private. This is competitive with previous frontier leaders, though at slightly higher cost. Due to the short testing window, ARC-AGI-3 was evaluated only at High reasoning effort
https://arcprize.org/results/anthropic-claude-opus-5
Citat:
Performance and cost-effectiveness

Claude Opus 5 provides greatly improved performance for the same cost as its predecessor, Opus 4.8. The charts in this section show how performance changes according to the model’s effort setting, which customers can use to optimize for intelligence or conserve tokens for faster and cheaper results.
Opus 5 excels on valuable software engineering tasks. For example, on Frontier-Bench v0.1, Opus 5 surpasses all other models, and more than doubles Opus 4.8’s performance at a lower cost per task. On CursorBench 3.2, at max effort, the model performs within 0.5% of Fable 5’s peak score, but at half the cost per task; it also achieves greater performance at a given cost than all other models on high, xhigh, and max effort.
https://www.anthropic.com/news/claude-opus-5
Citera
2026-07-25, 08:38
  #1937
Medlem
Cyborg2030s avatar
Citat:
Ursprungligen postat av DAGGER[X]
Stora hopp i kapacitet och kostnad för nya Anthropic modellen. När blev den här modellen färdig för dom internt och började jobba med dom med deras nästa modell? Jag vet inte men skulle inte förvåna om dom suttit på den här sedan april eller ännu tidigare.

https://arcprize.org/results/anthropic-claude-opus-5

https://www.anthropic.com/news/claude-opus-5
"Alignment"-testerna blir väl ganska kluriga nu när man vet att modellerna ljuger och fuskar ☠️👹🤷🏻‍♂️
Citera
2026-07-25, 21:56
  #1938
Medlem
En draft och ett papper på hur Athena ser ut idag.


https://drive.google.com/drive/folders/1QdmgWYSf03kTgfRRie1b92OVNlfF9GzQ?usp=sharing
Citera
2026-07-25, 22:41
  #1939
Medlem
Cyborg2030s avatar
Citat:
Ursprungligen postat av JadesDJxT
En draft och ett papper på hur Athena ser ut idag.
Körbar kod på Github nu, annars är du en nolla.
You have 20 seconds to comply:
https://www.youtube.com/watch?v=0InSlbNakOs
Citera
2026-07-25, 22:44
  #1940
Medlem
Citat:
Ursprungligen postat av Cyborg2030
Körbar kod på Github nu, annars är du en nolla.
You have 20 seconds to comply:
https://www.youtube.com/watch?v=0InSlbNakOs

Jag är gärna en nolla.


En nolla som värdesätter intellektuell egendom.
Citera

Skapa ett konto eller logga in för att kommentera

Du måste vara medlem för att kunna kommentera

Skapa ett konto

Det är enkelt att registrera ett nytt konto

Bli medlem

Logga in

Har du redan ett konto? Logga in här

Logga in